机器学习和数据挖掘02-Gaussian Naive Bayes

高斯朴素贝叶斯中的“朴素”假设是，给定类别标签，特征之间是相互独立的。这意味着在给定类别的情况下，特征的似然性被建模为一个由均值和标准差确定的正态分布。贝叶斯定理是概率中的基本定理，描述了如何根据更多证据或信息更新假设的概率。在分类的上下文中，它用于计算给定特征集的类别的后验概率。对于具有特征值的新数据点，算法使用贝叶斯定理计算每个类别的后验概率。具有最高后验概率的类别被预测为数据点的最终类别标签

丰。。

1029人浏览 · 2023-08-31 19:42:02

丰。。 · 2023-08-31 19:42:02 发布

概念

贝叶斯定理：
贝叶斯定理是概率中的基本定理，描述了如何根据更多证据或信息更新假设的概率。在分类的上下文中，它用于计算给定特征集的类别的后验概率。

特征独立性假设：
高斯朴素贝叶斯中的“朴素”假设是，给定类别标签，特征之间是相互独立的。这个简化假设在现实场景中通常并不完全准确，但它简化了计算过程，在实践中仍然可以表现良好。

高斯分布：
高斯朴素贝叶斯假设每个类别中的连续特征遵循高斯（正态）分布。这意味着在给定类别的情况下，特征的似然性被建模为一个由均值和标准差确定的正态分布。

参数估计：
要使用高斯朴素贝叶斯算法，需要为每个类别估计参数。对于每个类别中的每个特征，你需要基于训练数据估计均值和标准差。

分类：
对于具有特征值的新数据点，算法使用贝叶斯定理计算每个类别的后验概率。具有最高后验概率的类别被预测为数据点的最终类别标签。

公式

在这里插入图片描述

代码实现

from sklearn.datasets import load_iris
from sklearn.naive_bayes import GaussianNB
from sklearn.model_selection import cross_val_score, StratifiedKFold
import numpy as np

# Load example dataset (you can replace this with your own data)
data = load_iris()
X = data.data
y = data.target

# Create a Gaussian Naive Bayes model
gnb_model = GaussianNB()

# Create a StratifiedKFold cross-validation object
cvKFold = StratifiedKFold(n_splits=10, shuffle=True, random_state=0)

# Perform cross-validation using cross_val_score
scores = cross_val_score(gnb_model, X, y, cv=cvKFold)

# Print the cross-validation scores
print("Cross-validation scores:", scores)
print("Mean CV score:", np.mean(scores))

腾讯云开发者社区

腾讯云面向开发者汇聚海量精品云计算使用和开发经验，营造开放的云计算技术生态圈。

更多推荐

Js分割字符串(单个分割符、多个分割符、正则)

1.单个分割符1.1定义和用法split() 方法用于把一个字符串分割成字符串数组。1.2语法stringObject.split(separator,howmany)参数描述separator必需。字符串或正则表达式，从该参数指定的地方分割 stringObject。howmany可选。该参数可指定返回的数组的最大长度。如果设置了该参数，返回的子串不会多于这个参数指定的数组。如果没有设置该参数，

腾讯云开发者社区

curl

什么是curl命令？curl是利用URL语法在命令行方式下工作的开源文件传输工具。它被广泛应用在Unix、多种Linux发行版中，并且有DOS和Win32、Win64下的移植版本。如何在windows下使用curl命令？第一步：进入curl下载官网，下载合适的版本，我这里下载的是windows 64位的curl。其中我下载的zip文件。另外CAB文件也是压缩文件，这...

腾讯云开发者社区

Zynq7000 USB2.0协议解析及USB控制器详解

USB 2.0规范及控制器文章目录USB 2.0规范及控制器USB2.0Univerasl Serial BusUSBHostUSB总线接口标准总线信号USB拓扑结构数据流模型数据编解码和位填充USB逻辑部件USB时间基准USB 描述符USB设备USB设备供电方式USB设备分层USB设备插入检测机制USB设备状态USB总线枚举USB传输传输类型包(Packet)事务(transaction)传输(