位置: IT常识 - 正文

机器学习:基于朴素贝叶斯对花瓣花萼的宽度和长度分类预测

编辑:rootadmin
机器学习:基于朴素贝叶斯对花瓣花萼的宽度和长度分类预测 机器学习:基于朴素贝叶斯对花瓣花萼的宽度和长度分类预测

推荐整理分享机器学习:基于朴素贝叶斯对花瓣花萼的宽度和长度分类预测,希望有所帮助,仅作参考,欢迎阅读内容。

文章相关热门搜索词:,内容如对您有帮助,希望把文章链接给更多的朋友!

作者:AOAIYI

作者简介:Python领域新星作者、多项比赛获奖者:AOAIYI首页

😊😊😊如果觉得文章不错或能帮助到你学习,可以点赞👍收藏📁评论📒+关注哦!👍👍👍

📜📜📜如果有小伙伴需要数据集和学习交流,文章下方有交流学习区!一起学习进步!💪

专栏案例:机器学习机器学习:基于逻辑回归对某银行客户违约预测分析机器学习:学习k-近邻(KNN)模型建立、使用和评价机器学习:基于支持向量机(SVM)进行人脸识别预测决策树算法分析天气、周末和促销活动对销量的影响机器学习:线性回归分析女性身高与体重之间的关系机器学习:基于主成分分析(PCA)对数据降维文章目录机器学习:基于朴素贝叶斯对花瓣花萼的宽度和长度分类预测一、实验目的二、实验原理1.分类问题描述2.Bayes’ theorem(贝叶斯法则)3.朴素贝叶斯分类算法三、实验环境四、实验内容五、实验步骤1.朴素贝叶斯2.业务理解3.读取数据4.数据理解5.数据准备6.构建数据训练集和测试集7.构建三类模型总结一、实验目的

1.理解朴素贝叶斯的原理

2.掌握scikit-learn贝叶斯的用法

3.认识可视化工具seaborn

二、实验原理1.分类问题描述

贝叶斯分类是一类分类算法的总称,这类算法均以贝叶斯定理为基础,故统称为贝叶斯分类。而朴素贝叶斯分类是贝叶斯分类中最简单,也是常见的一种分类方法,对于分类问题,其实谁都不会陌生,日常生活中我们每天都进行着分类过程。例如,当你看到一个人,你的脑子下意识判断他是学生还是社会上的人;你可能经常会走在路上对身旁的朋友说“这个人一看就很有钱”之类的话,其实这就是一种分类操作,贝叶斯分类算法,那么分类的数学描述又是什么呢? 其中C叫做类别集合,其中每一个元素是一个类别,而I叫做项集合(特征集合),其中每一个元素是一个待分类项,f叫做分类器。分类算法的内容是要求给定特征,构造分类器f,让我们得出类别。

2.Bayes’ theorem(贝叶斯法则)

在概率论和统计学中,Bayes theorem(贝叶斯法则)根据事件的先验知识描述事件的概率。贝叶斯法则表达式如下所示:

P(A|B) – 在事件B下事件A发生的条件概率

P(B|A) – 在事件A下事件B发生的条件概率

P(A), P(B) – 独立事件A和独立事件B的边缘概率

朴素贝叶斯方法是一组监督学习算法,它基于贝叶斯定理应用每对特征之间的“天真”独立假设。给定类变量y和从属特征矢量X1通过Xn,贝叶斯定理状态下列关系式:

使用天真的独立假设

对所有人来说i,这种关系简化为

由于

输入是常数,我们可以使用以下分类规则:

我们可以使用最大后验(MAP)估计来估计的

前者是y 训练集中类的相对频率。不同的朴素贝叶斯分类器主要区别于他们对分布的假设

3.朴素贝叶斯分类算法

在scikit-learn中,提供了3种朴素贝叶斯分类算法:GaussianNB(高斯朴素贝叶斯)、MultinomialNB(多项式朴素贝叶斯)、BernoulliNB(伯努利朴素贝叶斯)

可以参考文档:

http://scikit-learn.org/stable/modules/naive_bayes.html

http://scikit-learn.org/stable/modules/generated/sklearn.naive_bayes.GaussianNB.html

三、实验环境

利用scikit-learn提供的三种朴素贝叶斯算法,构建分类器,根据花瓣花萼的宽度和长度判断他们属于哪一类

四、实验内容

Python 3.9

Jupyter notebook

五、实验步骤1.朴素贝叶斯

贝叶斯分类是一类分类算法的总称,这类算法均以贝叶斯定理为基础,故统称为贝叶斯分类。而朴素贝叶斯分类是贝叶斯分类中最简单,也是常见的一种分类方法

2.业务理解

先有一张表格,描述了花瓣的特征和种类,利用scikit-learn提供的三种朴素贝叶斯算法,构建分类器,根据花瓣花萼的宽度和长度预测他们属于哪一个品种

3.读取数据

1.编写代码,读取数据

#导入pandas库和numpy库 import pandas as pd import numpy as np iris = pd.read_csv(r'D:\CSDN\数据分析\naivebayes\iris.csv') iris.head()

4.数据理解

1.查看数据结构

iris.shape机器学习:基于朴素贝叶斯对花瓣花萼的宽度和长度分类预测

说明:该数据总共有150行,5列

2.查看数据列名称

iris.columns

5.数据准备

1.删除“种类”这列数据得到特征数据如下:

X_iris = iris.drop(['species'],axis=1)X_iris.head()

2.获取“species”这列数据并将其转换为数组,得到预测数据

y_iris = np.ravel(iris[['species']])y_iris

3.查看y_iris总共有多少行

y_iris.shape

6.构建数据训练集和测试集

1.构建训练和测试数据集

#导入相应的库 from sklearn.model_selection import train_test_split #将数据分为训练集,测试集 X_train,X_test,y_train,y_test = train_test_split(X_iris,y_iris,random_state=1) #获取数据前5行 X_train.head()

说明:将数据分为训练集和测试集,默认情况下,75%的数据用于训练,25%的数据用于测试

训练集是用于发现和预测潜在关系的一组数据。测试集是用于评估预测关系强度和效率的一组数据。

2.查看训练集和测试集的数据结构

print(X_train.shape)print(X_test.shape) print(y_train.shape) print(y_test.shape)

说明:训练集:X_iris数据为(150,4),X_train为(112,4),X_test为(38,4) sales数据为200行,y_train为(112,),y_test为(38,)

3.查看y_train数据

y_train

7.构建三类模型

在scikit-learn中,提供了3种朴素贝叶斯分类算法:GaussianNB(高斯朴素贝叶斯)、MultinomialNB(多项式朴素贝叶斯)、BernoulliNB(伯努利朴素贝叶斯)

GaussianNB实现高斯朴素贝叶斯算法进行分类。假设特征的可能性是高斯的:

1.利用GaussianNB(高斯朴素贝叶斯)类建立简单模型并预测

from sklearn.naive_bayes import GaussianNB#利用GaussianNB类建立简单模型 gb= GaussianNB() model_GaussinaNB = gb.fit(X_train,y_train) #predict(X):直接输出测试集预测的类标记,X_test为测试集 y_predict_GaussianNB= model_GaussinaNB.predict(X_test) print("y_predict_GaussianNB",y_predict_GaussianNB)

构建一个新的测试数组

import pandas as pdz_data ={'sepal_length':['5'],'sepal_width':['3'],'petal_length':['3'],'petal_width':['1.8']} Z_data =pd.DataFrame(z_data,columns=['sepal_length','sepal_width','petal_length','petal_width']) print(Z_data)

将测试数据带入模型预测得到预测结果

Z_model_predict=model_GaussinaNB.predict(Z_data)print('Z_model_predict',Z_model_predict)

说明:当我们提供的数据为’sepal_length’:[‘5’],‘sepal_width’:[‘3’],‘petal_length’:[‘3’],‘petal_width’:[‘1.8’]时,预测它属于‘versicolor’这个种类,到底预测正确与否呢?接下来看一下预测结果的平均值

查看预测结果的平均值

#预测结果 y_predict_GaussianNB==y_test

mean()函数功能:求取均值

y_test_mean=np.mean(y_predict_GaussianNB==y_test)print('y_test_GaussianNB_mean',y_test_mean)

查看预测正确率

score(X, y[, sample_weight]) 返回给定测试数据和标签的平均精度

gb.score(X_train,y_train)

2.BernoulliNB(伯努利朴素贝叶斯) BernoulliNB实现了根据多元伯努利分布的数据的朴素贝叶斯训练和分类算法; 即,可能存在多个特征,但每个特征被假定为二进制值(伯努利,布尔)变量。因此,该类要求将样本表示为二进制值特征向量;如果传递任何其他类型的数据,BernoulliNB实例可以将其输入二值化(取决于binarize参数)。

伯努利朴素贝叶斯的决策规则是基于

利用BernoulliNB类建立简单模型并预测

# ====================BernoulliNB from sklearn.naive_bayes import BernoulliNB model_BernoulliNB=BernoulliNB().fit(X_train,y_train) y_predict_BernoulliNB=model_BernoulliNB.predict(X_test) print('y_test_BernoulliNB_mean',np.mean(y_predict_BernoulliNB==y_test))

3.MultinomialNB(多项式朴素贝叶斯) MultinomialNB实现用于多项分布数据的朴素贝叶斯算法,并且是用于文本分类的两种经典朴素贝叶斯变体之一(其中数据通常表示为单词向量计数,尽管tf-idf向量也已知在实践中很好地工作) 。

利用MultinomialNB类建立简单模型并预测

# ====================MultinomialNB from sklearn.naive_bayes import MultinomialNB model_MultinomialNB=MultinomialNB().fit(X_train,y_train) y_predict_MultinomialNB=model_MultinomialNB.predict(X_test) print('y_test_MultinomialNBB_mean',np.mean(y_predict_MultinomialNB==y_test))

总结

贝叶斯分类是一类分类算法的总称,这类算法均以贝叶斯定理为基础,故统称为贝叶斯分类。而朴素贝叶斯分类是贝叶斯分类中最简单,也是常见的一种分类方法,对于分类问题,其实谁都不会陌生,日常生活中我们每天都进行着分类过程。例如,当你看到一个人,你的脑子下意识判断他是学生还是社会上的人;你可能经常会走在路上对身旁的朋友说“这个人一看就很有钱”之类的话,其实这就是一种分类操作。

每个人都会遇到困难跟挫折,要有同困难作斗争的决心跟勇气。困难跟挫折是成就事业的基石,岸在远方向我们招手,只要越过它,敢于在惊涛骇浪中博击,我们就会尝到胜利的果食。

本文链接地址:https://www.jiuchutong.com/zhishi/299553.html 转载请保留说明!

上一篇:Http协议之Content-Type理解

下一篇:STM32CubeIDE开发(三十一), stm32人工智能开发应用实践(Cube.AI).篇一(stm32cubeIDE开发串口 修改速率)

  • window10自带的杀毒软件是什么(window10自带的杀毒软件关闭)

    window10自带的杀毒软件是什么(window10自带的杀毒软件关闭)

  • switch黑屏无法开机(switch黑屏无法开机哪里坏了)

    switch黑屏无法开机(switch黑屏无法开机哪里坏了)

  • 输入网络凭据是什么(输入网络凭据是因为共享文件设置了密码吗)

    输入网络凭据是什么(输入网络凭据是因为共享文件设置了密码吗)

  • word标题前的黑点怎么添加(word标题前的黑点会打印出来吗)

    word标题前的黑点怎么添加(word标题前的黑点会打印出来吗)

  • 华为型号SEA-AL10什么意思(华为型号大全对照表)

    华为型号SEA-AL10什么意思(华为型号大全对照表)

  • nova7se有nfc功能吗(nova7se有没nfc)

    nova7se有nfc功能吗(nova7se有没nfc)

  • 苹果6手机屏幕不停闪烁(苹果6手机屏幕失灵是什么原因)

    苹果6手机屏幕不停闪烁(苹果6手机屏幕失灵是什么原因)

  • 操作系统负责管理计算机的什么(操作系统负责管理什么)

    操作系统负责管理计算机的什么(操作系统负责管理什么)

  • 华为p40有没有呼吸灯(华为p40有没有呼叫功能)

    华为p40有没有呼吸灯(华为p40有没有呼叫功能)

  • miui12充电慢(miui12.5.8充电慢)

    miui12充电慢(miui12.5.8充电慢)

  • 手机登录密码是什么(手机号一键登录)

    手机登录密码是什么(手机号一键登录)

  • 抖音总音浪音会清零吗(抖音的音浪是每场结算吗)

    抖音总音浪音会清零吗(抖音的音浪是每场结算吗)

  • 显示屏显示无信号是什么原因(显示屏显示无信号进入省电模式)

    显示屏显示无信号是什么原因(显示屏显示无信号进入省电模式)

  • 微信解封后多久能加人(微信解封后多久才可以让附近的人看到)

    微信解封后多久能加人(微信解封后多久才可以让附近的人看到)

  • 电池损耗18%需要换吗(电池损耗18%需要换电池吗)

    电池损耗18%需要换吗(电池损耗18%需要换电池吗)

  • 文本对齐方式有哪种(文本对齐方式有三种)

    文本对齐方式有哪种(文本对齐方式有三种)

  • 短信呼服务有几种可能(短信呼服务是不是拉黑名单了)

    短信呼服务有几种可能(短信呼服务是不是拉黑名单了)

  • 内存条32g和16g区别(内存条16g和32g可以一起用吗)

    内存条32g和16g区别(内存条16g和32g可以一起用吗)

  • 12306会员积分有什么用(12306会员积分怎么算钱)

    12306会员积分有什么用(12306会员积分怎么算钱)

  • 苹果手机怎么传送照片(苹果手机怎么传到安卓手机)

    苹果手机怎么传送照片(苹果手机怎么传到安卓手机)

  • 华为mate20 pro和mate30的区别(华为mate20pro和mate30pro对比)

    华为mate20 pro和mate30的区别(华为mate20pro和mate30pro对比)

  • 小溜共享免押金怎么弄(小溜共享要押金吗)

    小溜共享免押金怎么弄(小溜共享要押金吗)

  • iphone xs max官网怎么没有了(iphone xs max官网价格256G)

    iphone xs max官网怎么没有了(iphone xs max官网价格256G)

  • 苹果手表蜂窝要插卡吗(苹果手表蜂窝要装卡么)

    苹果手表蜂窝要插卡吗(苹果手表蜂窝要装卡么)

  • qq申诉在哪里(qq申诉在哪里找前提是QQ登不了了)

    qq申诉在哪里(qq申诉在哪里找前提是QQ登不了了)

  • Windows中的网络重置功能(windows中的网络协议的配置原理)

    Windows中的网络重置功能(windows中的网络协议的配置原理)

  • 发票上税额加不上怎么办
  • 增值税普票可以开给个人吗
  • 生产型企业直接进口产品是否可直接出口
  • 资本公积只能转现金吗
  • 机票行程单能报销几次
  • 开了负数发票增值税申报表怎么填
  • 取得保险赔偿的会计分录
  • 零售不要发票如何报税
  • 公司转让会计分录
  • 公司注销前的发言怎么写
  • 房地产开发资质管理办法
  • 地方教育费附加的会计分录
  • 企业向银行贷款需要什么条件
  • 违约金 罚款
  • 个税手续费返还奖励财务人员的文件
  • 企业可以采用在产品按固定成本计算法的有
  • 固定资产入账包括税额吗
  • 固定资产转入清理记账凭证
  • 预缴企业所得税怎么做账务处理
  • 企业开办费的会计分录
  • 调整会计分录是什么
  • 旅游服务业账务处理办法
  • 机票增值税怎么计算
  • 买车的收费项目详细清单
  • 图书装订的工作容易吗
  • php字符串变量
  • 在php中,字符串有哪些表示形式
  • 工业企业会计核算的特点
  • vant3.0
  • uniapp支付流程
  • CUDA(10.2)+PyTorch安装加配置 详细完整教程
  • 让税务局代开的发票直接交纳的税金怎么做会计分录?
  • 驾校属于什么行业分类类别
  • 收到的国家电网电话
  • javaweb总结笔记
  • 深度学习之bottleneck layer
  • python如何提取字典中的键
  • python可以制作软件吗
  • python字典添加数据
  • 以房租入股股份怎么计算
  • 摊销结束后
  • 所得税多交退回分录
  • 企业法人需要本人到场吗
  • sql server如何设置远程连接
  • 购买的手机可以退货吗
  • 接受劳务应付未付款费用
  • 关联表的作用
  • 不良资产处置公司违法吗
  • 投资收益是总账还是明细账
  • 收到存款利息属于资金周转吗
  • 管理费用月底结转吗
  • 分类法与品种法相比,最大的区别是
  • 超市的进场费怎么入会计科目
  • 房地产公司员工购房
  • 公司缴纳社保如何转为个人缴纳
  • windows延缓写入失败怎么修复
  • windows xp计算器
  • XP系统电脑开机密码忘了
  • ubuntu系统如何切换中文
  • ubuntu 12.04使用QQ截图安装教程
  • 怎么自己制作diy
  • bearshare.exe进程安全吗 bearshare是什么进程
  • 会声会影win7怎么兼容
  • centos删除virbr0
  • win10系统应用和浏览器控制出现感叹号
  • windows更新后桌面没反应
  • linux网卡添加vlan
  • opengl画矩形函数
  • 一系列优秀的Android开发资料
  • 好看的css样式代码
  • 首次安装操作系统称为什么盘
  • De facto standard 世界上不可思议的事实标准
  • Android 自定义控件
  • python 函数 星号参数
  • 每月公积金900元交多少
  • 贸易型企业进项发票
  • 食药监局下午几点上班
  • 岗位能手竞赛
  • 济南市地税局纳税服务中心孙凯简历
  • 中国的消费税是什么
  • 免责声明:网站部分图片文字素材来源于网络,如有侵权,请及时告知,我们会第一时间删除,谢谢! 邮箱:opceo@qq.com

    鄂ICP备2023003026号

    网站地图: 企业信息 工商信息 财税知识 网络常识 编程技术

    友情链接: 武汉网站建设