位置: 编程技术 - 正文

Python scikit-learn 做线性回归的示例代码

编辑:rootadmin

推荐整理分享Python scikit-learn 做线性回归的示例代码,希望有所帮助,仅作参考,欢迎阅读内容。

文章相关热门搜索词:,内容如对您有帮助,希望把文章链接给更多的朋友!

一、概述

机器学习算法在近几年大数据点燃的热火熏陶下已经变得被人所“熟知”,就算不懂得其中各算法理论,叫你喊上一两个著名算法的名字,你也能昂首挺胸脱口而出。当然了,算法之林虽大,但能者还是有限,能适应某些环境并取得较好效果的算法会脱颖而出,而表现平平者则被历史所淡忘。随着机器学习社区的发展和实践验证,这群脱颖而出者也逐渐被人所认可和青睐,同时获得了更多社区力量的支持、改进和推广。

以最广泛的分类算法为例,大致可以分为线性和非线性两大派别。线性算法有著名的逻辑回归、朴素贝叶斯、最大熵等,非线性算法有随机森林、决策树、神经网络、核机器等等。线性算法举的大旗是训练和预测的效率比较高,但最终效果对特征的依赖程度较高,需要数据在特征层面上是线性可分的。因此,使用线性算法需要在特征工程上下不少功夫,尽量对特征进行选择、变换或者组合等使得特征具有区分性。而非线性算法则牛逼点,可以建模复杂的分类面,从而能更好的拟合数据。

那在我们选择了特征的基础上,哪个机器学习算法能取得更好的效果呢?谁也不知道。实践是检验哪个好的不二标准。那难道要苦逼到写五六个机器学习的代码吗?No,机器学习社区的力量是强大的,码农界的共识是不重复造轮子!因此,对某些较为成熟的算法,总有某些优秀的库可以直接使用,省去了大伙调研的大部分时间。

基于目前使用python较多,而python界中远近闻名的机器学习库要数scikit-learn莫属了。这个库优点很多。简单易用,接口抽象得非常好,而且文档支持实在感人。本文中,我们可以封装其中的很多机器学习算法,然后进行一次性测试,从而便于分析取优。当然了,针对具体算法,超参调优也非常重要。

二、Scikit-learn的python实践

本篇文章利用线性回归算法预测波士顿的房价。波士顿房价数据集包含波士顿郊区住房价值的信息。

第一步:Python库导入

第二步:数据获取和理解

波士顿数据集是scikit-learn的内置数据集,可以直接拿来使用。

dict_keys([‘data', ‘target', ‘feature_names', ‘DESCR'])

(, )

Python scikit-learn 做线性回归的示例代码

[‘CRIM' ‘ZN' ‘INDUS' ‘CHAS' ‘NOX' ‘RM' ‘AGE' ‘DIS' ‘RAD' ‘TAX' ‘PTRATIO''B' ‘LSTAT']

结论:波士顿数据集个样本,个特征。

第三步:数据模型构建——线性回归

第四步:数据模型应用——预测房价

array([ ., . , . , ., .])

.

总结

1 使用.DESCR探索波士顿数据集,业务目标是预测波士顿郊区住房的房价;

2 使用scikit-learn针对整个数据集拟合线性回归模型,并计算均方误差。

思考环节

1 对数据集分割成训练数据集和测试数据集

2 训练数据集训练线性回归模型,利用线性回归模型对测试数据集进行预测

3 计算训练模型的MSE和测试数据集预测结果的MSE

4 绘制测试数据集的残差图

标签: Python scikit-learn 做线性回归的示例代码

本文链接地址:https://www.jiuchutong.com/biancheng/372141.html 转载请保留说明!

上一篇:Python定时器实例代码

下一篇:Python栈算法的实现与简单应用示例(python3 栈)

  • 增值税加计抵减政策
  • 基本税种有哪些税种
  • 税前利润是什么利润
  • 个税申报信息怎么恢复
  • 原材料暂估入库的账务处理有哪些
  • 利润和营收哪个更重要
  • 空白作废什么意思
  • 小规模纳税人纳税申报表
  • 利息股息红利所得个人所得税税率
  • 行政单位要纳税吗
  • 没有合作会怎么样
  • 2年前的增值税发票能不能用
  • 无票收入如何做账
  • 药企会计租金进项税不能抵扣
  • 通信服务费计入什么科目
  • 旅行社会议主持开场
  • 固定资产清理会计处理例题
  • 跨年度专用发票如何开红字发票
  • 出售固定资产账务处理
  • window11系统怎么用
  • 合并报表同一控制下和非同一控制下区别
  • 苹果电脑记笔记
  • 汇算清缴无形资产摊销填哪里
  • php 签名算法
  • php array_splice
  • fs是什么文件
  • bc2.exe
  • vue父组件调用子组件的方法报错
  • 企业汇算清缴费用
  • 印克斯湖国家公园中的德克萨斯矢车菊,德克萨斯州 (© Inge Johnsson/Alamy)
  • 微信开发获取位置
  • redirect_uri参数错误的解决方法(必看)
  • vue中的provide/inject
  • 用友软件怎么删除已经建立的账套
  • 2022年微信小程序游戏
  • login user
  • 二手车交易发票怎么收费
  • 绿化公司属于哪个行业
  • 银行承兑汇票收费标准
  • 本年累计金额怎么得到
  • 工会经费按工资总额的
  • 第6章 分支语句和逻辑运算符
  • c语言中局部变量和全局变量同名
  • 刘亦菲生日当天发素颜照
  • 经营范围技术服务技术开发技术咨询技术交流
  • 捐赠支出汇算清缴需要调增吗
  • 盈余公积年初和年末没有变化
  • 融资租赁租出的固定资产账务处理
  • 一般纳税人工程劳务发票税率是多少
  • 长期待摊费用好处
  • 水电费没有收到怎么处理
  • 递延负债和递延收益
  • 现代服务业营改增
  • 作废的支票由谁保管
  • 权益性无形资产包括哪些?
  • 商品和服务税收分类编码是什么
  • 未打印税务分类怎么处理
  • mysql的基本介绍
  • 打印机向windows发送消息
  • win10删除的文件恢复
  • xp系统为什么网页打不开了
  • microsoft onedrive怎么关闭
  • win7电脑开机提示oxcoooooe9
  • w10升级失败怎么办
  • 硬盘安装windows xp
  • win8网络图标不显示
  • win8电脑设置
  • win7系统管理员密码
  • javascript中对象一般由什么组成
  • web标准化
  • nodejs图片合成
  • c# for unity
  • 老板思维案例
  • Android-Universal-Image-Loader最新框架解析
  • asoul抽象
  • 医院的电子收据怎么查
  • 国税局升迁难么
  • 酒店访客时间是几个小时
  • 中国有没有豁免权
  • 企业可以出台政策吗
  • 免责声明:网站部分图片文字素材来源于网络,如有侵权,请及时告知,我们会第一时间删除,谢谢! 邮箱:opceo@qq.com

    鄂ICP备2023003026号

    网站地图: 企业信息 工商信息 财税知识 网络常识 编程技术

    友情链接: 武汉网站建设