位置: 编程技术 - 正文

Python scikit-learn 做线性回归的示例代码

编辑:rootadmin

推荐整理分享Python scikit-learn 做线性回归的示例代码,希望有所帮助,仅作参考,欢迎阅读内容。

文章相关热门搜索词:,内容如对您有帮助,希望把文章链接给更多的朋友!

一、概述

机器学习算法在近几年大数据点燃的热火熏陶下已经变得被人所“熟知”,就算不懂得其中各算法理论,叫你喊上一两个著名算法的名字,你也能昂首挺胸脱口而出。当然了,算法之林虽大,但能者还是有限,能适应某些环境并取得较好效果的算法会脱颖而出,而表现平平者则被历史所淡忘。随着机器学习社区的发展和实践验证,这群脱颖而出者也逐渐被人所认可和青睐,同时获得了更多社区力量的支持、改进和推广。

以最广泛的分类算法为例,大致可以分为线性和非线性两大派别。线性算法有著名的逻辑回归、朴素贝叶斯、最大熵等,非线性算法有随机森林、决策树、神经网络、核机器等等。线性算法举的大旗是训练和预测的效率比较高,但最终效果对特征的依赖程度较高,需要数据在特征层面上是线性可分的。因此,使用线性算法需要在特征工程上下不少功夫,尽量对特征进行选择、变换或者组合等使得特征具有区分性。而非线性算法则牛逼点,可以建模复杂的分类面,从而能更好的拟合数据。

那在我们选择了特征的基础上,哪个机器学习算法能取得更好的效果呢?谁也不知道。实践是检验哪个好的不二标准。那难道要苦逼到写五六个机器学习的代码吗?No,机器学习社区的力量是强大的,码农界的共识是不重复造轮子!因此,对某些较为成熟的算法,总有某些优秀的库可以直接使用,省去了大伙调研的大部分时间。

基于目前使用python较多,而python界中远近闻名的机器学习库要数scikit-learn莫属了。这个库优点很多。简单易用,接口抽象得非常好,而且文档支持实在感人。本文中,我们可以封装其中的很多机器学习算法,然后进行一次性测试,从而便于分析取优。当然了,针对具体算法,超参调优也非常重要。

二、Scikit-learn的python实践

本篇文章利用线性回归算法预测波士顿的房价。波士顿房价数据集包含波士顿郊区住房价值的信息。

第一步:Python库导入

第二步:数据获取和理解

波士顿数据集是scikit-learn的内置数据集,可以直接拿来使用。

dict_keys([‘data', ‘target', ‘feature_names', ‘DESCR'])

(, )

Python scikit-learn 做线性回归的示例代码

[‘CRIM' ‘ZN' ‘INDUS' ‘CHAS' ‘NOX' ‘RM' ‘AGE' ‘DIS' ‘RAD' ‘TAX' ‘PTRATIO''B' ‘LSTAT']

结论:波士顿数据集个样本,个特征。

第三步:数据模型构建——线性回归

第四步:数据模型应用——预测房价

array([ ., . , . , ., .])

.

总结

1 使用.DESCR探索波士顿数据集,业务目标是预测波士顿郊区住房的房价;

2 使用scikit-learn针对整个数据集拟合线性回归模型,并计算均方误差。

思考环节

1 对数据集分割成训练数据集和测试数据集

2 训练数据集训练线性回归模型,利用线性回归模型对测试数据集进行预测

3 计算训练模型的MSE和测试数据集预测结果的MSE

4 绘制测试数据集的残差图

标签: Python scikit-learn 做线性回归的示例代码

本文链接地址:https://www.jiuchutong.com/biancheng/372141.html 转载请保留说明!

上一篇:Python定时器实例代码

下一篇:Python栈算法的实现与简单应用示例(python3 栈)

  • 不得税前扣除的贷款利息
  • 城市维护建设税为什么是流转税
  • 什么是税收制度构成要素的中心环节
  • 购入原材料计划成本
  • 委托加工物资贷方
  • 计入损益的税
  • 网银盾属于什么费用
  • 慈善捐款抵税的会计分录
  • 维修企业主营项目有哪些
  • 银行现金支票怎么填
  • 年化收益率的计算公式
  • 税后工资反推税前工资计算方法
  • 建筑企业一般纳税人提供建筑服务属于老项目
  • 机打发票多久可以作废
  • 企业所得税营业利润怎么算
  • 未办理房屋预售许可证怎么处理
  • 推广费是广告费和业务宣传费吗
  • 服务业发票进项税怎么做凭证?
  • 增值税专用发票丢了怎么补救
  • 安全生产费用怎么支出
  • 安全平台无法认证怎么办
  • centos apache配置文件
  • type3插件
  • 缴税怎么入账
  • 建安混合销售能分开吗
  • 缴纳集团公司的税收
  • 清算公司资产怎么入账
  • 如何进入企业年报系统
  • linux双ip路由设置方法
  • 怎么更改win7
  • 煤炭企业的会计科目
  • 业务招待费如何进行纳税调整
  • 生产成本的主要分析方法
  • windows安装配置
  • 谷歌浏览器如何设置主页为默认页
  • yii框架手册
  • 两套账目
  • 投资收益属于营业外收入吗
  • Java+JSP+Mysql+Tomcat实现Web图书管理系统
  • php静态方法可以被继承吗
  • 魔改是啥
  • 资产基金的明细科目
  • 公司间代收代付
  • 数据类型所占的字节
  • 歌咏比赛服装费用规定标准最新
  • 个体工商户怎么年审
  • 向投资者分配现金股利为什么会导致所有者权益减少?
  • 普通发票能不能重新开
  • sql里面union 和union all区别
  • 进口关税的计算是以什么为基础
  • 单位未足额缴纳社保怎么赔偿
  • 制造费用包括哪些部门
  • 土地补偿费怎么算
  • 申请到了专利费多少钱
  • 代垫水电费的账务处理
  • 网店会计怎么做账
  • 农业技术人员是什么意思
  • 主营业务毛利率和毛利率
  • 商业健康保险抵扣个税规定
  • WIN7系统屏幕亮度哪里设置
  • win10系统崩溃怎么修复开不了机
  • linux临时目录在哪
  • 注册表c盘桌面路径改为d盘
  • ie11怎么打开ie8
  • ubuntu20.04 vim
  • ios太极
  • ssh登录报错
  • win7桌面文件夹路径
  • popupwindow底部弹出
  • Perl实现高水线算法(解决多值比较问题方法)
  • bash 入门
  • python的五个特点
  • jquery 鼠标
  • jquery.validate 自定义验证方法及validate相关参数
  • android摇一摇实现
  • js模拟实现new
  • 就业失业登记证网上申请
  • 最新专票税率几个档
  • 解放服务站总部电话
  • portal
  • 免责声明:网站部分图片文字素材来源于网络,如有侵权,请及时告知,我们会第一时间删除,谢谢! 邮箱:opceo@qq.com

    鄂ICP备2023003026号

    网站地图: 企业信息 工商信息 财税知识 网络常识 编程技术

    友情链接: 武汉网站建设