位置: 编程技术 - 正文

Python 多核并行计算的示例代码(python多核并行处理)

编辑:rootadmin

推荐整理分享Python 多核并行计算的示例代码(python多核并行处理),希望有所帮助,仅作参考,欢迎阅读内容。

文章相关热门搜索词:python 多核并行 windows,python多核并行处理,python多核并行处理,python 多核并行计算,python多核并行处理,python多核并行处理,python 多核并行 windows,python 多核并行计算,内容如对您有帮助,希望把文章链接给更多的朋友!

以前写点小程序其实根本不在乎并行,单核跑跑也没什么问题,而且我的电脑也只有双核四个超线程(下面就统称核好了),觉得去折腾并行没啥意义(除非在做IO密集型任务)。然后自从用上了核GB内存,看到 htop 里面一堆空载的核,很自然地就会想这个并行必须去折腾一下。后面发现,其实 Python 的并行真的非常简单。

multiprocessing vs threading

Python 自带的库又全又好用,这是我特别喜欢 Python 的原因之一。Python 里面有 multiprocessing和 threading 这两个用来实现并行的库。用线程应该是很自然的想法,毕竟(直觉上)开销小,还有共享内存的福利,而且在其他语言里面线程用的确实是非常频繁。然而,我可以很负责任的说,如果你用的是 CPython 实现,那么用了 threading 就等同于和并行计算说再见了(实际上,甚至会比单线程更慢),除非这是个IO密集型的任务。

GIL

CPython 指的是 python.org 提供的 Python 实现。是的,Python 是一门语言,它有各种不同的实现,比如 PyPy, Jython, IronPython 等等……我们用的最多的就是 CPython,它几乎就和 Python 画上了等号。

CPython 的实现中,使用了 GIL 即全局锁,来简化解释器的实现,使得解释器每次只执行一个线程中的字节码。也就是说,除非是在等待IO操作,否则 CPython 的多线程就是彻底的谎言!

有关 GIL 下面两个资料写的挺好的:

GIL 的缘故 threading 不能用,那么我们就好好研究研究 multiprocessing。(当然,如果你说你不用 CPython,没有 GIL 的问题,那也是极佳的。)

Python 多核并行计算的示例代码(python多核并行处理)

首先介绍一个简单粗暴,非常实用的工具,就是 multiprocessing.Pool。如果你的任务能用 ys = map(f, xs) 来解决,大家可能都知道,这样的形式天生就是最容易并行的,那么在 Python 里面并行计算这个任务真是再简单不过了。举个例子,把每个数都平方:

map 直接返回列表,而 i 开头的两个函数返回的是迭代器;imap_unordered 返回的是无序的。

当计算时间比较长的时候,我们可能想要加上一个进度条,这个时候 i 系列的好处就体现出来了。另外,有一个小技巧,就是输出 r 可以使得光标回到行首而不换行,这样就可以制作简易的进度条了。

更复杂的操作

要进行更复杂的操作,可以直接使用 multiprocessing.Process 对象。要在进程间通信可以使用:

multiprocessing.Pipe multiprocessing.Queue 同步原语 共享变量

其中我强烈推荐的就是 Queue,因为其实很多场景就是生产者消费者模型,这个时候用 Queue 就解决问题了。用的方法也很简单,现在父进程创建 Queue,然后把它当做 args 或者 kwargs 传给 Process 就好了。

使用 Theano 或者 Tensorflow 等工具时的注意事项

需要注意的是,在 import theano 或者 import tensorflow 等调用了 Cuda 的工具的时候会产生一些副作用,这些副作用会原样拷贝到子进程中,然后就发生错误,如:

could not retrieve CUDA device count: CUDA_ERROR_NOT_INITIALIZED

解决的方法是,保证父进程不引入这些工具,而是在子进程创建好了以后,让子进程各自引入。

如果使用 Process,那就在 target 函数里面 import。举个例子:

如果使用 Pool,那么可以编写一个函数,在这个函数里面 import,并且把这个函数作为 initializer传入到 Pool 的构造函数里面。举个例子:

标签: python多核并行处理

本文链接地址:https://www.jiuchutong.com/biancheng/372180.html 转载请保留说明!

上一篇:python判断字符串是否是json格式方法分享(Python判断字符串结尾并输出yes或no)

下一篇:python生成excel的实例代码(python怎么生成excel)

  • 外贸 代理
  • 应收账款资金占用费公式
  • 企业缴纳个人所得税比例
  • 公司购买设备报告怎么写
  • 公司雇佣退休人员怎样扣个税
  • 更正个税申报需要做账吗
  • 申请高新时需要几个项目
  • 公司代缴个税分录
  • 事业单位财政拨款取得方式
  • 经营活动现金净流量公式
  • 明细分类账采用的格式有
  • 票据贴现利息费用计入
  • 房地产企业土地使用税
  • 预提职工福利怎么记账
  • 购入材料时,会出现哪几种情况
  • 小规模企业如何变更营业范围
  • 2018年所得税表
  • 企业的福利费如何使用
  • 外管证交税需要带什么材料
  • 2018年生育保险报销
  • 公司为员工承担房租
  • 电厂采购通常采购什么
  • 空调安装费开票属于什么类
  • 附加税费减免性质代码
  • 公司在银行购买金币没有发票
  • 维修机器设备买什么好
  • windows history命令
  • 房地产销售代理是什么意思
  • php面向对象是什么意思
  • php字段
  • 税收原则的含义
  • 存货跌价后销售会计分录
  • 大自然水族馆怎么样
  • 北极光的征兆
  • 股权转让实操
  • blkid命令详解
  • 企业转让专利权属于什么收入
  • dedecms使用教程
  • python tkinter ttk
  • 应收应付对冲的会计分录
  • 电子发票冲红后对方能查到吗
  • 公允价值计量的投资性房地产
  • 酒店收取电费合理吗
  • 帝国cms视频教程
  • 织梦怎么调用当前栏目下的文章
  • PostgreSQL安装、配置及简单使用方法
  • mysql常用表
  • 企业待摊费用怎么计算
  • 旅行社小规模纳税人差额征税
  • 职业年金是什么意思?退休后怎么算职业年金?
  • 软件即征即退开票信息与资料不符
  • 房租可以一次性抵扣吗
  • 财务专用章是干嘛用的
  • 印花税账务处理
  • 税收滞纳金可以扣除吗
  • 应收帐款周转率计算公式为
  • 废料收入是什么会计分录
  • 总公司可以给子公司开票吗
  • 电子发票显示错误信息是什么原因
  • 红字发票怎么申报增值税
  • 工程施工科目核算内容
  • 公益捐赠仪式流程
  • 改制后的企业
  • 新办企业必须经过什么核准登记
  • mysql5.6解压版安装教程
  • mysql 连接语句
  • 微软surface pro 3按键驱动
  • windows7粘滞键怎么关
  • Red Hat Enterprise Linux AS release 4 apache+MYsql+PHP的安装和优化
  • mtr.exe
  • w10开机欢迎界面设置
  • 中小型企业的认定标准2023
  • docker save -o
  • Node.js中的全局对象有
  • js键盘事件有哪些?各自的作用如何
  • 关于增值税纳税人的规定,下列说法正确的是
  • 临时税务登记纳税有区域限制吗为什么
  • 南京交税的标准2019
  • 东莞办理房产证在哪里预约
  • 税务催报通知书怎么接收
  • 免责声明:网站部分图片文字素材来源于网络,如有侵权,请及时告知,我们会第一时间删除,谢谢! 邮箱:opceo@qq.com

    鄂ICP备2023003026号

    网站地图: 企业信息 工商信息 财税知识 网络常识 编程技术

    友情链接: 武汉网站建设