位置: 编程技术 - 正文

Python 多核并行计算的示例代码(python多核并行处理)

发布时间:2024-02-27

推荐整理分享Python 多核并行计算的示例代码(python多核并行处理),希望有所帮助,仅作参考,欢迎阅读内容。

文章相关热门搜索词:python 多核并行 windows,python多核并行处理,python多核并行处理,python 多核并行计算,python多核并行处理,python多核并行处理,python 多核并行 windows,python 多核并行计算,内容如对您有帮助,希望把文章链接给更多的朋友!

以前写点小程序其实根本不在乎并行,单核跑跑也没什么问题,而且我的电脑也只有双核四个超线程(下面就统称核好了),觉得去折腾并行没啥意义(除非在做IO密集型任务)。然后自从用上了核GB内存,看到 htop 里面一堆空载的核,很自然地就会想这个并行必须去折腾一下。后面发现,其实 Python 的并行真的非常简单。

multiprocessing vs threading

Python 自带的库又全又好用,这是我特别喜欢 Python 的原因之一。Python 里面有 multiprocessing和 threading 这两个用来实现并行的库。用线程应该是很自然的想法,毕竟(直觉上)开销小,还有共享内存的福利,而且在其他语言里面线程用的确实是非常频繁。然而,我可以很负责任的说,如果你用的是 CPython 实现,那么用了 threading 就等同于和并行计算说再见了(实际上,甚至会比单线程更慢),除非这是个IO密集型的任务。

GIL

CPython 指的是 python.org 提供的 Python 实现。是的,Python 是一门语言,它有各种不同的实现,比如 PyPy, Jython, IronPython 等等……我们用的最多的就是 CPython,它几乎就和 Python 画上了等号。

CPython 的实现中,使用了 GIL 即全局锁,来简化解释器的实现,使得解释器每次只执行一个线程中的字节码。也就是说,除非是在等待IO操作,否则 CPython 的多线程就是彻底的谎言!

有关 GIL 下面两个资料写的挺好的:

GIL 的缘故 threading 不能用,那么我们就好好研究研究 multiprocessing。(当然,如果你说你不用 CPython,没有 GIL 的问题,那也是极佳的。)

Python 多核并行计算的示例代码(python多核并行处理)

首先介绍一个简单粗暴,非常实用的工具,就是 multiprocessing.Pool。如果你的任务能用 ys = map(f, xs) 来解决,大家可能都知道,这样的形式天生就是最容易并行的,那么在 Python 里面并行计算这个任务真是再简单不过了。举个例子,把每个数都平方:

map 直接返回列表,而 i 开头的两个函数返回的是迭代器;imap_unordered 返回的是无序的。

当计算时间比较长的时候,我们可能想要加上一个进度条,这个时候 i 系列的好处就体现出来了。另外,有一个小技巧,就是输出 r 可以使得光标回到行首而不换行,这样就可以制作简易的进度条了。

更复杂的操作

要进行更复杂的操作,可以直接使用 multiprocessing.Process 对象。要在进程间通信可以使用:

multiprocessing.Pipe multiprocessing.Queue 同步原语 共享变量

其中我强烈推荐的就是 Queue,因为其实很多场景就是生产者消费者模型,这个时候用 Queue 就解决问题了。用的方法也很简单,现在父进程创建 Queue,然后把它当做 args 或者 kwargs 传给 Process 就好了。

使用 Theano 或者 Tensorflow 等工具时的注意事项

需要注意的是,在 import theano 或者 import tensorflow 等调用了 Cuda 的工具的时候会产生一些副作用,这些副作用会原样拷贝到子进程中,然后就发生错误,如:

could not retrieve CUDA device count: CUDA_ERROR_NOT_INITIALIZED

解决的方法是,保证父进程不引入这些工具,而是在子进程创建好了以后,让子进程各自引入。

如果使用 Process,那就在 target 函数里面 import。举个例子:

如果使用 Pool,那么可以编写一个函数,在这个函数里面 import,并且把这个函数作为 initializer传入到 Pool 的构造函数里面。举个例子:

标签: python多核并行处理

本文链接地址:https://www.jiuchutong.com/biancheng/372180.html 转载请保留说明!

上一篇:python判断字符串是否是json格式方法分享(Python判断字符串结尾并输出yes或no)

下一篇:python生成excel的实例代码(python怎么生成excel)

  • 企业的企业所得税
  • 零售环节征收消费税标准
  • 只报个税不交社保有什么税务风险
  • 增值税普通发票查询真伪
  • 集团内部资产调拨
  • 报完税没有清卡
  • 向投资者支付股利
  • 职工教育经费税法
  • 增值税发票常见问题
  • 支付的劳务派遣服务费现金流量
  • 小规模企业怎么报国税
  • 应付职工薪酬科目有余额怎么调整
  • 公司用无形资产抵税
  • 单位员工借款的认定
  • 印花税计入应交税费需要调整吗
  • 出口退税生产企业增值税附加税怎么申报
  • 烟酒销售公司要交哪些税
  • 高危行业企业探索实行什么制度
  • 员工离职违约金怎么算
  • 主营业务类别商业是什么
  • 分公司银行开户需要章程吗
  • 购物预付卡怎么用
  • 服务费计入什么收入
  • 事业单位坏账怎么处理
  • 简介linux系统中的10个常用命令及功能
  • 魁北克位置地图
  • vs code no such file or directory
  • linux中qq怎么添加快捷键启动功能?
  • php面向对象优点,缺点
  • 在建工程进项税额抵扣规定
  • 支付货款的流程
  • php socket_read
  • 事业单位会计专业知识考什么
  • vue2动态路由
  • 即征即退进项税转出
  • php接口验证
  • 【机器学习】python实现吴恩达机器学习作业合集(含数据集)
  • echarts在地图上标记图标
  • mount.nfs an incorrect mount
  • php中split
  • 支付中介费和物业费比例
  • 采矿权价款怎么做账
  • 小规模季报附加税怎么报
  • 应交土地增值税税率
  • 增值税申报销项发票采集少了怎么办
  • 公司垫付的工伤医药费怎么报销
  • linux mongodb创建用户
  • 优先股和普通股风险哪个大
  • 用于维修安装服务的工具
  • 资产处置损益影响损益吗
  • 外包工程会计怎么做账
  • 没有收到房租发票
  • 福利费发票可以抵扣进项税吗
  • 股权质押和股权抵押有什么区别
  • 公司发放工作服怎么做账务处理
  • 购买用品开专票怎么入账
  • 支付个人运费没有发票怎么办
  • 建筑业营改增后,人工费不存在可抵扣
  • 会计什么情况下不用继续教育
  • 被放弃的遗产
  • ubuntu安装教程20.04 u盘
  • ubuntu nm
  • linux做网卡绑定
  • ubuntu怎样
  • centos如何删除用户
  • win7关闭文件夹和内容一起显示
  • linux服务器dns配置安装
  • freebsd安装教程
  • 常用的加锁方式
  • 苹果mac安装
  • easyui multiple
  • 批处理实例
  • shell常用命令及示例
  • js面向对象的原理
  • js调用url接口
  • jquery事件处理有哪些
  • 解决android 11+的保存文件路径问题
  • android怎么运行
  • 怎么查询河南省考职位报名人数
  • 广西税务局发票查验平台
  • 免责声明:网站部分图片文字素材来源于网络,如有侵权,请及时告知,我们会第一时间删除,谢谢! 邮箱:opceo@qq.com

    鄂ICP备2023003026号