京公网安备 11010802034615号
经营许可证编号:京B2-20210330
作者:小K
来源:麦叔编程
今天可以来讲解下GIL是个什么了。
❞
GIL是Global Interpreter Lock的缩写,翻译过来就是全局解释器锁。
从字面上去理解,它就是锁在解释器头上的一把锁,它使Python代码运行变得有序。
假如有一段代码:
print(1)print(2)print(3)print(4)print(5)print(6)
运行之后,
123456
GIL通过确保在任何给定时间只运行一个线程来防止竞争条件
❝
GIL确保在任何给定时间只有一个线程在运行。
因此,不可能利用具有线程的多个处理器。
❞
❝
由于CPython的内存管理不是线程安全的,GIL可以防止竞争条件并确保线程安全。
❞
Python有多个解释器实现。分别用C、Java、C#和Python编写的CPython、Jython、IronPython和PyPy是最受欢迎的。
GIL 仅存在于CPython的原始Python实现中。
❝
那为什么不直接使用别的解释器为主要开发用呢?
因为CPython的库最为丰富。
如果别的解释器有支持你代码中的模块,那是可以直接移植过去使用的。
像Jython至今还没有推出Python3,只停留在Python2时代。
❞
我将用三段代码(单线程、多线程、多进程)解决一个问题(把50000000通过n-=1减至0)。
通过对比他们运行的所花费的时间,看哪段代码效率最高。
「单线程」
import timenum = 50000000def countdown(n): while n>0: n -= 1start = time.time()countdown(num)end = time.time()print('花费时间 -', end - start)
运行结果:
花费时间 - 3.7478301525115967
「多线程」
import timefrom threading import Threadnum = 50000000def countdown(n): while n>0: n -= 1t1 = Thread(target=countdown, args=[num//2])t2 = Thread(target=countdown, args=[num//2])start = time.time()t1.start()t2.start()t1.join()t2.join()end = time.time()print('花费时间 -', end - start)
运行结果:
花费时间 - 4.2221999168396
「多进程」
from multiprocessing import Poolimport timenum = 50000000def countdown(n): while n>0: n -= 1if __name__ == '__main__': pool = Pool(processes=2) start = time.time() r1 = pool.apply_async(countdown, [num//2]) r2 = pool.apply_async(countdown, [num//2]) pool.close() pool.join() end = time.time() print('花费时间 -', end - start)
运行结果:
花费时间 - 2.307600975036621
对于「计算密集型任务」,Python的多线程比单线程还慢,
这是由于线程的创建和销毁都要消耗资源(进程消耗资源更大)。
「对比单线程和多线程就能感受到GIL这个枷锁的束缚力了。」
用了多进程后,运行速度一下子从3.73缩短到2.30秒,证明多进程还是能突破GIL的封锁的。
❝
多进程底层是开了多个解释器去运行代码,一个进程一把GIL。
❞
Python三分钟--GIL专题到这一期就结束了~
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
同样是“银行数据岗”,在国有大行总行数据中心、在一家城商行的零售部、在银行系金融科技子公司、在保险公司,工作内容、成长节 ...
2026-09-29在数据分析与统计学研究中,数据往往不是独立存在的,不同变量之间普遍存在相互关联、相互影响的关系。相关性统计分析是挖掘变量 ...
2026-09-29 导读:大多数人只把 dataclasses 当成偷懒工具,用来少写 __init__、__repr__ 这类魔法方法。但它的能力远不止于此。本文带 ...
2026-09-29 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-09-29在MySQL数据库运维与业务开发中,行业普遍存在“数据达到千万级就必须分表”的说法。但在实际生产环境中,千万条数据并不是强制 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 5W1H 分析法 定义:经典系统性思维框架,通过六个核心维度对问题进行全方位拆解与剖析,确 ...
2026-09-28 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 用户标签体系 定义: 通过一系列高度精炼的特征标识,对用户属性、行为与偏好进行量化刻画 ...
2026-09-24Pandas是Python生态中用于表格数据处理的核心库,广泛应用于数据清洗、统计运算、报表输出、数据分析建模等场景。在处理极大数值 ...
2026-09-24随着数字经济快速发展,数据已成为核心生产要素,各行各业的业务沉淀、用户行为、设备运行、市场交易均产生海量数据。数据处理作 ...
2026-09-24 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-09-24在时序数据分析中,大部分业务数据并非持续平稳变化,而是会在某些时间节点出现突然抬升、断崖下跌、趋势反转、波动异变等现象, ...
2026-09-23在统计学与数据分析中,研究多组数据差异最常用的方法为单因素方差分析与事后多重比较。很多数据分析初学者容易混淆两者功能,认 ...
2026-09-23 很多数据分析师每天都在写 SQL,但当被问到“DQL 的本质是什么”“SELECT 子句的书写顺序与执行顺序为何不同”“INNER JOIN ...
2026-09-23 很多数据分析师写过无数个SELECT查询,但当被问到“如何新建一张表来固化中间数据”“创建视图和创建物理表有什么区别”“视 ...
2026-09-22CDA数据分析师 出品 作者:李诗怡 1. 金字塔原理 定义: 一种“先总后分、先结论后原因”的思考和表达方式。顶层为核心观点,中 ...
2026-09-22数据收集是数据分析、数据挖掘与数字化运营的源头工作,数据收集的完整性、准确性、时效性直接决定后续数据分析结果的可信度与业 ...
2026-09-21箱线图是数据分析中用于识别数据分布、判断离散程度、筛查异常值的核心图表。相比于直方图、趋势图,箱线图可以精准区分正常数据 ...
2026-09-21 很多数据分析师精通Excel函数和数据透视表,但当被问到“数据从哪里来”“表和视图有什么区别”“数据库管理系统和SQL是什么 ...
2026-09-21在数据库数据查询与数据分析工作中,日期时间是最常用的数据类型之一。原始数据库中存储的日期格式多为标准时间戳、年月日时分秒 ...
2026-09-20