Python列表创建与销毁及缓存池机制
作者:??编程学习网???? 发布时间:2023-11-29 14:21:21
列表的创建
创建列表,Python底层只提供了唯一一个Python/C API,也就是PyList_New。这个函数接收一个size参数,允许我们在创建一个PyListObject对象时指定底层的PyObject *数组的长度。
PyObject *
PyList_New(Py_ssize_t size)
{
//声明一个PyListObject *对象
PyListObject *op;
#ifdef SHOW_ALLOC_COUNT
static int initialized = 0;
if (!initialized) {
Py_AtExit(show_alloc);
initialized = 1;
}
#endif
//如果size小于0,直接抛异常
if (size < 0) {
PyErr_BadInternalCall();
return NULL;
}
//缓存池是否可用,如果可用
if (numfree) {
//将缓存池内对象个数减1
numfree--;
//从缓存池中获取
op = free_list[numfree];
//设置引用计数
_Py_NewReference((PyObject *)op);
#ifdef SHOW_ALLOC_COUNT
count_reuse++;
#endif
} else {
//不可用的时候,申请内存
op = PyObject_GC_New(PyListObject, &PyList_Type);
if (op == NULL)
return NULL;
#ifdef SHOW_ALLOC_COUNT
count_alloc++;
#endif
}
//如果size等于0,ob_item设置为NULL
if (size <= 0)
op->ob_item = NULL;
else {
//否则的话,创建一个指定容量的指针数组,然后让ob_item指向它
//所以是先创建PyListObject对象, 然后创建指针数组
//最后通过ob_item建立联系
op->ob_item = (PyObject **) PyMem_Calloc(size, sizeof(PyObject *));
if (op->ob_item == NULL) {
Py_DECREF(op);
return PyErr_NoMemory();
}
}
//设置ob_size和allocated,然后返回op
Py_SIZE(op) = size;
op->allocated = size;
_PyObject_GC_TRACK(op);
return (PyObject *) op;
}
我们注意到源码里面有一个缓存池,是的,Python大部分对象都有自己的缓存池,只不过实现的方式不同。
列表的销毁
创建PyListObject对象时,会先检测缓存池free_list里面是否有可用的对象,有的话直接拿来用,否则通过malloc在系统堆上申请。列表的缓存池是使用数组实现的,里面最多维护80个PyListObject对象。
#ifndef PyList_MAXFREELIST
#define PyList_MAXFREELIST 80
#endif
static PyListObject *free_list[PyList_MAXFREELIST];
根据之前的经验我们知道,既然创建的时候能从缓存池中获取,那么在执行析构函数的时候也要把列表放到缓存池里面。
static void
list_dealloc(PyListObject *op)
{
Py_ssize_t i;
PyObject_GC_UnTrack(op);
Py_TRASHCAN_SAFE_BEGIN(op)
//先释放底层数组
if (op->ob_item != NULL) {
i = Py_SIZE(op);
//但是释放之前,还有一件重要的事情
//要将底层数组中每个指针指向的对象的引用计数都减去1
//因为它们不再持有对"对象"的引用
while (--i >= 0) {
Py_XDECREF(op->ob_item[i]);
}
//然后释放底层数组所占的内存
PyMem_FREE(op->ob_item);
}
//判断缓冲池里面PyListObject对象的个数,如果没满,就添加到缓存池
//注意:我们看到执行到这一步的时候, 底层数组已经被释放掉了
if (numfree < PyList_MAXFREELIST && PyList_CheckExact(op))
//添加到缓存池的时候,是添加到尾部
//获取的时候也是从尾部获取
free_list[numfree++] = op;
else
//否则的话就释放掉PyListObject对象所占的内存
Py_TYPE(op)->tp_free((PyObject *)op);
Py_TRASHCAN_SAFE_END(op)
}
我们知道在创建一个新的PyListObject对象时,实际上是分为两步的,先创建PyListObject对象,然后创建底层数组,最后让PyListObject对象中的ob_item成员指向这个底层数组。
同理,在销毁一个PyListObject对象时,先销毁ob_item维护的底层数组,然后再释放PyListObject对象自身(如果缓存池已满)。
现在可以很清晰地明白了,原本空荡荡的缓存池其实是被已经死去的PyListObject对象填充了。在以后创建新的PyListObject对象时,Python会首先唤醒这些死去的PyListObject对象,给它们一个洗心革面、重新做人的机会。但需要注意的是,这里缓存的仅仅是PyListObject对象,对于底层数组,其ob_item已经不再指向了。
从list_dealloc中我们看到,PyListObject对象在放进缓存池之前,ob_item指向的数组就已经被释放掉了,同时数组中指针指向的对象的引用计数会减1。所以最终数组中这些指针指向的对象也大难临头各自飞了,或生存、或毁灭,总之此时和PyListObject之间已经没有任何联系了。
但是为什么要这么做呢?为什么不连底层数组也一起维护呢?可以想一下,如果继续维护的话,数组中指针指向的对象永远不会被释放,那么很可能会产生悬空指针的问题,所以这些指针指向的对象所占的空间必须交还给系统(前提是没有其它指针指向了)。
但是实际上,是可以将PyListObject对象维护的底层数组进行保留的,即:只将数组中指针指向的对象的引用计数减1,然后将数组中的指针都设置为NULL,不再指向之前的对象了,但是并不释放底层数组本身所占用的内存空间。
因此这样一来,释放的内存不会交给系统堆,那么再次分配的时候,速度会快很多。但是这样带来一个问题,就是这些内存没人用也会一直占着,并且只能供PyListObject对象的ob_item指向的底层数组使用。因此Python还是为避免消耗过多内存,采取将底层数组所占的内存交还给了系统堆这样的做法,在时间和空间上选择了空间。
lst1 = [1, 2, 3]
print(id(lst1)) # 1243303086208
# 扔到缓存池中,放在数组的尾部
del lst1
# 从缓存池中获取,也会从数组的尾部开始拿
lst2 = [1, 2, 3]
print(id(lst2)) # 1243303086208
# 因此打印的地址是一样的
小结
作为一个功能强大的数据结构,多花些时间是有必要的。
来源:https://juejin.cn/post/7089263511049601031


猜你喜欢
- ECMAScript5为数组定义了5个迭代方法。每个方法都接收两个参数:要在每一项上运行的函数和(可选的)运行该函数的作用域对象(即影响th
- 引言人工智能是计算机科学中一个非常热门的领域,近年来得到了越来越多的关注。它通过模拟人类思考过程和智能行为来实现对复杂任务的自主处理和学习,
- 牛顿摆是一个1960年代发明的桌面演示装置,五个质量相同的球体由吊绳固定,彼此紧密排列。又叫:牛顿摆球、动量守恒摆球、永动球、物理撞球、碰碰
- 导语新的一年迎来了元宵节,元宵佳节在陪伴家人的同时,自然也少不了赏花灯,猜灯谜的项目。当然,受到疫情的影响,许多地方今年无法出门赏花灯,猜灯
- 我们都知道打开文件有两种方法:f = open()with open() as f:这两种方法的区别就是第一种方法需要我们自己关闭文件;f.
- 如下所示:try: f =open("D:/1.txt",'r') f.clos
- 一、clear(清空字典内容)stu = { 'num1':'Tom', '
- 内容介绍将日常工作中遇到的数数据冲突和样本源的方法进行总结,其中主要包括实际业务数据冲突、样本选取问题、数据共线性 等思路,并且长期更新。实
- 处于兴趣,写了一个遍历指定城市五天内的天气预报,并转为华氏度显示。把城市名字写到一个列表里这样可以方便的添加城市。并附有详细注释import
- HTML5 越来越引起人们的关注,苹果甚至将 HTML5 视为 Flash 的掘墓人 。然而,作为一种尚未成型的技术,HTML5 对很多人来
- 之前安装mysql 5.7.12时未做总结,换新电脑,补上安装记录,安装的时候,找了些网友的安装记录,发现好多坑(一)mysql 5.7.1
- 归并排序思路:将数组不断二分,然后合并为有序数组C++实现:void mergeSort(T arr[], int left,int rig
- package 的导入语法写 Go 代码的时经常用到 import 这个命令用来导入包,参考如下:import( "f
- 本文实例讲述了SQL Server存储过程中编写事务处理的方法。分享给大家供大家参考,具体如下:SQL Server中数据库事务处理是相当有
- python 版本 3.x首先安装 PIL由于PIL仅支持到Python 2.7,加上年久失修,于是一群志愿者在PIL的基础上创建了兼容的版
- ECharts作为一个图标库已经被大家广泛使用,它提供了各式各样的图表类型,但是在我们日常使用中可能只会用到其中的某几个图表类型,常用的基本
- 英国著名学者李约瑟早在100多年前就疑惑:为什么中国的科技在唐宋时代就已领先西方,却在明清时代落后下来。对此,人们一向认为这主要是儒家思想的
- 一、前言嗨,大家好,我是新发。有同学私信我让我写一篇Unity网格相关的教程,那我就带大家来一次Unity的网格探险之旅吧~二、Hello
- 定义一个banner.js文件,代码如下;window.requestAnimationFrame = window.requestAnim
- 如果index是时间序列就不用转datetime;但是如果时间序列是表中的某一列,可以把这一列设为index例如:代码:DF=df2.set