使用 python multiprocessing.Queue 出现 too many open files 错误

问题描述

使用 python 子进程multiprocessing.Process执行任务,并使用multiprocessing.Queue回传任务执行结果。程序执行时间长以后,出现 Too many open files 错误。使用 lsof -p 进程号 能看到有很多未关闭的 pipe。后经排查发现大概率是 multiprocessing.Queue的问题,为了验证想法,写了一个测试脚本

python 复制代码
#!/usr/bin/env python
# -*- coding-utf8 -*-
"""
:Copyright: 2023, XXX
:Software python_cook_book
:File Name: queue_test.py
:Author wind
:Date 2023/9/5 11:52
:Version: v.1.0
:Description:
"""
import os
import time
from multiprocessing import Process, Queue


def start_sub_process(q, index):
    print(f'get a queue, index is: {index}')
    time.sleep(10)
    print('sleep finished')
    if q:
        q.put(f'hello {index}')


def execute():

    queues = []

    for i in range(10):
        q = None
        if i % 3 == 0:
            q = Queue()
        p = Process(target=start_sub_process, args=(q, i))
        p.start()
        queues.append((p, q))
        
    print('start sub process ok')

    for p, q in queues:
        msg = q.get() if q else ''
        print(f'q get ret is: {msg}')
        while p.is_alive():
            print('process is alive') 
            time.sleep(1)

        p.close()
        del p
        if q:
            # q._writer.close()
            q.close()
        time.sleep(20)
        print(f'close queue finished')

    while True:
        time.sleep(3)
        print('sleep')


if __name__ == '__main__':
    execute()

测试程序启动后,找到进程号,然后使用 lsof -p 进程号 | grep pipe | wc -l 查看遗漏的文件描述符的数量。这时出现了令人困惑的事情,在不同的linux发行版和同一个发行版不同的版本上,程序的遗漏文件描述符的数量不一样。而且有的能全部回收,有的只能部分回收。

问题处理

针对这种情况,最直接的当然是想办法让描述符能回收,如果确实不行,就只能将子进程放在进程池中进行管理再配备对应的通信队列,限制住进程队列的数量。

在网上找了一圈,最后找到一个比较靠谱的方案 python issue 即在回收队列时,调用 q._writer.close() ,上面脚本已经写上这行代码。但这个方案在有些系统下执行仍然会有文件描述符泄露的问题,并且用del queue gc.coolect()都没法解决,碰到这种没法直接用代码处理的最好是换处理方式,用进程池,并控制队列的使用数量

相关推荐
极客小云13 分钟前
【ComfyUI API 自动化利器:comfyui_xy Python 库使用详解】
网络·python·自动化·comfyui
凡人叶枫23 分钟前
C++中输入、输出和文件操作详解(Linux实战版)| 从基础到项目落地,避坑指南
linux·服务器·c语言·开发语言·c++
闲人编程29 分钟前
Elasticsearch搜索引擎集成指南
python·elasticsearch·搜索引擎·jenkins·索引·副本·分片
春日见35 分钟前
车辆动力学:前后轮车轴
java·开发语言·驱动开发·docker·计算机外设
痴儿哈哈38 分钟前
自动化机器学习(AutoML)库TPOT使用指南
jvm·数据库·python
锐意无限39 分钟前
Swift 扩展归纳--- UIView
开发语言·ios·swift
低代码布道师39 分钟前
Next.js 16 全栈实战(一):从零打造“教培管家”系统——环境与脚手架搭建
开发语言·javascript·ecmascript
花酒锄作田1 小时前
SQLAlchemy中使用UPSERT
python·sqlalchemy
SoleMotive.1 小时前
一个准程序员的健身日志:用算法调试我的增肌计划
python·程序员·健身·职业转型
念何架构之路1 小时前
Go进阶之panic
开发语言·后端·golang