父子任务共用一个全局线程池导致死锁

父子任务共用一个全局线程池导致死锁

一.背景

目前所有项目已升级至JDK 21,并采用了虚拟线程的新特性。然而,在synchronized方法块或类加载等隐式持有锁的场景中,虚拟线程可能导致平台线程被绑定,从而引发死锁问题。这种情况在集团框架中偶尔出现,导致应用程序卡死,影响业务连续性。为了解决这一问题,我们决定使用平台线程池执行核心业务。

二.问题

2.1 表象

由Qshedule调度的Job执行时间过长,导致系统出现不推单情况,线程池数量始终维持在核心线程数。

2.2 提出疑问

为什么使用虚拟线程的时候没有问题 ? 使用平台线程执行任务的时候反而出现了问题 ?

2.2 问题定位

  • 堆栈信息

查看多个堆栈信息发现,所有的线程全部卡在了pullAndHandleRouteLineSortedSet方法

  • 业务逻辑

查看业务代码发现,父任务会创建多个子任务,并等待子任务执行结束,而父子任务都是使用的同一个线程池,当线程池中执行线程都是父任务时,所有的子任务又都在任务队列中等待执行,所以这样就会发生死锁。

核心线程永远不会释放,而任务队列的大小又足够大,导致不会扩容线程。所以就出现了死锁。

  • 疑问:同样的代码为什么使用虚拟线程没问题,而使用平台线程池有问题?

    使用虚拟线程执行阻塞任务时,载体线程会yeild让出,而直接使用平台线程执行任务时,遇到阻塞时并不会让出线程从而导致上述问题。

三.解决方案

为避免父子任务使用同一线程池造成死锁,可以考虑使用独立线程池:将父任务和子任务分别提交到不同的线程池,避免共享线程池资源,减少死锁的可能性。

四.总结

  • 禁止使用Executors创建自定义线程池。使用ThreadPoolExecutor创建线程池时,注意每个参数的含义,规避资源耗尽的风险。
  • 线程池使用有界队列,避免使用无界队列。
  • 对于父子任务的场景,可以使用线程池或者 MQ。使用有界队列之后,制定合理的拒绝策略,拒绝策略可以考虑 MQ 做重试。
    以使用线程池或者 MQ。使用有界队列之后,制定合理的拒绝策略,拒绝策略可以考虑 MQ 做重试。
  • 不同业务使用不同的线程池,禁止父子任务使用相同的线程池。
相关推荐
4***1727几秒前
使用 java -jar 命令启动 Spring Boot 应用时,指定特定的配置文件的几种实现方式
java·spring boot·jar
CoderYanger17 分钟前
优选算法-字符串:63.二进制求和
java·开发语言·算法·leetcode·职场和发展·1024程序员节
3***312118 分钟前
java进阶1——JVM
java·开发语言·jvm
charlie11451419124 分钟前
深入理解C/C++的编译链接技术6——A2:动态库设计基础之ABI设计接口
c语言·开发语言·c++·学习·动态库·函数
Cx330❀27 分钟前
C++ STL set 完全指南:从基础用法到实战技巧
开发语言·数据结构·c++·算法·leetcode·面试
white-persist30 分钟前
【攻防世界】reverse | Reversing-x64Elf-100 详细题解 WP
c语言·开发语言·网络·python·学习·安全·php
FeiHuo5651530 分钟前
微信个人号开发中如何高效实现API二次开发
java·开发语言·python·微信
zmzb010332 分钟前
C++课后习题训练记录Day33
开发语言·c++
csbysj202034 分钟前
Bootstrap 折叠
开发语言
源码技术栈38 分钟前
什么是云门诊系统、云诊所系统?
java·vue.js·spring boot·源码·门诊·云门诊