mongos连接池耗尽表现为应用端connection refused或timeout,但mongos自身资源正常;其根本原因是客户端连接数×shard数导致后端连接爆炸,因mongos为每次请求涉及的每个shard单独建连,且无硬性连接限制。mongos 连接池耗尽的典型症状应用端报 connection refused 或 timeout waiting for connection,但 mongos 进程本身 CPU 和内存正常;用 db.currentOp() 查不到大量慢操作;netstat -an | grep :27017 | wc -l 显示 mongos 到后端 shard 的连接数远超预期------比如客户端只开 50 个连接,mongos 却维持了 800+ 到各 shard 的连接。为什么客户端连接数 × shard 数 = mongos 实际连接爆炸mongos 不复用连接:每个客户端连接在路由时,会为**本次请求涉及的每个 shard**(哪怕只查一个 collection)单独建立或复用一条到该 shard 的连接。如果集群有 8 个 shard,客户端开了 100 个连接,极端情况下 mongos 可能撑起近 800 条后端连接(尤其跨分片查询、chunk 迁移期间)。maxPoolSize 在 driver 层控制客户端到 mongos 的连接上限,但它对 mongos 内部到 shard 的连接完全无效mongos 自身没有类似 maxConnPerHost 的硬限制,只靠 connPoolMaxSize(默认 1000)软控,超限后新请求会被阻塞或失败分片键设计不合理(如全表扫描、范围查询覆盖多数 chunk)会加剧连接分散快速缓解:从 mongos 配置和 driver 参数双端压降不是调大连接数,而是减少"连接乘数"的触发条件。 Mokker AI AI产品图添加背景
相关推荐
龙腾AI白云24 分钟前
大语言模型:从语言理解到通用智能的跃迁安易算力26 分钟前
PUE优化工程实践:从1.5到1.2的制冷架构与气流组织改造路径troy1281 小时前
Codex 安全盲区:代码漏洞生成实测SelectDB1 小时前
快手基于 Apache Doris 千亿多模态检索的实践SelectDB1 小时前
StarRocks 迁移至 Apache Doris 完整指南:三步完成结构、数据与业务平滑切换这个DBA有点耶1 小时前
InnoDB索引组织表下,复合主键和自增主键的物理存储差异与选型对比嵌入式学习菌1 小时前
Workbuddy自动写一个RS485 / LoRa 参数调试工具其实防守也摸鱼2 小时前
常见安全架构中 Shiro 的认证确认机制解析钱栈up2 小时前
番茄小说榜单爬虫失效排查:从页面路由变更到API参数映射的全流程复盘唐璜Taro2 小时前
Agent Harness 系列 · 第 1 篇|Agent 不只是换一个更强的模型