CPA-Auto池方案总结

CPA Auto API 池方案总结

2026/7/5

目标

  • 10 个子代理并发执行,每代理处理 10 个 job(一个文件夹)
  • 多个 API provider 自动负载均衡,不限速、不绑死

CPA 配置改动(已生效)

1. 路由策略:填充 → 轮询

yaml 复制代码
routing:
  strategy: "round-robin"       # 原 fill-first,现轮询分配
  session-affinity: false       # 关粘性会话,防止子代理绑死同一个 key

2. 实现逻辑

所有启用的 provider 的 model 统一命名为同一个名字(如 split-agent),子代理只调这个名字:

复制代码
请求 split-agent → CPA 轮询 → 依次分到 agnes → 小水管user → yjjhwjw → sensenova → ...

3. 请求失败时的 fallback 路径

复制代码
请求 A 失败(429/超时)
  → CPA 自动冷却当前 provider(disable-cooling: false 已开)
  → 轮询到下一个 provider 重试
  → 最多重试 2 次(request-retry: 2)

当前启用的 provider

Provider Model Key 数 状态
agnes agnes-2.0-flash 1 个真实 key ✅ 启用
yjjhwjw agnes-2.0-flash 1 个 key ✅ 启用
小水管user deepseek-v4-flash 等 1 个 key ✅ 启用
小水管claude deepseek-v4-flash 1 个 key ✅ 启用
SenseNova deepseek-v4-flash 1 个 key ✅ 启用

其他 provider 已 disabled。

最终批处理流程(10×10)

复制代码
pending/ 按 10 个一分文件夹
       ↓
调度器派发:一次派 10 个文件夹给 AI
       ↓
AI 启动 10 个子代理并发执行
       ↓
每子代理调 CPA(model=split-agent)
       ↓
CPA 轮询分配请求到不同 provider
       ↓
子代理完成 → 报告调度器 → 领下一批 10 个文件夹

注意事项

  • CPA 不做速率感知(不知道每个 provider 当前接近限速值),靠 429 冷却被动降级
  • 部分 Sensonova 模型(6.7-flash-lite)返回空内容,已在 CPA 配置中不列入
  • 如某 provider 反复失败,考虑在 CPA 中暂时 disabled
相关推荐
朝朝辞暮i6 小时前
VLA 系统学习第 3 课:从一次机器人示范,到真正送进神经网络的 Batch
人工智能·python·深度学习·神经网络·vla
Joy T6 小时前
Spring AI 接入已有 Java 项目的三种架构设计
java·人工智能·springai·ai入门·chatclient·ai service·ai能力接入
笨蛋©6 小时前
[实战] 扫描图纸转DXF:2026年制造业数字化图纸处理与GD&T识别实操指南
ai·数字化·cad·质量管理·制造业
m4Rk_6 小时前
【论文阅读】Agent 记忆机制(94):MemGen——在推理过程中动态生成并织入潜在记忆
论文阅读·人工智能·学习·开源·github
IT_陈寒6 小时前
Redis卡顿的锅,这次真不是大key的错
前端·人工智能·后端
小鹿的周先生6 小时前
第11章-Structured-Output
开发语言·人工智能·python
175******631736 小时前
灰片调色适合什么素材
人工智能
大模型真好玩6 小时前
从 SDK 到成熟智能体:拆解 LangChain、Pi、DeepSeek Harness、Claude Code的本质区别
人工智能·agent·deepseek
程序哥聊面试6 小时前
什么是 Sandbox?给 AI Agent 划一道安全边界
人工智能·安全
大虾别跑6 小时前
ai-daily-2026-10-08
人工智能·chatgpt