CPA-Auto池方案总结

CPA Auto API 池方案总结

2026/7/5

目标

  • 10 个子代理并发执行,每代理处理 10 个 job(一个文件夹)
  • 多个 API provider 自动负载均衡,不限速、不绑死

CPA 配置改动(已生效)

1. 路由策略:填充 → 轮询

yaml 复制代码
routing:
  strategy: "round-robin"       # 原 fill-first,现轮询分配
  session-affinity: false       # 关粘性会话,防止子代理绑死同一个 key

2. 实现逻辑

所有启用的 provider 的 model 统一命名为同一个名字(如 split-agent),子代理只调这个名字:

复制代码
请求 split-agent → CPA 轮询 → 依次分到 agnes → 小水管user → yjjhwjw → sensenova → ...

3. 请求失败时的 fallback 路径

复制代码
请求 A 失败(429/超时)
  → CPA 自动冷却当前 provider(disable-cooling: false 已开)
  → 轮询到下一个 provider 重试
  → 最多重试 2 次(request-retry: 2)

当前启用的 provider

Provider Model Key 数 状态
agnes agnes-2.0-flash 1 个真实 key ✅ 启用
yjjhwjw agnes-2.0-flash 1 个 key ✅ 启用
小水管user deepseek-v4-flash 等 1 个 key ✅ 启用
小水管claude deepseek-v4-flash 1 个 key ✅ 启用
SenseNova deepseek-v4-flash 1 个 key ✅ 启用

其他 provider 已 disabled。

最终批处理流程(10×10)

复制代码
pending/ 按 10 个一分文件夹
       ↓
调度器派发:一次派 10 个文件夹给 AI
       ↓
AI 启动 10 个子代理并发执行
       ↓
每子代理调 CPA(model=split-agent)
       ↓
CPA 轮询分配请求到不同 provider
       ↓
子代理完成 → 报告调度器 → 领下一批 10 个文件夹

注意事项

  • CPA 不做速率感知(不知道每个 provider 当前接近限速值),靠 429 冷却被动降级
  • 部分 Sensonova 模型(6.7-flash-lite)返回空内容,已在 CPA 配置中不列入
  • 如某 provider 反复失败,考虑在 CPA 中暂时 disabled
相关推荐
johnsong2 分钟前
效率的边界:当推理突破遇见语言革命
人工智能·语言模型
染指11103 分钟前
119.Agent-LangChain核心组件-Runtime运行时
人工智能·langchain·agent
DevNo9 分钟前
英文会议音视频转中文纪要:我近期的几款工具使用记录
人工智能
别动我齐刘海12 分钟前
ROS2 Jazzy + C++ 实战路线——基础学习2
c++·人工智能·vscode·python·学习·机器学习·机器人
江苏久众新视18 分钟前
SOP-AI视觉检测实战:从“专人专用”到“产线普适”的工程落地分享
人工智能·视觉检测
科技研学社22 分钟前
自动化缝制升级:支撑产业海外转移,降低建厂用工门槛
人工智能·自动化
m0_4626052225 分钟前
大模型实战营week7
人工智能
adinnet202626 分钟前
Neo4j 凭什么叫原生图数据库?Cypher 查询能做什么
大数据·人工智能
小猿君40 分钟前
Claude 入口砍到只剩一个,GPT-6 已经能自己连干 24 小时
人工智能·chatgpt·agi
goujunwe43 分钟前
从效果衰减到稳定增长:GEO 常态化运维实战指南
人工智能