CPA-Auto池方案总结

CPA Auto API 池方案总结

2026/7/5

目标

  • 10 个子代理并发执行,每代理处理 10 个 job(一个文件夹)
  • 多个 API provider 自动负载均衡,不限速、不绑死

CPA 配置改动(已生效)

1. 路由策略:填充 → 轮询

yaml 复制代码
routing:
  strategy: "round-robin"       # 原 fill-first,现轮询分配
  session-affinity: false       # 关粘性会话,防止子代理绑死同一个 key

2. 实现逻辑

所有启用的 provider 的 model 统一命名为同一个名字(如 split-agent),子代理只调这个名字:

复制代码
请求 split-agent → CPA 轮询 → 依次分到 agnes → 小水管user → yjjhwjw → sensenova → ...

3. 请求失败时的 fallback 路径

复制代码
请求 A 失败(429/超时)
  → CPA 自动冷却当前 provider(disable-cooling: false 已开)
  → 轮询到下一个 provider 重试
  → 最多重试 2 次(request-retry: 2)

当前启用的 provider

Provider Model Key 数 状态
agnes agnes-2.0-flash 1 个真实 key ✅ 启用
yjjhwjw agnes-2.0-flash 1 个 key ✅ 启用
小水管user deepseek-v4-flash 等 1 个 key ✅ 启用
小水管claude deepseek-v4-flash 1 个 key ✅ 启用
SenseNova deepseek-v4-flash 1 个 key ✅ 启用

其他 provider 已 disabled。

最终批处理流程(10×10)

复制代码
pending/ 按 10 个一分文件夹
       ↓
调度器派发:一次派 10 个文件夹给 AI
       ↓
AI 启动 10 个子代理并发执行
       ↓
每子代理调 CPA(model=split-agent)
       ↓
CPA 轮询分配请求到不同 provider
       ↓
子代理完成 → 报告调度器 → 领下一批 10 个文件夹

注意事项

  • CPA 不做速率感知(不知道每个 provider 当前接近限速值),靠 429 冷却被动降级
  • 部分 Sensonova 模型(6.7-flash-lite)返回空内容,已在 CPA 配置中不列入
  • 如某 provider 反复失败,考虑在 CPA 中暂时 disabled
相关推荐
FellAveal1 小时前
【Transformer入门】从函数到Transformer
人工智能·深度学习·transformer
阳光开朗男孩1 小时前
Pytorch的安装与配置
人工智能·pytorch·python
ZeekerLin1 小时前
本体论Ontology在企业AI项目落地思考
大数据·人工智能·企业ai落地·本体论
RSTJ_16251 小时前
PYTHON+AI LLM DAY ONE HUNDRED AND THIRTY-TWO
人工智能
等一朵映山红1 小时前
动态图 vs 静态图:PyTorch 与 TensorFlow 架构底层对比
人工智能·pytorch·python
七夜zippoe1 小时前
基于 DolphinDB 构建全流程质量追溯体系:从原材料到成品的全链路追踪
大数据·人工智能·算法·全链路·dolphindb·质量追溯
向上的车轮1 小时前
GitHub Actions 自动化运维实战:Java + TypeScript 全栈项目 CI/CD 至阿里云
运维·自动化·github
szxinmai主板定制专家1 小时前
Zynq MPSoC半导体高精度运动控制方案|FPGA硬件插补实现亚微米级伺服实时控制
人工智能·嵌入式硬件·fpga开发·zynq·运动控制·ethercat
小园子的小菜1 小时前
大模型应用开发核心组件全解|从提示工程到向量数据库、Agent 落地
人工智能