GPT 返回 429 ,意思是:请求太多,或者额度不够,被限流了。
常见原因主要有这几种:
-
请求频率太高
- 短时间内发送了太多请求
- 并发数过高
- 超过 RPM(每分钟请求数)或 TPM(每分钟 Token 数)
-
账户余额或额度不足
- API 余额用完
- 月度消费上限到了
- 中转平台账户余额不足
-
模型限额
- 某个模型单独有限速
- 新账号或低等级账号额度较低
- 上游渠道当前用户太多
-
中转平台渠道拥堵
- 你使用 New API、Sub2API 或其他中转时,上游 Key 被多人共用
- 渠道配额耗尽或并发已满
常见报错内容对应关系:
text
Rate limit reached
表示请求太快,需要降低并发或稍后重试。
text
insufficient_quota
表示余额、额度或配额不足。
text
Too many requests
表示同一时间请求数量过多。
处理方式通常是:
- 降低并发数
- 请求失败后等待几秒重试
- 使用指数退避:1 秒、2 秒、4 秒、8 秒
- 检查 API 余额和消费上限
- 更换可用渠道或 API Key
- 检查中转平台的模型倍率、渠道状态和用户额度
例如代码里不要立即无限重试,而是:
python
import time
for attempt in range(5):
try:
response = call_gpt()
break
except RateLimitError:
time.sleep(2 ** attempt)
429 本身不代表接口地址写错。 地址或鉴权错误通常是 400、401、403;429 更偏向于频率、并发、余额或渠道配额问题。
