gpt-5.6-luna 频繁 429 但 gpt-5.5 正常怎么办?不是配额问题,是 luna 独立的并发 session 限速桶上周三我在跑一个批量摘要任务,把模型从 gpt-5.5 切到 gpt-5.6-luna,代码一行没改,结果 429 错误持续涌现。查了半小时余额、查了半小时 Tier 等级,最后才发现:luna 的限速机制跟 gpt-5.5 完全不一样——gpt-5.5 按 token/min(TPM)计,luna 按并发 session 数计,重置窗口也从 60s 变成了 30s 滑动窗口(个人实测值,非官方文档值)。 你的 429 大概率不是"请求太快",而是"同时在飞的请求太多"。下面把排查路径、Retry-Aft