8月31日,三个模型的"到期日"撞在了同一天。
早上九点的时候,我在群里看了一张截图:Kimi k2.5 和 moonshot-v1 今天正式下线,GPT-5.4 也从 ChatGPT 登录的 Codex 里消失了,而 Claude Sonnet 5 的"首发价"到底是今天到期还是已经永久,不同网站上写着两个版本。
"这哪是写代码,这是在追更。"
模型不是装上就能用三年的基础设施,而是带保质期的消费品,而且保质期还爱扎堆。
三个到期日,同一天到账
8月31日这天至少三件事同时落地。
第一是 Kimi。官方文档写得清楚:kimi-k2.5 和 moonshot-v1 全系列今天停止服务,迁移目标是通用场景切 kimi-k3,写代码切 kimi-k2.7-code。问题是很多老项目里还埋着 moonshot-v1-8k、moonshot-v1-128k 这些字符串,没到期前谁都想不起来。
第二是 OpenAI Codex。从今天开始,用 ChatGPT 账号登录的 Codex 不再提供 GPT-5.4 和 GPT-5.4 mini,替代的是 GPT-5.6 Terra 和 Luna。只是"ChatGPT 登录"这条路断了,用Key直连的那条路还能走。一批用惯了零配置入口的开发者,今天突然要决定要不要上个正式Key。
第三是 Claude Sonnet 5 的价格。这里反而成了罗生门。官方在8月10日更新过文档,说原本9月1日到期的首发价已经永久化。但包括AI Tools Recap、flatkey.ai在内的几家价格追踪站,到今天仍在写"Sonnet 5 即将涨价"。你可以理解为信息滞后,也可以理解为:当官方自己都改过一次口径后,生态里没有人能确定该信哪一版。
比到期更累的,是"被美化"的到期
同一天公布的还有限额调整。官方说9月14日起每周限额永久提高25%。听着像福利,但算一笔账就知道怎么回事------原本基准是100,5月以来临时给到150,9月14日之后变成125。相对老基准确实是+25%,相对你现在用习惯的150,其实是-17%。官方后来把原帖删了重发,补上了"相对今天减少17%"这句话。
这种"用旧基准说增长"的话术提醒我们:读公告时,不能只看百分比,得看分母。
OpenAI也在同一天暴露了另一个隐形成本。Codex负责人宣布修复了8类异常消耗额度的Bug,包括任务目标机制失控能吃掉单周70%额度、后台Memory Worker极端情况下重复检查15000次、子进程私自升级高价模型等等。修完之后,同等额度能多撑10%到50%。这等于反向证明:过去几个月很多人的账单里,有相当比例不是模型在真的干活,而是在为Bug买单。
把"到期日"当成工程问题来管
三件事加在一起,事实很清楚:大模型不是一次接入就永久可用的水电煤,而是一堆会过期、会改入口、会偷偷调整计费口径的服务。个人开发者和小团队最吃亏的地方在于,没有专门的运维去盯这些变更。
比较现实的应对方式有三点:模型字符串不要写死,抽成配置而不是散落代码;自己维护一份"到期日历",以官方更新日志和价格页为源,第三方价格站只能当参考;给调用加预算硬上限和模型降级策略,主模型涨价、下线或限额收紧时自动切备选,而不是等报错或账单爆炸。
说到底,8月31日不是一个孤立事件。后面排着的是10月24日DeepSeek老版本下线,11月21日GPT-5.6促销价到期,以及谁也不知道哪天会变的下一个"永久价格"。
把多家厂商的模型入口、到期时间、价格窗口和备选路由都摊到一张可视图里,比每次手动改代码从容得多。
最近接触到一个叫 EasyAPI 的工具,做的就是这件事------把各家模型接口统一成一套标准,到期迁移、模型降级、预算上限这些事都可以在控制台配置,不用每次改代码。不是帮你省一次钱,而是让你不用在每个到期日都手忙脚乱。
