技术栈
prompt缓存
Patrick在香港
15 天前
python
·
prompt
·
claude
·
成本优化
·
prompt缓存
·
anthropic api
Claude Prompt Caching 实测账单:第一轮贵 25%,从第二轮开始省 86%
API 涨价的讨论很多,省钱手段的实测账单很少。这篇用官方倍率把 Prompt Caching 的账逐轮算给你看:4k token 的固定系统提示,5 轮对话,不开缓存累计 27000 个相对成本单位,开了缓存只要 9170,省 66%。但第一轮单看是 贵 25% 的——缓存写入按 1.25 倍计费,不是免费午餐。
bryant_meng
20 天前
chatgpt
·
线程
·
压缩
·
codex
·
prompt缓存
【Codex】Part 18 — Codex Context Lifecycle Management
摘要:上下文(Context)是模型在当前推理中能够看到的信息,不等同于线程记录、项目文件、记忆或 Git 工作区。理解“信息如何进入上下文、怎样增长、何时压缩、哪些状态必须落盘”,才能让 Codex 稳定完成长任务。
我是有底线的