AI Coding 最大的 token 黑洞,可能根本不是 prompt

我最近才意识到:

AI Coding 最大的 token 黑洞,可能根本不是 prompt。

而是 shell output。

Claude Code / Cursor 在长时间 agent session 里,会不断读取:

  • git log
  • npm install
  • cargo build
  • docker logs

这些 CLI 输出很多都是"人类都不会认真看"的噪音,但模型会把它们重新塞进 context。

结果就是:

你在花钱让 LLM 重复阅读终端垃圾信息。

最近看到一个很有意思的项目:

lean-ctx(GitHub 已经 1.7k⭐)

它做的事情其实很简单:

在 AI Agent 和代码仓库之间加一层 context optimization。

核心包括:

• 压缩 shell 输出

• AST / Tree-sitter 分析代码结构

• 缓存重复上下文

• 只给模型真正相关的代码片段

官方数据里提到:

  • token reduction 可达 60--95%
  • cached re-read 最低只需要十几个 token
  • 支持 Claude Code、Cursor、Codex、Windsurf 等 Agent

但我觉得最有意思的不是"压缩文件读取"。

而是:

它终于开始优化 CLI output 了。

现在很多 AI Coding 工具都在做 RAG、memory、prompt engineering。

但真正疯狂烧 token 的,

往往是那些没人关注的终端日志。

AI Coding 下一阶段,

可能已经不是 "更强模型" 竞争了。

而是:

谁能更高效地管理 context。

相关推荐
雪隐22 分钟前
个人电脑玩AI-13让5060 Ti给你打工——我用 0.9B 小模型终结了"谁来记会议纪要"这个世纪难题
前端·人工智能·后端
橘子星25 分钟前
我一个前端切图仔,凭什么能在浏览器里跑大模型?
前端·javascript·前端框架
70asunflower30 分钟前
初学者理解 Web 工作原理(完全教程)
前端
爱勇宝33 分钟前
《道德经》第 7 章:真正厉害的领导者,不抢主角
前端·后端·程序员
观远数据34 分钟前
Excel到数据资产池:文件数据入湖的治理规范怎么建
前端·javascript·excel
CoderWeen35 分钟前
我写了个能一步步点着看的 Dijkstra 可视化项目(Vue3 + Leaflet + Generator)
前端·javascript·vue.js
两点王爷1 小时前
一个快速加载面和多面数据的html测试页面(可以导出geojson数据文件)
前端·html·gis
热爱前端的小张1 小时前
第四章 接口和类型兼容性
前端
hunterandroid1 小时前
[鸿蒙从零到一] HarmonyOS 资源管理与多语言适配实战
前端
用户69371750013841 小时前
Claude Code终端日志Token占用实测:一个过滤器砍掉60%-90%
android·前端·后端