我同时在用的 AI Coding Agent 和模型评测,cc/gpt/antigravity(2026.08)
工作原因,我每天同时开着好几个 AI 编程 Agent 干活。用了这么久,每个工具都有点心得体会,简单聊聊。
Claude Code:慢是真慢,强也是真强
Claude Code 还是王者,没得说。
面对复杂问题,它定位 Bug、跨模块重构、长上下文关联这些场景,准确率一直是第一梯队。别的工具搞不定的问题,丢给它,基本能慢悠悠的稳稳解决。
缺点就一个字:慢。
不管选 Fable 5 还是 Opus 5,终端里那个转圈能把你急死。主要是 Claude Code 自己设计上验证环节太多了,各种自动检查、轮询,流程,随便一个问题就要30m起步。
所以它最适合的场景就是:丢一个复杂需求给它,然后切出去干别的,半小时后回来看结果。
模型上我个人体感:Fable 5 > Opus 5,推理严密程度和上下文保持都稍好一些。
ChatGPT:最接近 Claude Code 的存在,但重置额度很难评
前阵子我觉得 ChatGPT 已经超越 Claude Code 了,最近又感觉还差那么一点距离。
但说句公道话,它仍然是目前最接近 Claude Code 的 Agent,而且比 Claude Code 快很多。吐字速度、响应速度都好一截。
就是额度这块最近挺烦的,感觉官方在悄悄缩减额度,全靠刷新续命。
模型选型上我有明确分工:
- 复杂工程直接上 5.6 Sol Max
- 日常开发 Medium 就够了
- 省 Token 用 Terra,勉强能用
最好别用 Luna 虽然价格白菜,但智力也白菜,跑了几次感觉还不如 DeepSeek v4 Pro,又呆又笨,避坑。
Antigravity:曾经的三剑客,如今菜得发昏
不客气地说,Antigravity 无愧"美国豆包"的称号。
曾经的三剑客已经彻底陨落了,现在稍微复杂一点的任务就开始犯迷糊。基本上只能做点简单修改、UI 调整之类的活。
唯一的优点:快,加上同套餐下额度最大。简单粗活用它还行,别的就算了。
Trae CN 企业版:简单需求凑合用
最近试了几趟 Trae CN + GLM 5.2 的组合,简单需求能按部就班完成,流程固定的代码补全还行。
但复杂场景就暴露了,感觉还不如我自己写的 Agent 灵活。想靠它扛核心工程,目前还不太现实。
并且国产的qoder/work buddy都简单的试用了下,可能表现最好的是qoder?
Pi.dev:急性子的救星
最近非常喜欢用 Pi.dev。
看惯了 Claude Code 转圈,Pi.dev 那种几乎零延迟的吐字简直太舒服了。急性子用它,幸福感拉满。
特别是 Pi + DeepSeek v4 (grok) 的组合,快得像闪电一样。
虽然它在超高难度任务上不如 Claude Code 周全,但做快速验证、轻量编写、实时对话,体验非常好。
总结
简单总结一下,目前我复杂问题就会给cc来做规划,然后给其他稍微次一点的模型来实现,做完之后再让cc来review,这样会省下来一些token,而且整体速度也会提升一些。
第二主力就使用chatgpt,简单的小任务就用 pi + ds v4/mimo v2.5 pro。
目前来说,这套组合是非常适合我的,兼顾了我各个场景的需求。