没想到,同样是技术方案Review,Gemini 是这样,Codex却是。。。

背景

有个前端页面是AI生成的,十分臃肿,大概页面useState有十几个,行数一千行的样子(只是根组件),还有很多子组件。准备重构它。当然自己动手重构那是不可能的,还是交给AI来做

Claude Code 分析代码、产出重构文档

首先我还是让 Claude Code阅读代码,给我一个重构文档,我的prompt大概是这样的:

diff 复制代码
这个页面太复杂了, app/dashboard/page, 通读代码给我一个重构方案。

重构要遵循
- 单一原则
- 组件分层要清楚,分清楚是渲染组件还是容器等组件
- 公共组件封装
- 重复逻辑hook复用
- 可扩展,可维护。
- 等等

然后Claude Code就开始一顿操作了,最后产出了一份技术文档,嗯,确实很全,接近一千七百行

问题来了,这么长的文档也看不过来啊,主要还是不想看,那就交给AI吧。

Gemini 小试牛刀

首先出场的gemini-pro-2.5, 我在Gemini cli中让它review技术文档,我是这样提问的:

@docs/prd/FE_refactor_prd.md 我已经根据需求v1.0.2,完成了技术方案 @docs/tech/refactor/FE-refactor-dashboard-v1.0.2, 通读相关的代码,review我的技术文档是否有问题

我的天,Gemini几乎是秒回答的,它是这样回答的

好吧,我只看到了吹嘘,没看到任何有用的结果。我不甘心接着问:

你阅读相关代码了吗? 就做这个评价

这回它开始读代码了,但是时间也很快就给我答复了

呃,好吧,你是最棒的

智谱 glm-4.6 跃跃欲试

最近比较火智谱glm-4.6, 号称模型接近sonnet 4.0,让它也来试试。 我在Claude Code中使用智谱 glm-4.6, 同样的提示词:

@docs/prd/FE_refactor_prd.md 我已经根据需求v1.0.2,完成了技术方案 @docs/tech/refactor/FE-refactor-dashboard-v1.0.2, 通读相关的代码,review我的技术文档是否有问题

这是它的回答:

中规中矩吧,还不错,也认真读了现有的代码。总结了很多,也提出了一些问题。其他的也是一些表扬的话

Codex 低调登场

接着我用Codex,使用的模型是gpt-5-doex 的Medium,同样的提示词:

@docs/prd/FE_refactor_prd.md 我已经根据需求v1.0.2,完成了技术方案 @docs/tech/refactor/FE-refactor-dashboard-v1.0.2, 通读相关的代码,review我的技术文档是否有问题,中文回答

在思考了4分钟后,它给出了答案

简洁明了,没有任何恭维的话,直接列出问题

总结

gemini-2.5-pro令人失望,没有什么有价值的东西,就是一顿吹嘘。glm-4.6还行,中规中矩,谈不上出色。最后还是得Codex啊,结论中肯有用,没有额外花里胡哨的话

相关推荐
倔强的石头_12 小时前
不想每次都从头解释:我用 Doubao-Seed-Evolving 做了一个「稿件接力站」
ai编程
大模型码小白14 小时前
【Python零基础教程】继承、多态与魔法函数:面向对象编程三大核心特性详解
java·大数据·开发语言·人工智能·python·ai编程
-XWB-15 小时前
【LLM】Agent Planning 完全指南:8 种纯 LLM 范式 + 8 种混合规划模式详解(二)
人工智能·经验分享·aigc·学习方法·ai编程
沉默王二16 小时前
腾讯一面,我霸气反问:“你说你们在做Agent项目,说说 SubAgent、Plan 模式、Skill 调用这些你们都是怎么做的?”面试官一直在擦汗。。
面试·agent·ai编程
kyriewen16 小时前
我让AI改一个bug——它偷偷动了5个我没让它碰的地方
前端·javascript·ai编程
神奇霸王龙18 小时前
Claude Code屠榜:MiMo与Grok紧追Codex
服务器·网络·人工智能·gpt·ai·ai编程
z1234567898619 小时前
2026最新两款AI编程工具深度对比实测
java·数据库·ai编程
GeekArch20 小时前
第24讲:Vibe模式代码风格控制——适配Keil/STM32工程规范
人工智能·stm32·单片机·嵌入式硬件·mcu·决策树·ai编程
OpenTiny社区20 小时前
深度解析 LSP 如何为 AI 装上“眼睛”
前端·ai编程