别被那些“必装清单”骗了,我替你们踩完了 Codex Skills 的所有坑

前天下午,正搁那儿抓耳挠腮地调一个数据脚本,微信群里又弹出来一张制作精美的"Codex 必装十大 Skills 清单"。

好家伙,排版高级,Star 数亮眼,吹得天花乱坠。

我的第一反应是:得,又是熟悉的配方。

这半年来,类似的"必装指南"我没有看过一百,也看过八十了。每次兴冲冲地装上一堆,没过三天就因为各种报错、卡顿、或者干脆想不起来用,最后默默在终端里把它们全删了。

但这次有点不一样。

我盯着那张清单看了会儿,发现 Codex 的社区风向确实变了。以前大家用 Codex 都是"赤手空拳"地裸奔,全靠手写一堆又臭又长的 system prompt。现在,大家终于意识到,得给这头野马套上"工作流"的笼头了。

为了看看这些工具到底是不是花架子,我花了一整周时间,把清单上的 Skill 挨个装上,在实际干活的场景里暴力测试了一遍。

今天不吹不黑,直接给你们排个实战版的优先级。

第一档:天天上场,起死回生的"防呆底座"

这一档只有两个,但装上之后,Codex 的智商能直接上一个台阶。

1. Superpowers ------ 强行卡死流程的"严厉监工"

很多人推荐它时喜欢扯"测试驱动开发(TDD)"这种大词。

说白了,它的核心作用就是:别让 Codex 偷懒。

大模型有个毛病,你给它一个稍微复杂的任务,它为了图快,往往会自作聪明地直接甩给你一堆看起来很美、但一跑就报错的代码。

Superpowers 就像一个死板的监工。在 Codex 想要直接写代码的那一秒,强行把它按住:你必须先给我列出详细的步骤计划,必须先写好测试用例,通过了才能继续往下写。

现在写稍微复杂点的脚本,不挂着它,我心里真没底。

2. Planning with Files ------ 专治大模型健忘症的本地缓存

这是一个被严重低估的神器。

Codex 的上下文空间其实挺窄的,对话稍微多轮几次,它就会开始"选择性失忆"。

我前阵子清洗一份 10 万行的小红书竞品博主数据,Codex 总是自作聪明地把 user_id 里的前导零(比如 00123 变成 123)给格式化掉,导致跟 API 接口对不上。我纠正了三次,它第四次又偷偷改回去了,当时真的想摔键盘。

Planning with Files 的解决思路非常暴力:它把任务计划、当前进度、关键字段规则,实时保存为本地的 Markdown 文件。

Codex 每次干活前,强迫它先去读这个文件;干完一步,再把进度更新进去。

大模型会忘事,但本地的 Markdown 文件不会。有了这个外挂,它终于能处理长线任务了。

额外补充:不写代码时,我用它来解决出图焦虑

说实话,我平时用 Codex,除了写写脚本,大部分时间都在跟内容死磕。

如果你跟我一样,做自媒体、搞副业,或者日常要帮公司运营账号,其实没必要死盯着开发工具。我最近发现了一个专门干内容生产的实战派 Skill,直接解决了我的出图焦虑。

这就是 红鸦小红书图文 Skill

它是干什么用的?

这个 Skill 在系统里的标识是 redya-xiaohongshu,由红鸦 AI 提供。你可以把它直接装进 WorkBuddy、Codex、Claude Code 或者 Cursor 里。

它的逻辑很简单:你给它一个主题,它帮你把小红书的爆款标题、发布正文、每一页的图片提示词(Prompt)全部生成出来,然后直接在后台帮你批量合成整套精美的图片。

不管是普通图文、知识科普,还是带货图文,它都能搞定。

想看源码或者了解更多,可以去他们的 GitHub 仓库瞧瞧: https://github.com/rnthking/redya-skills

怎么用?其实就三步

首先,你得去拿个 API 凭证。

拿到 Key 之后,安装不需要你手动去配。把下面这段配置直接丢给你的 Agent(不管是 WorkBuddy、Codex 还是 Cursor),它自己就会去检测环境、写入并验证:

ini 复制代码
请帮我安装「红鸦小红书图文」能力到当前 AI 环境:

1. 下载 https://hy.ithinkai.cn/openapi/skill.md 的内容,保存为 ~/.claude/skills/redya-xiaohongshu/SKILL.md
2. 设置环境变量 REDYA_API_KEY=rk-你的APIKey
3. 设置环境变量 REDYA_BASE_URL=https://hy.ithinkai.cn

![把安装任务交给 Agent](https://mmecoa.qpic.cn/sz_mmecoa_png/icQRajV2qID072cDniabtiatGZwrwW7bljtKribZ6KbTVXxmQtgM5IRLociaq9CDFBzBgERRO4ic0OyP6TqgTdPubPpN1496yricjsf5EMZK0avjz8/640?wx_fmt=png&from=appmsg&tp=wxpic&wxfrom=10005&wx_lazy=1#imgIndex=5)

装好后我要用它生成小红书图文笔记。

装好之后,怎么调用就看你习惯了。

我一般喜欢"先看大纲再出图"。让 Agent 先把标题、正文和每张图的画面构想列出来,我微调一下,觉得没问题了,再让它批量出图。

当然,如果你赶时间,也可以直接给它一个主题,让它一口气把文案和图全部搞定。

嫌命令行麻烦?它还有网页端

如果你不喜欢在黑乎乎的终端里敲命令,直接登录红鸦 AI 的网页端就行。

在网页端,你可以像编辑文档一样,在线修改生成的标题、正文,调整每页的图片提示词,然后再一键批量生成图片,可视化操作更直观。

对于做电商带货的朋友,它还有一个"商品图文模式"。

你可以先建个商品档案,把真实的商品图传上去。这样 AI 在生成小红书配图时,就会参考这些真实的商品细节,不会出现"图文不符"或者画面细节对不上的尴尬情况。

最爽的是,不管是终端调用还是网页端操作,消耗的都是同一个账号的积分。

所有的生成结果都会保存在"我的创作"里,你随时可以在终端写完大纲,再去网页端精修图片,两边数据是通的。

想在终端直接调用的,就去装 redya-xiaohongshu;喜欢可视化编辑的,直接用网页端,怎么顺手怎么来。

第二档:特定场景下的省时利器

这一档的工具不需要天天挂着,但在特定任务下,确实能帮你省下不少时间。

3. SuperClaude Framework ------ 常用命令的快捷弹药库

它把一堆常用的 Prompt 浓缩成了简单的斜杠命令。比如 /analyze(分析)、/refactor(重构)、/explain(解释代码)。

刚装上的前几天觉得爽翻了,但时间一长,三十多个命令根本记不住。最后真正沉淀进我肌肉记忆的,也就两三个。不过,光是这几个常用命令,每天也能帮我省下不少反复敲 Prompt 的时间。

4. Anthropic Official Skills ------ 官方出品的"教科书"

这个官方 Skill 包最核心的价值,其实不在于它能帮你干什么。

而是如果你打算自己写个特定场景的 Skill,别去看网上的杂牌教程,直接去读这个包里的源码。代码写得非常规范,我后来自己写的一些小工具,底层的骨架基本上都是从这里抄来的。

5. Vercel Agent Skills ------ 前端开发的防呆墙

如果你经常需要让 Codex 写前端页面,这几乎是必装的。

它会自动用 Vercel 内部审查 React 代码的规则去过滤一遍。挂上它之后,Codex 写出来的代码明显规整了很多,至少不会再犯一些让专业前端看了血压飙升的低级错误。

第三档:概念很新,但目前还挺鸡肋

这一档的工具,名气很大,但实际用起来,体验只能说一言难尽。

6. MiniMax Skills ------ 工业级的流程卡片

它更像是一个标准化的工业级模板库,涵盖了整套开发流程。

我试着跑过两次,输出的规范性确实很强,连 README 都写得挑不出毛病。但对于个人开发者或者写小脚本的人来说,它太重了,日常根本用不上。

7. Context Engineering Skills ------ 让 Agent 自己整理记忆

这个工具的设计很有意思,试图教会 Codex 自己去管理和优化上下文。

但在实际体验中,它的存在感极低。你不会觉得 Codex 突然变聪明了,可能只有在跑一些超大型项目时,它才能在后台默默发挥点作用,新手完全可以忽略。

8. Composio Skills ------ 看起来很美,用起来很累

它的定位很宏大:让 Codex 去调用各种外部服务。

愿景很美好,但现实很骨感。目前生态的兼容性差强人意,我尝试调用的外部服务里,有一半以上都因为权限或者版本冲突报错。它代表了未来,但显然不是现在。

写在最后:别把你的 Agent 塞成"胖子"

听我一句劝,别去 GitHub 照单全收。

我见过不少人,电脑里密密麻麻装了三十多个 Skill,结果每次启动 Agent 光是加载这些插件就要卡上好几秒。更糟糕的是,工具装得太多,Agent 在干活前光是"纠结该用哪个工具"就要消耗大量的 Token,甚至还会出现指令冲突。

给 Agent 装工具,越克制,它反而越专注。

先把 Superpowers 和 Planning with Files 装上,用一个星期,如果你的 Agent 还没开始变聪明,再考虑去装别的。

至于哪一件最合身,别光听别人吹,自己去试一试,你的身体自然会给出答案。

相关推荐
张申傲1 小时前
拆解 harness9(9):Observability 可观测性
人工智能·aigc·agent·deepseek·harness
李剑一2 小时前
瑞幸也AI上了?我用AI命令行帮我点了一杯咖啡,但是我花了不止一杯咖啡钱
aigc·openai·ai编程
武子康2 小时前
Copilot Code Review 从固定 Reviewer 演进为可编程 Runtime,仓库控制面、Setup 供应链、Runner 资源和 MCP 工具同时被纳入审查决策
人工智能·github·aigc
K姐研究社3 小时前
Codex 怎么用国产模型?Kimi + CC Switch 接入配置指南
人工智能·aigc
wangruofeng12 小时前
姚顺雨长谈:在 Anthropic 和 Gemini 训练模型,英雄主义已经过时
llm·aigc
-XWB-14 小时前
【LLM】Agent Planning 完全指南:8 种纯 LLM 范式 + 8 种混合规划模式详解(二)
人工智能·经验分享·aigc·学习方法·ai编程
爱听歌的周童鞋16 小时前
霹雳吧啦Wz | AIGC | 图像生成篇 | DDPM介绍与公式推导 | 笔记 | (二) 优化目标引入 ELBO/VLB
aigc·diffusion model·ddpm·reverse process·image generate·forward process
-XWB-21 小时前
【 LLM】Agent Planning 完全指南:8 种纯 LLM 范式 + 8 种混合规划模式详解(一)
人工智能·aigc·学习方法·ai编程
TheBestRucy21 小时前
RAG知识库问答系统落地:从向量检索到上下文增强的全链路实践
人工智能·python·langchain·aigc·交互