半年 20 万 Star 的「反 Vibe Coding」:Matt Pocock 是如何用一套 Skill 驯服 AI 编程代理的

适合人群:正在用 Claude Code / Codex 等 AI 编程代理做真实项目,却总觉得它「没听懂人话」的工程师。

阅读收获:了解 mattpocock/skills 是什么、为什么火,以及它和流程管控派(superpowers)在设计哲学上的根本分歧。

01 · 一个被误解 60% 的「数据迁移脚本」

先还原一个真实场景------

你让 Agent 写一个「数据迁移脚本」,它信心满满地交出一坨代码。

跑了一半你才发现:它理解的「迁移」,和你脑子里的「迁移」,根本不是一回事。差了 60%。

不是模型笨,是「对齐」断了。

这正是 AI 编程时代最隐蔽的坑:模型能力已经够强,但你和它之间的理解,常常是错位的。

你以为它懂了,它以为你懂了,最后成品一塌糊涂。

02 · 流程管控的解法,为什么让 Matt Pocock 不满意

市面上为这个问题诞生了不少「流程管控」方案------GSD、BMAD、Spec-Kit。

它们的思路高度一致:

  • 接管整个开发流程
  • 用层层关卡逼 Agent 按规矩办事
  • 用「过程正确」换「结果可靠」

听起来很美,但 Matt Pocock 指出了这套路线的代价:

这些方案在「拥有流程」的同时,也拿走了你的控制权------而且流程本身的 bug,极难排查。

于是 Matt 反其道而行。

他不接管流程,只丢给你一包又小、又容易改、可自由组合的 Skill。

这就是 mattpocock/skills

03 · 作者是谁?TypeScript 圈的「布道者」

如果你写过 TypeScript,大概率绕不开 Matt Pocock 这个名字。

三个标签快速认识他:

  • Total TypeScript 课程作者
  • 前 Vercel 工程师
  • YouTube 频道 10 万+ 订阅,被社区称作「TypeScript 布道者」

靠着「TS 错误翻译器」和各类类型体操教学,他几乎撑起了英文社区 TS 教学的半边天。

04 · 他做了一件朴素到极致的事

2026 年 2 月 3 日,Matt 做了一件简单到近乎朴素的事:

把自己每天真实在用的 .claude 目录,直接推上了 GitHub。

仓库名叫 skills,介绍只有一句------「Skills For Real Engineers」(给真·工程师用的 Skill),口号更是直白:

my agent skills that I use every day to do real engineering ------ not vibe coding. (我每天用来做真工程的 Skill,不是 Vibe Coding。)

05 · 流行度:半年 20 万星的「现象级」

这套 Skill 的蹿红速度,夸张到让人怀疑真实性:

  • 半年 20 万+ Star ------ 2 月 3 日创建,8 月 5 日发布 v1.2 时 Star 已破 20.5 万 ,Fork 接近 1.8 万
  • 稳居最火的 Claude Code Skills 合集之一,常年霸榜 GitHub Trending
  • 作者维护着约 6 万订阅的 newsletter,专门推送 Skill 更新
  • 招牌 Skill /grill-me 累计下载量破 87 万次

一句话概括:

这是目前生态里最火的「个人 Agent Skills 集合」之一。

06 · 核心理念:小、可组合、信任模型

Matt 在设计上的几个关键词,直接决定了这些 Skill 长什么样:

  1. Small(小) ------ 每个 SKILL.md 都很精炼,只讲清「什么时候用 + 怎么做」
  2. Easy to adapt(好改) ------ Skill 就是普通 Markdown 文件,可以直接 fork、改写
  3. Composable(可组合) ------ 松耦合,按「谁调用」分两层,不搞强捆绑
  4. Works with any model(模型无关) ------ 不绑定 Claude,Codex / Gemini 都能用

而最反直觉的一点,是它把「信任」交还给了模型本身

Matt 不像流程管控派那样,用 Hooks、命令、卡点去「锁死」Agent 的每一步。

他相信:只要给模型足够清晰的「纪律指引」,一个够强的模型自己就能走对。

所以他的 Skill,更像「教练给的动作清单」------而不是「工头手里的鞭子」。

07 · 30 秒装完:两条路,两种哲学

安装方式本身就体现了他「不锁死」的态度。

方式一:订阅式(Claude Code 插件)

bash 复制代码
claude plugins install mattpocock-skills

或会话内直接:

bash 复制代码
/plugin install mattpocock-skills

已进入 Claude Code 官方 marketplace,只读、自动更新------你是在「订阅」,不是在「fork」。

方式二:可编辑式(skills.sh / npx,适合爱折腾的人)

bash 复制代码
npx skills@latest add mattpocock/skills

会把 Skill 作为你自由拥有的普通文件写进仓库,还能勾选要哪几个、装到哪个 Agent。想同步作者更新时:

bash 复制代码
npx skills update

装完每个仓库跑一次 /setup-matt-pocock-skills,配好 issue 追踪器、triage 标签、文档路径即可开工。

提醒:两种方式二选一,别都装,否则每个 Skill 会重复出现两份。

08 · Skill 全景:分两层,各司其职

这套 Skill 有个很聪明的切分------按「谁能触发」分成两类:

  • User-invoked(用户触发) :只能你手动敲 /xxx 唤起,负责「编排」工作流
  • Model-invoked(模型触发) :你可以敲,Agent 判断任务合适时也能自动伸手去拿,承载「可复用的纪律」

工程类核心 Skill:

Skill 作用 类型
/grill-me 像不依不饶的面试官,追着你问,直到需求每个分支都问清 用户触发
/grill-with-docs 追问的同时,帮你建立项目的「共享语言」(CONTEXT.md / ADR) 用户触发
/to-spec 把当前对话合成一份 spec,发布到 issue 追踪器 用户触发
/to-tickets 把计划拆成带「阻塞边」的 tracer-bullet 任务 用户触发
/implement 按 spec/tickets 推进,驱动 TDD,收尾先过 code-review 用户触发
/tdd 红-绿-重构循环纪律,教你什么测试好、什么测试烂 模型触发
diagnosing-bugs 分阶段调试纪律:变红→最小化→假设→埋点→修复→回归 模型触发
code-review 双轴审查:标准轴 + 规格轴,跑并行子 agent 模型触发
improve-codebase-architecture 扫描代码库找「可加深」模块,生成可视化报告 用户触发

生产力类还有 /handoff(对话压缩成交接文档)、/teach(多会话教学)、/wait-what(怀疑没听懂时重新解释)。

09 · 三个有说服力的实践案例

案例一:共享语言,句句省钱。

Matt 自己仓库的例子------把「课程某个 section 里的 lesson 被'落地'到文件系统」这种啰嗦表达,压缩成一个领域术语:

materialization cascade(物化级联)

一句压缩掉 20 个词的冗余。每个会话都在省 token、省思考,变量 / 函数 / 文件命名也跟着统一。他称这是「可能是整个仓库最酷的技巧」。

案例二:grilling,先对齐再动手。

招牌 /grill-me 之所以爆火,是因为它把「沟通鸿沟」做成了产品:

Agent 不停追着你问「为什么」「如果这样呢」------直到你俩对需求的理解完全一致,才动手写代码。

案例三:TDD 救回「会跑但不靠谱」的代码。

Agent 写出的代码「能跑但质量拉胯」,本质是缺反馈回路/tdd 逼 Agent 先写失败测试再修复,让每一步都有持续反馈,产出质量肉眼可见地变好。

10 · 和 superpowers:两条路线,两种哲学

这是理解 mattpocock/skills 最关键的一块。

obra/superpowers 由 Jesse Vincent(obra)开发,站在「流程管控」的另一端:约 24.5 万星,内含 14 个核心 Skill辅以 Hooks 和 Commands,支持 Claude Code / Cursor / Codex / Gemini 等 7+ 平台。

其核心理念是:用苏格拉底式头脑风暴 + 工程纪律流水线,「强制执行」开发流程。

一图看懂两者分歧:

维度 mattpocock/skills obra/superpowers
哲学 信任模型,给「指引」而非「锁死」 管控流程,Hooks/Commands 强制执行
体积 SKILL.md 极薄,聚焦单一动作 每个 Skill 附带 Hooks、Commands,流程厚重
组织 按触发方分层,松耦合可组合 强流水线,环环相扣
入口 碎片化,用哪个敲哪个 类「全套流水线」,入口统一
可定制 强调「改成你自己的」 偏「方法论 + 框架」,调整成本更高
信任模型 高------相信模型自己走对 低------相信流程卡点能兜底

一句话总结:

superpowers 是「工头 + 流水线」,mattpocock/skills 是「教练 + 动作清单」。

前者靠流程兜底,适合规范落地的大团队;后者靠模型能力,行数更少、上手更快、更好二次改造

没有绝对优劣,看你要解决的问题偏向哪一端。

11 · 三个最常见的坑

误区 真相 正确姿势
装完就万事大吉 还需 /setup-matt-pocock-skills 配置才发挥 每仓库配一次追踪器/标签/路径
两种方式一起装更全 插件与 npx 会重复安装 二选一
SKILL.md 越厚越权威 Matt 反其道,靠「薄」取胜 先跑熟原版,再定制

另一层提醒: 如果你需要的是「强流程兜底」,它恰恰不锁流程------这时可考虑 superpowers,或二者结合。

写在最后

mattpocock/skills 的价值,在于把「真工程师的纪律」,用一套又小、又松、可自由组合的 Skill 装进 AI 代理,而不是靠流程去锁死它。

它火,是因为它精准地戳中了 AI 编程的真痛点------

不是模型不够强,而是「对齐」和「反馈回路」断了。

如果你受够了 Agent 的「自嗨式 Vibe Coding」,不妨先装一个 /grill-me 试试。

被它像面试官一样追着问几轮,你大概就会理解:

有时候,最好的工具不是替你做决定,而是逼你把需求说清楚。


相关资源

参考来源

相关推荐
yuhulkjv3351 小时前
Gemini鸿蒙版导出word格式的终极解法:AI 导出鸭如何重构AI内容落地链路
人工智能·ai·word·harmonyos·ai导出鸭
雪的季节1 小时前
OPENCV学习(补充1)
人工智能·opencv·学习
9i编程1 小时前
四大准则也还是不靠谱啊:定好了铁律,AI 照样偷懒给你看
人工智能·openai·ai编程
狂僧1 小时前
从 Markdown、Wiki 到 AI 知识库:本体与知识图谱到底处在哪一层?
人工智能
lf13210271 小时前
用 JSON Schema 管装修节点记录:从照片台账到可校验工程数据
网络·数据库·人工智能·经验分享·物联网·json·智能家居
watersink1 小时前
机器学习XGBoost
人工智能·机器学习
新知图书2 小时前
7.2 上下文记忆的优化与重整合(智能体工程)
人工智能·agent·ai agent·智能体
watersink2 小时前
机器学习极大似然估计与EM算法
人工智能·算法·机器学习
叠层归一研究院2 小时前
如何用程序搭建一个 AGI 种子系统(一):从向量种子到无限生长引擎
人工智能·python·算法·机器学习·agi