
一个月前,我写过一篇关于 Loop Engineering 的文章:《Harness 还没学会,又来了个 Loop Engineering ?》
Coding Agent 已经能自己写代码,但 App / Web 的产品验证,往往还靠如人肉测试。
当时我们做的 Munk AI,定位很清楚------AI 引擎,把真机、浏览器上的验证接进 Coding Loop。
但,那只是验证这一环。
要让一条需求自己跑起来,还缺整条链路:接住需求、改代码、过检查、部署、验证、失败再修、最后写回本地。

Cursor 之类的 VS Code 编程工具,要落地 Loop Engineering,障碍还是太多。毕竟它们都不是为了 Agent 编排而设计的。
于是,我就自己做了一个 Agent 编排引擎,名字还是 Munk AI,这次是桌面端 App。
Munk AI 与 Munk Test
| 名字 | 定位 |
|---|---|
| Munk AI | 桌面应用:把研发工作跑成完整闭环 |
| Munk Test | 原 Munk AI CLI:产品验证引擎,内置于桌面端 |
以前叫「Munk AI」的那套 CLI,现在改称 Munk Test:仍在真机与浏览器上跑验证,给出通过 / 不通过,以及可回传的证据。
桌面端沿用 Munk AI,负责把整条交付链路串起来。
你不用费劲的把 Munk Test 接入到你的工作流里,它已经是闭环里的一环。
你把需求讲清楚,剩下的,交给 AI。
一句话:Munk AI 负责编排交付,Munk Test 负责验产品。
桌面端 AI 研发闭环

Munk AI 是本机上的工作台,不是又一个 Chat 窗口。
一个需求进来后,大致会经历:
接需求,需求来源可以是 Github Issue,飞书,钉钉,等等澄清需求,必要时,会调度 PM Agent 写 PRD,Design Agent 写设计稿,架构师 Agent 写技术方案写代码,Coding Agent 改代码,并通过基础检查部署 + 验证,交给 Munk Test 做产品级验证失败-修复 Loop;通过后才允许交付失败边界,Loop 失败超过 N 次后,会停下来,在 Inbox 里等你处理
Munk AI 只做一件事------让 AI 研发持续运转,并在需要人的时候把控制权交回来。
一切跑在你自己的电脑上,隐私与控制权都在本地。
想一起试试?
感兴趣的话,欢迎关注,留意后续内测:
- 📮 公众号「朱涛的自习室」:内测名额与进度会优先在这里同步
- 👀 官网提交 Waitlist :munk.sh
- 🐦 X / Twitter :x.com/iBoyCoder
Munk AI,很快见面。