Agent Harness 越堆越烂?600 次实验推翻"自进化",个人场景下更适合"自驯化"TL;DR很多人给 AI Agent 加规则、加记忆、加 hook,想着靠 Harness 迭代让模型越来越强。但用久了发现不对劲——规则越堆越多,模型反而开始无视约束,管线越来越臃肿。清华 SEAGym 综述提出了 Harness "自进化"的路线,我拿自己的 Claude Code 配置系统跑了 3 个月、600+ 次 API 实验。结论是:个人场景下,追求"通用变强"会撞上 Harness 腐烂的硬上限。真正可持续的不是"自进化",是"自驯化"——不提升通用能力,只贴合一个人的工作流。