【唤醒实战笔记】2026-09-29 | 智能体提示词迭代史(v1 → v8)
date: 2026-09-29
tags: HarmonyOS, 提示词工程, 小艺开放平台, 智能体, LLM, 端云协作, 迭代
type: 实战笔记
一、先看两张对比
同一个智能体,同一个"分析模型"角色,两个月前和现在的提示词开头,几乎认不出是同一个东西:
v1 开头:
你是「唤醒」的大脑,在一个三人系统中工作:
你(大脑)→ FC模型(手)→ 你(大脑)→ FC模型(手)→ ... → 聊天模型(嘴)
v8 开头:
你是「唤醒」的决策者,在一个多模型协作系统中工作。
工具模型(FC):翻译者。它把你的意图声明翻译成结构化调用参数(JSON)......它不再转述结果。
v1 的核心规则:
最多 5 轮:你→FC→你→FC 最多循环 5 轮,仍不足则输出【信息足够】
v8 的核心规则(同一件事):
续轮:三段式(铁律,禁止从用户消息重新推理)
- 复述最新执行 → 2. 对照目标评估 → 3. 决策(三选一)
两相对照,最大的变化不是"更长了",而是角色变了、推进方式变了、刹车方式变了 。而这三个变化,没有一个是"我想优化一下"主动写出来的------每一个都是被一个具体的线上故障逼出来的。
这个智能体的提示词,从 v1 到 v8 迭代了八个版本,跨四个模型角色(分析 / FC / 存储分析 / 聊天)。这篇笔记不准备把八个版本逐一列一遍,而是讲清楚一件事:每一版升级的背后,都躺着一个具体的故障。
二、v1:一个靠"定计划"硬推的决策者
最初的 v1 分析模型,本质是一个"写步骤清单的规划器":
- 收到任务,先输出
计划:1. [步骤1] → 2. [步骤2] → 3. [步骤3] - 然后
当前:调 [工具名] [action],[参数] 填 [值] - 循环继续时输出
已完成:1. [步骤1] → 2. [步骤2]+下一步:调 [工具]
推进靠"计划 + 步骤编号",刹车靠硬编码的"最多 5 轮"。工具表里有 8 个工具:InfoManage、GoalManage、ActionManage、BlockStore、OutlineUpdate、OutlineRead、CurrentTime、LogRetrieve。
这个版本最大的隐患其实已经埋下了------它把"走到哪一步"这个状态,完全交给了模型自己在每轮重新生成的"计划"里维护。模型没有真实的内存,它每轮都是从头开始想。 一个靠"我记得我做到第 3 步了"来推进的系统,迟早会循环。
(这一点就是下面第三节要讲的循环问题,"最多 5 轮"这个硬刹车也正是在那里被证明是无效的。)
三、第一代进化(v2/v3):从"提取信息"到"方法论"
8 月 3 日,产品方向迎来一次根本转折:
唤醒方法论完整确立:条件池 + 目标树 + 递归拆解,从"信息提取"升级为"条件挖掘 + 目标拆解"。
在这之前,端侧做的是信息提取 (实体识别、分词、事件提取),智能体的定位是"把用户的话记下来"。这一天之后,定位变成了规划------核心循环:
定目标 → 列出达成目标需要的条件 → 条件池检索 → 找缺口 → 缺口变子目标 → 递归 → 直到明天可行
支撑它的一句话哲学是:
没有约束,只有代价。AI 展开代价,人决定走不走。
提示词在这一代经历的是定位升级:它不再是"提取字段",而是"规划对话"。相应地,提示词里开始出现"条件池""缺口""递归"这些概念,工具也从单纯的信息存取,扩展出 GoalManage(目标树)、条件池这套体系。
这一代最大的价值不是技术,是把提示词从"说明书"升级成了"世界观"------后面所有迭代,都是在让模型更准确地执行这套世界观。
四、第二代进化(v6/v7):主循环的三场病
方法论确立后,智能体真正跑起来了,然后循环问题开始集中爆发。两天之内,连续暴露了三个。
病一:循环根因------v7 缺"续轮模板"
现象:多段轮次日志里,模型像卡带一样重复------相同的 search 连发 4 次(用户打断),另一次连发 4 次后第 5 轮才自纠。
根因 :v7 提示词只有"从用户消息起手"的首轮模板 ,没有续轮模板 。于是模型每一轮都从用户消息重新推理,确定性地产出同样的结论------逐字重复。之前观察到的"自纠",只是碰巧从历史起手的轮次,纯概率,不可依赖。
修复 :v8 加入"续轮三段式"------复述最新执行 → 对照目标评估 → 三选一决策,并规定"思考历史末尾已有 调用/返回 记录"就是续轮,禁止再从用户消息重新推导。
这就是 v1 那个"靠计划硬推"隐患的正式爆发。它证明了:"我做到第几步了"不能靠模型记,必须靠外部给它的"已执行记录"来判断当前位置。
病二:放弃平台的提问节点------时间限制 + 撑爆上下文
现象:提示词里最初写了大量"提问路径"------遇到模糊指令就反问用户。
根因 :平台其实有提问节点,但不好用。一是提问节点有时间限制,卡在等待用户回答上,用户体验太差;二是它可能让当前轮次无限扩展上下文,容易把上下文撑爆。权衡之后,选择了放弃提问节点。
替代方案 :需要用户确认时,分析模型直接结束当前轮(退出循环),交付摘要写明"需要用户决定:事项与候选",由聊天模型转述给用户,用户下轮回答再执行。
教训:平台的某个节点"能用"和"好用"是两回事。提问节点解决的是"要不要问用户",但代价是时间限制和上下文膨胀------当这个代价超过收益,放弃它、自己设计一条更可控的路径,比硬套平台能力更划算。
病三:零工具轮次却宣称"已完成"
现象:分析模型没调任何工具(直答路径),却回复用户"已经完成了"。
修复:双向约束------分析模型侧,"完成类措辞必须有思考历史里的工具返回支撑";聊天模型侧,"无工具返回支撑的完成宣称不可信,零工具轮回复禁止完成类表述"。
教训:这是"LLM 假装干活"的变体。模型的文字里说"完成了",不代表它真的调过工具。必须在**产出端(分析模型)和转述端(聊天模型)**同时加约束,因为模型会自己说服自己。
五、第三代进化(v8):规则精细化
到了 v8,主循环的框架稳了,问题从"跑不起来"变成了"细节上跑错"。这一代的特点是一堆精细规则,每条都对应一个具体故障。
复合关键词查空
现象 :模型把多个关键词塞进一个 query(如 query="淮南,费用"),端插件按整串子串匹配,必然查空 → 触发"空结果即最终答案" → 向用户误报"确实没有"。
修复:单关键词铁律------"金力和费用"必须写成两行意图。因为端插件不支持分隔符,决定插件不动,改提示词。
查改混批
现象:"查询某任务详情"+"更新该任务为完成"同批发出。模型思考里明明制定了"先确认再更新"的串行计划,却拍平成批量------更新在查询返回前就执行了。若查询证伪了前提,错误写入不可逆。
修复 :意图声明规则新增"决策依赖"定义------后一步是否执行、取决于前一步结果的,必须拆轮等待。并加自检反问:"若前一条的返回与预期完全不同,这条还照做吗?不确定或否 = 拆轮。"
两步确认闭环
现象:信息写操作需要"先亮方案、用户确认、再执行",但确认链要经聊天模型转述------转述版是唯一存世的方案文本,转述稍有偏差,存储的就不是用户确认的那份。
修复 :聊天模型加"方案保真规则"(逐字转述),分析模型执行轮以"对话历史中被确认的方案文本"为准。用户确认的和实际存储的,必须是同一份文本。
越界提取撞车
现象 :同一轮内同一条认知被创建了两次------存储流程建一条、分析模型又建一条,cognition/keywords 逐字相同。
根因 :存储流程越界提取了"两步闭环内容"。而原规则"经用户确认的写操作由分析模型处理"只停留在身份描述,没有可执行规则。
修复:防护规则------两步闭环内容不提取(分析模型只写闭环内容、存储流程只写非闭环内容,两写者内容集互斥)。
整理机制
功能:存储分析模型每次收尾对照目录扫关键词重合簇,重复/同义合并、keywords 规范化、可疑项报告,作为上面"越界提取"残留的兜底收敛。
六、反直觉认知:这八版教会我的几件事
把 v1 到 v8 摊开,有几条认知是反复被证实的,值得单独拎出来:
1. 模型无法自数轮次------"最多 N 轮"是无效的
v1 写着"最多 5 轮",v8 把它删了。原因是:模型每轮从头生成,它根本数不清自己跑到第几轮。"最多 N 轮"这条规则,模型既看不到也执行不了。
你以为你在给模型设上限,其实它无法自数。 真正的刹车不能靠模型自己数,要靠外部路由(输出含标记才退出)。
2. 提示词里的"示例"会变成模型的"事实"
模型会拿提示词里的示例数据当真实结果回复------比凭空编造更隐蔽,因为内容"有出处",看起来更真实。所以示例要写清"这是示例、不是事实",可观测标记(_source/_timestamp)才是判断"真执行"的物理证据。
3. 规则必须是"可执行动作",不是"身份描述"
"越界提取"的坑就是典型:"经用户确认的写操作由分析模型处理"这句话,说了跟没说一样 ------它描述了"谁该负责",却没给出"遇到这种情况具体怎么做"。真正有用的规则是"两步闭环内容不提取"这种能直接落到一个判断上的指令。
4. 有些问题,提示词救不了
上面这些都是"改提示词能解决"的。但 v8 还有一个更大的变化,是我刻意没展开的------FC 从"执行者"变成了"参数生成器",数据从转写三遍变成一遍 。那不是提示词迭代,是架构重构 。这个问题单独成篇(下一篇笔记),因为它的教训是另一回事:当问题出在架构上,再会写提示词也没用。
学习小结:一个智能体的提示词不是"写出来的",是被真实故障逼出来的------v1 靠"计划 + 步骤编号"硬推,被循环问题证明"模型记不住自己走到哪";v7 缺续轮模板导致逐字循环,逼出了"续轮三段式";放弃平台的提问节点(时间限制 + 撑爆上下文)后,改用"退出循环 + 聊天模型转述"的澄清方式;"说完成了"不等于"真执行了",逼出双向约束;v8 的一堆精细规则(单关键词、决策依赖拆轮、两步确认、写者互斥)每一条背后都是一个具体故障。最反直觉的三条:模型无法自数轮次("最多 N 轮"无效)、提示词示例会变成模型的事实、规则必须是可执行动作而非身份描述。而 FC 从"执行者"变"参数生成器",则说明提示词的天花板在架构------那是下一篇的事。
懿路向前 · AI辅助整理
2026-09-29