约束工程:如何让 AI 没法跑偏

本文是《AI Loop Engineering 系列》的第三篇。

一、本质

AI 不需要被引导,它需要被限制

引导是"往这边走",AI 会理解成"附近都行"。

限制是"只能往这边走",AI 没得选。

约束工程的核心思想:把 AI 的行为边界从"软提醒"变成"硬约束"。

二、三种约束机制

2.1 工具门禁(Tool Gate)

机制:当前阶段能调什么工具,不是 prompt 提醒,是代码拦截。

阶段 可用工具
Spec 阶段 read
Plan 阶段 read + bash(只读)
Execute 阶段 read + write + edit + bash
Verify 阶段 read + bash(只跑测试)

原理:阶段错了,工具不存在。agent 不是"被提醒不能写",而是"根本调不到写工具"。

2.2 输出契约(Output Contract)

机制:每一步输出必须满足结构约束,不满足就不算完成。

yaml

复制代码
tasks:
  - id: T1
    action: fix
    verify: "go test ./... exit code 0"

原理:不是 prompt 说"检查代码",是代码里写死"exit code 不是 0 就不算 done"。

2.3 上下文锁(Context Lock)

机制:每轮 agent 调用前,注入当前 spec + 当前阶段 + 已完成任务。超出范围的内容被过滤。

text

复制代码
每一轮 agent 的上下文 = spec + 阶段 + 已完成 task + 当前 task
其他历史 = 不可见

原理:不是"记住你该做什么",是"你只能看到该做的事"。

三、三种约束的互补关系

约束 解决什么问题 硬约束还是软约束
工具门禁 agent 做了不该做的事 硬约束(做不了)
输出契约 agent 做了但没做好 硬约束(不算完)
上下文锁 agent 忘了自己该做什么 硬约束(看不见)

三者互补:看不见 → 做不了 → 做不完。

层层收窄,没得跑偏。

四、约束工程 vs 脚手架

RuoYi 类型的框架是脚手架------把一堆技术决策打包成一个不可分割的整体,你要么全要,要么全不要。

约束工程不一样:

脚手架 约束工程
定义目录结构 只定义思考维度
绑定工具链 不绑定任何工具
强制生命周期 只标注当前阶段
写死验证方式 只说"需要验证",怎么验由 spec 定
退出代价大 卸载即无痕迹

约束工程给的是原则和边界,不是路径和模板。

五、总结

核心要点 一句话
本质 限制 AI,不是引导 AI
工具门禁 阶段错了,工具不存在
输出契约 不满足条件,不算完成
上下文锁 不该看的,看不见
三者关系 看不见 → 做不了 → 做不完
约束 vs 脚手架 给原则,不给路径

下一篇:一切皆函数------为什么函数式设计是约束工程、反复对齐、模块化的自然汇聚点。

相关推荐
小刘快学习15 分钟前
把 AI 账单拆到部门:企业 AI 网关的精准分账思路
人工智能
米小虾22 分钟前
你让监控模型读的思维链,可能是攻击者写好的剧本
人工智能
deepseek2334 分钟前
Iris 开源搜索智能体拆解:35B 与 397B 中文仅差 0.3 分,上下文管理胜过堆参数
人工智能·ai agent·开源模型
ai小陈36 分钟前
CUDA Stream实战:让数据传输与GPU计算真正重叠
人工智能·深度学习·ai·pdf·云计算·gpu算力
residual_fan41 分钟前
【学术论文】航空发动机故障诊断智能体:基于持续对比强化学习的动态优化方法
人工智能·算法·数据挖掘·数据分析
东风破_44 分钟前
从 RAG 到 Agentic RAG:第二步,把复杂问题拆开再检索
人工智能
dehuisun1 小时前
第07篇:RAG+Agent 部署架构、资源评估与私有化方案
人工智能
霸道流氓气质1 小时前
DriftKit 完全指南:从入门到精通,掌握 Java AI 提示词生命周期管理
ai
米小虾1 小时前
拆给 8 个子智能体,只拿回 2.3 倍信息:多智能体分解的产出守恒律
人工智能·agent
虹科网络安全1 小时前
Redis 安全公告:CVE-2026-81934 TLS 处理漏洞及修复建议
网络·人工智能·网络安全