今天的关键词是:治理。团队协作开始有并发配额和成本上限,模型调用的延迟第一次能被逐层归因,知识摘要开始做保真检查,执行续跑不再重复插入记录。
系统在从"能干活"走向"可治理"。
一、团队协作:从"能并行"到"可预算、可追溯、可恢复"
团队协作这轮做了系统性治理。
并发与预算:新增组织级团队运行并发配额和独立的子任务并发闸,排队等待时间不再计入成员执行死线。按一次团队运行归集Token和成本,并提供默认关闭的预算硬上限------花多少钱、用多少量,现在可以管了。
版本冻结与追溯:审批或中断恢复后,继续使用派发时冻结的智能体发布版本,不会在运行中静默切换。团队进度和追踪记录增加版本标识,可以追溯到实际执行的智能体版本。
并发安全:修复多成员并发更新时互相覆盖快照的问题。断线重连时先回放成员完成和运行中的进度,再订阅实时事件------重连后不会丢失已经发生的事。
生命周期管理:父任务结束时,级联结束所有仍在运行或等待输入的成员子任务,不会留下孤儿。Review模式通过意见指纹识别连续无新事实的停滞状态,提前结束无效循环。成员产出增加结构化引用,执行取消后已产生的副作用会被明确标记。
成员控制:每个智能体新增"允许参与协作"开关,默认开启。支持每项分工单独设置执行期限,并区分硬超时和空闲超时。可选择在成员派发前让用户确认或修改分工,默认关闭。团队执行期间的新约束不再返回"忙碌"错误,而是排队等待注入。
团队工具不再被收窄:团队工具被标记为始终暴露,不会因为动态工具收窄而消失。
这轮团队协作从"能启动多个成员"走到了"有预算、有配额、有版本、可追溯、可恢复"。

二、LLM协议兼容与对冲请求:让模型调用更稳、更快、更聪明
模型调用层做了几件事。
协议回退:当网关返回协议不支持时,自动从一种协议切换到另一种协议重试。只有切换成功后才按模型记忆协议,后续调用直接使用正确协议。不会放宽其他业务性错误的重试范围------该失败还是失败,该重试才重试。协议和重试策略按模型隔离,一个模型的问题不影响其他模型。
首字延迟归因:新增完整的模型调用延迟观测。逐次记录首字延迟、流式块数量、当前尝试次数、前序失败等待时间、推理强度和推理Token数。前端等待阶段显示正在等待哪个模型、已等待多少秒、当前是否正在重试、等待是否主要来自模型网关。过程记录显示"模型响应耗时、网关首字耗时、第几次尝试"。修复了归因字段被事件流白名单过滤的问题。
对冲请求:新增模型请求对冲机制,默认关闭,在测试环境灰度开启。主请求迟迟没有首个响应时,并发启动备用请求,首个返回响应的请求获胜,另一条立即取消。两路输出不会交错进入同一个回复。记录对冲触发次数、备用请求获胜次数和取消耗时。同时修复了对冲路径缺少取消等待器的问题。
延迟不再是一个黑盒,而是一层一层可以被归因的东西。

三、知识保真:从词表正则到模型抽取,确保摘要不歪曲原意
知识库的摘要保真做了改进。
之前摘要保真检查用的是简单词表加正则,容易误判。现在改成先用模型抽取,再做确定性比较------从"看关键词"变成了"看语义"。极性判断也修正了:按效果方向判断,而不是按句子是肯定还是否定形式判断。
保真门禁接入智能入库聚合流程。批量分析遇到传输层超时时自动拆小批次。摘要失败时不再生成空的来源页面。三元组抽取失败不再被两层异常捕获吞掉,日志会区分调用异常、抽取器返回空、返回内容无法解析三种情况------失败了至少知道为什么失败。
知识摘要不能歪曲原文的意思,保真检查从"看词"升级到了"看义"。

四、执行一致性:续跑不重复、耗时不为负、并发不打架
执行和续跑做了一致性修复。
之前任务执行记录会出现负耗时或等待时间不匹配的问题------续跑节点的时间对不上。中断续跑时现在复用原始运行记录,不再重复插入新的运行记录。原始运行标识被写回运行时配置。
相同操作键并发登记时存在竞态:两个请求同时登记同一个操作,可能产生冲突。现在使用数据库唯一约束裁决赢家,失败方重新读取并收敛到同一条记录,保证数据库最终只有一条记录。
续跑不会重复记录,耗时不会变成负数,并发登记不会打架。

五、沙箱、权限与IM细节:超时容忍、归因准确、回复自然
沙箱会话的创建改用独立超时,可以容忍准入控制导致的额外延迟。沙箱置备失败时保留真实异常和诊断信息,不再丢失原因。
Webchat权限修复了一个归因问题:受数据权限限制时,会话拒绝原因被错误诊断为"会话不存在"。现在查询无法判断时改为"不可见",同组织内其他用户的会话仍可准确归因为"其他用户"。对外仍保持统一404,避免产生会话存在性推断。
企业微信等外部客户IM回复改成更自然的口语表达,减少加粗和列表式排版------客户看到的不再像一份报告,而像一条正常的消息。网页助手不受影响。
超时更宽容,归因更准确,回复更自然。

110天,系统在把"能干活"变成"可治理"。团队协作有了预算和配额,模型延迟有了归因,知识摘要有了保真,执行续跑有了一致性,沙箱和权限的归因更准确。
这些都不是新功能,但每一个都在让系统从"看起来在运转"走向"真的可以被信任"。
这,是第110天。
**《从0到1:企业级AI项目迭代日记》**记录一个企业级 AI 项目从创意、架构到落地的真实过程。不讲神话,只记录进化。
如果你也在做企业 AI 落地,欢迎留言来聊。或者,把这篇转发给一个正在踩同样坑的朋友。