从0到1:企业级AI项目迭代日记 Vol.87|记忆链路切换了,系统接管有了质量门

这五天,155条提交。核心三件事:记忆向量链路从旧模型切换到了新模型,系统接管有了质量门和持续进化能力,审批Gate在真实环境里跑通了。

一、记忆链路:换引擎,修整编

记忆系统做了一次底层替换。Embedding模型从旧方案切换到新方案,维度从512升级到1024,检索精度和语义理解能力同步提升。

客户端支持主备端点,切换时可以平滑过渡;召回阈值和合并阈值从硬编码改为可配置,调参不需要重新部署。测试和生产环境统一固化到新模型状态,防止回退到旧配置。

切换过程中发现了一个更棘手的问题:记忆整编(把零散记忆整合成结构化摘要)频繁失败。根因是输出Token预算不足导致截断,整条记忆被丢弃。尝试用结构化输出修复反而导致100%失败,最终回退后改用引号转义处理非法字符------记忆整编从"经常丢"变成了"稳定跑"。

记忆从检索到整编,全线换了一颗更强的心脏。

二、系统接管:质量门、持续进化、发布门

企业系统接管从"操作闭环"推进到了"可治理"。

新增了质量门:接管生成或修改的技能必须通过质量检查才能生效,失败后可以恢复到安全状态,不会把半成品放出去。

新增了持续进化能力:接管结果可以基于实际使用反馈持续优化,按组织灰度推进,先在小范围验证再扩大。

新增了真实数据库发布门:不再依赖模拟或静态检查,发布前必须通过真实的数据库模式、权限和生命周期验证。修复了测试模型、约束别名、事件契约和数据清理顺序等一系列真实环境才暴露的问题。

过去是"能探索",现在是"有质量、可进化、能发布"。

三、定时任务:终于有了自己的身份

定时任务之前一直在"借用"身份运行------能用,但权限边界模糊。这轮把定时任务的Agent Identity彻底接上了。

现在定时任务以Agent身份运行,有专属工作区,能导入知识库内容,显式继承Agent预设模型,模型降级时不再静默切换,会明确告诉用户。大型技能正文和工具结果按会话定界落盘,后续可以正确回读。没有知识库绑定的Agent也不会必然失败。

定时任务不再是"匿名打工",而是以Agent身份稳定运行。

四、审批Gate:真实环境跑通了

审批Gate在Helm配置缺少关键字段时曾直接崩溃,修复后测试环境可以真正开启拦截。工具等待审批时记录为挂起而非失败,审批卡无需刷新页面即可出现,批准、拒绝、恢复执行的交互全部跑通。

只读工具直接放行,真正会产生写入或副作用的工具才挂起审批------判断依据是真实风险,不是一刀切。长参数自动换行或截断,不会把审批卡顶出会话区域。

审批从"能接线"走到了"真实可用"。

五、四个角落:会话、工作区、工具结果、评测

会话清理不会互相等待死锁,部署期间DDL不再与请求事务争锁。工作区批量删除正确处理版本冲突,会话沙箱静默运行时不会被错误超时,配额能够正确释放。

大型工具结果落盘后可稳定回读,用户附件与Agent运行工件分开管理,图片输入生命周期统一。用量写入修复与隔离层上下文不一致导致的静默丢失。

历史事故被转化为回归评测用例,发布流程增加评测范围扫描。旧Embedder和旧组件正式退役,集群资源得以释放。

记忆换了一颗更强的心脏,系统接管有了质量门,定时任务有了独立身份,审批在真实环境跑通了,四个角落的底层问题一并补上。

引擎换了,治理上了,身份给了,审批通了------系统正在从"能跑"走向"能交付"。

这,是第八十七天。

**《从0到1:企业级AI项目迭代日记》**记录一个企业级 AI 项目从创意、架构到落地的真实过程。不讲神话,只记录进化。


如果你也在做企业 AI 落地,欢迎留言来聊。或者,把这篇转发给一个正在踩同样坑的朋友。

相关推荐
全栈弄潮儿5 小时前
《小项目实战 1:用 AI 从零搭一个 API 服务》
aigc·openai·ai编程
m4Rk_6 小时前
【论文阅读】Agent 记忆机制(83):Inside Out——用可演化 PersonaTree 构建 Agent 的核心长期记忆
论文阅读·人工智能·学习·开源·github
运行时异常6 小时前
【WMS 仓储系统集成 AI Agent 实战】第 8 讲(终篇):生产部署与并发安全——Semaphore 放进 Flux.defer 的坑,压测抓了一晚上
人工智能·安全
杨杨杨大侠6 小时前
Jev、Kev、Laya:决策模型怎么选,什么时候需要微调?
人工智能·python·agent
代码方舟6 小时前
零信任架构实战:基于天远人企关联构建自动化供应链金融网关
运维·人工智能·架构·自动化
ha_lydms6 小时前
MaxCompute中加密与解密函数
大数据·数据库·数据仓库·hadoop·dataworks·maxcompute·odps
虹科网络安全6 小时前
“顶会”看安全(十八):超越越狱:揭示由能力边界模糊引发的 LLM 应用安全风险
人工智能·安全
Maiko Star7 小时前
* LangChain 提示词模板详解:ChatPromptTemplate 的使用与高级特性
java·人工智能·langchain
鬓戈7 小时前
Rust 语言与 AI 应用生态调研及学习路径
人工智能·学习·rust
天远API7 小时前
零信任架构实战:基于天远人企关联构建自动化图谱网关
网络·人工智能·架构·自动化