记忆机制

白拾16 小时前
机器人操作·具身智能·vla模型·记忆机制
【ICLR 2026 2026】MemoryVLA 论文解读|从认知科学与机器人记忆机制视角本文解读 ICLR 2026 论文《MemoryVLA: Perceptual-Cognitive Memory in Vision-Language-Action Models for Robotic Manipulation》。该论文提出MemoryVLA,一个认知科学启发的认知-记忆-动作框架,通过融合工作记忆(短期)、感知-认知记忆库(长期,类海马体)与扩散动作专家,为视觉-语言-动作(VLA)模型显式建模非马尔可夫的长时序依赖,其特别之处在于用"检索 + 门控融合 + 紧凑整合"三大机制同时保留
尽兴-2 个月前
ai·长期记忆·短期记忆·记忆机制·向量记忆·记忆总结
4.2 记忆机制:短期/长期/向量记忆、记忆总结人没有记忆就是金鱼——每次醒来都不记得昨天发生了什么。Agent 也一样,没有记忆的 Agent 只是个「单次对话工具」。要让 AI 助手真正有用,它必须能跨会话记住你是谁、你做过什么、你喜欢什么。这就是记忆系统的价值。
ん贤3 个月前
agent·rag·记忆机制
如何设计Agent的记忆模块大模型天生就有有记忆缺陷。 就同HTTP请求一般,每次对大模型的请求,都是无状态的。所以为了让大模型拥有记忆,就需要在每次请求里面,携带上他之前说过的话。从而模仿他的记忆,让他知道,自己是谁,为谁服务,服务什么,服务对象又有什么性格等等…
Fzuim4 个月前
ai·架构·claude code·上下文管理·记忆机制
Claude Code v2.1.88 三层「自愈记忆」架构深度解析基于 Claude Code 源码(通过 sourceMap 还原)逆向分析其上下文管理与记忆系统。Claude Code 的上下文管理是一个 三层渐进式压缩 + 多重自愈恢复 的系统。三层并非平行运行,而是按「代价从低到高」依次升级:
M宝可梦7 个月前
深度学习·架构·transformer·deepseek·记忆机制
新一代Transformer 架构MAT: Engram-STEM-PLE本文介绍一篇与DeepSeek颇有渊源的一片工作,来自meta; 同样使用了embedding table 来存储词向量,在FFN层作为改进,进行memory 注入;
我是有底线的