[论文阅读] |智能体长期记忆与反思

写在前面:10月份的时候,联发科天玑9400发布,搭载这款旗舰 5G 智能体 AI 芯片的荣耀MagicOS9.0实现了一句话让手机自动操作美团点咖啡。很快商场实体店里便能看到很多品牌手机已经升级为智能体语音助手。下一步,这些智能体或许便能结合长期交互记忆,挖掘表面行为背后的深层模式(例如偏好)。本文整理前段时间调研的智能体基于长期记忆进行反思的几篇论文。

智能体长期记忆与反思

      • [1. 高层抽取--斯坦福虚拟小镇:智能体角色模拟,基于近期记忆(事件+思考)推理高层思考,形成反思内容](#1. 高层抽取--斯坦福虚拟小镇:智能体角色模拟,基于近期记忆(事件+思考)推理高层思考,形成反思内容)
      • [2. 经验积累--Reflexion【NeurIPS 23】: 聚焦多步骤任务,基于之前轮次任务执行的反馈分析失败原因,将反思出的经验作为长期记忆,存储到情景缓冲区用来指导后续轮次的任务决策](#2. 经验积累--Reflexion【NeurIPS 23】: 聚焦多步骤任务,基于之前轮次任务执行的反馈分析失败原因,将反思出的经验作为长期记忆,存储到情景缓冲区用来指导后续轮次的任务决策)
      • [3. 经验积累-- Ghost in the Minecraft 游戏代理,学习成功的规划对应的具体执行步骤](#3. 经验积累-- Ghost in the Minecraft 游戏代理,学习成功的规划对应的具体执行步骤)
      • [4. 终身学习--Jarvis-1:开放世界下形成多模态记忆(目标+环境+成功执行的计划步骤),并基于经验终身学习提升规划能力](#4. 终身学习--Jarvis-1:开放世界下形成多模态记忆(目标+环境+成功执行的计划步骤),并基于经验终身学习提升规划能力)
      • [5. DiLu(的卢)【ICLR 24】记忆初始化模拟人类驾校考试+记忆存储llm含有数学计算的推理过程](#5. DiLu(的卢)【ICLR 24】记忆初始化模拟人类驾校考试+记忆存储llm含有数学计算的推理过程)
      • [6. MemoChat(腾讯)微调教会智能体识别对话不同主题,存储、并检索记忆](#6. MemoChat(腾讯)微调教会智能体识别对话不同主题,存储、并检索记忆)
      • 总结

1. 高层抽取--斯坦福虚拟小镇:智能体角色模拟,基于近期记忆(事件+思考)推理高层思考,形成反思内容

2. 经验积累--Reflexion【NeurIPS 23】: 聚焦多步骤任务,基于之前轮次任务执行的反馈分析失败原因,将反思出的经验作为长期记忆,存储到情景缓冲区用来指导后续轮次的任务决策

3. 经验积累-- Ghost in the Minecraft 游戏代理,学习成功的规划对应的具体执行步骤

4. 终身学习--Jarvis-1:开放世界下形成多模态记忆(目标+环境+成功执行的计划步骤),并基于经验终身学习提升规划能力

5. DiLu(的卢)【ICLR 24】记忆初始化模拟人类驾校考试+记忆存储llm含有数学计算的推理过程

6. MemoChat(腾讯)微调教会智能体识别对话不同主题,存储、并检索记忆

总结

带着目的找论文
  • 关注发表时间、单位、期刊、是否有落地/代码
  • 阅读摘要和简介里贡献,粗略了解要解决的问题、提出的方法、达到的结果→判断是否符合当前需求、是否继续阅读
    • 不符合则暂时中止
    • 符合则详细了解设计的方法有什么可借鉴之处、实验部分如何评估并带来多大的增益
    • 论文解释不清楚的地方,必要可寻找补充材料和代码(如prompt如何定义反思的概念)
  • 最后整体思考和总结优点、缺点,再次思考可借鉴的地方。
  • 整体扫描结束后,回头整理所有看的论文,输出结论。
相关推荐
zhangbaolin7 小时前
深度智能体-长短期记忆
langchain·大模型·长期记忆·深度智能体·短期记忆
wbzuo9 小时前
Clip:Learning Transferable Visual Models From Natural Language Supervision
论文阅读·人工智能·transformer
想成为PhD的小提琴手1 天前
论文阅读13——基于大语言模型和视觉模态融合的可解释端到端自动驾驶框架:DriveLLM-V的设计与应用
论文阅读·语言模型·自动驾驶
编程小白_正在努力中2 天前
第四章深度解析:智能体经典范式实战指南——从ReAct到Reflection的全流程拆解
人工智能·agent·智能体
想看雪的瓜2 天前
Origin将2D普通的XPS曲线图升级为三维XPS瀑布图
论文阅读·论文笔记
北邮刘老师2 天前
智能家居,需要的是“主控智能体”而不是“主控节点”
人工智能·算法·机器学习·智能体·智能体互联网
DuHz2 天前
基于信号分解的FMCW雷达相互干扰抑制——论文阅读
论文阅读·算法·汽车·信息与通信·毫米波雷达
m0_650108243 天前
MiniGPT-4:解锁 LLM 驱动的高级视觉语言能力
论文阅读·开源·视觉语言大模型·minigpt-4·跨模态对齐·强llm+视觉对齐
WSKH09293 天前
【论文阅读】(2016)Dual Inequalities for Stabilized Column Generation Revisited
论文阅读·线性规划·运筹学·列生成·对偶不等式·稳定列生成
程途拾光1583 天前
用流程图优化工作流:快速识别冗余环节,提升效率
大数据·论文阅读·人工智能·流程图·论文笔记