参考链接:https://zhuanlan.zhihu.com/p/717482601
主要就是提出了一种MLP的方法去生成预测点,然后在将预测点detach掉,在refine生成轨迹
ADAPT论文阅读
ZHANG8023ZHEN2025-10-22 14:09
相关推荐
Capricorn198819 小时前
知芽研究问题看板无法推进?从孵化区到笔记的机制排查指南m4Rk_2 天前
【论文阅读】Agent 记忆机制(38):AMA——用多智能体协作动态选择记忆粒度m4Rk_6 天前
【论文阅读】Agent 记忆机制(34):MemoryBank——用遗忘曲线管理可强化的长期对话记忆zzm6288 天前
安全嵌套子博弈求解与非完美信息博弈——NIPS 2017 最佳论文阅读笔记张继雁9 天前
夏季切削液发臭不用瞎换液m4Rk_9 天前
【论文阅读】Agent 记忆机制(31):MemAgent——通过强化学习让固定长度记忆处理百万级长文本森诺Alyson9 天前
前沿技术借鉴研讨-2026.8.6(影响中国育龄妇女生育偏好的因素/分孕周血压与不良妊娠结局的风险)张小泡泡10 天前
AUTO_EVAL:面向大语言模型的多层次自动化评测框架m4Rk_12 天前
【论文阅读】Agent 记忆机制(28):MEM1——将记忆压缩融入推理,实现近似恒定上下文的长程智能体m4Rk_13 天前
【论文阅读】Agent 记忆机制(27):MemRefine——用 LLM 事实判断将长期记忆压缩到固定预算