主要特点:出轨迹是迭代了多次,每次出一条,然后去找和真值最近并且出现最早的轨迹,进行监督。
和QCNet一样loss是基于Laplace negative log-likelihood的。传统的WTA的策略只会监督和GT差异最小的那条轨迹。而EMTA策略会监督在RNN结构中找和GT match上的并且是相对更早decode出来的那条轨迹(也就是在RNN结构中认为概率更高的那条)。这里决定是不是match用的是Miss Rate的判定标准。如果没有match上的话,就退回WTA策略。这样就能让model尽早decode出目标的模态,也能提升Miss Rate的表现。
ModeSeq论文阅读
ZHANG8023ZHEN2025-08-03 13:15
相关推荐
m4Rk_1 天前
【论文阅读】Agent 记忆机制(54):MINJA——普通用户如何仅通过查询污染 Agent 的长期记忆Capricorn19881 天前
个人知识库接入大模型频现“幻觉引用”?排查 RAG 溯源失效问题,解析知芽构建可信第三大脑的底层架构Capricorn19882 天前
科研引用无法溯源怎么排查?知芽 Notebook Skill 技术机制拆解Capricorn19882 天前
Agent 记忆层接入后引用仍不可信?知芽 Notebook Skill 排障指南Rocky Ding*2 天前
【三年面试五年模拟】2026-08-16_拼多多_笔试题与题解全解析无线通信科研笔记2 天前
IEEE TWC 2026 论文精读与完整复现|H-PASS:机械—电子双重可重构波束成形m4Rk_2 天前
【论文阅读】Agent 记忆机制(53):Experience-Following——为什么错误经验会在记忆中不断传播sel_92 天前
【多轮对话论文导读(三)】多轮对话与Agent论文阅读笔记:用户模拟、轨迹生成与长期记忆西柚小萌新2 天前
【论文阅读】-- 通过跨模态操纵多模态智能体提示注入小新科研测评3 天前
2026 年论文阅读工具横评:Zotero、EndNote、Mendeley、Scholaread 哪个效率更高?