GameFormer论文阅读

参考博客:https://blog.csdn.net/m0_48100146/article/details/135683444

这篇文章的思路还是很清晰的,直接看图就能看懂

Modality Embedding Query是可学习的embedding, 类似于multipath++中的query
除了上述模型结构的特点,还增加了一个辅助判碰撞loss
目前对这篇论文还存在的疑惑的点:

  1. 每个level的trajectory都要进行监督吗? --- 是的,看开源代码是的
  2. Agent Future Mask是怎么做的? --- 在每次迭代的时候,将要迭代的障碍物的未来轨迹进行mask掉。防止模型在预测某个智能体未来时,利用到它自己未来的真实信息,保证训练/推理的公平性和泛化能力。

开源代码:https://github.com/MCZhi/GameFormer

相关推荐
Rocky Ding*3 小时前
【三年面试五年模拟】2026-09-08 DeepSeek AI Agent开发岗社招一面:20道问题与系统设计题全解析
论文阅读·人工智能·深度学习·机器学习·aigc·ai-native·deepseek
林浩杨_5 小时前
中科大 × NUS × 美团提出Pigeon:个性化图像生成
论文阅读·人工智能
CV-杨帆17 小时前
论文阅读 ICML 2026 SkillTrojan: Backdoor Attacks on Skill-Based Agent Systems
论文阅读
m4Rk_1 天前
【论文阅读】Agent 记忆机制(68):Memp——把历史轨迹沉淀为可检索、可纠错的程序性记忆
论文阅读·人工智能·学习·开源·github
Rocky Ding*1 天前
一文读懂LLM Agent Skills 的运行时本质:从能力路由到渐进式披露
论文阅读·人工智能·深度学习·机器学习·aigc·ai-native·agent skills
Rocky Ding*2 天前
一文读懂MiniCPM5-2B:端侧 Agent 的突破,不是“小模型打赢大模型”,而是训练系统开始开源
论文阅读·人工智能·深度学习·机器学习·aigc·ai-native·minicpm5-2b
XLYcmy2 天前
ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory论文阅读
论文阅读·google·llm·agent·记忆·harness·自进化
西柚小萌新3 天前
【论文阅读】--TrustRAG:RAG中的稳健性和可信度
论文阅读
VL——MOESR3 天前
【具身智能】Cosmos Policy论文阅读随笔
论文阅读·人工智能·机器学习·具身智能·cosmospolicy
Rocky Ding*4 天前
【三年面试五年模拟】2026-09-06 拼多多 AI Agent研发岗秋招笔试4道算法题完整题解
论文阅读·人工智能·深度学习·机器学习·aigc·ai-native·拼多多