技术栈

atlanta world

大江东去浪淘尽千古风流人物
3 小时前
atlanta world
【HumanScale】重新定义预训练数据问题提出与实验设计: 预训练阶段更缺动作对齐还是世界覆盖?北大HumanScale给出反直觉回答:第一视角人类视频可能是更好的预训练数据源。作者固定模型架构、预训练时长、后训练数据,只替换预训练数据源,将HumanNet的5000h第一视角视频与同等规模机器人数据直接对比,后训练用AgibotWorld的15个任务,分Seen和Unseen评测。
我是有底线的