具身智能

_张一凡2 小时前
3d·具身智能·世界模型
【论文解读】一篇读懂LAWM-3D:从 DreamDojo 的 2D 潜动作到 3D 感知,关键不是加多视角而是三道防泄漏设计论文:LAWM-3D: Learning 3D-Aware Latent Actions from Human Videos for Generalizable Robot World Models(Nankai University / Tsinghua University / Harbin Institute of Technology / EPFL,AAAI 2027) 发布时间:2026 年 8 月 6 日(arXiv v1) 作者:Jiarui Yang、Jiale Zhang、Jiawei
Bright Data15 小时前
训练数据·具身智能·视频数据
小米新发布的 Robotics-1 在向市场传递什么信息?小米科技刚刚发布的Xiaomi-Robotics-1(XR-1)机械臂,是一个基于两个阶段训练的视觉-语言-动作(VLA)基础模型的具身智能硬件:
m0_5474866621 小时前
机器人·具身智能
《机器人学与具身智能》全套课件PDF2026《机器人学与具身智能》全套课件PDF2026内容:第一章绪论.pdf 第二章机器人运动学.pdf 第三章 机器人动力学.pdf 第四章 机器人控制.pdf 第五章 典型机器人应用.pdf 第六章具身智能.pdf
白拾4 天前
人工智能·机器人·具身智能·vla·icml·记忆·基准评测
【ICML 2026 (Oral)】RoboMME 论文解读:首个大规模具身记忆评测基准,系统评估 VLA 长程记忆本文解读 ICML 2026(Oral)论文《RoboMME: Benchmarking and Understanding Memory for Robotic Generalist Policies》。该论文提出大规模具身记忆评测基准 RoboMME,通过融合认知心理学记忆分类框架与非马尔可夫任务设计,系统性评测 VLA 模型的长程记忆能力,其特别之处在于首次同时覆盖时序、空间、对象、程序四种记忆维度,并在统一 π0.5 基座上构建 14 种记忆增强变体进行公平对比。实验表明感知记忆 + Modula
TsingtaoAI5 天前
机器人·大模型·具身智能
基于MyCobot Pro 450机器人的VLA多模态具身智能实训建设方案1.1 项目背景具身智能是当前人工智能与机器人领域的核心前沿方向,彻底改变了传统机器人固定编程、指令式执行的作业模式,实现机器人类人感知、理解环境、自主决策与自适应作业。其中,VLA(视觉-语言-动作)多模态大模型是具身智能落地的核心技术底座,结合3D视觉深度感知能力,可让机器人具备自然语言交互、环境自主认知、智能动作生成的能力。
科研小刘带你玩学术6 天前
人工智能·机器学习·具身智能·未来趋势·ai机器人·智能系统
【科研快讯】从自动执行到自主决策:具身智能正在推动AI进入机器人智能时代过去几年,人工智能的发展主要集中在数字世界。大语言模型让AI具备了文本理解能力;多模态模型让AI能够分析图像、声音和视频。而下一阶段的重要方向,是让AI进入真实物理环境。这一方向被称为:具身智能(Embodied AI)简单来说,具身智能希望让人工智能拥有:感知环境 → 理解任务 → 制定策略 → 执行动作的完整能力。
HyperAI超神经8 天前
人工智能·深度学习·机器人·多模态·图像生成·具身智能·智能体
15亿参数挑战机器人控制,MiniCPM-RobotManip正式开源;覆盖文本/图/视频/动作序列,英伟达发布全模态模型Cosmos3-Edge在具身智能领域,让机器人具备感知、理解与行动能力,是推动智能体进入真实世界的关键。MiniCPM 推出的 MiniCPM-Robot 系列模型,围绕机器人操作与目标跟踪两大核心任务展开探索。其中,MiniCPM-RobotManip 是一个仅 15 亿参数的视觉语言动作模型,基于 MiniCPM-V 4.6 视觉语言骨干,并结合扩散动作头,实现从视觉观察和语言指令到机器人动作的端到端映射;MiniCPM-RobotTrack 则聚焦实体目标跟踪,以 0.9B 参数实现端侧实时视觉跟踪能力。通过轻量化架构、
iiiiii118 天前
论文阅读·人工智能·笔记·深度学习·机器学习·机器人·具身智能
【论文阅读笔记】Reparameterization Proximal Policy Optimization (RPO):将PPO的稳定性引入可微分强化学习ICML 2026 poster这篇文章提出了 Reparameterization Proximal Policy Optimization (RPO) ,核心贡献在于建立了重参数化策略梯度(RPG)与PPO风格替代目标函数之间的理论联系,从而为RPG提供了统一、稳定的样本复用机制。
才鲸嵌入式9 天前
人工智能·机器学习·大模型·自动驾驶·具身智能·通用人工智能·jepa
JEPA具身智能或自动驾驶路线的公司2026年7月ICML大会上,冯雁作为首个特邀演讲者,系统阐述了"JEPA路线相较生成式路线的结构性优势"。
深蓝学院10 天前
具身智能
苏黎世联邦理工提出 EgoHTR:野外 4D 人体-地形对齐,把人类动作重新放回真实地形它不只记录人怎么动,也记录人在哪里动、脚踩在哪里,以及周围地形是什么形状。——野外 4D 人体 - 地形对齐
LuminWave11 天前
大数据·人工智能·具身智能·灵巧手·tof相机
资本扎堆灵巧手赛道,数据基建成为规模化落地关键变量灵巧手被视作人形机器人、具身智能落地的 “最后一厘米”,是机器人实现精细操作、通用作业的核心末端执行器。据 GGII《2026 年 H1 中国灵巧手行业调研报告》数据,2023-2026 年 5 月国内灵巧手行业累计完成 57 笔融资,总融资规模达 128 亿元,2025 年起融资热度全面爆发,2026 年单笔融资金额、行业总投资额持续走高,灵心巧手等企业一年内完成 7 轮融资,估值突破 200 亿元,资本持续押注赛道长期成长空间。
feasibility.11 天前
人工智能·机器人·自动驾驶·嵌入式·无人机·具身智能·智能体
从数字智能到物理智能体:深度解构具身智能时代的边缘计算、嵌入式实时系统与多形态智能体2026年的AI产业正在经历一场静默的范式转移。当大语言模型已经"吃饱"了互联网上的文本、图像与代码,当软件智能体在云端能够自主调用API、编写程序、生成报告,数字世界的智能边际收益正在递减。物理世界——那个充满摩擦、噪声、延迟与不可逆后果的真实世界——成为唯一尚未被大规模开垦的数据边疆。
Cx330_FCQ12 天前
具身智能·vla·lerobot
LeRobot SO-101 机械臂从底层控制到 VLA 视觉语言动作模型完整实操复盘本次任务主要学习 SO-101 机械臂的运动学基础,包括:实验代码:Task2 目录主要包含:本题采用改进型 DH,也就是 Craig 约定。相邻坐标系之间的变换为:
搞科研的小刘选手16 天前
机器人·具身智能·学术会议·控制系统·会议推荐
【浙江工业大学主办】2026年具身智能、机器人与控制系统国际学术会议(EIRCS 2026)2026年具身智能、机器人与控制系统国际学术会议(EIRCS 2026)2026 International Conference on Embodied Intelligence, Robotics, and Control Systems
AI猫站长15 天前
人工智能·具身智能·灵巧手
快讯|特斯拉Optimus量产卡壳灵巧手;京灵智康获亿元天使轮融资🐾 今天是2026年7月24日星期五,「具身智能」赛道重要资讯有这些: 灵心巧手入选工信部人形机器人标委会全工作组成员,标准话语权再升级;特斯拉Optimus双线推进产线,马斯克称量产爬坡史上最难;京灵智康成立不到3个月斩获近亿元天使轮;元昊动力完成数亿元种子轮融资;普华永道中国AI研究院落地上海,发布智能机器人产业白皮书;小鹏人形机器人开启小批量试生产;腾讯发布具身世界认知基座模型RxBrain。
hitgavin15 天前
具身智能·行业观察·waic2026
2026 WAIC见闻2026 世界人工智能大会(WAIC 2026)于 2026-07-17 ~ 07-20 在上海举办。本届首次单设学术分会 WAICA(World Artificial Intelligence Conference · Academic,07-18 ~ 07-20 · 世博展览馆),产业展偏产品与商务,WAICA 偏论文与学术声誉。
MocapLeader17 天前
具身智能·机器人训练数据采集·freetacman·视觉触觉数据集·机器人模仿学习·多模态数据采集·nokov度量光学动作捕捉
如何采集机器人复杂接触操作数据?FreeTacMan 视觉-触觉-位姿同步方法解析机器人要完成易碎杯抓取、USB 插接、书写、盖章等复杂接触操作,难点不只是“看见物体”,还要理解接触发生在何处、夹爪如何移动、动作轨迹如何变化。香港大学、上海创智学院李弘扬团队在 ICRA 2026 发表论文《FreeTacMan: Robot-free Visuo-Tactile Data Collection System for Contact-rich Manipulation》,提出一种无需机器人参与的视觉-触觉数据采集系统 FreeTacMan。该研究中,NOKOV 度量光学动作捕捉系统用于采