谷歌推出基于Gemini 2.0的机器人AI模型

Gemini Robotics将AI带入物理世界

谷歌DeepMind正式推出基于Gemini 2.0的两款机器人AI模型:

  1. Gemini Robotics:先进的视觉-语言-动作(VLA)模型,新增物理动作输出模态,可直接控制机器人
  2. Gemini Robotics-ER:具备空间理解能力的增强模型,支持开发者调用其具身推理(ER)能力

核心技术突破

通用性

  • 利用Gemini的世界理解能力处理未见过的任务/物体/环境
  • 在泛化基准测试中性能达到其他SOTA模型的两倍以上

交互性

  • 基于Gemini 2.0的自然语言理解
  • 支持多语言即时指令响应
  • 实时环境监测与动态调整能力

灵巧性

  • 完成折纸、食品包装等精细操作
  • 支持多步骤复杂任务执行

多形态适配

  • 兼容ALOHA 2双臂平台
  • 适配Franka机械臂
  • 正在开发人形机器人Apollo的专用版本

安全架构

  • 底层运动控制安全机制(防碰撞/接触力限制)
  • 高层语义安全理解
  • 发布ASIMOV数据集推进安全研究
  • 采用数据驱动的"机器人宪法"框架

合作伙伴

  • Apptronik(人形机器人开发)
  • 波士顿动力等机构参与测试

查看技术报告

更多精彩内容 请关注我的个人公众号 公众号(办公AI智能小助手)

公众号二维码

相关推荐
新缸中之脑1 小时前
Paperless-NGX实战文档管理
人工智能
无极低码3 小时前
ecGlypher新手安装分步指南(标准化流程)
人工智能·算法·自然语言处理·大模型·rag
grant-ADAS3 小时前
记录paddlepaddleOCR从环境到使用默认模型,再训练自己的数据微调模型再推理
人工智能·深度学习
炎爆的土豆翔3 小时前
OpenCV 阈值二值化优化实战:LUT 并行、手写 AVX2 与 cv::threshold 性能对比
人工智能·opencv·计算机视觉
智能相对论3 小时前
从AWE看到海尔智慧家庭步步引领
人工智能
云和数据.ChenGuang3 小时前
魔搭社区 测试AI案例故障
人工智能·深度学习·机器学习·ai·mindstudio
小锋学长生活大爆炸3 小时前
【工具】无需Token!WebAI2API将网页AI转为API使用
人工智能·深度学习·chatgpt·openclaw
昨夜见军贴06163 小时前
AI审核赋能司法鉴定:IACheck如何保障刑事证据检测报告精准无误、经得起推敲?
人工智能
测试_AI_一辰3 小时前
AI系统到底怎么测?一套六层测试框架(Agent案例)
人工智能·功能测试·需求分析·ai编程
运维小欣3 小时前
智能体选型实战指南
运维·人工智能