谷歌推出基于Gemini 2.0的机器人AI模型

Gemini Robotics将AI带入物理世界

谷歌DeepMind正式推出基于Gemini 2.0的两款机器人AI模型:

  1. Gemini Robotics:先进的视觉-语言-动作(VLA)模型,新增物理动作输出模态,可直接控制机器人
  2. Gemini Robotics-ER:具备空间理解能力的增强模型,支持开发者调用其具身推理(ER)能力

核心技术突破

通用性

  • 利用Gemini的世界理解能力处理未见过的任务/物体/环境
  • 在泛化基准测试中性能达到其他SOTA模型的两倍以上

交互性

  • 基于Gemini 2.0的自然语言理解
  • 支持多语言即时指令响应
  • 实时环境监测与动态调整能力

灵巧性

  • 完成折纸、食品包装等精细操作
  • 支持多步骤复杂任务执行

多形态适配

  • 兼容ALOHA 2双臂平台
  • 适配Franka机械臂
  • 正在开发人形机器人Apollo的专用版本

安全架构

  • 底层运动控制安全机制(防碰撞/接触力限制)
  • 高层语义安全理解
  • 发布ASIMOV数据集推进安全研究
  • 采用数据驱动的"机器人宪法"框架

合作伙伴

  • Apptronik(人形机器人开发)
  • 波士顿动力等机构参与测试

查看技术报告

更多精彩内容 请关注我的个人公众号 公众号(办公AI智能小助手)

公众号二维码

相关推荐
八角Z2 分钟前
AI Agent作为经济参与者的兴起:机器经济与传统金融体系的并存与交织
大数据·人工智能·服务发现
碧海银沙音频科技研究院2 分钟前
GX8002语音识别SDK
人工智能·语音识别
冷雨夜中漫步9 分钟前
DeepSeek Harness:一切皆插件的 AI Agent 框架深度解析
java·人工智能·ai·开源·github
IT_陈寒9 分钟前
Vite热更新失效?八成是这个配置在搞鬼
前端·人工智能·后端
皮皮虾❀11 分钟前
AI Agent可观测性:在钉钉生态中构建透明、可控的智能体服务
人工智能·钉钉
ʜᴇɴʀʏ13 分钟前
TIP 2025 | DIL-SSOD:密集信息增强与关系一致性正则化的半监督目标检测
人工智能·目标检测·目标跟踪
Nomarsgo16 分钟前
柔性生产平台工业显示解决方案——基于联控 Lionconit IFD-1901 工业显示器打造高可靠人机交互终端
人工智能·科技·计算机外设·视觉检测·电脑·人机交互·制造
天天代码码天天30 分钟前
不装 Android Studio,也能把 Vue / React 一键打成 APK:开源工具 lw.Web2Android
人工智能
武子康30 分钟前
DeepSeek Harness:Subagent、Job、Goal 都叫任务,为什么不能混成一个对象
人工智能·llm·agent