传统触觉传感器依赖压阻、电容或压电元件,通过物理换能器直接测量力或压力。这类方案存在一个根本性瓶颈:分辨率有限、接触信息受限,在精密操作和动态环境下容易失效。
视触觉传感器开辟了一条截然不同的路径。它的核心思路可以用一句话概括:把一只眼睛放在皮肤下面,近距离观察接触发生时弹性体的细微变化。
具体来说,视触觉传感器由触觉皮肤(透明弹性体)、光源和内置相机三部分组成。弹性体表面覆盖一层反射涂层,当物体接触时,弹性体发生形变,内置相机从内部拍摄形变图像,再通过计算机视觉算法重建接触表面的三维几何和力分布。
这种"以图像测触觉"的架构带来了三个本质优势:
-
高空间分辨率:一个指甲盖大小的传感器即可获得数万个有效像素,空间细节达到数十微米量级;
-
稠密接触几何:突破了传统触觉传感器无法获取稠密接触几何形状的难题;
-
与深度学习天然兼容:触觉形变图像可直接复用成熟的视觉算法和模型。
视触觉传感器的技术根源可追溯至2004年东京大学的研究。但真正奠定这一技术路线的是2009年MIT计算机科学与人工智能实验室Edward Adelson团队首次提出的GelSight方案。当时的研究重点集中在微观几何分析的高分辨率三维图像重建,机器人传感应用直到2014年才被系统探索------MIT推出了首款指尖GelSight传感器。
此后,视触觉传感器经历了从"结构主导设计"到"结构-算法协同",再到"任务自适应系统集成"的三阶段演进。
第一阶段的焦点是器件本身:如何设计更好的弹性体材料、更紧凑的光路结构。第二阶段的标志是算法与结构的协同优化,深度学习开始大规模进入视触觉领域,传感器不再只是一个数据采集设备,而成为学习系统的一部分。第三阶段则面向真实任务场景,传感器设计需要与具体的操作任务、学习算法和系统约束共同优化。
在这一演进过程中,一个核心矛盾始终存在:结构决定可观测性,算法决定可恢复性,而任务需求施加系统级权衡。换句话说,传感器的设计不能只追求"看到更多",还要考虑"看得对不对、算得准不准、用得好不好"。
视触觉传感器领域经过十余年发展,已形成较为清晰的技术格局。GelSight作为开创性方案,在学术和工业界被广泛采用,其指尖版本的分辨率据称超越人类手指上万倍,被学术界公认为领先的触觉解决方案之一。
北邮&清华团队是国内最早系统开展视触觉传感器研究的团队之一。团队自主研发的高分辨率视触觉传感器,通过微型相机与高弹性凝胶结构的配合,模拟人体皮肤感知微观形变的机制。当指尖接触物体时,传感器能实时捕捉接触力度、滑移趋势和接触姿态,让机器人指尖如人手,"可感知蝴蝶落下的微重"。
在模型层面,团队进一步提出了VTLA操作模型框架,将触觉信号作为原生模态纳入视觉-语言-动作大模型的预训练和推理体系,实现三模态对齐。这一思路的关键在于:让模型不仅"看到"物体在哪里,更"感受到"接触正在发生什么。在系统层面,团队将视触觉传感器集成到多指灵巧手平台,在物流分拣、工业装配等真实场景中验证了触觉感知对抓取稳定性和操作精度带来的实质提升。在产业层面,团队将触觉传感器从实验室推向了规模化部署。
当前视触觉传感器正在从"能感知"走向"能理解",从"单点突破"走向"系统集成"。综合当前技术趋势,以下几个方向值得关注。
方向一:多模态同源融合。未来的视触觉传感器可能同时集成温度、振动、剪切等多模态感知,在同一个物理层完成信号采集,从根本上消除"信息孤岛"问题。
方向二:从硬件传感器到系统级感知能力。视触觉传感器的价值不在于传感器本身,而在于它能为机器人操作带来什么。。
方向三:标准化的触觉数据基础设施。视触觉传感器的规模化应用面临一个关键瓶颈:不同传感器的输出格式不统一,导致触觉数据难以跨平台迁移。建立标准化的触觉数据格式、采集规范和评价基准,是推动领域从"各自为战"走向"协同进化"的前提。
方向四:低成本规模化制造。当前主流高性能灵巧手单价较高,触觉传感器的高成本是制约规模化落地的重要因素。如何在不牺牲性能的前提下实现低成本、高一致性的批量制造,是产业化必须跨越的门槛。
方向五:从被动感知到主动探索。人类触觉不是被动接收的------我们会主动摸索物体表面,通过运动获取更丰富的接触信息。让机器人学会主动触觉探索,根据任务需求自主决定"摸哪里、怎么摸、摸多久",是视触觉感知走向真正智能的关键一步。
视触觉传感器让机器人第一次拥有了"看清接触"的能力,这项技术正在从实验室走向工厂和家庭,为机器人灵巧操作铺设最底层的感知基础。
