技术栈

smolvla

风合星语
10 天前
pytorch·机器人·具身智能·vla·lerobot·smolvla
2026 具身智能技术实战(一):VLA 到底怎么控制机器人?——用 LeRobot 跑通 SmolVLA 推理给机器人一张桌面图片,再说一句“把红色方块放到蓝色托盘里”,接下来会发生什么?普通聊天模型通常给你一句回答。机器人需要的却是可以被控制系统使用的动作表示。两者之间,不是把一段自然语言直接发给电机那么简单。
qq_41920323
4 个月前
smolvla
SmolVLA模型整体结构解读SmolVLA(Small Vision-Language-Action model)是一个轻量级(约5亿参数)、端到端的视觉-语言-动作(VLA)模型,专为机器人控制设计,基于统一Transformer骨干与流匹配(Flow Matching)训练,实现“看图+听指令→生成连续关节动作”的多模态推理。
贾全
1 年前
人工智能·机器人·大模型·vla·smolvla
【中文翻译】SmolVLA:面向低成本高效机器人的视觉-语言-动作模型本文翻译自《SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics》,旨在促进相关技术在国内学术界的传播和发展。
我是有底线的