Talk|卡内基梅隆大学李博文:适用于机器人的可泛化的目标感知

本期为TechBeat人工智能社区 579 线上Talk。

北京时间3月20日(周三 )20:00, 卡内基梅隆大学 博士生 ---李博文的Talk已准时在TechBeat人工智能社区开播!

他与大家分享的主题是: " 适用于机器人的可泛化的目标感知",向大家系统地介绍了如何在有限的数据上学习到可泛化的,适用于机器人的目标感知模型。

Talk·信息

主题:适用于机器人的可泛化的目标感知

嘉宾:卡内基梅隆大学 李博文

时间:北京时间3 月20日(周三)20:00

地点:TechBeat人工智能社区

点击下方链接,即可观看视频!

TechBeatTechBeat是荟聚全球华人AI精英的成长社区,每周上新来自顶尖大厂、明星创业公司、国际顶级高校相关专业在读博士的最新研究工作。我们希望为AI人才打造更专业的服务和体验,加速并陪伴其成长。https://www.techbeat.net/talk-info?id=858

Talk·介绍

视觉目标感知是计算机视觉研究已久的问题。然而,在机器人上部署目标感知算法常常会遇到泛化性的局限性。换言之,离线的大规模数据集只能提供有限的目标特征与运动模式,如何在有限的数据上学习到可泛化的,适用于机器人的目标感知模型是本次talk的重点。具体而言,我将从运动泛化性与实例泛化性两个角度讨论这一主题。

Talk大纲

运动泛化性

1、机器人部署时的感知延迟问题与已有解决措施

2、预测性目标跟踪框架概览(PVT++)

3、PVT++在设计时的三个关键点

4、实验结果

实例泛化性

1、现实生活中的实例感知问题

2、已有的二维表征方案及其问题

3、可感知实例三维结构的检测方法VoxDet

4、建立实例感知数据集

5、实验结果

Talk·预习资料

论文链接:

https://arxiv.org/abs/2005.10420

论文链接:

https://arxiv.org/abs/2211.11629

论文链接:

https://arxiv.org/abs/2204.10776

论文链接:

https://arxiv.org/abs/2305.17220

Talk·提问交流

在Talk界面下的**【交流区】**参与互动!留下你的打call🤟和问题🙋,和更多小伙伴们共同讨论,被讲者直接翻牌解答!

你的每一次贡献,我们都会给予你相应的i豆积分,还会有惊喜奖励哦!

Talk·嘉宾介绍

李博文

卡内基梅隆大学·博士生

我是卡内基梅隆大学机器人研究所在读博士生,师从Sebastian Scherer教授。我的主要研究方向是机器人学,视觉感知,与神经符号推理。李博文曾以第一作者身份在ECCV,ICCV,NeurIPS等计算机视觉顶级会议发表多篇研究论文。其中关于实例三维感知的成果VoxDet入选为NeurIPS 2023 Spotlight。

个人主页:

https://www.techbeat.net/grzytrkj?id=38301


关于TechBeat人工智能社区

TechBeat(www.techbeat.net)隶属于将门创投,是一个荟聚全球华人AI精英的成长社区。

我们希望为AI人才打造更专业的服务和体验,加速并陪伴其学习成长。

期待这里可以成为你学习AI前沿知识的高地,分享自己最新工作的沃土,在AI进阶之路上的升级打怪的根据地!

更多详细介绍>>TechBeat,一个荟聚全球华人AI精英的学习成长社区

相关推荐
zdl6863 小时前
易信easyMarkets:出金申请规范推进帮助用户澄清诈骗担忧
机器人
小赵AI手记3 小时前
技术拆解(十五)具身智能:RT-2为什么能听懂“灭绝动物”?VLM知识如何变成动作
人工智能·机器人
逻辑君5 小时前
ANNA 认知引擎 · Humanoid 机器人训练白皮书
人工智能·深度学习·机器学习·机器人
bryant_meng9 小时前
【Point Cloud】Point Cloud Fundamentals(1)
计算机视觉·点云·点云配准·点云分割·点云检测·点云特征提取
robottt66611 小时前
30KG重载协作机器人差异:柔性力控与恒力打磨,越疆领全域落地
机器人
w32963627111 小时前
Gazebo 机器人实操:驱动一辆差速小车
机器人
w32963627113 小时前
ros2命令行工具与 turtlesim
机器人
w32963627113 小时前
ros2环境准备
机器人
江畔柳前堤1 天前
信号的本质——从模拟波形到AI中的数据张量
人工智能·深度学习·机器学习·计算机视觉·数据挖掘·语音识别
HyperAI超神经1 天前
15亿参数挑战机器人控制,MiniCPM-RobotManip正式开源;覆盖文本/图/视频/动作序列,英伟达发布全模态模型Cosmos3-Edge
人工智能·深度学习·机器人·多模态·图像生成·具身智能·智能体