LSS论文阅读

计算机视觉通用做法:

通常将图像作为输入,并输出一个与坐标系无关的预测(例如在分类中 19, 30, 16, 17

或一个与输入图像相同坐标系中的预测(例如在目标检测、语义分割或全景分割中 7, 1, 15, 36

单目3d目标检测分为3类

1、二阶段,第一阶段网络学习2d目标检测,第二阶段网络学习2d到3d的恢复

2、伪lidar:学习深度估计,同时预测bev

3、类似于detr3d,用3维参考点,基于内外参去各个2维图像上收集信息

BEV有两个体系

第一种体系是LSS, 通过显示深度估计获取3d信息

第二种体系是BEVFormer,通过3d采样点投影到2d来获取信息。

pipeline

图像特征提取-> lift升为3维-->外参矩阵获取2d信息->splat,将3维信息拍平到bev平面上

特点

1、训练从6个图像中随意选5个,进而使模型获取对任意相机的处理能力

2、对内外参增加噪声,用于应对内外参噪声的问题。

相关推荐
蓝速科技3 小时前
桌面双屏翻译机量产调试:三类场景兼容性破局方案丨蓝速科技
运维·数据库·人工智能·科技·技术分享
见闻小天地3 小时前
脱硫脱硝塔选变频器避坑指南:四方DL500变频器使用体验分享
大数据·运维·人工智能·业界资讯
打工仔折腾 AI3 小时前
普通摄像头接入AI识别:绿联NAS部署Frigate监控实战
人工智能·后端·python·性能优化·ai agent 实战
2601_957638243 小时前
常佐网络做的裂变小程序会不会被封:实践与思考
人工智能·常佐网络做的裂变小程序会
爱丶不疚3 小时前
Skill的形态有哪些?什么样的Skill 叫做好Skill?
人工智能·agent
逻辑君3 小时前
MoreLogic RAG 个人免费版 · 产品宣传手册和产品白皮书
人工智能·机器学习
AskHarries3 小时前
我用 Grok Bot 搭了一个「数字军团」,还真的把网站做出来了
人工智能
byte轻骑兵3 小时前
【BlueZ 】input 模块:蓝牙鼠标/键盘等输入设备的基础适配逻辑
linux·人工智能·bluez·电脑蓝牙·嵌入式蓝牙
autotian3 小时前
神经网络及其应用
人工智能·深度学习·神经网络
雾屿_Mistisle3 小时前
AI安全设计总结
人工智能·机器学习·数据分析