LSS论文阅读

计算机视觉通用做法:

通常将图像作为输入,并输出一个与坐标系无关的预测(例如在分类中 [19, 30, 16, 17])

或一个与输入图像相同坐标系中的预测(例如在目标检测、语义分割或全景分割中 [7, 1, 15, 36])

单目3d目标检测分为3类

1、二阶段,第一阶段网络学习2d目标检测,第二阶段网络学习2d到3d的恢复

2、伪lidar:学习深度估计,同时预测bev

3、类似于detr3d,用3维参考点,基于内外参去各个2维图像上收集信息

BEV有两个体系

第一种体系是LSS, 通过显示深度估计获取3d信息

第二种体系是BEVFormer,通过3d采样点投影到2d来获取信息。

pipeline

图像特征提取-> lift升为3维-->外参矩阵获取2d信息->splat,将3维信息拍平到bev平面上

特点

1、训练从6个图像中随意选5个,进而使模型获取对任意相机的处理能力

2、对内外参增加噪声,用于应对内外参噪声的问题。

相关推荐
咚咚王者4 小时前
人工智能之数学基础 线性代数:第三章 特征值与特征向量
人工智能·线性代数·机器学习
g***B7386 小时前
Java 工程复杂性的真正来源:从语言设计到现代架构的全链路解析
java·人工智能·架构
Shawn_Shawn9 小时前
大模型的奥秘:Token与Transformer简单理解
人工智能·llm
weixin_3776348410 小时前
【K-S 检验】Kolmogorov–Smirnov计算过程与示例
人工智能·深度学习·机器学习
菜鸟起航ing11 小时前
Spring AI 全方位指南:从基础入门到高级实战
java·人工智能·spring
Guheyunyi11 小时前
智慧消防管理系统如何重塑安全未来
大数据·运维·服务器·人工智能·安全
ZZY_dl11 小时前
训练数据集(三):真实场景下采集的课堂行为目标检测数据集,可直接用于YOLO各版本训练
人工智能·yolo·目标检测
yiersansiwu123d12 小时前
AI伦理治理:在创新与规范之间寻找动态平衡
人工智能
华清远见成都中心12 小时前
成都理工大学&华清远见成都中心实训,助力电商人才培养
大数据·人工智能·嵌入式
爱好读书12 小时前
AI生成er图/SQL生成er图在线工具
人工智能