端到端自动驾驶

自动驾驶主要流程:感知->预测->规划

预测是预测周围目标(车、行人、动物等)的轨迹,规划是规划自车的运动轨迹。

UniAD[CVPR 2023]:

使用transformer架构,统一自动驾驶流程 ,完成所有检测,跟踪,建图,轨迹预测,占据栅格预测与规划的端到端推理。

参考:

CVPR 2023 Award Candidate | 自动驾驶通用算法框架UniAD - OpenGVLab的文章 - 知乎

https://zhuanlan.zhihu.com/p/616433397

VAD[ICCV2023]:

核心在于场景表征使用矢量化 的方式,非图像常用的栅格化。好处就是可以加快推理。

【「你好,开发者」 ICCV 2023 VAD 基于矢量化环境表征的高效端到端自动驾驶框架】 https://www.bilibili.com/video/BV12u4y1V7zV/?share_source=copy_web

FusionAD

基于BEV统一相机和雷达多模态输入 。task使用类似FPN的层级结构。

https://hub.baai.ac.cn/view/28712

Tesla FSD V12

AD-MLP

仅仅使用了传感器数据,利用简单的mlp网络,就在nuscene plan数据集上得到了很好的效果。说明nuscene plan数据集过于简单,仅在这个上面做开环测试不能很好的说明问题,需要引入其他的如仿真环境中做更多的闭环测试。

参考:

端到端自动驾驶算法在 nuScenes 数据集上的开环评测或许并不靠谱 - Muyun99的文章 - 知乎

https://zhuanlan.zhihu.com/p/654533840

相关推荐
大模型真好玩4 分钟前
LangGraph实战项目:从零手搓DeepResearch(二)——DeepResearch架构设计与实现
人工智能·python·langchain
地平线开发者12 分钟前
新版 perf 文件解读与性能分析
算法·自动驾驶
Elastic 中国社区官方博客24 分钟前
Elasticsearch 推理 API 增加了开放的可定制服务
大数据·数据库·人工智能·elasticsearch·搜索引擎·ai·全文检索
濑户川30 分钟前
基于DDGS实现图片搜索,文本搜索,新闻搜索
人工智能·爬虫·python
ReinaXue1 小时前
大模型【进阶】(六)QWen2.5-VL视觉语言模型详细解读
图像处理·人工智能·神经网络·目标检测·计算机视觉·语言模型·transformer
童欧巴1 小时前
去班味儿这件事,八爪鱼RPA敢做成这样?
人工智能·aigc
~kiss~1 小时前
膨胀算法去除低谷噪声
人工智能·算法·计算机视觉
爱看科技1 小时前
苹果智能眼镜研发进度更新,三星/微美全息提速推进AI+AR产业化进程
人工智能·ar
jjjxxxhhh1231 小时前
【学习】USB摄像头 -> FFmpeg -> H264 -> AI模型
人工智能·学习·ffmpeg
CodeJourney.1 小时前
Sora引爆AI视频革命
人工智能·音视频