大语言模型在端到端智驾中的应用

大语言模型在端到端智驾中的应用

双系统端到端

小鹏:AI天玑系统---神经网络XNet+规控大模型XPlanner+大语言模型XBrain

商汤绝影:DriveAGI

理想:端到端+VLM

VLA端到端

Waymo:EMMA

OPENEMMA

Wayve:LINGO-2

Awesome-VLM-AD-ITS Public
万字总结 - 2023大模型与自动驾驶论文走马观花

待看论文

VLM-AD:通过视觉语言模型监督实现端到端自动驾驶

WiseAD:基于视觉-语言模型的知识增强型端到端自动驾驶

Senna:连接大型视觉-语言模型和端到端自动驾驶

DriveGenVLM:基于视觉-语言模型的自动驾驶真实世界视频生成

攻克复杂驾驶场景!

SimpleLLM4AD:用于自动驾驶的端到端视觉语言模型

DriveMLM [42] 结合额外的激光雷达数据,并提出一种基于 LLaMA [40] 的多模态模型来提供高级驾驶决策

RAG-Driver [44] 并未提供端到端解决方案,而是使用 VLM 进行知识检索 和增强的可泛化驾驶解释

VLP [40] 将真实轨迹和边界框标签转换为文本特征用于对比学习,但它并没有引入现有监督标签之外的信息

相关推荐
非门由也5 小时前
《sklearn机器学习——特征提取》
人工智能·机器学习·sklearn
机器学习之心6 小时前
基于CNN的航空发动机剩余寿命预测 (MATLAB实现)
人工智能·matlab·cnn
钝挫力PROGRAMER6 小时前
AI中的“预训练”是什么意思
人工智能
Godspeed Zhao6 小时前
自动驾驶中的传感器技术39——Radar(0)
人工智能·机器学习·自动驾驶·毫米波雷达
idealmu7 小时前
知识蒸馏(KD)详解一:认识一下BERT 模型
人工智能·深度学习·bert
Cathyqiii7 小时前
生成对抗网络(GAN)
人工智能·深度学习·计算机视觉
ai产品老杨8 小时前
打通各大芯片厂商相互间的壁垒,省去繁琐重复的适配流程的智慧工业开源了
人工智能·开源·音视频·能源
小陈phd9 小时前
高级RAG策略学习(五)——llama_index实现上下文窗口增强检索RAG
人工智能
凯禾瑞华养老实训室10 小时前
人才教育导向下:老年生活照护实训室助力提升学生老年照护服务能力
人工智能
湫兮之风11 小时前
Opencv: cv::LUT()深入解析图像块快速查表变换
人工智能·opencv·计算机视觉