大语言模型在端到端智驾中的应用

大语言模型在端到端智驾中的应用

双系统端到端

小鹏:AI天玑系统---神经网络XNet+规控大模型XPlanner+大语言模型XBrain

商汤绝影:DriveAGI

理想:端到端+VLM

VLA端到端

Waymo:EMMA

OPENEMMA

Wayve:LINGO-2

Awesome-VLM-AD-ITS Public
万字总结 - 2023大模型与自动驾驶论文走马观花

待看论文

VLM-AD:通过视觉语言模型监督实现端到端自动驾驶

WiseAD:基于视觉-语言模型的知识增强型端到端自动驾驶

Senna:连接大型视觉-语言模型和端到端自动驾驶

DriveGenVLM:基于视觉-语言模型的自动驾驶真实世界视频生成

攻克复杂驾驶场景!

SimpleLLM4AD:用于自动驾驶的端到端视觉语言模型

DriveMLM [42] 结合额外的激光雷达数据,并提出一种基于 LLaMA [40] 的多模态模型来提供高级驾驶决策

RAG-Driver [44] 并未提供端到端解决方案,而是使用 VLM 进行知识检索 和增强的可泛化驾驶解释

VLP [40] 将真实轨迹和边界框标签转换为文本特征用于对比学习,但它并没有引入现有监督标签之外的信息

相关推荐
唔皇万睡万万睡1 分钟前
基于模板匹配的数字和大写字母识别(Matlab)
图像处理·人工智能·机器学习·计算机视觉·matlab
阿里云云原生13 分钟前
阿里巴巴 AI Coding 分享会 —— Qoder Together 广州站来啦!
人工智能
DO_Community15 分钟前
在 DigitalOcean GPU 云服务上使用 LangChain 构建Serverless AI 应用
人工智能·langchain·serverless
亚马逊云开发者1 小时前
Agentic AI基础设施实践经验系列(六):Agent质量评估
人工智能
郁大锤1 小时前
OpenAI responses使用教程(三) ——Responses create python SDK 介绍
人工智能·python·ai·openai
余衫马1 小时前
聚类算法入门:像魔法一样把数据自动归类
人工智能·算法·机器学习·聚类
半臻(火白)1 小时前
Kimi K2 Thinking:开源时代的「思考代理」革命,重新定义AI复杂任务处理
人工智能
水如烟1 小时前
孤能子视角:“十五五“规划动力学分析
人工智能
AI人工智能+1 小时前
无缝对接与数据驱动:护照MRZ识别技术在智慧景区管理中的深度应用
人工智能·计算机视觉·ocr·护照mrz码识别
一水鉴天2 小时前
整体设计 全面梳理复盘之30 Transformer 九宫格三层架构 Designer 全部功能定稿(初稿)之2
前端·人工智能