大语言模型在端到端智驾中的应用

大语言模型在端到端智驾中的应用

双系统端到端

小鹏:AI天玑系统---神经网络XNet+规控大模型XPlanner+大语言模型XBrain

商汤绝影:DriveAGI

理想:端到端+VLM

VLA端到端

Waymo:EMMA

OPENEMMA

Wayve:LINGO-2

Awesome-VLM-AD-ITS Public
万字总结 - 2023大模型与自动驾驶论文走马观花

待看论文

VLM-AD:通过视觉语言模型监督实现端到端自动驾驶

WiseAD:基于视觉-语言模型的知识增强型端到端自动驾驶

Senna:连接大型视觉-语言模型和端到端自动驾驶

DriveGenVLM:基于视觉-语言模型的自动驾驶真实世界视频生成

攻克复杂驾驶场景!

SimpleLLM4AD:用于自动驾驶的端到端视觉语言模型

DriveMLM [42] 结合额外的激光雷达数据,并提出一种基于 LLaMA [40] 的多模态模型来提供高级驾驶决策

RAG-Driver [44] 并未提供端到端解决方案,而是使用 VLM 进行知识检索 和增强的可泛化驾驶解释

VLP [40] 将真实轨迹和边界框标签转换为文本特征用于对比学习,但它并没有引入现有监督标签之外的信息

相关推荐
辉视广播对讲4 小时前
医院IPTV,让医疗服务更有温度
网络·人工智能
xqqxqxxq4 小时前
Java AI智能P图工具技术笔记
java·人工智能·笔记
AI袋鼠帝4 小时前
本地4B开源模型,把任何App当Skil用!告 别token焦虑,私密性强~
人工智能
ComputerInBook4 小时前
数字图像处理(4版)——第 11 章——特征提取(下)(Rafael C.Gonzalez&Richard E. Woods)
图像处理·人工智能·特征提取
在线打码4 小时前
ToutiaoAI:AI 驱动的智能新闻杂志平台
人工智能·ai·aigc·ai写作·新闻资讯
ar01234 小时前
AR电路巡检:让电力运维进入智能可视化时代
运维·人工智能·ar
低调小一4 小时前
Midscene.js 原理拆解:它不是“自然语言点按钮”,而是一套会看屏幕的 UI 自动化运行时
人工智能·rnn·架构·大模型·transformer·tdd·midscene
Slow菜鸟5 小时前
Codex CLI 教程(五)| Skills 安装指南:面向 Java 全栈工程师打造个人 ECC(V1版)
大数据·前端·人工智能
昇腾CANN5 小时前
5月11日直播丨CANN算子挑战赛(江山赛区)赛题和评分规则解读
人工智能·昇腾·cann·deepseek
菜鸡信息技术5 小时前
VSCode 安装 Claude Code 插件,配置 DeepSeek V4(Windows)
人工智能