GitCode 同步发布百度 ERNIE-4.5-VL-28B-A3B-Thinking 多模态大模型

百度文心多模态思考模型 ERNIE-4.5-VL-28B-A3B-Thinking 正式开源,GitCode 同步发布,快来体验!

👉 模型开源地址: https://ai.gitcode.com/paddlepaddle/ERNIE-4.5-VL-28B-A3B-Thinking

ERNIE-4.5-VL-28B-A3B-Thinking 是在 ERNIE-4.5-VL-28B-A3B 基础上训练的深度思考模型,在视觉语言多模态理解能力上实现了显著提升。模型具备领先的文档与图表理解能力,在理科与文科综合推理、通用视觉推理等任务中表现优异,展现出更强的跨模态推理与问题解决能力。同时,结合空间定位与工具调用,该模型推出"图像思考"等创新功能,为多模态思维与交互应用带来更丰富的可能。

ERNIE-4.5-VL-28B-A3B-Thinking 作为激活仅 3B 的轻量级模型,在各项测试中的表现紧咬业界顶级旗舰模型,以轻量级规模实现了接近 SOTA 的视觉表现。
小模型,大能量

👀|视觉推理

通过大规模强化学习策略,模型在复杂视觉任务中展现卓越的多步推理、图表解析与因果推理能力。

复杂图表解析,避开高峰时段

🔢|学科计算

凭借强大视觉能力,模型在拍照解题等学科推理中实现飞跃式提升,复杂题目也能轻松搞定!

解决物理学科电阻问题 📝

📌|视觉定位

定位更精准,指令执行更灵活,轻松触发复杂工业场景下的定位功能,效率直线上升!

快速识别穿西服戴礼帽人物数量及定位🎩

模型Grounding输出结果的可视化------图中边界框对应模型生成的 "穿西装的人" 的bbox_2d坐标。

🖼️|图像思考

如同真人般思考,模型可对图片自由放大缩小,把控每个细节,洞察每一处信息!

支持图片自由放大,识别图片细节信息 🔍

🔧|工具调用

具备强大的工具调用能力,模型可即时调用图片搜索等功能,轻松识别长尾知识,实现全方位信息获取!

工具调用认识更多热门IP🙌

📺|视频理解

模型具备卓越的时间感知与事件定位能力,能够精准识别视频中不同时间段的内容变化,让视频分析更智能、更高效!

卓越定位广告片不同时段内容变化、分析更智能📹

立即体验

ERNIE-4.5-VL-28B-A3B-Thinking 模型在 GitCode 发布并开源,开发者可访问 GitCode 平台免费体验。

👉 模型开源地址: https://ai.gitcode.com/paddlepaddle/ERNIE-4.5-VL-28B-A3B-Thinking

相关推荐
陈思杰系统思考Jason6 天前
系统思考:自由职业背后的悖论
百度·微信·微信公众平台·新浪微博·微信开放平台
陈思杰系统思考Jason7 天前
系统思考:动态性复杂时代的组织认识
百度·微信·微信公众平台·新浪微博·微信开放平台
拓端研究室7 天前
2026年人工智能AI未来报告:智能体、元宇宙、教育、商业化落地|附400+份报告PDF、数据、可视化模板汇总下载
人工智能·百度
陈思杰系统思考Jason8 天前
系统思考:战略定力与组织能力
百度·微信·微信公众平台·新浪微博·微信开放平台
陈思杰系统思考Jason9 天前
系统思考:组织能力持续学习
百度·微信·微信公众平台·新浪微博·微信开放平台
geneculture11 天前
四维矩阵分析:人机互助超级个体与超级OPC关系研究——基于HI×AI、个体×团队、个体×OPC与波士顿矩阵的整合框架
人工智能·百度
陈思杰系统思考Jason11 天前
系统思考:创办人心智模式与企业规模
百度·微信·微信公众平台·新浪微博·微信开放平台
码农杂谈000712 天前
企业人工智能:2026 避坑指南,告别工具摆设,实现 AI 价值变现
人工智能·百度
陈思杰系统思考Jason14 天前
系统思考:心智模式与组织结构
百度·微信·微信公众平台·新浪微博·微信开放平台
GISer_Jing14 天前
Horse发生,新年快乐,平安喜乐
百度·微信公众平台·新浪微博