元乘象Chatimg3.0来了,赶超GPT-4V,还给出产业升级新打法

最近,AI 领域都在思考一件事:多模态大模型落地产业,好的打法应该是什么?

通用人工智能时代正在到来,AI 大模型技术已成为数字经济下基础设施建设的重要支撑,也成为产业智能化转型的核心「引擎」,AI 大模型 + 产业应用迎来了前所未有的发展机遇。

在 10 月 28 日举办的 CNCC 2023「超智融合 AI 大模型应用落地发展论坛」上,智子引擎发布了「元乘象 Chatimg3.0」,展示了多模态通用生成模型「元乘象 Chatimg3.0」的最新进展与落地探索。
Chatimg3.0 核心技术的升级迭代

元乘象 Chatimg3.0 是一个超精细识别、少幻觉的多模态大模型,同时支持多图理解、物体定位、OCR 等功能。Chatimg3.0 给硬件设备装上了大脑,可实现更自然更流畅的人机交流,为 AI 多模态大模型赋能产业应用打下了坚实的基础。

与 Chatimg2.0 相比,Chatimg3.0 主要进行了两方面的升级,包括第一阶段的预训练(描述、检测、OCR 等多任务训练)以及第二阶段的指令微调(高质量的人工精筛指令集)。

为更好的评估多模态大模型的能力,智子引擎构建了一个全新的多模态对话测试集,从描述、推理、检测、问答、业务五个方面对模型能力进行评测,而且在问答和业务两个方面的能力上赶超 GPT-4V,展现出了国产大模型优秀的发展潜力。

以下是 Chatimg3.0 对比 GPT-4V 在测试中的具体表现:

描述:

左:Chatimg3.0,右:GPT-4V。 *

*推理:

左:Chatimg3.0,右:GPT-4V。

检测:

左:Chatimg3.0,右:GPT-4V。

问答:

左:Chatimg3.0,右:GPT-4V。

左:Chatimg3.0,右:GPT-4V。 *

*重点领域探索应用

目前,智子引擎已经将「元乘象 Chatimg3.0」应用于全域防控和无人机巡检等领域,通过与无人机、电子探头等前端感知设备的融合,升级传统巡检和安防,实现了 AI 缺陷识别、异常检测、行为分析、重点监控、自主巡查、风险预测等功能,推动了 AI 工程化革新进程。

作为国内首个多模态大模型研发团队,智子引擎不仅在人才和技术上拥有先天的优势,多个知名投资机构和 IT 行业龙头的天使投资,也让这家公司「如虎添翼」。

在软通动力、华软科技等知名企业的协同助力下,融合「元乘象 Chatimg3.0」研发的「智子・天穹」和「智子・天巡」系统一经面世便得到了行业的关注,产品被快速应用于城市治理、智慧电力、管道巡检、园区管理、农业、金融等多行业应用场景,并逐步开始试点部署。

未来,为了加速大模型产业应用落地,促进数字经济可持续发展,智子引擎将继续加强模型训练和能力升级,汇聚行业顶尖人才和优势资源,为大模型助力产业升级不遗余力。核心模型 「元乘象 Chatimg」未来还会在 AI agents、具身智能等方向持续发力,并将收获更多行业关注。

相关推荐
程序员鱼皮16 小时前
微信正式接入 OpenClaw,Cursor 被锤套壳 Kimi… 本周最炸 AI 热点汇总
aigc·ai编程·资讯
冬奇Lab4 天前
一天一个开源项目(第55篇):Spec Kit - GitHub 开源的规范驱动开发工具包
开源·ai编程·资讯
冬奇Lab5 天前
一天一个开源项目(第54篇):Supabase - 开源的 Postgres 开发平台,Firebase 替代方案
后端·开源·资讯
冬奇Lab6 天前
一天一个开源项目(第53篇):PDF 补丁丁 - 功能全面的 PDF 工具箱,编辑书签、解除限制、合并拆分、OCR 识别
开源·资讯
冬奇Lab7 天前
一天一个开源项目(第52篇):OPB-Skills - 一人公司的 AI 团队,91 个专业 Skill 覆盖完整业务
人工智能·开源·资讯
冬奇Lab9 天前
一天一个开源项目(第51篇):system-prompts-and-models-of-ai-tools - AI 工具系统提示词和模型资源集合
开源·ai编程·资讯
bryant_meng10 天前
【Reading Notes】(7.11)Favorite Articles from 2024 November
人工智能·深度学习·计算机视觉·aigc·资讯
冬奇Lab10 天前
一天一个开源项目(第50篇):MarkItDown - Microsoft 开源的文件转 Markdown 工具,支持 PDF、Office、图片、音频等 15
开源·markdown·资讯
冬奇Lab10 天前
一天一个开源项目(第49篇):Anything to NotebookLM - 多源内容智能处理器,一句话变播客、PPT、思维导图、Quiz
人工智能·开源·资讯
冬奇Lab11 天前
一天一个开源项目(第48篇):Agent-Reach - 给 AI Agent 装上互联网能力,零 API 费用支持 Twitter、Reddit、YouTub
人工智能·开源·资讯