阿里通义千问开源Qwen2.5系列模型:Qwen2-VL-72B媲美GPT-4

通义千问团队近日重磅宣布,继其Qwen2模型发布仅三个月后,再次推出Qwen家族的全新成员------Qwen2.5系列语言模型,并已全面开源。这次开源行动堪称史上规模之最,涵盖了通用型Qwen2.5,以及专为编程和数学领域打造的Qwen2.5-Coder与Qwen2.5-Math两大细分模型。

人工智能 - Ai工具集 - 未来办公人的智能办公生活导航网站!

AI-321工具集 | 专注全球AI工具推荐

据悉,Qwen2.5系列模型基于最新的大规模数据集进行了深度预训练,该数据集规模高达惊人的18T tokens。与上一代Qwen2相比,新模型在知识吸收、编程技巧以及数学解题能力上均实现了质的飞跃。值得一提的是,该模型能够处理超长文本,生成长度可达8K tokens的内容,同时依然兼容29种以上的语言。

值得一提的是,Qwen2.5系列模型的开源采用了宽松的Apache2.0许可证,并且提供了多个不同规模的版本,以满足各种实际应用场景的需求。更令人振奋的是,通义千问团队还同步开源了性能可与GPT-4相媲美的Qwen2-VL-72B模型。

在各项性能上,新模型取得了显著的进步。无论是指令执行、长文本生成,还是结构化数据的理解与输出方面,Qwen2.5都表现得更为出色。特别是在编程和数学这两个专业领域,经过专业数据集针对性训练的Qwen2.5-Coder和Qwen2.5-Math模型展现出了卓越的专业能力。

想要亲身体验Qwen2.5系列模型的强大实力吗?请点击:Qwen2.5合集!

相关推荐
心动啊12116 分钟前
机器学习概念2
人工智能·机器学习
港港胡说26 分钟前
机器学习(西瓜书)学习——绪论
人工智能·学习·机器学习
LeeZhao@29 分钟前
【AGI】GPT-5:博士级AI助手的全面进化与协作智能时代的黎明
人工智能·gpt·agi
深圳UMI1 小时前
AI模型设计基础入门
大数据·人工智能
白雪讲堂1 小时前
【GEO从入门到精通】生成式引擎与其他 AI 技术的关系
大数据·人工智能·数据分析·智能电视·geo
魔力之心2 小时前
actuary notes[1]
人工智能·概率
Fine姐2 小时前
数据挖掘2.3-2.5:梯度,梯度下降以及凸性
人工智能·数据挖掘
2501_924730613 小时前
智慧城管复杂人流场景下识别准确率↑32%:陌讯多模态感知引擎实战解析
大数据·人工智能·算法·计算机视觉·目标跟踪·视觉检测·边缘计算
CONDIMENTTTT3 小时前
[机器学习]05-基于Fisher线性判别的鸢尾花数据集分类
人工智能·分类·数据挖掘