新版 DeepSeek-V3 官方报告出炉:超越 GPT-4.5,仅靠改进后训练

刚刚,DeepSeek 官方发布 DeepSeek-V3 模型更新技术报告。

V3 新版本在数学、代码类相关评测集成绩超过 GPT-4.5

而且这只是通过改进后训练方法实现

DeepSeek-V3-0324 和之前的 DeepSeek-V3 使用同样的 base 模型

打破了之前传言该版本 base 模型是 R2 的传言。

新版本参数量约为 660B,与此前网传的 685B 有所出入。

开源版本上下文长度为 128K(网页端、App 和 API 提供 64K 上下文)。

私有化部署时只需要更新 checkpoint 和 tokenizer_config.json(tool calls 相关变动)。

目前,想要体验这一版本模型,只需用户登录官方网页、APP、小程序进入对话界面后,关闭深度思考即可体验。API 接口和使用方式保持不变。

官方建议,此后非复杂推理任务使用 V3 新版本更好。

此外,官方还进一步展示了新版本在各个维度的能力。

前端开发

生成代码可用性更高,视觉效果也更好。

中文写作

相较于 R1 版有进一步优化,特别提升了中长篇的内容质量。

比如写一篇关于苏轼生平的散文:

中文搜索

联网情况下,V3 新版本的搜索输出内容也更详实准确、排版更清晰美观。

现在写一份 3000 字的市场报告也是 so easy(上下滑动查看完整内容):

此外,V3 新版本在工具调用、角色扮演、问答闲聊等方面也进一步提升。

今天白天不少网友也上手实测了诸多能力,比如做个小游戏:

视频详情

该版本模型采用宽松的 MIT 开源协议。

且可直接部署在 M3 Ultra 的 Mac Studio 上。

这意味着大模型开发应用的门槛更进一步降低。

话不多说,趁着深夜,还没睡的赶紧去体验最新版吧~

参考链接: mp.weixin.qq.com/s/XK6ymJL7y...

--- ---

相关推荐
AI创界者4 分钟前
《2026 视觉革命:深度测评 GPT-Image-2,基于 DMXAPI 实现 4K 超分与批量生图实战》
人工智能
云上码厂6 分钟前
2023年之前物理信息神经网络PINN papers
人工智能·深度学习·神经网络
aini_lovee10 分钟前
多目标粒子群优化(MOPSO)双适应度函数MATLAB实现
人工智能·算法·matlab
Cosolar11 分钟前
提示词工程面试题系列 - Zero-Shot Prompting 和 Few-Shot Prompting 的核心区别是什么?
人工智能·设计模式·架构
灵机一物15 分钟前
灵机一物AI原生电商小程序、PC端(已上线)-【无标Anthropic 研究深度解析:AI 对就业市场的实际冲击与高危职业排行题】
人工智能·ai·程序员·职业发展·anthropic·就业市场
电子科技圈17 分钟前
芯科科技在蓝牙亚洲大会展示汽车与边缘AI前沿蓝牙创新技术, 解锁车用、家居、健康及工商业等应用场景
人工智能·科技·嵌入式硬件·mcu·物联网·网络安全·汽车
redreamSo24 分钟前
让AI Agent自动接Issue、写代码、上线:我用200行代码搭了一个全自动开发流水线
人工智能·开源·github
Cosolar32 分钟前
告别无脑循环:深入解析 ReWOO 与 Plan-and-Execute Agent 架构
人工智能·面试·全栈
Hector_zh35 分钟前
AI多租户平台的物理隔离方案实践与权衡
人工智能
啦啦啦_999944 分钟前
2. 分类问题的评估
人工智能·分类·数据挖掘