DeepSeek V3-0324深度实测:小小升级,巨大进步

前言

昨日(3月24日)深夜,DeepSeek 以"小版本升级"的名义悄然推出V3-0324模型。

尽管官方未高调宣传,但6850亿参数的规模、接近Claude 3.7的编程能力以及更宽松的MIT开源协议,让这次更新成为AI开源社区的现象级事件。

白天有点事情,没有第一时间测试,这就补上。

更新内容

  • 编程能力:前端代码生成质量达Claude 3.7同级,可完整实现复杂功能模块开发。
  • 数学推理:突破高等数学全领域解题,实现从计算到逻辑推理的跨越式升级。
  • 对话交互:上下文窗口从64K扩展至128K,支持更复杂的多轮对话。
  • 响应速度:新增快速响应模式,简单任务处理效率提升40%+且API无缝兼容。
  • 免费商用:采用MIT协议,允许商业场景免费使用,降低企业集成门槛。
  • 风格调整:输出风格转向技术化、专业化,弱化拟人化表达。

提升评测

相比较DeepSeek V3,DeepSeek V3-0324在多个评测指标中都有显著提升:

  • MMLU-Pro:从75.9提升至81.2(+5.3)
  • GPQA:从59.1跃升至68.4(+9.3)
  • AIME:实现最大幅度提升,从39.6飙升至59.4(+19.8)
  • LiveCodeBench:从39.2进步到49.2(+10.0)

DataLearnerAI 的大模型官方评测排行榜可以看出,明显超过 Claude 3.5。

数据来源:www.datalearner.com/ai-models/a...

实测

挑选了两个之前分享过的场景做个对比。

SVG生成

昨天刚分享了 Claude 3.7 生成SVG的效果,今天咱就对比下 DeepSeek V3-0324 效果如何。

从理科到文科的华丽转身:Claude 3.7轻松生成SVG图形,让你创作升级 - 掘金

Claude 3.7

V3-0324

V3

虽然有些细节没有到位,但整体效果其实已经非常可以了。

毕竟为了对比,我是一字未改的采用了 Claude 3.7 的提示词(针对Claude优化过的),如果针对 DeepSeek V3 稍微优化下,估计能够更加完善。

前端界面生成

DeepSeek V3-0324这次专门提到了前端效果生成提升,那我们也测试下。

Cursor实战:非前端人员实现工作台前端需求 - 掘金

Claude 3.7

V3-0324

确实很好,可以说和 Claude 3.7 不相上下。

V3 之前版本的效果就不放了,差距有点大。

V3-0324 免费 API

之前 DeepSeek 一直使用的硅基流动 API,但是今天尚未上线 V3-0324,为了给大家看效果,就去 DeepSeek 官网充值了。

结果,刚充值完,我就看到了一篇分享,OpenRouter 上V3-0324 免费,我...

分享给大家,大家可以免费体验去。

openrouter.ai/deepseek/de...

总结

通过实测,我们看到了 DeepSeek V3-0324 在生成SVG以及前端界面方面的表现确实很不错,平均下来也是Claude 3.6+ 的水平了。

甚至,考虑到我 V3 使用经验不够,它可能还有提升空间。

让我们期待下吧,希望 DeepSeek 未来持续进步,完全替代国外的模型,也让我们可以毫无留恋地转到完整的国内生态中。

加油~

相关推荐
我材不敲代码几秒前
OpenCV+Dlib实战:人脸检测 + 表情识别 + 年龄性别预测
人工智能·opencv·计算机视觉
ModelWhale几秒前
从“社区”到“生态”:和鲸科技CEO范向伟在InnovateX大赛揭示OPC孵化“正确路径”
大数据·人工智能·科技
Binary_ey1 分钟前
车载 AR-HUD 虚像不清晰?OAS软件跨尺度仿真来助力
人工智能·ar·软件需求·光学设计·光学软件
博.闻广见2 分钟前
AI_线性代数-1.矩阵
人工智能·线性代数·矩阵
xiaoduo AI3 分钟前
客服机器人知识库多久更新一次?智能 Agent 自动爬取新问答,过期话术能否及时淘汰?
大数据·人工智能·机器人
好运的阿财4 分钟前
OpenClaw工具拆解之 sessions_list+sessions_history
人工智能·python·程序人生·ai·ai编程·openclaw
Westward-sun.5 分钟前
OpenCV 疲劳检测实战:用 dlib 计算眼睛纵横比 (EAR)
人工智能·opencv·计算机视觉·视觉检测
AI周红伟5 分钟前
Hermes Agent 工具-周红伟
linux·网络·人工智能·腾讯云·openclaw
杜子不疼.5 分钟前
Python + AI 实战:用 LangChain 搭建企业级 RAG 知识库
人工智能·python·langchain
阿杰学AI6 分钟前
AI核心知识118—大语言模型之 Software 2.0 (简洁且通俗易懂版)
人工智能·ai·语言模型·自然语言处理·aigc·编程·software 2.0