DeepSeek V3“小版本升级” 实测堪比 V3.5,非推理模型也有 “啊哈时刻”,7 米甘蔗过 2 米门想通了

DeepSeek V3 升级了,新版本 V3-0324。

官方轻描淡写只说是 "小版本升级",但很多人实测下来可一点也不小。

把流行的小球弹跳测试,提升难度到 4 维空间超立方体也没问题。

天哪,如果这只是一个小更新,那我想象不出大更新会是什么样子。

编程这块,只需一句提示词开发一个完整产品着陆页,带自适应布局带动效,被评价为与 Claude 3.7 Sonnet 同一水平。

由于发布时间太短,还没有正式测评结果,不过在开发者 Xeophon 的个人 Benchmark 上所有指标都有大提升,成为该测试下最好的非推理模型。

不是推理模型也有 "啊哈时刻"

DeepSeek-V3-0324 并非推理模型,在回答之前不会给出思考过程,但依然遵循一定的思维方式分解问题。

走入死胡同的话,还表现出自主回到上一步重新思考的能力。

在 "9.11 和 9.9 那个大"、"Straberry 有多少个 r" 已经不成问题的今天,最新折磨 AI 的难题是"让 7 米长的甘蔗通过 2 米高 1 米宽的门"。

在量子位的测试中,DeepSeek-V3-0324 先是像它的前辈以及许多其他 AI 一样碰壁。

碰壁之后开始重新思考题目本身的含义,后面依旧陷入误区,但突然在中文解题过程中夹杂一句英语思考,类似 DeepSeek-R1 技术报告中的 "啊哈时刻"

等等,这似乎与之前的对角线方法相似,也许我遗漏了什么。

顿悟之后,突然就走上了正确的道路,注意到了题目中没直接提到的隐藏条件。

虽然从计算过程看,还是没理解到问题的本质,但好歹得出了解决方案,还认识到了自己的误区。

依旧免费, 依旧开源

像这样的优秀模型依旧免费, 依旧开源,权重文件已火速上线 HuggingFace,使用最宽松的 MIT 协议。

所有权重文件加起来占硬盘空间约 688GB,与初代 v3 保持一致,说明依然是 671B 参数的 MoE 模型,目前没有更多技术细节,还需等待官方进一步发布公告。

目前在官网和官方 APP(关闭深度思考即可)、HuggingFace 等渠道都能体验到 v3-0324。

也可以到大模型竞技场去与其他模型 pk,不过投票结果还要等一段时间才能出来。

当然最让大家期待的还是,v3 更新了,r2 还会远吗?

官网试玩:

chat.deepseek.com/

HuggingFace:

huggingface.co/deepseek-ai...

参考链接:

1\][x.com/TheXeophon/...](https://link.juejin.cn?target=https%3A%2F%2Fx.com%2FTheXeophon%2Fstatus%2F1904225899957936314 "https://x.com/TheXeophon/status/1904225899957936314") \[2\][x.com/Yuchenj_UW/...](https://link.juejin.cn?target=https%3A%2F%2Fx.com%2FYuchenj_UW%2Fstatus%2F1904223627509465116 "https://x.com/Yuchenj_UW/status/1904223627509465116") \[3\][x.com/risphereedi...](https://link.juejin.cn?target=https%3A%2F%2Fx.com%2Frisphereeditor%2Fstatus%2F1904194061780590773 "https://x.com/risphereeditor/status/1904194061780590773") --- **完** ---

相关推荐
合合技术团队2 分钟前
理解文字识别:一文读懂OCR商业化产品的算法逻辑
大数据·人工智能·算法
自由鬼6 分钟前
企业在本地部署 Hugging Face后如何微调
人工智能·python·深度学习
爱分享的花宝12 分钟前
Dify +飞书多维表格: 实现一键识别票据到Execl表格
人工智能·deepseek
Bony-15 分钟前
适合各个层次的 7 个计算机视觉项目【1】:植物病害检测
人工智能·计算机视觉
蹦蹦跳跳真可爱58917 分钟前
Python----计算机视觉处理(Opencv:图像旋转:插值方法,边缘填充方法)
人工智能·opencv·计算机视觉
Lx35217 分钟前
📌中小团队突围指南:低资源玩转AI落地的5种姿势
人工智能
RWKV元始智能18 分钟前
全新开源!边缘设备也可运行的推理模型 RWKV7-G1 0.4B 正式发布
人工智能·架构·开源
结构化知识课堂21 分钟前
Axure项目实战:智慧城市APP(六)市民互动(动态面板、显示与隐藏)
人工智能·智慧城市·axure·动态面板
阿里云云原生24 分钟前
如何在IDEA中借助深度思考模型 QwQ 提高编码效率?
人工智能·阿里云·云原生·通义灵码·ai程序员
火山引擎边缘云25 分钟前
重构智能设备管理范式:火山引擎端智能解决方案上新,多重 AI 服务即刻享用!
人工智能·llm·边缘计算