AI大模型扎堆上新?Kimi K3、Qwen 3.8、DeepSeek v4马上上线,旧的还没用上,新的就来了!比当年山寨机上新还快!

不知道大家最近有没有详细了解大模型方面,现在离了AI几乎就没法干活儿了。

而且最关键的是现在面试去,无论前端、后端、测试岗都会问AI。我之前还见过一个公司面试问"过拟合 ",我当时就反问他,我面的不是前端岗嘛?

人家也很有理:我们这是前端岗,但是需要深度使用AI,还牵扯一部分模型训练相关的。

我了个去,合着现在前端不光得会后端的东西,连AI和算法岗的活儿也一块儿干了。

最近大模型也是扎堆上新,不知道大家关注没有。


首先是Kimi K3,Kimi K3 是首个达到 2.8 万亿参数规模的开源模型,号称是3 万亿级别模型。

注意,其他的模型目前没有超过这个规模的,所以在参数规模方面它是绝对的第一。

根据官方提供的数据,实测过程中Kimi K3 的整体表现略落后于最强的闭源模型 Claude Fable 5 和 GPT-5.6 Sol。

但它在官方的整套评测中展现出前沿水平的能力,并稳定超过了其他所有模型。

而且只是个开始,后续估计K3还有发力点。

详细的可以去看看官推~

最搞的还不是这个,K3 是7月17号发布的,仅仅过了一天,官方又发了一篇公告:

总结一句话:我们已经麻了,大家先等等


紧跟着就是阿里这边宣布发布Qwen3.8 Max预览版,参数规模也不小,高达2.4万亿

略小于Kimi K3,但是在行业内这个参数规模已经很大了。

官方宣称其综合能力在全球范围内仅次于Anthropic的Fable 5,但是目前完整模型权重还没开放,大家还需要再等等。

目前,预览版已在阿里旗下代码开发平台Qoder、QoderWork及Token Plan上线,公众对话版本同步开放。


还有就是之前放出消息的DeepSeek V4,之前上线开源的那个是预览版,现在这个是正式版,大家做个区分。

之前的预览版有Pro、Flash两个版本,估计正式版也是这两个版本。

按照内测大哥们的总结:V4正式版整体表现接近Opus 4.8级别,编码能力不弱于GTP-5.6 Sol。

Agent能力和3D、SVG这个方面能力大幅度提升,据说是同样的任务比Fable 5 迭代轮数多。

但是就这个总结上来说,估摸着够呛能干得过Kimi K3。

不过DeepSeek之前发的邮件说启用"峰谷计费"的定价策略(创意抄袭国家电网是吧,哈哈!),那时候就预告了V4正式版是7月中旬上。

所以我猜哈,我猜的。

大概率性能上干不过,就从价格上干。

影响使用的也不单单只有性能一个指标,价格也是一个很重要的方面。

就跟之前DeepSeek V4 Pro Max和Opus 4.6 Max一样,性能只差0.2%,但是价格只有七分之一,可谓是"性价比"拉爆~

等等看吧,最终结论还是以官方为准。

但是现在AI的发布节奏都快赶上当年的山寨机了,上新速度 Cua Cua 的!

相关推荐
怕浪猫6 小时前
设计你自己的可替换能力:三段式 Seam 实战,从需求到上线
agent·产品
许雪里7 小时前
XXL-BOOT v2.1.0 发布:React 全新上线 · 全栈 TypeScript · AI+SKILL 驱动开发
ai编程
腾讯云大数据8 小时前
DataBuddy数据语义驱动的企业Agent Runtime实践
大数据·人工智能·腾讯云·agent
AI砖家8 小时前
Kimi K3 本地部署全解析:需要什么配置的电脑,到底要花多少钱?
人工智能·ai编程
小磊哥er9 小时前
深入解构Claude Code - 第 7 篇 · 连接外面的世界
javascript·ai编程
星核0penstarry9 小时前
试一试用gr.Workflow把AI多步骤串联变成可视化画布
人工智能·python·ai作画·api·ai编程·工作流·api聚合平台
小磊哥er9 小时前
深入解构Claude Code - 第 6 篇 · 终端里的图形界面
javascript·ai编程
软件聚导航10 小时前
「聚小软 AI 助手」技术升级:从数据库检索到 RAG 知识库问答
前端·数据库·mysql·微信小程序·小程序·ai编程·rag
plainGeekDev11 小时前
Agent高级编排模式
agent·ai编程·claude