不知道大家最近有没有详细了解大模型方面,现在离了AI几乎就没法干活儿了。
而且最关键的是现在面试去,无论前端、后端、测试岗都会问AI。我之前还见过一个公司面试问"过拟合 ",我当时就反问他,我面的不是前端岗嘛?
人家也很有理:我们这是前端岗,但是需要深度使用AI,还牵扯一部分模型训练相关的。
我了个去,合着现在前端不光得会后端的东西,连AI和算法岗的活儿也一块儿干了。
最近大模型也是扎堆上新,不知道大家关注没有。
首先是Kimi K3,Kimi K3 是首个达到 2.8 万亿参数规模的开源模型,号称是3 万亿级别模型。



注意,其他的模型目前没有超过这个规模的,所以在参数规模方面它是绝对的第一。
根据官方提供的数据,实测过程中Kimi K3 的整体表现略落后于最强的闭源模型 Claude Fable 5 和 GPT-5.6 Sol。
但它在官方的整套评测中展现出前沿水平的能力,并稳定超过了其他所有模型。
而且只是个开始,后续估计K3还有发力点。
详细的可以去看看官推~
最搞的还不是这个,K3 是7月17号发布的,仅仅过了一天,官方又发了一篇公告:

总结一句话:我们已经麻了,大家先等等。
紧跟着就是阿里这边宣布发布Qwen3.8 Max预览版,参数规模也不小,高达2.4万亿。
略小于Kimi K3,但是在行业内这个参数规模已经很大了。

官方宣称其综合能力在全球范围内仅次于Anthropic的Fable 5,但是目前完整模型权重还没开放,大家还需要再等等。
目前,预览版已在阿里旗下代码开发平台Qoder、QoderWork及Token Plan上线,公众对话版本同步开放。
还有就是之前放出消息的DeepSeek V4,之前上线开源的那个是预览版,现在这个是正式版,大家做个区分。

之前的预览版有Pro、Flash两个版本,估计正式版也是这两个版本。
按照内测大哥们的总结:V4正式版整体表现接近Opus 4.8级别,编码能力不弱于GTP-5.6 Sol。
Agent能力和3D、SVG这个方面能力大幅度提升,据说是同样的任务比Fable 5 迭代轮数多。
但是就这个总结上来说,估摸着够呛能干得过Kimi K3。
不过DeepSeek之前发的邮件说启用"峰谷计费"的定价策略(创意抄袭国家电网是吧,哈哈!),那时候就预告了V4正式版是7月中旬上。

所以我猜哈,我猜的。
大概率性能上干不过,就从价格上干。
影响使用的也不单单只有性能一个指标,价格也是一个很重要的方面。
就跟之前DeepSeek V4 Pro Max和Opus 4.6 Max一样,性能只差0.2%,但是价格只有七分之一,可谓是"性价比"拉爆~
等等看吧,最终结论还是以官方为准。
但是现在AI的发布节奏都快赶上当年的山寨机了,上新速度 Cua Cua 的!