AI大模型扎堆上新?Kimi K3、Qwen 3.8、DeepSeek v4马上上线,旧的还没用上,新的就来了!比当年山寨机上新还快!

不知道大家最近有没有详细了解大模型方面,现在离了AI几乎就没法干活儿了。

而且最关键的是现在面试去,无论前端、后端、测试岗都会问AI。我之前还见过一个公司面试问"过拟合 ",我当时就反问他,我面的不是前端岗嘛?

人家也很有理:我们这是前端岗,但是需要深度使用AI,还牵扯一部分模型训练相关的。

我了个去,合着现在前端不光得会后端的东西,连AI和算法岗的活儿也一块儿干了。

最近大模型也是扎堆上新,不知道大家关注没有。


首先是Kimi K3,Kimi K3 是首个达到 2.8 万亿参数规模的开源模型,号称是3 万亿级别模型。

注意,其他的模型目前没有超过这个规模的,所以在参数规模方面它是绝对的第一。

根据官方提供的数据,实测过程中Kimi K3 的整体表现略落后于最强的闭源模型 Claude Fable 5 和 GPT-5.6 Sol。

但它在官方的整套评测中展现出前沿水平的能力,并稳定超过了其他所有模型。

而且只是个开始,后续估计K3还有发力点。

详细的可以去看看官推~

最搞的还不是这个,K3 是7月17号发布的,仅仅过了一天,官方又发了一篇公告:

总结一句话:我们已经麻了,大家先等等


紧跟着就是阿里这边宣布发布Qwen3.8 Max预览版,参数规模也不小,高达2.4万亿

略小于Kimi K3,但是在行业内这个参数规模已经很大了。

官方宣称其综合能力在全球范围内仅次于Anthropic的Fable 5,但是目前完整模型权重还没开放,大家还需要再等等。

目前,预览版已在阿里旗下代码开发平台Qoder、QoderWork及Token Plan上线,公众对话版本同步开放。


还有就是之前放出消息的DeepSeek V4,之前上线开源的那个是预览版,现在这个是正式版,大家做个区分。

之前的预览版有Pro、Flash两个版本,估计正式版也是这两个版本。

按照内测大哥们的总结:V4正式版整体表现接近Opus 4.8级别,编码能力不弱于GTP-5.6 Sol。

Agent能力和3D、SVG这个方面能力大幅度提升,据说是同样的任务比Fable 5 迭代轮数多。

但是就这个总结上来说,估摸着够呛能干得过Kimi K3。

不过DeepSeek之前发的邮件说启用"峰谷计费"的定价策略(创意抄袭国家电网是吧,哈哈!),那时候就预告了V4正式版是7月中旬上。

所以我猜哈,我猜的。

大概率性能上干不过,就从价格上干。

影响使用的也不单单只有性能一个指标,价格也是一个很重要的方面。

就跟之前DeepSeek V4 Pro Max和Opus 4.6 Max一样,性能只差0.2%,但是价格只有七分之一,可谓是"性价比"拉爆~

等等看吧,最终结论还是以官方为准。

但是现在AI的发布节奏都快赶上当年的山寨机了,上新速度 Cua Cua 的!

相关推荐
_瑞19 小时前
AI Coding 那么快,为什么还需要 SDD?
人工智能·ios·ai编程
HYDtomako19 小时前
Claude Code学习
学习·ai·agent·claude code
小岛前端19 小时前
展示!我 Vibe 了一个 Codex HUD
前端·ai编程
不一样的少年_20 小时前
不用 LangChain,手搓 AI Agent:给大模型装上“手”,让它自己读项目文件
前端·人工智能·agent
云烟成雨TD20 小时前
Agent Scope Java 2.x 系列【42】2.0 GA 正式发布:从透明开发迈向智能体系统工程
java·人工智能·agent
TrisighT20 小时前
从单个 Skill 到团队私有市场:Plugin 打包分发的最后一公里
aigc·agent·ai编程
程序员老刘20 小时前
跨平台开发地图 | 2026年7月
flutter·ai编程·客户端
Miku1620 小时前
Claude Code 循环(Loops)入门:从 /goal 到 /schedule 的四种模式
agent·ai编程·claude
轩辕十四leo20 小时前
Astrolabe(星盘):让 AI 看见自己写出的 UI
ios·ai编程