AI大模型扎堆上新?Kimi K3、Qwen 3.8、DeepSeek v4马上上线,旧的还没用上,新的就来了!比当年山寨机上新还快!

不知道大家最近有没有详细了解大模型方面,现在离了AI几乎就没法干活儿了。

而且最关键的是现在面试去,无论前端、后端、测试岗都会问AI。我之前还见过一个公司面试问"过拟合 ",我当时就反问他,我面的不是前端岗嘛?

人家也很有理:我们这是前端岗,但是需要深度使用AI,还牵扯一部分模型训练相关的。

我了个去,合着现在前端不光得会后端的东西,连AI和算法岗的活儿也一块儿干了。

最近大模型也是扎堆上新,不知道大家关注没有。


首先是Kimi K3,Kimi K3 是首个达到 2.8 万亿参数规模的开源模型,号称是3 万亿级别模型。

注意,其他的模型目前没有超过这个规模的,所以在参数规模方面它是绝对的第一。

根据官方提供的数据,实测过程中Kimi K3 的整体表现略落后于最强的闭源模型 Claude Fable 5 和 GPT-5.6 Sol。

但它在官方的整套评测中展现出前沿水平的能力,并稳定超过了其他所有模型。

而且只是个开始,后续估计K3还有发力点。

详细的可以去看看官推~

最搞的还不是这个,K3 是7月17号发布的,仅仅过了一天,官方又发了一篇公告:

总结一句话:我们已经麻了,大家先等等。


紧跟着就是阿里这边宣布发布Qwen3.8 Max预览版,参数规模也不小,高达2.4万亿。

略小于Kimi K3,但是在行业内这个参数规模已经很大了。

官方宣称其综合能力在全球范围内仅次于Anthropic的Fable 5,但是目前完整模型权重还没开放,大家还需要再等等。

目前,预览版已在阿里旗下代码开发平台Qoder、QoderWork及Token Plan上线,公众对话版本同步开放。


还有就是之前放出消息的DeepSeek V4,之前上线开源的那个是预览版,现在这个是正式版,大家做个区分。

之前的预览版有Pro、Flash两个版本,估计正式版也是这两个版本。

按照内测大哥们的总结:V4正式版整体表现接近Opus 4.8级别,编码能力不弱于GTP-5.6 Sol。

Agent能力和3D、SVG这个方面能力大幅度提升,据说是同样的任务比Fable 5 迭代轮数多。

但是就这个总结上来说,估摸着够呛能干得过Kimi K3。

不过DeepSeek之前发的邮件说启用"峰谷计费"的定价策略(创意抄袭国家电网是吧,哈哈!),那时候就预告了V4正式版是7月中旬上。

所以我猜哈,我猜的。

大概率性能上干不过,就从价格上干。

影响使用的也不单单只有性能一个指标,价格也是一个很重要的方面。

就跟之前DeepSeek V4 Pro Max和Opus 4.6 Max一样,性能只差0.2%,但是价格只有七分之一,可谓是"性价比"拉爆~

等等看吧,最终结论还是以官方为准。

但是现在AI的发布节奏都快赶上当年的山寨机了,上新速度 Cua Cua 的!

相关推荐
楚楚2513 分钟前
2026最新5款AI编程助手免费用平替深度实测对比
ai编程
Jing_jing_X1 小时前
大模型只会输出token,是怎么“调用工具“的?
ai·agent·个人开发·ai应用开发
枫叶丹41 小时前
语音 AI 怎样边听边答:实时对话系统的工作原理
开发语言·人工智能·chatgpt·开源·php·agent·codex
江屿风1 小时前
【Plain Language Large Model】【理清常见国内外大模型的定位和特长】流食般投喂
人工智能·gpt·claude·glm·gemini·千问·deepseek
旖旎夜光2 小时前
【LangGraph实战】LangGraph 学习笔记(四):持久化——从线程记忆到跨会话长期记忆
人工智能·笔记·python·学习·ai编程·langgraph
楚楚2512 小时前
2026最新6款企业级AI编程软件免费实测深度对比
ai编程
七牛云行业应用2 小时前
Dots 完整教程:从安装入口、跑第一个任务到给 Codex 派活(2026 年 10 月)
人工智能·大模型·agent
hpoenixf11 小时前
从工具调用到模型输入:把 Agent 的观测链路接起来
agent
aqi0011 小时前
鸿蒙版本的电子书阅读APP开放源码啦
android·华为·ai编程·harmonyos·鸿蒙
10年前端老司机12 小时前
你的RAG检索正在“高效地重复废话”:一文彻底搞懂MMR算法
langchain·llm·agent