💡 今日趋势速览:月之暗面开源2.8万亿参数Kimi K3,Anthropic策略性暂缓Fable 5.1,谷歌加速训练Gemini 4,巨头竞速升级。
插播一条信息:朋友力荐的人工智能学习平台,亲测内容易懂、风格有趣,适合想入门/进阶AI的小伙伴~直接点链接跳转网站👉 人工智能学习网
🎯 今日要点
📋 今日内容汇总
🤖 AI动态
- 月之暗面即将开源 Kimi K3 权重
- Fable 5.1 就绪但 Anthropic 暂不发布
- 谷歌 CEO 确认 Gemini 4 已开始训练
- Meta 宣布重返开源模型赛道
- Codex 推出 Multi-Agent V2
- 米哈游 AI 陪伴产品 AnuNet 宣布关停
- Anthropic Claude 共享链接致聊天内容被公开收录
- 腾讯复活 QQ 宠物布局 AI 情感陪伴
- KAT-Dev-32B 编程基准登顶
- 英伟达发布 Molt 自主强化学习框架
- 微软算力吃紧 1900 亿资本支出不够
- 英伟达为 OpenAI 谈判 2500 亿担保
- vLLM 0.26.0 发布加速 AMD 平台
🧪 芯片半导体
📌 模型排行榜
🤖 AI动态
月之暗面即将正式发布 Kimi K3 开放权重模型,成为全球最大开放权重模型供免费下载。模型拥有 2.8 万亿参数,在多项基准测试中跻身全球前十,开源权重策略加速了开源模型商业化进程。


2. Fable 5.1 就绪但 Anthropic 暂不发布
分析人士认为 Fable 5.1 已准备就绪,但 Anthropic 正将其保留以应对 OpenAI 的下一次发布。两家公司的发布节奏博弈日趋明显,竞争从技术延伸到市场策略。

谷歌 CEO 皮查伊确认 Gemini 4 已投入训练,按以往节奏有望年底发布。Gemini 系列的迭代速度正在加快,与 OpenAI 和 Anthropic 的竞争进入白热化阶段,多模态能力持续提升。


Alexandr Wang 在现场确认 Meta 接下来将推出一套 Harmony 开源模型。此前 Meta 在开源领域一度沉寂,此次回归被视为对开源生态的重大利好,与 Llama 系列形成延续。


OpenAI Codex 推出 Multi-Agent V2,支持多智能体协作完成复杂编程任务。新版本引入团队编排能力,多个 Agent 可分工并行处理不同模块,提升大规模项目处理效率。

米哈游创始人蔡浩宇发布的 AI 陪伴产品 Anuttacon 旗下 AnuNet 宣布关停,上线仅 8 个月。反映了 AI 陪伴赛道的商业化困境,即使有顶级游戏公司资源和创始人亲自投入也难以维持。


7. Anthropic Claude 共享链接致聊天内容被公开收录
Anthropic的Claude共享功能存在隐私漏洞,生成的公开链接未添加禁止搜索引擎收录的标签,导致大量包含API密钥、个人简历、律师记录及公司内部项目的私密聊天内容被谷歌等搜索引擎收录,任何人可直接搜索查看。用户需手动在设置中删除已共享内容。



AI 情感陪伴赛道大火,腾讯宣布复活经典产品 QQ 宠物,融入 AI 技术打造情感交互体验。此举被视为腾讯在 AI to C 场景的重要布局,对标 Character.AI 等海外产品的本地化竞争。


KAT-Dev-32B 在 SWE-Bench Verified 上达到 62.4%,位列开源模型前列。基于 Qwen 架构的后训练方法在编程任务上展现强大潜力,为中小规模模型提供新路径。


英伟达发布 Molt,基于 PyTorch 的原生自主强化学习框架,代码约 9200 行。该框架旨在为 AI 智能体提供从环境交互中持续学习的能力,填补了开源生态中自主强化学习基础设施的空白。


消息称微软全年 1900 亿美元资本支出预算仍不够用,面临整体算力吃紧。AI 需求增长速度超出最激进的产能扩张计划,微软不得不重新评估数据中心建设节奏和 GPU 采购策略。


英伟达正谈判为 OpenAI 提供约 2500 亿美元财务担保,支持其租赁软银在俄亥俄州开发的十吉瓦数据中心。算力巨头从 GPU 供应商升级为金融担保方,标志 AI 基础设施竞赛进入新阶段。

vLLM 0.26.0 发布,来自 212 位贡献者的 411 次提交。新增 ROCm W4A16 推理内核加速 AMD Strix Halo,Qwen 和 Gemma 模型延迟降低三倍以上,标志 AMD 在开源推理生态持续投入。


🧪 芯片半导体
受存储芯片涨价与供应短缺影响,英伟达大幅削减 Vera Rubin NVL72 机架内存配置:SOCAMM 从 192GB 减半至 96GB,CPU 内存从 54TB 砍到 28TB,仅 HBM4 显存维持不变。


美国切断华为高带宽内存供应后,华为正联合深圳 DRAM 厂商 SwaySure 自研 HBM,半导体分析师称双方合作推进相关研发。此举标志华为在先进封装受限下寻求国产内存替代路径。

韩国当地媒体报道三星正在考虑使用中国制造的 DRAM 芯片。在存储芯片涨价和供应链紧张的背景下,韩国巨头不得不重新评估中国供应商的合作可能性,地缘政治影响持续渗透半导体供应链。

三星确认下一代 HBM5 内存将采用 2nm GAA 工艺制造,速度较 HBM4E 提升超过 50%。这一工艺升级将显著提高 AI 加速器的内存带宽和能效,三星与 SK 海力士的技术竞争加剧。

📌 模型排行榜
18. Artificial Analysis AI 模型能力排行榜
最后是今日的 AI 模型能力排行榜单,Claude Opus 5 以智力61分、代码78.0分、智能体55.3分全面领跑,与GPT-5.6 Sol(智力59分、代码77.4分、智能体54.0分)形成双雄对峙;Claude Fable 5、Kimi K3紧随其后,闭源阵营竞争胶着。



以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。