Anthropic发布Fable 5.1与Mythos 5.1登顶,Meta超级应用定名Muse,Spark连发两款端侧智能体 | 9月2日 AI日报

💡 今日趋势速览:Anthropic发布Claude Fable 5.1与Mythos 5.1,双双登顶智力榜与智能体榜。Meta超级应用Project Hatch定名Muse并开启候补名单。SparkLLM发布两款端侧智能体模型,支持百万token上下文,模型轻量与智能体应用正成为新战场。

B站视频:【Anthropic发布Fable 5.1与Mythos 5.1登顶,Meta超级应用定名Muse,Spark连发两款端侧智能体 | 9月2日 AI日报】

🎯 今日要点

  1. Anthropic 发布 Fable 5.1 与 Mythos 5.1
  2. Meta 超级应用 Project Hatch 将以 Muse 之名发布
  3. SparkLLM 发布端侧智能体模型 Spark-X2.5-4B 与 1.7B

📋 今日内容汇总

🤖 AI动态

  1. Anthropic 发布 Fable 5.1 与 Mythos 5.1
  2. Meta 超级应用 Project Hatch 将以 Muse 之名发布
  3. SparkLLM 发布端侧智能体模型 Spark-X2.5-4B 与 1.7B
  4. World Labs 发布空间智能世界模型 Atlas
  5. OpenRouter 独家上线 Mercury 2.5,称其推理速度最快
  6. Runway 发布世界模型 Solaris,直接生成可交互 App 界面
  7. viskoai 发布首个实时模型 Orbis 1.0,流式生成世界
  8. Meta 发布流式语音转写模型 Muse Voice Transcribe
  9. Gemini 新增智能体式视频理解,token 消耗最多降 88%
  10. OpenAI 暂停前沿强化学习训练,Astra 触及网络安全阈值
  11. 英伟达 DLSS 5 将于 9 月 3 日随《NBA 2K27》上线
  12. OpenAI 单日连挖三人充实 Codex 与 ChatGPT 团队
  13. Celeris-1 Magnus 发布:面向智能体工作的混合扩散模型
  14. Grok Build v1.0.17 发布,MCP 工具支持多轮引导交互

🧪 芯片半导体

  1. The Information:长鑫存储首次小批量产出 HBM3E

📌 模型排行榜

  1. Artificial Analysis AI 模型能力排行榜

🤖 AI动态

1. Anthropic 发布 Fable 5.1 与 Mythos 5.1

来源:原文 | cheatyyyy | elder_plinius

Anthropic官方宣布推出Claude Fable 5.1与Claude Mythos 5.1性能上,该模型在各项基准测试中树立新标准,Terminal-Bench-Science 0.1测试得分52.6%价格方面,Fable 5.1缓存读取成本比Fable 5低75%,典型工作负载整体降约25%,高度智能化负载降达45%。

🔗 https://x.com/claudeai/status/2094848572143407483


2. Meta 超级应用 Project Hatch 将以 Muse 之名发布

来源:原文 | Medfa1222

据TestingCatalog消息,Meta即将推出的超级应用内部代号Project Hatch,将以Muse之名正式发布,并推出候补名单。该应用被称作ChatGPT Work和Claude Cowork的竞品,消息发布者本人已加入候补名单。

🔗 https://x.com/testingcatalog/status/2094827945843921332


3. SparkLLM 发布端侧智能体模型 Spark-X2.5-4B 与 1.7B

来源:原文 | SparkLLM

vLLM团队宣布,SparkLLM发布Spark-X2.5-4B和1.7B两款紧凑型端侧智能体模型,支持200多种语言,具备原生100万token上下文。发布当天,两款模型均通过Spark的树外通用插件获得vLLM首日支持,并在智能体、代码、数学等多项基准测试中亮相。

🔗 https://x.com/vllm_project/status/2094674692133298363


4. World Labs 发布空间智能世界模型 Atlas

来源:原文 | mark_k

World Labs 发布面向空间智能的全新世界模型 Atlas。它可以从图像和视频生成、重建并模拟 3D 世界,支持精准镜头控制,能够生成长度最长 1 分钟、1440p 分辨率的视频,把 3D 世界的创建与模拟整合进单一模型。以下是官方给出的 demo

🔗 https://x.com/mark_k/status/2094865925912633389


5. OpenRouter 独家上线 Mercury 2.5,称其推理速度最快

OpenRouter 宣布独家上线 Inception AI 的 Mercury 2.5 Preview,称其为推理速度最快的大语言模型。模型采用并行 token 生成,速度达每秒 1,107 个 token,支持可调节推理强度、并行工具调用与符合 schema 的 JSON 输出,面向延迟敏感的工作负载。

🔗 https://x.com/OpenRouter/status/2094792813603119482


6. Runway 发布世界模型 Solaris,直接生成可交互 App 界面

来源:原文 | op7418 (Twitter)

Runway 发布世界模型 Solaris,可直接生成应用界面,目前处于研究预览阶段。它跳过先写 HTML、CSS 代码再渲染的传统流程,界面由模型实时生成,基于 Gen-4.5 改造官方同步发布了 demo,演示其逐帧实时生成可交互界面的效果,用户可申请抢先体验。以下是官方给出的 demo

🔗 https://x.com/0xLogicrw/status/2094705208844841068


7. viskoai 发布首个实时模型 Orbis 1.0,流式生成世界

来源:原文 | TestingCatalog (Twitter)

viskoai 发布其首个实时模型 Orbis 1.0,可创建生动的世界并实时流式传输。模型具备持久记忆与交互性,支持基于物理规律的无限制长度生成。官方同时提供动态版本与稳定版本,API 也已开放获取。以下是官方给出的 demo

🔗 https://x.com/viskoai/status/2094817592754291173


8. Meta 发布流式语音转写模型 Muse Voice Transcribe

来源:原文 | alexandr_wang

Meta 超级智能实验室发布首个流式语音转文本模型 Muse Voice Transcribe,在 AA-WER 最终转写准确率登顶:语音结束后 0.16 秒实现 3.1% 词错率(WER)。模型基于 70 多种语言训练,其中 25 种经严格验证,支持超一小时音频输入且无需后处理。

🔗 https://x.com/ArtificialAnlys/status/2094849283120128135


9. Gemini 新增智能体式视频理解,token 消耗最多降 88%

来源:原文 | Google

Google DeepMind 宣布为最新的 Gemini 模型带来智能体式视频理解能力。升级后,模型可以更精准地分析视频,同时将 token 消耗减少多达 88%,在视频理解任务中兼顾分析质量与调用成本。

🔗 https://x.com/GoogleDeepMind/status/2094840179676660097


10. OpenAI 暂停前沿强化学习训练,Astra 触及网络安全阈值

来源:原文 | 思维怪怪 (Tech) (Twitter) | TechMeme (Twitter)

OpenAI率先公开踩下前沿模型训练的刹车,面向部署的最新模型强化学习训练暂停了两周随后压力传至Anthropic,该公司也把未发布模型的高风险RL训练暂停了数周,目前大部分已恢复,仍有部分训练环境处于暂停状态,等待人工审核,外部网络安全评估也一度中止。

🔗 https://x.com/0xLogicrw/status/2094632857482182842


11. 英伟达 DLSS 5 将于 9 月 3 日随《NBA 2K27》上线

来源:原文 | Tom's Hardware

英伟达确认 DLSS 5 将于 9 月 3 日随《NBA 2K27》发布,并公布首批基准测试。该技术将支持所有 RTX 50 系列显卡、笔记本以及 GeForce NOW 云服务。DLSS 5 此前争议不断,首批基准数据将检验其实际画质与性能。

🔗 https://www.tomshardware.com/pc-components/gpus/nvidias-controversial-dlss-5-will-launch-september-3-with-nba2k27-available-on-all-rtx-50-series-gpus-laptops-and-geforce-now


12. OpenAI 单日连挖三人充实 Codex 与 ChatGPT 团队

OpenAI 在一天内为 Codex 和 ChatGPT 招入三名干将。Linear 产品负责人 Nan Yu 宣布结束四年任期加入 OpenAI;Kairos Computer 两位联合创始人 Manas Bam 与 Samarth Patel 随后宣布加盟,三人均流向 Codex 与 ChatGPT 团队。Kairos 主打能直接操作电脑的个人智能体产品。

🔗 https://x.com/0xLogicrw/status/2094737793457233988


13. Celeris-1 Magnus 发布:面向智能体工作的混合扩散模型

来源:原文 | Celeris_ai

Celeris AI 推出专为智能体工作打造的混合扩散模型 Celeris-1 Magnus,基于 qwen3.8-27b 衍生。在 τ³-bench 银行任务上,Magnus 以 55 秒中位耗时取得 41.2% 的成绩,对比 GPT-5.6-sol 的 79 秒与 38.1%,速度与正确率均占优。

🔗 https://x.com/Celeris_ai/status/2094626639842078755


14. Grok Build v1.0.17 发布,MCP 工具支持多轮引导交互

来源:原文 | XFreeze

Grok Build v1.0.17 正式发布。MCP 工具现已支持 2026-07-28 规范的多轮往返引导流程,工具调用可返回 input_required 状态,并在重试时继续执行。此外,下一行提示的幽灵建议出现频率降低且准确性提高;/btw 面板的表格单元格选择也修复为正确高亮并按 TSV 格式复制。

🔗 https://x.com/blankspeaker/status/2094856719751156060


🧪 芯片半导体

15. The Information:长鑫存储首次小批量产出 HBM3E

来源:原文 | LinuxDo 前沿快讯

据 The Information 报道,两位知情人士确认,中国最大内存厂商长鑫存储(CXMT)首次小批量产出 HBM3E,即 AI 处理器所用的高速内存。阿里平头哥和寒武纪已开始测试,计划 2027 年起用于自家产品;报道也指出其技术仍落后三星与 SK 海力士。

🔗 https://x.com/wlzh/status/2094585412560056818


📌 模型排行榜

16. Artificial Analysis AI 模型能力排行榜

智力榜前三:Claude Fable 5.1(66分)、Claude Opus 5(63分)、Claude Fable 5(62分)。智能体榜:Claude Fable 5.1 以61分居首,Opus 5、GLM-5.3、Grok 4.6 同以59分并列。GLM-5.3 智能体榜并列第二、智力榜60分第7。

🔗 https://artificialanalysis.ai/?intelligence=artificial-analysis-intelligence-index#intelligence-tabs

以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。

相关推荐
云卷云舒___________4 天前
谷歌内测Gemini 3.8 Flash,智谱开源GLM-5.3权重,腾讯亮剑Hy4,开源大模型神仙打架 | 8月29日 AI日报
谷歌·腾讯·glm·gemini·混元·智谱·ai日报
TunerT_TQ4 天前
Meta|Flow 源码结构解析:一个大型 JavaScript 静态类型检查项目的工程化实践
meta·开源·github
deepseek235 天前
Anthropic MHS 拆解:MCP 管软件,MHS 管硬件,AI 第一次安全操作显微镜、机械臂和激光器
硬件·ai agent·anthropic·mcp
云卷云舒___________8 天前
Qwen新模型paloma现身Arena、阿里Wan3.0视频模型上线、字节豆包工作开放下载 | 8月25日 AI日报
qwen·阿里·字节跳动·ai日报·豆包工作·paloma·wan30
Roadinforest10 天前
Claude Code 架构深度解析:从 Agent Loop 到 Tool、MCP 与 Context
ai·架构·llm·agent·anthropic·claudecode
XLYcmy12 天前
小红书 算法一面 十一
google·meta·llm·负载均衡·token·moe·glam
TunerT_TQ14 天前
Meta React 源码静态评测:从 4540 个源文件看 React Compiler 的工程化演进
meta·开源·github
漂流瓶jz16 天前
一文读懂大模型生态:分类/参数/结构/训练/GPU/评测/排行/社区
人工智能·大模型·llm·openai·nvidia·deepseek·anthropic
云卷云舒___________17 天前
Anthropic披露内部模型Model 2、Codex多智能体v2委派多模型、英伟达开源550B推理教师模型 | 8月16日 AI日报
多智能体·codex·英伟达·anthropic·ai日报·model2·推理教师模型