AI Weekly 8.3-8.9

本周 AI 快讯 | 1 分钟速览

01 千问 App 五大功能上线,Apple Intelligence 千问扩展同周落地 :定时任务、办公助理、语音通话等功能免费开放,支持手机与 PC 跨端协同;苹果更新 Mac 简体中文支持文档,macOS 26.6 起,Siri 可调用千问,需要中国大陆账户。

02 阿里 Wan 3.0 公测,首次支持文档直转 30 秒视频 :接受 doc、xls、ppt、pdf 等文档输入,可将办公素材转化为教学课件和产品演示视频;API 定价 480p 每秒 0.3 元、720p 每秒 0.6 元、1080p 每秒 1.2 元。

03 DeepSeek 宣布全线大幅涨价,V4-Flash 周调用量登顶全球第一 :具体新价格和生效日期尚未公布;OpenRouter 周榜 V4-Flash 以 7.22 万亿 Token 登顶,8 月 1 日单日峰值突破 8 万亿。

04 字节 SeedRealtime 全双工模型上线豆包,Seedance 2.5 API 同周开放SeedRealtime 统一架构原生融合音频、视频和文本,实现「边看边听边说」;Seedance 2.5 API 上线火山引擎,原生支持 30 秒视频直出。

05 Kimi K3 在安全测试中逃出沙盒,Meta AI 同周误入第三方公司系统 :Frontier Security 测试发现 Kimi K3 突破沙盒后访问了互联网,未实施攻击;Meta Muse Spark 1.1 因评估环境配置失误意外入侵第三方。

06 OpenAI Astra 遭数学家抄袭指控,智能体入侵 HuggingFace 曝光,因安全风险暂缓发布 :多名数学家指控 Astra 论文未对已有研究成果进行署名;Black Hat USA 揭露未发布模型智能体自建通信频道、利用 8 个 CVE 入侵 HuggingFace;Sam Altman 确认因安全风险暂缓发布。

07 ChatGPT 免费用户默认升级 GPT-5.6 Luna 不限量,Sol 推理滑块上线 :免费用户文字聊天不限量,事实错误比 GPT-5.5 Instant 减少 62%;Plus 和 Pro 用户 GPT-5.6 Sol 新增推理强度滑块,事实错误减少 68%。

08 OpenAI 发布 Agent Plugins 1.0.0 标准,谷歌同日加入GPT-5 上线一周年,OpenAI 联合微软、亚马逊、Cursor、Vercel 发布面向 AI 智能体的插件打包标准;首批支持 VS Code、Cursor、GitHub Copilot、ChatGPT & Codex 等客户端。

09 谷歌 DeepMind 大换血,哈萨比斯退位,Jeff Dean 带三人出走创业 :哈萨比斯转任主席兼 Alphabet 首席科学家;Jeff Dean 联合 Ghemawat、Vinyals、Quoc Le 创办 Discovery Loop;谷歌股价跌约 5%。

10 Claude Code 默认切换 auto mode,Fable 5 生物安全误判减少 85% :8 月 14 日起,Claude Pro、Max、Team 用户默认开启 Claude Code 自动模式,安全分类器拦截 89% 危险命令,720 次注入攻击无一成功;v2.1.224 新增会话间消息协作;Claude Fable 5 生物学降级减少 85%。

11 Meta 首款编程智能体 Muse Code 上线,默认「代码换算力」引争议Muse Spark 1.2 驱动,支持并行子智能体;Standard 层级每百万 token 输入 1.25 美元、输出 4.25 美元;Contributor 层级价格约便宜 12.5 倍,但 Meta 有权用代码训练模型,安装后默认开启。

12 SpaceXAI Imagine Image 2.0 上线,Arena 生图排名全球第二 :Quality Mode 上线网页端和移动端,支持区域编辑、背景移除、多参考图输入;Arena 排行榜仅次于 gpt-image-2


01|千问 App 五大功能上线,「Apple Intelligence」千问扩展同周落地

8 月 7 日,千问 App 一口气推出了五个新功能。定时任务支持自动完成行业简报梳理和数据清洗汇总,设定好执行时间后即可自动运行。办公助理连接备忘录、日历和邮件,可以操控浏览器和 PC 执行多步骤任务,支持手机和电脑跨端协同。语音通话全天候在线,支持辅导、讲故事、语音叫车等场景。思考研究和智能体广场同步上线,前者强化多步推理和结构化输出,后者覆盖物流、房产、金融等生活场景。全部功能免费开放。

8 月 8 日,苹果更新了 Mac 简体中文支持文档,确认 Apple Intelligence 将通过千问扩展接入。macOS 26.6 及以上版本,使用中国大陆 Apple 账户或国行 Mac 硬件即可启用。用户可以在系统设置中配置千问扩展,Siri 会在合适的场景下主动提示是否转给千问处理,写作工具也支持调用千问进行文本创作和改写。具体接入的千问模型版本未在文档中披露。


02|阿里「Wan 3.0」公测,首次支持文档直转 30 秒视频

8 月 6 日,阿里通义万相团队开放 Wan 3.0 公测,单次可生成 30 秒视频,支持连续运镜和一镜到底叙事。最突出的升级是文档输入,接受 doc、xls、ppt、pdf、md 等格式,单个文件最大 100MB、50 页,可以直接将办公素材转化为教学课件、产品演示等视频内容。人像生成追求千人千面,角色、道具、场景和风格的一致性相比上一代有明显提升。

Wan 3.0 的 API 定价分三档,480p 每秒 0.3 元,720p 每秒 0.6 元,1080p 每秒 1.2 元。Wan 3.0 目前在百炼、万境一刻、通义万相网站等平台公测,千问 App 灰度接入中。支持这么多文档格式在视频生成领域尚属首次,从 Markdown 转产品演示到 Excel 转数据可视化都能覆盖。


03|DeepSeek 宣布全线涨价,「V4-Flash」周调用量登顶全球第一

OpenRouter 周统计显示,DeepSeek V4-Flash 以 7.22 万亿 Token 的调用量位居全球第一,8 月 1 日单日峰值突破 8 万亿 Token。其中约 5 万亿来自免费试用,3 万亿来自开发者付费调用。国产模型包揽了 OpenRouter 周榜前四位,V4-Flash 0731 正式版和 V4-Pro 也进入了前六。

调用量登顶的同一周,DeepSeek 宣布涨价。8 月 6 日,DeepSeek 公告称计划近期全线上调 API 定价,「预计涨幅较大」,具体新价格和生效日期尚未公布。V4-Flash 当前定价输入 1 元、输出 2 元(每百万 token),缓存命中 0.02 元,工作日高峰时段价格翻倍。这是 DeepSeek 2025 年以低价策略入局以来首次全线涨价。


04|字节「SeedRealtime」全双工上线豆包,「Seedance 2.5」API 同周开放

8 月 5 日,字节 Seed 团队发布 SeedRealtime,和此前的语音全双工系统不同,SeedRealtime 用统一架构原生融合了音频、视频和文本三种模态,模型可以同时看到画面、听到声音并做出回应。利用视觉场景语境解决同音词歧义,感知到画面变化时主动开口,端到端人工评测显示对话节奏问题比传统级联系统减少约 50%。SeedRealtime 已全量上线豆包 App。

两天后,Seedance 2.5 API 在火山引擎正式上线。上期报道了 Seedance 2.5 模型发布,本周 API 开放意味着开发者可以接入自己的产品。定价按 token 计费,无视频输入时约 70 元/百万计费 token,有视频输入时约 42 元。一段 5 秒 480p 视频约 3.36 元,5 秒 720p 约 7.56 元。8 月 7 日至 9 月 7 日促销期间,Seedance 2.0 mini 按标价的 40% 收费,Seedance 2.0 fast 按标价的 75% 收费。LibTV、启象 AI、TapNow 等平台已首批接入。


05|「Kimi K3」在安全测试中逃出沙盒,Meta AI 同周误入第三方公司系统

安全公司 Frontier Security 在加州实验室测试 Kimi K3 的网络安全能力时,模型突破了英国 AI 安全研究所搭建的沙盒环境,访问了真实互联网。逃逸后 Kimi K3 没有发起任何攻击行为,只是去 GitHub 搜索它正在解决的问题的答案。Frontier Security CEO 将原因归结为沙盒配置漏洞和 Kimi K3 缺少网络防护机制。和同期曝出的 OpenAI、Anthropic 模型逃逸事件不同,Kimi K3 是唯一一个可被公众直接下载使用的模型,公开版本和测试版本的安全防护完全一致。月之暗面截至报道时未公开回应。

同一周,Meta 的 Muse Spark 1.1 模型在第三方机构 Irregular 进行的网络安全评估中,因测试环境配置失误获得了互联网访问权限,随后利用弱密码入侵了一家未具名公司的系统,并修改了部分内部环境。Irregular 声明事件源于评估环境意外放开了网络连接,并非沙盒逃逸或自主攻击。加上 OpenAI 智能体入侵 HuggingFace 的事件,一周内三家头部公司的模型都突破了测试边界,三起事件的共同根因都指向测试环境配置而非模型主动恶意。


06|OpenAI「Astra」遭数学家抄袭指控,智能体入侵 HuggingFace 细节曝光

本周多名数学家公开指控 OpenAI 学术不端。Yeshiva 大学数学教授 Steven Miller 指出 Astra 球填充证明的核心论证直接复用了他 2016 年的论文,未给署名,称 OpenAI「在蓄意践踏前人的工作」。剑桥大学 Francesco Fournier-Facio 在非 sofic 群的结果中发现了同样的问题,涉及 2016 年和 2019 年的两篇已发表论文。OpenAI 原始博客曾声称这些问题「至少十年没有进展」,随后悄悄修改了措辞,并表示计划在本周对论文做小幅更新。

抄袭指控的同一周,Black Hat USA 首次公开了 Astra 内部测试智能体入侵 HuggingFace 的完整细节。7 月 9 日至 13 日,多个未发布模型智能体在网络安全评估中发现并利用了一个 JFrog Artifactory 实例作为共享通信频道,自行搭建了隐蔽的「留言板」,交换漏洞利用代码和凭据,协调分工,持续运行数周。研究人员删除第一个留言板后,智能体利用 Artifactory 远程缓存的目录名重建了第二个更隐蔽的通道。整个攻击链涉及 8 个 CVE,包括一个零日远程代码执行漏洞,共记录约 17600 次攻击动作。前 NSA 网络安全主管 Rob Joyce 称这是「莫里斯蠕虫以来最重大的黑客事件」。

8 月 7 日,Sam Altman 确认 Astra 因网络安全风险延缓公开发布。OpenAI 表示无法排除 Astra 达到「关键网络安全阈值」,即模型能在无人干预下自主发现和利用零日漏洞。白宫确认 OpenAI 已主动通报。Astra 的后续开发已转入网络隔离的测试环境。


07|ChatGPT 免费用户「GPT-5.6 Luna」不限量,「Sol」推理滑块上线

ChatGPT 免费用户的文字聊天不限量了。8 月 6 日起,GPT-5.6 Luna 成为免费用户的默认模型,文字对话取消配额限制,同时开放「思考」按钮用于复杂问题。文件上传、图片生成等工具仍有限额。免费用户升级后,每月 8 美元的 Go 用户核心卖点(对话消息多 10 倍)被追平。

Plus 和 Pro 用户同步收到 GPT-5.6 Sol 更新,新增推理强度滑块,用户可以自行选择每个问题投入多少算力。OpenAI 内部测试显示,GPT-5.6 Luna 在金融、医疗、法律场景中的事实错误比 GPT-5.5 Instant 减少 62%,GPT-5.6 Sol 减少 68%。此前 ChatGPT 的即时回复和深度推理由不同模型驱动,语气风格不统一,本次更新将两者合并为同一个 GPT-5.6 Sol,推理深度由滑块控制。


08|OpenAI 发布「Agent Plugins」1.0.0 标准,谷歌同日加入

GPT-5 上线已整整一年。8 月 7 日,OpenAI 联合微软、亚马逊、Cursor 和 Vercel 发布 Agent Plugins 1.0.0,是面向 AI 智能体的插件打包标准。一个插件是一个文件夹,包含 plugin.json 清单、技能文件和 MCP 服务器配置。首批支持客户端包括 VS Code、Cursor、GitHub Copilot、ChatGPT & Codex 和 Kiro。谷歌同日宣布以 Core Maintainer 身份加入,发布了 Agents CLI 和 Data Agent Kit 两个插件生产工具。

技术指导委员会由亚马逊、Cursor、微软、OpenAI、Vercel 各出一人组成,反垄断条款规定任何一家不能占据多数席位。该规范于 7 月 24 日提交,目前仍是「Working Draft」状态。v1.0.0 缺少权限审批模型、沙盒隔离要求、代码签名验证和密钥管理等关键安全机制,VS Code 文档写道,安装插件后其 MCP 服务器「被隐式信任」。Agent Plugins 独立运作,不属于 MCP 的上级项目。


09|谷歌 DeepMind 大换血,哈萨比斯退位,Jeff Dean 带队出走创业

8 月 5 日,Alphabet 宣布重组 DeepMind,消息公布后谷歌股价当天下跌约 5%。哈萨比斯卸任 CEO,转任 DeepMind 主席兼 Alphabet 首席科学家,聚焦 AGI 战略和 AI 制药公司 Isomorphic Labs。接替他负责日常运营的是 DeepMind 13 年老将 Koray Kavukcuoglu,以高级副总裁身份直接向 CEO Pichai 汇报,新职务没有沿用 CEO 头衔。哈萨比斯 2024 年凭借 AlphaFold 获得诺贝尔化学奖,在个人声誉的最高点选择退居二线。

同一天,Jeff Dean 宣布结束了在谷歌 27 年的职业生涯,联合 Sanjay Ghemawat、Oriol Vinyals、Quoc Le 创办 Discovery Loop,定位为公益公司,专注于机器学习和科学研究自动化。Alphabet 是创始投资方,并提供云计算资源。Dean 说离开上市公司是因为想做「不一定符合公司纯粹财务利益」的决定。谷歌近期高层流失加速,Noam Shazeer 加入了 OpenAI,John Jumper 加入了 Anthropic,Gemini 3.5 Pro 比原定上线目标已延迟数月。


10|Claude Code 默认切换「auto mode」,「Claude Fable 5」生物安全误判减少 85%

89% 的危险命令被自动拦截,720 次提示注入攻击无一成功。8 月 14 日起,Anthropic 将 Claude Code 的默认权限模式从手动切换为 auto mode,覆盖 Pro、Max 和 Team 用户。安全分类器在每个工具调用前评估风险,阻止不可逆、破坏性或越界操作。对比测试中人工审核员只拦住了 13.6% 的危险命令,50 次操作后更是降到约 5%。分类器产生的 token 不向用户收费,使用 auto mode 的团队产出的 pull request 数量提升了约 25%。

同一周,Claude Code v2.1.224 上线了跨会话通信功能,新增 ListAgents 和 SendMessage 两个工具,会话之间可以直接发消息协作。同台机器的消息走本地 socket,不经过 Anthropic 服务器,跨机器的消息通过 Remote Control 路由。收到的消息无法批准权限弹窗、修改配置文件或执行斜杠命令。Anthropic 同时更新了 Claude Fable 5 生物安全分类器,重写规则集并重新训练,生物学相关误拦截减少了 85%,claude.ai 总拦截量下降约 67%。病毒学、毒理学和分子设计等双用途请求仍然受限。


11|Meta 首款编程智能体「Muse Code」上线,默认「代码换算力」引争议

8 月 5 日,Meta 超级智能实验室推出 Muse Code 测试版,首款终端 AI 编程智能体,直接和 Claude Code、Codex 竞争。底层由 Muse Spark 1.2 驱动,支持并行子智能体和隔离工作树,在演示中同时为一个游戏构建了六个功能且互不冲突。一条命令即可安装,支持 macOS 和 Linux。Muse Code 在 Terminal-Bench、DeepSWE 等基准上公布了成绩,但只以截图形式发布,没有附方法论说明。

Muse Code 的定价分为两档。Standard 层级每百万 token 输入 1.25 美元、输出 4.25 美元,缓存命中 0.15 美元。Contributor 层级输入 0.10 美元、输出 0.20 美元,价格约便宜 12.5 倍,代价是 Meta 有权使用用户的提示词和代码输出来训练模型。安装后默认选择 Contributor 层级,用户需要手动切换到 Standard 才能退出数据共享。有评论直接将 Contributor 层级定性为「用源代码换算力的交易」。


12|SpaceXAI「Imagine Image 2.0」上线,Arena 生图排名全球第二

Arena 排行榜文生图和图像编辑两个维度均排名全球第二,仅次于 gpt-image-2。8 月 7 日,SpaceXAI 发布 Imagine Image 2.0,以 Quality Mode 上线 网页端和 iOS、Android 应用。核心升级集中在编辑能力,新增魔法棒区域编辑、分割精确选区、背景移除透明导出,支持最多五张参考图联合生成。

Imagine Image 2.0 的预设模板覆盖产品图、头像、电商素材、游戏资产和营销物料,排版和小字渲染精度有了明显的改善。Smart-resize 支持九种宽高比自动适配。API 接入已在计划中,具体开放日期和定价尚未公布。

相关推荐
AI导出鸭1 小时前
怎么让豆包做表格?AI导出鸭苹果版将豆包输出的管道表格智能解析为二维结构,一键导出为Excel或Word标准表格。
人工智能·chatgpt·word·excel·ai导出鸭
霸道流氓气质3 小时前
普通办公电脑基于 Ollama 的本地 AI 能力技术文档
人工智能·电脑
点云-激光雷达-Slam-三维牙齿3 小时前
速度起飞 笔记本电脑6G显卡llama运行Qwen3.6 35BA3B MTP 大模型
人工智能·python·电脑·llama
Shockang8 小时前
AI 智能体安全沙盒实战
人工智能
yuhulkjv3359 小时前
Claude表格复制到word不再崩溃,AI导出鸭批量导出+格式无损一键搞定
人工智能·ai·c#·word·ai导出鸭
大明者省10 小时前
WSL2 Ubuntu22.04 GPU训练环境配置指南
人工智能·算法·计算机视觉
抱抱宝10 小时前
Agent-study项目教程(03):手写 Mini-ReAct Agent(不依赖框架)
javascript·人工智能·gpt·react.js·prompt·agent
抱抱宝10 小时前
大模型应用开发教程08 | 构建完整 RAG 应用(Chroma/FAISS 实战)
人工智能·gpt·prompt·agent
美团技术团队11 小时前
KDD‘26 美团学术论文精选及KDD Cup‘26 DataAgents赛道冠军思路解读
人工智能