国庆七天,AI圈没一天消停

大家放假这七天,AI公司基本没停手。旗舰模型一款接一款地出,"永不下班"的智能体开始上岗,欧洲还甩出一个万亿参数的开放权重模型。热闹归热闹,10月3日的一封辞职信,给这场狂欢泼了盆冷水。下面按时间线捋,最后说说我的看法。

发布会全赶在假期前后

严格算,这轮密集发布从9月28日就开始了。

那天 Anthropic 放出 Claude Sonnet 5.5------5.5系列第二款,前面9月22日已经出了旗舰 Opus 5.5。官方说法:速度快30%以上,多数场景成本最高降三成。跑分更有意思,终端操作基准 Terminal-Bench 4.0,Sonnet 5.5 拿了70.6%,压过自家旗舰的66.4%,价格只要一半左右。要我说,这一手比跑分本身狠:中档型号干旗舰的活,收一半的钱。发布时点也挑得妙,连续第二次卡在 OpenAI 办大事的前头。

北京时间9月30日凌晨,OpenAI 在旧金山办年度开发者大会 DevDay 2026。整场53分钟,20多项更新一个接一个地念,像报菜名。挑三样要紧的说。

头一个,常驻智能体 Dots。它跟你现在用的对话框不一样:永远在线,在云端有一台自己的电脑,接了4000多个应用,任务在那台机器上跑,不占你的使用额度。说白了,OpenAI 想给你的不是聊天窗口,是数字员工。

新模型叫 GPT-6.1 Sol,编程能力追平自家旗舰 GPT-6 Astra,价格只要五分之一。这步棋人人都看得懂:旗舰立招牌,平价型号走量抢客户。

生意层面还配了一整套:新增每月500美元的最高档 Pro 订阅(注意,Dots 不对免费版、Go 和 Plus 开放),协作空间 ChatGPT Spaces,能操作电脑的 Agents API,外加32家伙伴入驻的应用市场。这套组合拳不复杂,模型管性价比,生态管留人。

北京时间10月1日凌晨(美国时间9月30日),轮到 Google。Gemini 4 Argon,自称迄今最强,暂时不公开卖,先通过一个叫 Fairwind 的计划交给"可信网络防御者"用。理由很具体:测试中它发现一个医疗软件的严重漏洞,敏感个人数据有泄露风险。最强模型先交给安全人员,再一步步放大范围,这种分级投放,头部模型里少见。

DeepSeek假期加了个班

10月3日,DeepSeek 更新了开源智能体框架 DeepSeek Harness,强化插件化和跨平台能力,还塞进去一个实验性的 Claude Code Mods 兼容层。

这事得补点背景。Harness 在8月14日开源,口号"一切皆插件",24小时 GitHub 星标破5万。Anthropic 那边,刚在 Claude Code 新版(v2.1.287)里加了 Mods 机制:开发者写一段 TypeScript 函数挂到事件流上,就能观察、改写甚至接管工具调用。

换句话说,给 Claude Code 写的 Mods 插件,理论上经适配后能跑在 Harness 上。10月4日,Harness 负责人崔添翼发文回应:这功能还在 alpha 阶段,做它主要是想验证 Claude Code Mods 那套插件接口值不值得跟进。他还说了句挺直白的话,团队希望做出"让世界上的 AI 巨头也会认可和跟进的创新"。

我觉得这是七天里最有嚼头的一条新闻。表面是兼容,底下的意思:对手定义的接口有价值,那就先承认它、接过来,再把用户引到自己的地盘。智能体开发框架的"事实标准"之争,打到桌面上了。

欧洲甩出大家伙,Anthropic收尾

10月6日前后,法国 Mistral AI 开放 Mistral Large 4 公测,昵称 Le Chonk("肥墩墩",调侃它块头大),1万亿参数,眼下最大的开放权重模型,《连线》杂志干脆称它"最佳开放权重模型"。开放权重,指参数可以下载、可以本地部署、可以自己改,对数据隐私敏感的客户就吃这一套;网络安全部门和政府还会拿到专门的安全版本。正式版定在10月27日。欧洲在闭源巨头之外,亮出的卖点是"数据主权"。

长假最后一天(10月7日),Anthropic 发布 Claude Haiku 5.5,5.5系列里最便宜、最快的轻量款。旗舰、中档、轻量三档就此凑齐。商业上还有一条:据财联社此前报道,多名投资方透露 Anthropic 计划10月上市,估值或达2万亿美元。截至发稿,还没看到正式挂牌的消息。

两盆冷水

据央视新闻报道,10月3日,OpenAI 安全系统团队负责人大卫·罗宾逊(David Robinson)辞职了,还公开批评公司文化"已经崩坏",说 AI 企业开发这项技术时"远远不够谨慎"。OpenAI 发言人证实他于上周离职。放在 OpenAI 屡次被曝安全问题的背景里,又紧跟着 DevDay 那套激进发布节奏,这事看着格外扎眼。

另一盆水泼在 Meta 身上。10月1日,Meta 否认自家爆款智能体 Muse"未经许可读取用户私信"。此前《Inc.》杂志专栏作家杰森·阿滕报道称,他聊天时被 Muse 弹窗插嘴,事后发现它在被拒绝访问的情况下偷偷开了聊天记录同步;还有位加拿大博主被它自作主张降价卖掉键盘,取货地址都给了买家。Meta 对"读私信"这一条予以反驳。麻烦恐怕才开头:Muse 上线三周登顶美区免费榜,日活到 ChatGPT 同期的近三倍------需求是真的;订阅费、交易抽佣、高成本,三座大山也是真的。至于它替你做的每个决定该谁来负责,现在没人答得上来。

国内的动静

国内的两条线都在应用层。

一条是跟进。据36氪报道,腾讯在个人智能体上加码,冲在前面的是元宝:跑在用户专属的云虚拟机上,7×24小时干活,能跨会话执行长任务。学 Meta Muse 推倒重来,还是学 OpenAI 的 Dots 嵌进现有产品,腾讯还没亮牌。方向倒没什么悬念,海外的 Muse、Cue、Grok Bot 已经开跑,国内大厂都盯着"常驻的个人数字员工"这个位置。

另一条是翻车。假期里很多人把出行攻略交给大模型,路线、餐厅、门票一键生成,看着挺美。可一到人流高峰就露馅:公开信息整理得再快,也算不出实时的路况、人流和天气。内容那边的数据更难看:2026年上半年22.19万部 AI 短剧和漫剧,播放量破亿的只有1055部;据 DataEye-ADX 监测,98.7% 的 AI 微短剧上线半年内回不了本。想用的人很多,能接住的供给还没铺好。

我看到的三个苗头

智能体的变化最直观。从 Dots 到 Muse 再到元宝,产品形态正从"你问它答"挪向"它在云端有台电脑,替你盯着事"。比的东西也换了:应用生态(4000多个应用)和信任机制(它替你做的决定谁负责)。跑分那一页,翻过去了。

价格战其实已经开打。GPT-6.1 Sol 用五分之一的价格追平旗舰,Sonnet 5.5 半价反超 Opus,Haiku 5.5 主打最便宜最快,Le Chonk 拿开放权重换部署自由。发布会开一场,模型层的利润就薄一层,钱开始往订阅档位、应用市场分成和垂直场景跑。往后,"便宜量大"的模型只会更多,光靠模型本身赚大钱的故事,不好讲了。

安全放在最后说,但它没准最值钱。Gemini 4 Argon 那套分级投放,安全做在了前头;罗宾逊辞职和 Muse 隐私风波,风险漏在了后头。模型能力的差距在缩小,"谁更值得托付"会同时影响监管态度、企业采购和资本市场给的钱。Anthropic 带着安全叙事走向 IPO,OpenAI 还缠在安全人事动荡里,两种剧本摆在一起,下一阶段的座次没准就看这个。

结语

七天假期,AI行业把未来一年的三张牌都亮了:更便宜的智能,常驻的智能体,还有一条越推越宽、也越推越险的开放边界。假期结束了,牌局才刚开始。

相关推荐
掘金酱4 小时前
[稀土掘金 × 火山引擎] AI用量周榜冲刺赛|获奖名单公示
前端·人工智能·后端
montEvergreen4 小时前
RTMP 里的那根“连接线”:读一份 NetConnection 源码
后端·go
montEvergreen4 小时前
RTMP 握手:一场客户端与服务端的“暗号”对决
后端·go
泡泡oO4 小时前
“如果你还在用Superpowers,那我不要和你说话”
前端·后端·全栈
YatHinLay4 小时前
FastThreadLocal
后端
newerp4 小时前
sync.Mutex 源码深度拆解:正常模式(自旋)与饥饿模式
后端·程序员·go
武子康5 小时前
LingBot-Video 怎么选推理路径?8 步 DMD 不等于小显存
人工智能·后端
打工仔折腾 AI5 小时前
Docker镜像分层与卷挂载到底怎么工作:一次文件系统层面的实测分析
运维·人工智能·后端·python·docker·容器·性能优化
程序员Sunday5 小时前
MCP stdio 与 Streamable HTTP 怎么选,流式消息传到哪里
后端