截至 2026-09-02。今天的三条主线都关于「门槛」:能入侵系统的模型 OpenAI 要先设发布护栏再放出来;Anthropic 把同一个模型按护栏松紧拆成两个卖;Vercel 那批顶级开源项目开始拒绝人类的路过式 PR。三分钟,扫完今天的新东西。
【AI 动态】
Astra:OpenAI 首个「网安临界」模型要来了 :OpenAI 官方公告,Astra 是第一个触及 Preparedness Framework 里 Critical 级网络安全能力阈值的模型,发布会带更强护栏;TechCrunch 的标题更直白------「非常擅长入侵计算机系统」。我的判断:这不是坏消息,是能力刻度尺终于有了读数------前沿模型的攻防能力已经高到必须先量再放,护栏成了发布流程的一部分。
Anthropic 发布 Fable 5.1 / Mythos 5.1:同一个模型,两档护栏 :Unite.AI 报道,两款是同一底模的不同护栏配置------Fable 5.1 全量开放,Mythos 5.1 只给受信任机构,护栏为网安和生命科学工作放宽。TechCrunch 补充:5.1 主打更便宜、误拦更少。把「安全强度」做成可选型的产品线而不是枷锁,这是护栏的商业化时刻。
ChatGPT 接入 Epic 电子病历和 9 个医疗数据集 :OpenAI 公告,医疗机构可以把 Epic 的 EHR 环境连进 ChatGPT for Healthcare,另有一个对接九个官方医疗数据集的公共数据插件。医疗 AI 的竞争焦点从「问答像不像医生」转到「能不能安全接到病历数据」------数据接入权才是行业纵深的门票。
AfterQuery 五个月干成 YC 最快独角兽 :TechCrunch 报道,这家模型训练公司 4 月才宣布 $3000 万 A 轮(估值 3 亿),据报道新一轮直接把估值抬到 32 亿美元。五个月翻十倍,训练层还是资本眼里最肥的那段。
蚂蚁 OmniTable 拿下 VLDB 2026 工业最佳论文 :量子位报道,一套统一宽表系统搞定 35PB 大模型语料清洗,效率提升 5.6 倍。大模型竞争的脏活累活------数据管道------开始拿顶会最佳论文了,语料工程的地位肉眼可见在上抬。
阿里更新 Qwen3.8-Max,量子位称前端编程能力全球第一 :量子位今早的报道。国产旗舰这轮的更新节奏咬得很紧,编程能力榜基本一周一变------看榜不如看自己任务集,这句老话今年特别应景。
【AI 技术文章】
《PRs NOT Welcome》:顶级开源项目用 agent 工厂替代社区 PR :Latent Space 深度报道,Vercel 的 AI SDK、Astro、Flue、tldraw 正在把路过式社区 PR 换成「软件工厂」------agent 团队负责应用修复和特性。开源协作模式二十年来的底层假设(贡献来自人)被改写了。做开源的读者这条必读:你的 CONTRIBUTING.md 可能马上要多一章「agent 须知」。
Willison 实测 Claude Fable 5.1 :Simon Willison 用新模型做了只动画鹈鹕,顺手拆了数据:Terminal-Bench-Science 0.1 这个 8 月 27 日才发布的新基准上,Fable 5.1 拿 52.6%,上一代 24.7%、Opus 5 是 29.0%。新基准上线五天就被刷到翻倍,benchmark 通胀的速度本身值得记录。
Anthropic EFS:监控数据存在你自己的云账号里 :MarkTechPost 报道,企业前沿护栏(EFS)把滥用检测的监控数据放在客户自己的云环境,密钥和复核权都在客户手里,检测本身仍由 Anthropic 自动化跑,今秋分阶段上线。企业级 AI 合规的「数据主权」问题,第一次有了一个干净的工程答案。
Perplexity 的 Mac 混合计算:云端大脑,本机保险箱 :MarkTechPost 报道,Perplexity Computer 的单个任务可以拆给云端前沿模型和本机模型协同,敏感上下文锁在设备上处理。agent 的结构性矛盾------有用的上下文恰恰是不能上传的上下文------被架构层面接住了,私有化部署会因此好做很多。
Codex 的运行时里塞了一整套 LibreOffice :Simon Willison 翻 ~/.cache 时发现 ChatGPT 桌面端(原 Codex 桌面版)带着 1.7GB 的完整运行时:Python、Node.js、Poppler、git,还有 LibreOffice 全套。agent 不满足于调 API 了,开始在本地整机自带办公软件------「agent 的电脑」这个隐喻正在字面化。
Meta Muse Voice Transcribe:一个模型顶三个 :MarkTechPost 报道,Meta 超智能实验室把流式转写、说话人分离、断句检测三个系统合并成单个实时自回归模型。语音栈每多一次交接就多一分延迟和一个故障点,三合一砍掉的正是这些。
【GIS×AI】
Willison 现场用 agent 造了个 GeoJSON 地图查看器 :他帮 Natalie 整理选区地图时缺一个「GeoJSON 上地图、导出 PNG」的小工具,问 GPT-5.6-Sol 要建议,模型直接动手建了一个,又用 Claude Code 和 Fable 5.1 迭代几轮成型。这类「缺什么工具就让 agent 现造」的工作流,工具本身开始按需生成,GIS 小工具长尾会被 agent 吃掉。
【GitHub AI 热榜】
今天热榜的主题很集中:agent skills 职业化------专利和科研全链路都有人做成 skills 了。
patent-disclosure-skill:中国专利编写 skills :新上榜,专利点挖掘、交底书编写、审查答复辅助,连政策动向嗅探都有。垂直专业的知识正在被 skills 化装进 agent------这和我写「怎么动手编写 skills」那篇的思路完全一致:你的专业经验就能变成技能。
academic-research-skills:科研全链路 skills :research → write → review → revise → finalize,五个环节做成一套 Claude Code 技能。科研流水线的 agent 化比想象中快。
openclaude:连榜两日 :「runs anywhere. uses anything.」------跨平台 agent 运行时。名字起得直白,榜位也给得直白。
scientific-agent-skills 续榜 :昨日报过的 165 个科研技能 + 19 万用户还在涨,和上面两个放一起看:专业领域 skills 已经是从编程外溢到科研、专利、学术写作的浪潮。
昨日已报的 OpenMAIC、minimind、video-use 今日仍在榜,增速正常,不复读。
【DeepSeek harness 插件生态】
昨日已报的主仓和 seam 包只报增量,今天新看点是接缝清单又长了。
主仓 20.87 万星 :deepseek-harness 昨天 20.77 万,今天 208,714,日增约一千。增速比前几日略缓,基数大了,正常。
连子进程和上下文压缩都是插件 :npm 上 @deepseek-ai/dsh-subprocess-local(子进程 seam 的本地实现)和 @deepseek-ai/dsh-compaction(ctx.compaction,抽象压缩服务接缝)挂出来了。算上昨天的 session、system-prompt,「万物皆插件」的接缝清单已经覆盖到子进程管理和上下文压缩------agent harness 里最难内聚的两块,也拆开了。
@ai-sdk/deepseek 今晨又更新 :Vercel AI SDK 的 DeepSeek provider 今早 3 点(UTC)推了新版,@langchain/deepseek 昨天刚更过。昨天说的「DeepSeek 成 JS 生态标配」,今天变成「标配还在日更」。
今天的速报就到这里。每天这个点,我帮你把 AI 圈的重要动静筛一遍------关注专栏,后续继续为你播报。