AI 日报(2026年9月9日)

今日主题:OpenAI声称破解千禧年数学难题引学界争议,Mistral与Cognition获巨额融资

本期概览:今日AI领域迎来多项重磅进展与行业博弈。学术与模型层面,OpenAI宣布利用内部系统给出纳维-斯托克斯千禧年难题的证明及Lean形式化代码,随后引发学界关于成果归属与数据获取的公开争议;OpenAI还正式推出了新一代图像生成模型ChatGPT Images 2.5;面壁智能开源2B端侧模型MiniCPM5-2B,基元律动推出探索自我改进的NeoHorse-1。资本与生态方面,Mistral AI完成30亿欧元D轮融资,Cognition以480亿美元估值完成20亿美元融资;Meta全面上线个人AI助手Muse。此外,硅谷围绕Token过度消耗展开反思,Meta考核取消AI调用量指标,微软开始全面收紧员工AI账单预算;安全方面,黑客被曝通过盗取账户凭证窃取Claude订阅用户Token额度,引发对订阅制AI额度安全的担忧。

本期精选 28 条 · 国内 13 / 国际 15

模型发布

1. OpenAI 正式发布图像生成模型 ChatGPT Images 2.5

OpenAI发布了全新图像生成模型ChatGPT Images 2.5,包含Sunburst与Flare两个API模型版本,大幅提升了多轮指令遵循速度与对参考图主体的保留精度。同时,ChatGPT端内新增Sketch涂鸦生成功能,允许用户直接通过草图与文字提示共同驱动精细化图像创作。

2. 面壁智能开源端侧基座模型 MiniCPM5-2B 及强化学习框架

面壁智能联合OpenBMB开源了2B参数的新一代端侧基座模型MiniCPM5-2B,主打工具调用、代码生成与Agent能力,并在英特尔、瑞芯微和Arm等计算平台上完成首日适配。除模型权重外,团队还开源了自研强化学习框架Meshy与JustRL II算法,为端侧小模型的Agent化提供了可复现技术路径。

3. 基元律动发布 Agent-Native 模型 NeoHorse-1 探索递归自我改进

基元律动联合无问芯穹、清华大学、北京大学及阿里巴巴发布基于Qwen3.5后训练的模型NeoHorse-1(包含4B与9B版本),探索将Agent执行轨迹与工具调用经验转化为模型自身能力。团队利用路由系统产生的交互轨迹进行在策略蒸馏,完成了单轮递归自我改进(RSI)的工程验证。

4. Cohere 发布 23 亿参数文档多模态模型 Parse 5

Cohere推出了专为高吞吐、高精度企业级文档结构化设计的23亿参数多模态模型Parse 5。该模型采用North-Micro-Vision-Instruct架构,结合SigLIP 2与2D RoPE保留空间几何关系,能够高效实现复杂格式PDF到Markdown的解析转换与视觉定位。

5. DeepSeek 开放 V4.1 Flash 中间测试模型限时内测

DeepSeek上线了名为deepseek-v4.1-flash-expires-on-0910的中间测试版本并向部分开发者开放为期两天的限时内测。该版本旨在让开发者提前评估其快速响应能力,并将在9月10日自动下线为最终定稿版本让路。

算力硬件

1. Arm 推出移动子系统 CSS for Mobile 2,强化 CPU 与 GPU 的端侧 AI 算力

Arm发布面向智能手机的CSS for Mobile 2计算子系统,新一代C2 Ultra核心针对智能体编排与突发任务增强了单线程能力,并通过SME2技术使特定模型执行性能提升至1.7倍。此外,Mali G2-Ultra NX GPU首次引入神经图形加速以提升渲染效率,Arm明确表示移动端NPU创新仍交给合作伙伴自主实现。

2. Arm 发布 Neoverse CSS N4 计算子系统与 AGI 服务器芯片方案

Arm正式推出Neoverse CSS N4计算子系统,支持单裸片最高128核,专为基础设施定制化芯片设计以降低集成复杂度。Arm同时推进即用型AGI CPU落地,旨在满足AI智能体应用对通用CPU、高内存带宽及低延迟I/O日益激增的吞吐需求。

产品应用

1. Google DeepMind 推出人类基因组单字母变异预测图谱 AlphaGenome Atlas

Google DeepMind发布了AlphaGenome Atlas平台,涵盖人类基因组中90亿个单核苷酸变异(所有可能发生的单字母改变)的分子生物学影响预测。该平台被描述为目前最全面的基因突变对分子生物学影响的目录,已通过免费网站门户向学术界开放以加速疾病机制研究。

2. Meta 正式推出个人 AI 智能体 Muse 进军消费级助手市场

Meta宣布推出面向日常任务与个人项目的AI智能体Muse,支持通过独立移动App、网页端及WhatsApp直接进行交互,并计划拓展至智能眼镜端。该助手目前提供免费体验,但高频自动化任务需要购买订阅计划,标志着Meta在消费级智能体领域的全面押注。

3. OpenAI 披露利用 GPT-5.6 Sol 辅助量子计算芯片实验测量

OpenAI发布案例阐述研究人员如何将GPT-5.6 Sol连接至实验室软硬件控制系统,用于自动化执行和优化量子芯片的日常基准测试。该实践大幅减少了人工配置上千次测量的前期工作周期,使物理学家得以更专注于实验设计与宏观数据分析。

4. Anthropic 团队发布降低 Claude 调用成本与维持性能的最佳实践

Anthropic官方发布技术实践指南,提出在不牺牲应用性能的前提下大幅降低Claude调用开销的三项核心手段:最大化Prompt缓存命中率、升级模型时清理提示词反模式、以及根据具体任务校准思考工作量。相关调优策略已作为claude-api技能整合进Claude Code中。

5. AWS Bedrock 正式上线 OpenAI GPT-6 Astra 接入支持

亚马逊云科技宣布在Amazon Bedrock上集成OpenAI的GPT-6 Astra模型,依托Bedrock的高性能推理引擎为企业客户提供高并发与安全性保障。此举进一步扩充了AWS托管模型阵容,帮助用户在现有合规与云架构下调用尖端推理模型。

6. Perplexity 推出本地 Agent 硬件设备并采用阿里千问开源模型

硅谷AI搜索独角兽Perplexity推出本地Agent硬件产品Portable Computer,核心算法基于阿里巴巴开源的Qwen3.8-27B构建。该产品在英伟达DGX Spark硬件架构上针对本地任务进行了专门优化,可在离线状态下协助用户处理文档分析与本地编程任务。

研究论文

1. OpenAI 宣布给出纳维-斯托克斯千禧年难题解法并遭学界质疑

OpenAI宣布其内部AI系统给出了纳维-斯托克斯存在性与光滑性问题的解决方案,展示了流体方程有限时间奇异性的产生,并发布了书面证明与Lean形式化代码。然而,纽约大学数学教授Tristan Buckmaster指出,其与Anthropic学者合作的相关研究细节疑似在交流中提前泄露,指责OpenAI抢发成果并试图排除合作者署名,OpenAI则对相关指控予以否认。

2. Multiverse Computing 提出狭窄边界安全机制以减少大模型误拒

Multiverse Computing在技术博客中指出,当前按通用话题粗暴判定违规的对齐机制容易导致模型过度拒绝正常提问。研究团队提出狭窄边界安全校准方案,主张模型仅拒绝话题内的实际有害子集而非屏蔽整个类别,以平衡实用性与安全性。

开源工具

1. vLLM 引入 Hybrid HiSparse 稀疏化技术优化 GLM 5.3 长文本推理

开源推理引擎vLLM发布技术方案,通过新引入的Hybrid HiSparse显存优化技术,首次实现了在单台8卡H200节点上完整部署GLM 5.3模型。该优化成功支持了该大模型在单节点上跑满100万Token的上下文长度,并显著提升了跨长度并发吞吐。

2. vLLM 联手 AgentX 优化面向真实智能体工作负载的推理服务

vLLM团队发文指出智能体的高频多轮对话与超长前缀复用正成为推理服务的核心负载。针对这一趋势,vLLM联合AgentX在KV Cache生命周期管理、并行调度及Prefill/Decode解耦策略上完成协同调优,以降低智能体多轮协作的端到端时延。

行业动态

1. 欧洲大模型创企 Mistral AI 完成 30 亿欧元 D 轮融资

法国AI公司Mistral宣布完成30亿欧元D轮股权融资,投后估值突破210亿欧元,创下欧洲科技公司单轮股权融资新纪录。本轮由三星电子领投,EQT与PSG Equity联合领投,英伟达、ASML等多家半导体及产业资本跟投,资金将用于扩大前沿模型研究、训练算力储备及全球商业拓展。

2. AI 编程初创公司 Cognition 获 20 亿美元融资,估值达 480 亿美元

AI软件工程师Devin的开发商Cognition宣布完成20亿美元新一轮融资,估值较四个月前接近翻倍达到480亿美元。本轮融资由a16z、Accel、Founders Fund、General Catalyst等领投,显示出资本市场对AI原生编码应用前景的持续看好。

3. 统计显示 2026 上半年国内 AI 创企融资突破 3000 亿元

据行业统计,2026年上半年国内AI创业公司总融资金额突破3000亿元,其中上亿元级融资达到77起,数量上居全球首位。资金除持续流向DeepSeek、月之暗面等基础大模型底层外,正加快向视频生成、Agent、具身智能及企业服务等具体场景扩散。

4. 微软收紧内部 AI 支出并启动部门级 Token 预算管理

据外媒爆料,微软内部调查显示有员工单月AI消耗达到2.8万美元,导致全公司开始倒查高额算力账单。目前微软已引入部门级预算红线并监控个人Token支出看板,同时将内部日常协作的默认模型切换为成本更均衡的GPT-5.6 Sol以控制浪费。

5. Arm 联合 80 余家企业推出物理 AI 生态及机器人能力分级框架

Arm在年度大会上发布面向物理AI的全面设计生态项目,联合AWS、通义千问等80余家产业链伙伴加速具身模型与硬件适配。同时,Arm借鉴自动驾驶分级模式牵头推出机器人能力分级框架,旨在为行业建立涵盖时延、算力与安全约束的统一标准化能力语言。

6. DeepSeek 大规模招聘 150 名工程师,将精通 Agent 列为硬性指标

DeepSeek Harness团队负责人崔添翼宣布启动约150人的资深工程人才社招,重点涵盖弹性计算平台及服务端核心架构开发。招聘要求候选人必须能够熟练使用AI Agent进行软件开发、负责复杂决策,并对Agent生成结果具备批判性纠错能力。

7. 遏制"刷量"风气,Meta 工程师绩效考核取消 AI 使用量指标

Meta内部备忘录显示,公司决定在工程师的绩效评估中彻底移除AI工具使用看板和Token计数指标。这一调整源于部分员工为了刷高活跃度而刻意制造冗余提示词的"tokenmaxxing"行为,未来考核将重新聚焦于代码与工程的实际质量与复杂度。

8. Runway 年化经常性收入(ARR)突破 2 亿美元

生成式视频创企Runway宣布其年度经常性收入(ARR)已跨越2亿美元大关,展现出强劲的商业化变现速度。随着单季度新增ARR创纪录并支撑起53亿美元的估值,公司正将研发重心从单纯的视频生成逐步转向世界模型的长期构建。

9. 黑客窃取 Claude 订阅用户 Token

据TechCrunch报道,黑客正在通过盗取账户凭证窃取Claude订阅用户的Token额度。一名独立AI顾问发现其Claude Max 20x账户在非使用状态下Token用量持续异常攀升,疑似账户凭证遭泄露并被外部盗用,引发对订阅制AI额度安全性的担忧。

政策观点

1. Anthropic 遭遇高阶订阅用户集体诉讼,被指虚假宣传额度待遇

部分高阶订阅客户对Anthropic发起扩大的集体诉讼,指控该公司误导消费者购买顶层价格订阅计划。诉状指出,用户在实际使用中并未获得承诺的高优先级和充裕用量支持,甚至频繁遭到隐性限制与降级服务。

2. 陶哲轩警告 AI 集中抢答未解难题或对开放科学造成长期损害

数学家陶哲轩公开发文表达对当前学术生态的担忧,指出有价值的未解科学问题正被不可再生式地开采。他指出,目前一旦有研究方向传闻流出,便会引来巨量AI算力提前"收割",这可能迫使学者不再公开分享前沿研究思路,进而逆转数百年来的开放科学传统。


本文由 AI225 AI 日报 自动聚合整理,共收录 28 条 AI 领域动态。内容基于公开信息进行 AI 摘要与归纳,可能存在疏漏或偏差,仅供参考。完整内容及相关来源请访问:

https://daily.ai225.com/daily/2026-09-09

相关推荐
士明1 小时前
Thread、Session、Turn:Codex 的五种生命周期
人工智能
老余说AI1 小时前
从开源换脸工具到商业级 AI 换脸平台:SoundView 视频换脸的产业定位与边界
人工智能·音视频·视频换脸
Anhty1 小时前
叮咚变声器上手实测,iOS短板、安卓悬浮窗使用感受分享
android·人工智能·功能测试·ios·智能手机
四方云1 小时前
低配4C4G服务器,10秒录音1秒转写!解决电销系统混合录音质检最大难题
大数据·人工智能·自动化·电销破局
Henry-SAP1 小时前
SAP PP 反冲机制业务解析
人工智能·云原生·sap·erp
Akir.weiwen1 小时前
⑤ 消费格式差异:同一份契约的四角色消费格式
人工智能·编译·设计规范·语义
广凌股份(广凌科技)1 小时前
实验室安全检查包括哪些内容?智能管理平台筑牢校园实验安全防线
大数据·人工智能
差不多的周周1 小时前
《MotionLLM:从人体运动和视频理解人类行为》论文核心部分详解
人工智能·深度学习·机器学习·计算机视觉·语言模型·音视频
麻雀飞吧1 小时前
搜索“近期量化入门”时,先补交易理解再看 Python 和 API
人工智能·python