今日主题:联邦法院裁定五角大楼封杀Anthropic违法,混元开源770B模型Hy4
本期概览:今日 AI 领域多维突破:司法层面,美国联邦法院裁定五角大楼将 Anthropic 列入国防供应链黑名单的行为属于非法报复。模型与算力端,腾讯开源 770B 参数的混元 Hy4 preview,Cohere 推出主打高性价比的视觉文档解析模型 Parse 5,Lambda 则获 10 亿美元债务融资扩充算力池。此外,AI 在科研、世界模型及跨平台协作上的落地持续深入,前沿研究也在强化学习探索与测试期优化方面取得新进展。
本期精选 24 条 · 国内 7 / 国际 17
模型发布
1. 自变量机器人发布 WALL-SS 自回归世界模型
自变量机器人发布下一尺度自回归世界模型 WALL-SS,旨在解决机器人仿真中因果预测失真和"磁铁式抓取"问题。该模型采用由粗到细的推演生成方式并结合长时记忆机制,可实现最长 60 秒的连续物理推演。测试数据显示其动作跟随得分达 0.29,大幅优于同类测试基准,为具身智能提供了更逼真的虚拟训练场。
2. Cohere 发布文档解析视觉语言模型 Parse 5,主打极致推理性价比
Cohere 正式推出 2.3B 参数的视觉语言模型 Parse 5,专用于将企业级 PDF、幻灯片和扫描图像直接转换为结构化 Markdown。Parse 5 采用单阶段视觉语言处理架构替代传统 OCR 加模型流程,API 定价为每千页 1.50 美元。虽然在基准跑分上略低于通用前沿大模型,但其在表格与复杂排版解析上兼顾了可用性与企业规模化部署成本。
3. 腾讯混元发布 770B 开源模型 Hy4 preview 并接入 MCP
腾讯混元正式发布 Hy4 preview 大模型,总参数达 770B,激活参数为 4.9B,支持 1M 上下文窗口。模型权重已在 Hugging Face 与 GitHub 等平台开源,并在架构上深度接入游戏引擎与 MCP 协议。官方表示该模型在代码、办公与科学计算等场景达到开源第一梯队,展现了"模型即 Agent"的落地能力。
算力硬件
1. AI 云服务商 Lambda 获 10 亿美元债务融资采购英伟达芯片
AI 云算力提供商 Lambda 完成 10 亿美元短期私人债务融资,用于采购英伟达 AI 芯片并将其基础设施租赁给微软。这是 Lambda 为满足特定客户算力需求所进行的最新一轮举债融资。此前该公司已先后完成 10 亿美元信贷额度及 9.26 亿美元贷款,持续推进以 GB300 为代表的高性能 GPU 基础设施建设。
产品应用
1. DeepMind 升级 AI Co-Scientist:实现实验设计与论文撰写全流程闭环
谷歌 DeepMind 对科研系统 Co-Scientist 进行了重大升级,使其从最初的科学假设生成工具扩展为可直接对接实验室的科研系统。该系统基于 Gemini 多智能体架构,已在材料合成和医学 AI 架构自主开发等三个学科领域完成了实验规划、操作实验室设备及撰写科研论文的完整闭环,成果均获得实验验证。
2. Anthropic 面向全美 K-12 学校免费推出 Claude for Teachers
Anthropic 宣布面向美国 K-12 阶段学校及学区免费提供 Claude for Teachers 企业级服务。该版本内置基于学习科学的教学辅助能力,并直接对接全美 50 个州的学术课程标准。在 2027 年 6 月 30 日前注册的合规教育机构均可享受为期一年的免费使用权限。
3. Anthropic 推出协同办公工具 Claude Tag 并集成至 Slack
Anthropic 介绍了企业内部使用的工作流工具 Claude Tag,该功能允许用户在 Slack 等即时通讯平台中像 @ 同事一样直接调用 Claude。Claude Tag 能够读取群聊上下文、结合历史记忆与预设指令,在对话流中自动完成数据分析、工单处理及故障根因排查并直接回复结果。
4. Amazon SageMaker Feature Store 新增批量写入与特征枚举 API
Amazon SageMaker Feature Store 正式上线 BatchWriteRecord 和 ListRecords 两个全新 API。BatchWriteRecord 支持单次调用跨多个特征组写入最多 25 条记录,ListRecords 则用于枚举特征组内的记录标识符,进一步提升了特征工程的数据写入效率与资产检索体验。
5. AWS 联合 fal 演示通过 MCP 协议构建创意工作流智能体
AWS ML Blog 发布技术实践方案,展示如何利用 Amazon Quick 与 fal 平台,通过模型上下文协议(MCP)构建可复用的智能体框架。文章以八格分镜故事板和音乐视频概念原型为例,介绍了如何消除多工具割裂及人工上下文传递开销以提升创意生产效率。
6. Meta 推出 XR Operator 开发者工具,利用 AI 智能体自动化测试 VR 应用
Meta 宣布在 Meta XR SDK v205 中集成实验性工具 Meta XR Operator,支持开发者借助 AI 智能体自动化测试 VR 应用。该智能体能够自主启动项目、捕获画面、排查缺陷并修改代码重新验证,从而免除反复佩戴头显调试的繁琐步骤。当前该工具支持自然语言指令驱动,并优先适用于高确定性的静态测试场景。
研究论文
1. Anthropic 探索自动化 AI 研究员自我修复对齐问题
Anthropic 研究人员发表论文展示了通过 AI 自主改进模型安全对齐的最新实验成果。研究团队构建了自动化研究系统,在针对特定未对齐行为的 10 项基准测试中,AI 系统成功提升了每一项测试的对齐表现,且未造成模型整体能力的退化。该研究为未来利用模型进行自我迭代与对齐维护提供了实践依据。
2. Meta 联合 UIUC 提出 EvoHarness-RL:8B 模型对标 Claude Opus 4.5,增强智能体长程任务能力
Meta AI 与伊利诺伊大学厄巴纳-香槟分校联合提出 EvoHarness-RL 框架,为 AI 智能体的运行时环境(Harness)增加抽象层。该框架通过强化学习训练底层模型自主决定何时读取、更新或整合环境反馈,使 8B 规模的模型在无需人工硬编码规则的情况下有效执行复杂的跨系统长程任务。
3. arXiv 论文:提出 TTPO 实现大模型测试期免标注策略优化
浙江大学与阿里等机构研究团队提出测试期策略优化框架 TTPO,解决了强化学习与自蒸馏在测试期缺乏真实标签的问题。该方法利用多数投票的不对称错误特性,对一致采样进行蒸馏并对偏离采样施加组强化惩罚,在五项竞赛级数学基准测试中免标注达到了有监督蒸馏的水平,显著提升了推理性能。
开源工具
1. Hugging Face 语音识别基准榜单首次引入全球南方语言
Hugging Face 宣布在开源语音识别排行榜 Open ASR Leaderboard 中新增首个全球南方语言评测维度。此举旨在完善评估指标体系的公信力与多样性,推动语音识别模型摆脱对主流通用语言的单一依赖,促进多语种语音技术的均衡发展。
2. DuckDB Labs 发布 v2.0 官方预览版,迈向分布式架构演进
DuckDB Labs 正式推出代号为 Cyanoptera 的 DuckDB v2.0 官方预览版。作为包含超万次代码提交的重要里程碑,v2.0 在保持嵌入式单二进制文件简洁性的同时,将运行范围扩展至分布式拓扑并稳定了插件生态,正式版预计于秋季上线。
行业动态
1. 《时代》周刊发布 2026 全球百大 AI 人物,11 位华人入选
《时代》杂志公布 2026 年全球百大 AI 人物榜单,阿里巴巴 CEO 吴泳铭与李飞飞共同登上封面。本次共有 11 位华人入选领军者、创新者等类别,包括梁汝波、何庭波、梁孟松、杨植麟及邓泰华等。评选着重考量了过去一年在推动前沿模型、具身智能及产业生态变革中发挥关键作用的代表人物。
2. OpenAI 联合泰国高等科研创新部推出 AI 初创加速器
OpenAI 与泰国高等教育、科学、研究与创新部(MHESI)在曼谷联合宣布启动为期八周的创业加速器项目。该项目旨在为泰国本土 AI 初创企业提供技术支持与指导,推动有前景的原型设计转化为可在实际商业场景落地的产品方案。
3. 佑驾创新发布 2026 中期业绩:无人车运营服务收入同比增长超 4 倍
自动驾驶科技企业佑驾创新发布 2026 年中期报告,期内总营收 4.50 亿元,同比增长 30.1%,毛利率升至 17.9%。其中无人车运营服务收入达 5300 万元,同比大幅增长 423.4%,公司全栈自研的无高精地图依赖 L4 级物流车及无人巴士在多地展开规模化交付与商业化运营。
4. Meta 印度及东南亚副总裁转投 OpenAI 负责亚太市场运营
Meta 印度及东南亚副总裁 Sandhya Devanathan 已确认离职并加入 OpenAI。Devanathan 将常驻新加坡,负责 OpenAI 在东南亚和澳大利亚的消费者业务增长、企业级应用拓展、合作伙伴关系以及监管事务沟通,此举表明 OpenAI 正在加速亚太本土化运营布局。
5. 优必选 2026 中报:全尺寸具身智能人形机器人收入同比增长 1445%
优必选发布 2026 年中期业绩报告,上半年实现营收 12.7 亿元,同比增长 104.2%,经调整 EBITDA 亏损同比收窄 45.9%。其中全尺寸具身智能人形机器人(算力≥200T、身高 160cm 以上)收入达 5.9 亿元,实现 1445% 的爆发式增长,反映出工业级具身智能硬件正加速商业化放量。
政策观点
1. 美国环保署拟取消数据中心空气污染公开通告要求
美国国家环境保护局(EPA)计划废除一项要求特定工业设施在产生污染时必须进行公开通告并接受公众质询的联邦法规。随着全美数据中心建设规模快速扩张并引发周边社区反弹,该政策调整将进一步降低外界对数据中心环境污染监督的透明度。
2. DJ 平台 Beatport 正式封禁完全由 AI 生成的音乐曲目
知名 DJ 音乐市场 Beatport 宣布全面禁止完全或绝大部分由 AI 生成的音乐作品上线,仅允许人类主导且带有明确标识的 AI 辅助音乐。平台已与音频防欺诈机构 Beatdapp 合作部署检测工具,在上传环节自动拦截违规音轨。平台调查显示,60% 的用户明确拒绝在演出中使用 AI 音乐。
3. 开源维护者警示:AI 编码智能体让漏洞探测进入"分钟级"时代
剑桥大学计算机教授兼 OCaml 核心维护者 Anil Madhavapeddy 指出,当前 AI 编码智能体能根据微小的代码变动在数分钟内自动挖掘安全漏洞并尝试利用。rclone 维护者亦证实近期收到的安全报告激增。该现象表明传统的开源漏洞禁运协调流程已难以应对极速自动化的攻击探测,开源社区亟需重构安全响应机制。
本文由 AI225 AI 日报 自动聚合整理,共收录 24 条 AI 领域动态。内容基于公开信息进行 AI 摘要与归纳,可能存在疏漏或偏差,仅供参考。完整内容及相关来源请访问: