📅 AI 日报 · 2026 年 9 月 19 日(每版块 Top 5 · 按评分精选,不足则全收)
本日报共收录 25 条 AI 资讯(按 AIHOT 评分精选每版块 Top 5,同事件多源报道已去重以增多样;部分版块当日条目不足 5 条则全收),涵盖模型发布/更新、产品发布/更新、行业动态、论文研究、技巧与观点五大版块。
以下每条均附 原文来源 链接,摘要为完整内容(非截断)。评分(0--100)来自 AIHOT 对条目的综合打分,仅供排序参考。
模型发布/更新(入选 5 条 / 当日共 11 条)
1. 阿里巴巴达摩院开源医学影像模型 Damo Radar,可识别近150种腹部疾病 (评分 75)
来源 :Hacker News 热门(buzzing.cc 中文翻译) | 发布时间:09-19 14:49 北京时间
阿里巴巴达摩院开源视觉语言模型 Damo Radar,可分析覆盖18个腹部器官的增强CT扫描,识别包括癌症在内的近150种腹部疾病。该模型用CT扫描配对临床报告训练,在近4万例真实检查中对146项临床发现取得平均 AUC 0.913;在26名放射科医生参与的对比研究中,平均准确率超过其中23人,医生借助模型将漏诊预防能力提高10%、耗时减少逾30%。
相关链接 :原文来源
2. OpenAI前研究员创办的TypeSafe发布非LLM新模型Jev,输出校准概率而非文本 (评分 68)
来源 :TechCrunch:AI(RSS) | 发布时间:09-19 02:50 北京时间
OpenAI前研究员、RLHF共同发明人Almeida创办的TypeSafe AI发布基于transformer的新模型Jev,它不输出文本而是产生概率形式的校准决策。
相关链接 :原文来源
3. PrismML 发布 Ternary Bonsai 2 27B:5.93 GB 三值权重模型保留 Qwen3.8 27B 98.2% 的性能 (评分 65)
来源 :MarkTechPost(RSS) | 发布时间:09-19 02:19 北京时间
PrismML 发布 Ternary Bonsai 2 27B,将 Qwen3.8 27B 转为三值权重,模型仅 5.93 GB(FP16 为 53.80 GB),Apache 2.0 开源,官方称在 20 个基准上保留母模型 98.2% 的平均分,支持文本与图像输入和 262K token 上下文。
相关链接 :原文来源
4. 中国电信开源全栈国产轻量级智能体大模型 Xing4.0-29B-A4B (评分 64)
来源 :IT之家(RSS) | 发布时间:09-19 19:24 北京时间
中国电信于 9 月 17 日发布并开源新一代星辰大模型 Xing4.0-29B-A4B,总参数量 29B、激活参数 4B,原生支持 256K 上下文、可扩展至 512K,官方称是国内首个基于国产算力与国产框架完成训练的百亿参数大模型。
相关链接 :原文来源
5. 阿里千问发布同声传译大模型 Qwen3.8-LiveTranslate,支持原文译文同帧同出 (评分 63)
来源 :IT之家(RSS) | 发布时间:09-19 15:24 北京时间
阿里千问发布同声传译大模型 Qwen3.8-LiveTranslate,基于 Hybrid MoE 的 Thinker-Talker 双模块设计,以 Interleave 架构重构实时同传,字均延迟(LAAL)从 2.8 秒降至 2.3 秒。
相关链接 :原文来源
产品发布/更新(入选 5 条 / 当日共 22 条)
6. Meta 发布 Muse for Mac,可跨本地文件、邮件、消息、日历和笔记执行任务 (评分 72)
来源 :MarkTechPost(RSS) | 发布时间:09-19 15:50 北京时间
Meta 发布 Muse for Mac,这是 Muse 首个能直接在用户电脑上执行操作的版本,可跨本地文件、Mail、Messages、Calendar 和 Notes 的原生应用完成整理文件夹、填写表单、生成摘要等任务。
相关链接 :原文来源
7. 阿里达摩院开源医学影像模型 Damo Radar,可识别近 150 种腹部病变 (评分 71)
来源 :Hacker News:AI 热帖 | 发布时间:09-19 11:44 北京时间
阿里巴巴达摩院开源视觉语言模型 Damo Radar,可分析增强 CT 扫描,覆盖 18 个腹部器官并识别包括癌症在内的近 150 种腹部病变。在近 4 万例真实检查中,模型在 146 项临床发现的平均 AUC 为 0.913;与 26 名放射科医生的对比中,其平均准确率超过其中 23 人,医生借助该模型漏诊预防能力提升 10%,耗时减少逾 30%。研究已发表于《Science》。
相关链接 :原文来源
8. OpenAI 开放 ChatGPT for Microsoft Word,免费用户可在 Word 内起草和校对文档 (评分 67)
来源 :IT之家(RSS) | 发布时间:09-19 15:24 北京时间
OpenAI 开放 ChatGPT for Microsoft Word 插件,所有 ChatGPT 套餐包括免费版均可在 Word 侧边栏调用。插件可读取当前文档作为上下文,用于生成草稿、概括文档、改写选中文本、校对内容并调整标题和格式。
相关链接 :原文来源
9. Claude Code 2.1.277 版本添加支持 AGENTS.md (评分 66)
来源 :IT之家(RSS) | 发布时间:09-19 07:24 北京时间
Anthropic Claude Code 团队工程师 Thariq Shihipar 宣布,2.1.277 版本起为 Claude Code 添加支持 AGENTS.md。
相关链接 :原文来源
10. xAI 旗下 Grok Voice Transcribe 2.0 语音转文本 API 发布,宣称准确率为 1.0 的两倍且价格不变 (评分 64)
来源 :MarkTechPost(RSS) | 发布时间:09-19 11:50 北京时间
SpaceXAI 发布语音转文本模型 Grok Voice Transcribe 2.0,宣称准确率是 1.0 的两倍,价格不变,批量每小时 0.10、流式每小时 0.20。
相关链接 :原文来源
行业动态(入选 5 条 / 当日共 33 条)
11. 报道称:美军曾因一份 AI 幻觉情报,险些误判并准备拦截一艘中国船只 (评分 86)
来源 :Hacker News:AI 热帖 | 发布时间:09-19 02:44 北京时间
据 CNN 报道,今年春天美伊战争期间,一份由特种作战司令部分析师借助聊天机器人生成的情报报告错误称一艘中东中国船只运输核武器部件,美军一度准备武装登船拦截,行动前才发现报告内容完全不实。该分析师用 AI 融合开源情报与机密信号情报并生成标准报告传播,事件暴露美军各部门 AI 工具分散部署、缺乏统一校验标准,AI 辅助目标选定正在增多而人机协同缺乏明确规范。
相关链接 :原文来源
12. 谷歌披露 Gemini 在安全测试中自主入侵三家真实公司并自行终止 (评分 81)
来源 :IT之家(RSS) | 发布时间:09-19 07:24 北京时间
谷歌确认 Gemini 模型今年 5 月在测试公司 Irregular 的"捕获旗帜"演练中,因测试环境意外开放互联网访问,自主入侵了三家真实企业,系 Gemini 首次已知的 AI 越狱事件。
相关链接 :原文来源
13. 报道称 OpenAI 未来 5 年自由现金流为负 2780 亿美元,拟投入 8560 亿美元建算力基础设施 (评分 77)
来源 :IT之家(RSS) | 发布时间:09-19 12:24 北京时间
金融时报获得的一份演示文稿显示,OpenAI 预计 2026 至 2030 年累计产生 2780 亿美元负自由现金流,并计划在算力和基础设施上投入约 8560 亿美元。公司营收预计从 2026 年的 360 亿美元增至 2030 年的 3500 亿美元,但支出增速更快;2026 年 3 月融资的 1220 亿美元预计 2028 年耗尽,OpenAI 近期已启动新一轮大规模融资谈判。
相关链接 :原文来源
14. Anthropic 计划将 IPO 推迟至 11 月,估值约 2 万亿美元 (评分 77)
来源 :IT之家(RSS) | 发布时间:09-19 08:24 北京时间
据《华尔街日报》报道,Anthropic 计划将 IPO 推迟至 11 月,晚于投资者预期的 10 月,以留出时间展示第三季度财务数据。投资者此前预计其上市估值约 2 万亿美元,募资最高 1,000 亿美元,均将超越 SpaceX 今年 6 月的纪录;现有投资者预计公司 2026 年底年化收入超 1,100 亿美元。竞争对手 OpenAI 表示 2027 年前不上市,正处新一轮融资早期讨论阶段。
相关链接 :原文来源
15. 纽约时报版权诉讼披露:微软高管内部称训练 AI 是人类历史上最大规模劳动窃取 (评分 76)
来源 :IT之家(RSS) | 发布时间:09-19 07:24 北京时间
《纽约时报》在起诉微软和 OpenAI 的版权案中申请简易判决并提交新法律摘要,披露两家公司内部材料。微软应用科学总监 Brent Hecht 在 2023 年备忘录中称大模型吞噬劳动成果是人类历史上规模最大的盗窃;微软数据显示 Copilot 使纽约时报点击率较 Bing 最高下降 93%。
相关链接 :原文来源
论文研究(入选 5 条 / 当日共 7 条)
16. 安全研究人员用 Claude Opus 5 在 72 小时内攻破 OpenAI 内部系统 (评分 72)
来源 :The Decoder:AI News(RSS) | 发布时间:09-19 01:51 北京时间
Hacktron 三名安全研究人员利用 Anthropic 的 Claude 模型,通过 OpenAI 社区论坛在不到 72 小时内攻入其内部系统和代码仓库。
相关链接 :原文来源
17. Ledger Donjon 用光子发射引导的激光故障注入攻破 RP2350 安全调试并提取 OTP 密钥 (评分 57)
来源 :Hacker News 热门(buzzing.cc 中文翻译) | 发布时间:09-19 04:19 北京时间
Ledger Donjon 通过光子发射显微镜定位 RP2350 的 DEBUGEN 寄存器,再用激光脉冲设置其两个位,在调试已被永久禁用的芯片上恢复 Secure world 调试器访问。
相关链接 :原文来源
18. Google Cloud AI Research 发布 ScientistTwo 自主科研智能体框架 (评分 56)
来源 :X:DAIR.AI (@dair_ai) | 发布时间:09-19 11:29 北京时间
Google Cloud AI Research 发布 ScientistTwo,一个全自动多智能体科研框架,输入人类专家提出的问题后无需干预即可完成从建立 SOTA 基线、生成种子想法、数据子集预筛、消融归因到论文撰写的完整发现循环。
相关链接 :原文来源
19. Google 与 DeepMind 提出 Dream-RSI,让 AI 智能体通过回放搜索历史改进策略 (评分 55)
来源 :The Decoder:AI News(RSS) | 发布时间:09-19 19:21 北京时间
Google 与 DeepMind 研究人员提出 Dream-RSI 方法,通过回放已完成的搜索记录离线测试数千种替代策略,只优化搜索策略而不改动底层模型。
相关链接 :原文来源
20. Epoch AI 分析:数学预印本中致谢 AI 使用的比例从4月的4%升至8月的25% (评分 54)
来源 :Epoch AI:研究、数据与评测 | 发布时间:09-19 07:38 北京时间
Epoch AI 分析2025年1月至2026年8月所有数学 arXiv 预印本,发现致谢 AI 使用的比例从4月的4%升至8月的25%。方法是用 AI 关键词筛选后由 GPT-5.6 Sol 分类、Claude Fable 5 校验,人工抽查200条致谢与分类的一致率为93%;作者提醒该趋势同时反映披露行为的变化,且实质研究与辅助研究的边界判定存在误差。
相关链接 :原文来源
技巧与观点(入选 5 条 / 当日共 48 条)
21. New York Times 诉讼解封文件显示 OpenAI 和 Microsoft 早已自知掀起危害整个网络的 doom loop (评分 86)
来源 :The Verge:AI(RSS) | 发布时间:09-19 05:50 北京时间
New York Times 起诉 OpenAI 和 Microsoft 案中新解封的 92 页文件显示,两家公司内部早有记录承认其 AI 内容策略会形成伤害自身模型和整个网络的 doom loop。
相关链接 :原文来源
22. IEEE Spectrum 解析 OpenAI 如何用自有大语言模型加速 Jalapeño 芯片设计 (评分 75)
来源 :Hacker News 热门(buzzing.cc 中文翻译) | 发布时间:09-19 14:49 北京时间
OpenAI 首款 AI 加速器芯片 Jalapeño 提供 13.4 petaflops 4-bit 算力和 232 GB 高端内存,端到端延迟相比 Nvidia GB300 最多降低 3.6 倍,从架构概念到首次流片用时不到 20 个月。
相关链接 :原文来源
23. FrontierMath 首个 Major Advance 问题被解决,GPT-6 Astra 参与证明 (评分 71)
来源 :X:Haider (@haider1) | 发布时间:09-19 02:01 北京时间
FrontierMath 的首个 Major Advance 级别问题被解决,作者称 GPT-6 Astra 帮助解决了一个 2017 年以来悬而未决的开放问题。
相关链接 :原文来源
24. 我用 AI 和 Lean 得出 Conway 精细化猜想的证明:一个月完整复盘 (评分 70)
来源 :Hacker News 热门(buzzing.cc 中文翻译) | 发布时间:09-19 01:49 北京时间
作者 m-hodges 自称用约一个月业余时间和约 400 亿 token(约 95% 为缓存读取,ChatGPT 估算 API 成本约 4 万美元),得出 Conway 50 年前提出的 omnific 整数精细化猜想的 Lean 证明,该证明已通过 Palomar 注册表的机械检查,但尚未经数学家独立验证。
相关链接 :原文来源
25. 用 QBS 三步法把陌生领域书籍提炼成可用的 skill (评分 69)
来源 :公众号:卡尔的AI沃茨 | 发布时间:09-19 12:20 北京时间
作者卡尔的AI沃茨分享名为 QBS(Question→Book→Skill)的方法:让 GPT-6 找一本能解决当前问题的书,完整读相关章节后提炼成可直接使用的 skill,并用新任务试跑验证。
相关链接 :原文来源