传OpenAI将发Astra新一代模型、谷歌Gemini3.5Pro现身后端、字节欲练5万亿参数大模型 | 8月7日 AI日报

💡 今日趋势速览:AI巨头卷起参数与速度军备竞赛。传OpenAI内网狂跑Astra,谷歌Gemini3.5Pro蓄势待发,字节更拟建5万亿参数模型冲击国内之最。

🎯 今日要点

  1. OpenAI 新模型 Astra 传闻下周发布
  2. 谷歌后端出现 Gemini 3.5 Pro 模型标签
  3. 字节跳动讨论训练超 5 万亿参数大模型,目标国内最大规模

📋 今日内容汇总

🤖 AI动态

  1. OpenAI 新模型 Astra 传闻下周发布
  2. 谷歌后端出现 Gemini 3.5 Pro 模型标签
  3. 字节跳动讨论训练超 5 万亿参数大模型,目标国内最大规模
  4. DeepSeek 获国家 AI 产业基金入股,注册资本增至 1644.7 万
  5. DeepSeek 出资 1.4 亿认购宇树科技战略配售
  6. Hark 发布浏览器 Agent Handoff,登顶基准测试
  7. OpenAI 宣布让 ChatGPT 中更好的推理能力对所有人更易获取
  8. Meta 让自研模型参加五项 STEM 奥赛并禁用工具做纯推理测试
  9. Meta 被曝自建网络索引摆脱对谷歌搜索依赖
  10. 阿里巴巴推出 Wan3.0 视频生成模型公开测试版
  11. 科学家用基因序列训练 AI 设计出 16 种自然界不存在的活性病毒
  12. Cloudflare 推出 WebMCP,让浏览器 Agent 调用网站工具
  13. DeepMind 气旋预测模型 WeatherNext 登上《自然》
  14. 阿里拟向 Qwen 开源模型大客户收营收分成
  15. Cursor 上线代理插件开放标准,用于打包技能与 MCP 服务器供多代理复用

🔌 AI基础设施

  1. AI 光互联新主线:NPO 缩短电通道,比 CPO 更易量产维护
  2. 华为昇腾支持蚂蚁百灵 Ling-3.0-flash,首推 CANN PyPTO

🧪 芯片半导体

  1. AMD 收购多伦多 AI 芯片公司 Taalas,交易金额未披露
  2. 马斯克揭晓特斯拉与 SpaceX 联合打造的 Terafab 超级半导体晶圆厂
  3. SK 海力士与 Sandisk 发布首个 HBF 标准及 375 层 NAND
  4. 消息称英伟达因 HBM 供应紧张考虑推出低内存版 Rubin Ultra GPU
  5. 英特尔 Diamond Rapids 至强 ES 现身,18A-P 工艺跑通

🦾 机器人具身智能

  1. 北京 Simple AI 开源 HiFi-UMI-2K 高保真双臂操作数据集

📌 模型排行榜

  1. Artificial Analysis AI 模型能力排行榜

🤖 AI动态

1. OpenAI 新模型 Astra 传闻下周发布

OpenAI 新模型 Astra 传闻下周发布,员工已在内网以 Cerebras 级速度使用,基于史上最大规模预训练构建,内部检查点 mewfour,可能命名为 GPT-5.7 或 GPT-6。

🔗 https://x.com/pankajkumar_dev/status/2085368727437300109


2. 谷歌后端出现 Gemini 3.5 Pro 模型标签

谷歌后端被发现出现 Gemini 3.5 Pro 的模型标签,通常被视为该模型即将正式发布的准备信号。Gemini 3.5 系列此前已延迟数月,标签现身提示其发布窗口临近。

🔗 https://x.com/LuminaXspace/status/2085060385208443373


3. 字节跳动讨论训练超 5 万亿参数大模型,目标国内最大规模

字节跳动讨论训练超 5 万亿参数大模型,若落地将超过阿里 Qwen3.8-Max(2.4 万亿)和月之暗面 Kimi K3(2.8 万亿)。项目由 Seed 负责人项亮主导,仍处早期讨论阶段,是否训练和发布未定。

🔗 https://x.com/0xLogicrw/status/2085351045665108144


4. DeepSeek 获国家 AI 产业基金入股,注册资本增至 1644.7 万

天眼查数据显示,DeepSeek 关联公司近期完成工商变更,新增国家人工智能产业投资基金等为股东,注册资本由 1500 万元增至约 1644.7 万元。公司成立于 2023 年 7 月,法定代表人裴湉。

🔗 https://linux.do/t/topic/2714675


5. DeepSeek 出资 1.4 亿认购宇树科技战略配售

据路透社消息:DeepSeek 出资约 2080万美元认购宇树科技上海 IPO 战略配售 2.31% 股份,双方将联合开发人形机器人 AI 模型,并在采购与服务上互为优先,达成战略合作。

🔗 https://www.reuters.com/world/asia-pacific/deepseek-invests-208-million-unitrees-shanghai-ipo-2026-08-06/


6. Hark 发布浏览器 Agent Handoff,登顶基准测试

Hark 发布浏览器 Agent Handoff:Online-Mind2Web 以 97.7 分居首,仅领先第二名 Yutori 0.4 分;WebTailBench v2 以 68.6 分输给 GPT-5.5 的 72.3 分,且产品暂未开放第三方复测

🔗 https://x.com/0xLogicrw/status/2085326512065269887


7. OpenAI 宣布让 ChatGPT 中更好的推理能力对所有人更易获取

OpenAI 通过官方账号宣布,在 ChatGPT 中让更好的智能(推理能力)对所有人更易获取,并列出多项模型与权限调整。原始推文以列表形式发布,具体型号与细节因来源截断未给出,以官方公告为准。

🔗 https://x.com/OpenAI/status/2085434712429052386


8. Meta 让自研模型参加五项 STEM 奥赛并禁用工具做纯推理测试

Meta 让自研模型参加五项 STEM 奥赛并禁用搜索、编码、计算器等全部工具作纯推理测试:亚洲与国际物理奥赛理论考试满分,IMO 金牌,IChO、RMM 达金牌级表现,体现长链推理与论证能力

🔗 https://x.com/AIatMeta/status/2085388945148297322


9. Meta 被曝自建网络索引摆脱对谷歌搜索依赖

Meta 被曝正构建独立的网络索引,为其 AI 提供事实依据,以摆脱对谷歌搜索和 Brave 的依赖。此举将重塑 AI 搜索生态格局,是巨头在底层基础设施层面的全面脱钩。

🔗 https://x.com/glenngabe/status/2085486976048750922


10. 阿里巴巴推出 Wan3.0 视频生成模型公开测试版

阿里巴巴推出新一代视频生成模型 Wan3.0 公开测试版,主打简单输入、智能创作,支持从文本提示与文档生成最长约 30 秒的视频,可在通义千问云平台 Wan3.0-Video 体验。

🔗 https://x.com/Alibaba_Wan/status/2085339761284104529


11. 科学家用基因序列训练 AI 设计出 16 种自然界不存在的活性病毒

据纽约时报报道,科学家用 DNA 库训练 AI 模型,让其生成自然界不存在的病毒基因组配方,最终得到 16 种活性病毒。它们能感染细菌但对人类无威胁,展示了 AI 在基因组设计上的能力。

🔗 https://www.techmeme.com/260806/p40#a260806p40


12. Cloudflare 推出 WebMCP,让浏览器 Agent 调用网站工具

Cloudflare 推出 WebMCP 开发者预览:接入站点打开控制台开关,浏览器 Agent 即可调用站方开放的工具,无需改源码;接口由谷歌、微软推动,默认仅读图片 C2PA 凭证与对接既有 MCP 服务器两类工具。

🔗 https://x.com/0xLogicrw/status/2085385015383544285


13. DeepMind 气旋预测模型 WeatherNext 登上《自然》

Google DeepMind 的 AI 模型 WeatherNext 已在《自然》发表,在气旋路径和强度预测上达到业界最先进水平,平均可额外争取约 24 小时的准备时间,有望帮助提前预警、降低灾害损失。

🔗 https://x.com/GoogleDeepMind/status/2085395442347524506


14. 阿里拟向 Qwen 开源模型大客户收营收分成

据路透社报道,阿里巴巴计划要求下一代 Qwen 开源 AI 模型的主要商用用户分享营收,标志着头部厂商开源商业化模式的重大转变,将深远影响开源 AI 生态。

🔗 https://x.com/Reuters/status/2085551532225737186


15. Cursor 上线代理插件开放标准,用于打包技能与 MCP 服务器供多代理复用

Cursor 宣布支持代理插件(Agent Plugins),定位为开放标准,用于打包技能与 MCP 服务器,使同一套能力可在不同代理之间复用。该标准意在降低代理生态的能力接入成本,让用户更便捷地为 Cursor 等代理工具扩展技能组合。

🔗 https://x.com/cursor_ai/status/2085464617694777762


🔌 AI基础设施

16. AI 光互联新主线:NPO 缩短电通道,比 CPO 更易量产维护

AI 服务器向超节点演进,芯片间传输成为算力关键。东北证券指出,NPO 将光引擎部署于 ASIC 附近,比可插拔方案减少约 9-11dB 信号损耗,与 CPO 差距仅约 3dB,但良率和维护性更优。

🔗 https://wallstreetcn.com/articles/3778847


17. 华为昇腾支持蚂蚁百灵 Ling-3.0-flash,首推 CANN PyPTO

蚂蚁百灵开源原生混合推理模型 Ling-3.0-flash,华为昇腾完成 0 Day 适配并首推 CANN PyPTO 算子编程框架,缩短复杂融合算子交付周期,开放完整部署工程。适配兼容昇腾 A2/A3 系列。

🔗 https://www.ithome.com/0/986/724.htm


🧪 芯片半导体

18. AMD 收购多伦多 AI 芯片公司 Taalas,交易金额未披露

AMD 已收购位于多伦多的 AI 芯片公司 Taalas。Taalas 的核心技术是将模型权重直接集成到硅片中,从而提升 AI 推理性能。本次收购金额未予披露,消息来源于 The Register。

🔗 https://x.com/Techmeme/status/2085461108094275779


19. 马斯克揭晓特斯拉与 SpaceX 联合打造的 Terafab 超级半导体晶圆厂

马斯克宣布,特斯拉与 SpaceX 联合打造的 Terafab 建筑正式亮相,该项目将在得克萨斯州建造。马斯克表示,Terafab 将成为世界上最大、最有价值的建筑。

🔗 https://x.com/mark_k/status/2085387174015316385


20. SK 海力士与 Sandisk 发布首个 HBF 标准及 375 层 NAND

SK 海力士与 Sandisk 在 FMS 2026 发布业界首个高带宽闪存 HBF 标准,定位介于 HBM 与 SSD 之间;SK 海力士同场首发 V10 代 375 层 4D NAND,能效比较上一代提升约 2.5 倍。

🔗 https://linux.do/t/topic/2716215


21. 消息称英伟达因 HBM 供应紧张考虑推出低内存版 Rubin Ultra GPU

据 The Information 报道,英伟达因在获取足够 HBM(高带宽内存)方面可能面临困难,正考虑推出低内存版本的 Rubin Ultra GPU,并已测试至少三个版本。HBM 短缺可能影响下一代 AI 加速卡的产能与出货节奏。

🔗 https://x.com/Techmeme/status/2085401980118479138


22. 英特尔 Diamond Rapids 至强 ES 现身,18A-P 工艺跑通

英特尔下一代至强 Diamond Rapids 工程样品现身 SiSoftware 数据库,采用增强版 18A-P 工艺,配 32 核、64MB 二级缓存和 240MB 三级缓存,频率仅 1.1GHz,定位数据中心。

🔗 https://www.ithome.com/0/986/765.htm


🦾 机器人具身智能

23. 北京 Simple AI 开源 HiFi-UMI-2K 高保真双臂操作数据集

北京 Simple AI 开源 HiFi-UMI-2K:2000 小时高保真双臂操作数据,含 432 万+片段、480+场景,有效轨迹超 98%。仅用人类数据训练的策略与遥操作数据训练策略表现不相上下,误差仅几个百分点以下是官方给出的 demo

🔗 https://x.com/CyberRobooo/status/2085381602033717496


📌 模型排行榜

24. Artificial Analysis AI 模型能力排行榜

最后是今日的 AI 模型能力排行榜单,Claude Opus 5 (max)以63分领跑智力榜与59.2分稳居智能体榜首,持续压制GPT-5.6等闭源竞品。开源梯队正加速追赶,Qwen3.8 Max凭58.4分跃居智能体榜眼。

🔗 https://artificialanalysis.ai/?intelligence=artificial-analysis-intelligence-index#intelligence-tabs

以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。

相关推荐
绵满1 小时前
"AgentX: Towards Agent-Driven Self-Iteration of Industrial Recommender Systems" 论文笔记
大模型·推荐系统·多智能体
VIP_CQCRE3 小时前
用 Ace Data Cloud 接入 Codex:让 AI 编程工具配置更简单
openai·ai编程·开发工具·codex·acedatacloud
熊猫钓鱼>_>1 天前
用Seed Evolving+高德地图做城市旅行规划Agent
大模型·agent·规划·智能体·豆包·火山·seed evolving
hoaxxcj1 天前
多智能体把云可靠性工程自动化:NeurIPS 2025 的 STRATUS 比 SOTA 强 1.5 倍,还顺手定了条“安全规范“
运维·安全·自动化·大模型·ai论文·前沿解读
9i编程1 天前
手敲重构学透 Multi-Agent 代码(上):逐行拆解 AgentScope 1.0.8,从「跑通了但没懂」到真懂了
人工智能·openai·ai编程
梦想三三1 天前
Qwen Function Calling实战:重构电商客服AI Agent
人工智能·python·langchain·大模型·rag
VIP_CQCRE1 天前
用 Cherry Studio 接入 Ace Data Cloud:一个 Token 打通 Claude、GPT、Gemini、DeepSeek 等主流模型
ai·大模型·api·cherry studio·ace data cloud
云卷云舒___________2 天前
Gemini 3.5 Pro疑灰度测试、北京酒吧送DeepSeek算力、谷歌发布第八代TPU | 8月3日 AI日报
谷歌·ai算力·deepseek·tpu·ai日报·gemini35pro·deepseekv4flash