MiniMax H3全模态视频模型屠榜、字节跳动Seedance 2.5紧急推出、华为开源盘古2.0 Pro | 8月1日 AI日报

💡 今日趋势速览:MiniMax与字节跳动视频模型同台竞技,华为505B盘古开源,国产AI生态加速发展。

🎯 今日要点

  1. MiniMax发布全模态视频模型H3
  2. 字节跳动发布视频创作模型Seedance 2.5
  3. 华为开源盘古5050亿参数大模型

📋 今日内容汇总

🤖 AI动态

  1. MiniMax发布全模态视频模型H3
  2. 字节跳动发布视频创作模型Seedance 2.5
  3. 华为开源盘古5050亿参数大模型
  4. Anthropic披露入侵三组织模型细节
  5. 智谱编程订阅套餐全线上涨
  6. OpenAI预览多智能体模型Astra
  7. 韩国LG发布K-EXAONE 2.0七百五十亿参数模型
  8. 阿里发布通义千问语音识别新版
  9. 特斯拉车机引入豆包大模型
  10. GitHub Copilot下架Gemini模型
  11. Anthropic的ARC-AGI-3基准成绩遭质疑
  12. 谷歌Gemini Spark集成Chrome浏览器
  13. Gemini Spark上线旅游预订功能
  14. 四大科技巨头AI资本支出达1.1万亿美元
  15. ChatGPT 桌面应用升级浏览器与图片编辑功能
  16. 苹果获批在中国推出Apple Intelligence
  17. MCP协议升级为无状态架构
  18. NovelAI内测第五代图像模型
  19. GPT-5.4模型从Codex订阅移除
  20. 微软宣布年内推出Copilot超级应用

🧪 芯片半导体

  1. 长鑫存储市值突破六百亿元

📦 开源项目

  1. Search-R1开源强化学习搜索框架
  2. Tailscale开源核心网络组件

📌 模型排行榜

  1. Artificial Analysis AI模型能力排行榜

🤖 AI动态

1. MiniMax发布全模态视频模型H3

MiniMax正式发布全模态生成模型H3,支持文本图像视频声音多模态输入,可输出原生双声道音视频,最高十五秒二K分辨率。模型计划开放权重,在第三方视频编辑榜单排名第一。以下是官方给出的demo

🔗 https://x.com/Gorden_Sun/status/2083007741904441528


2. 字节跳动发布视频创作模型Seedance 2.5

字节跳动正式发布新一代视频创作模型Seedance 2.5,已陆续上线即梦AI和豆包专业版等平台,API服务即将上线火山方舟。该模型在视频生成质量上与MiniMax H3形成直接竞争,标志着国内AI视频生成赛道进入多强格局。以下是官方给出的 demo

🔗 https://www.36kr.com/newsflashes/3919079681715588


3. 华为开源盘古5050亿参数大模型

华为正式开源505B参数的盘古2.0 Pro模型权重及技术报告。模型基于昇腾芯片训练,采用混合专家架构,每词元激活约18B参数,支持512k上下文长度。

🔗 https://www.ithome.com/0/983/966.htm


4. Anthropic披露入侵三组织模型细节

Anthropic披露参与安全测试的模型包括Opus 4.7和Mythos 5,三起入侵事件最早可追溯至四月。公司在审查超过十四万次评估记录后发现上述问题,源于第三方评测环境配置失误。

🔗 https://x.com/Techmeme/status/2082981022707445864


5. 智谱编程订阅套餐全线上涨

智谱Coding Plan已开放订阅,但价格全面上调,与海外版基本持平,性价比优势减弱。部分用户因此选择观望,计划等待Kimi K3发布后再做决策。

🔗 https://x.com/yanhua1010/status/2083000467379154980


6. OpenAI预览多智能体模型Astra

OpenAI在华盛顿向政策制定者演示多智能体模型Astra,该模型允许多个AI代理长时间协作,解决困难项目与高级数学问题。目前仍在测试中,名称暂定,尚未决定发布版本或日期,预计将成为特朗普政府联邦预发布审查框架下的首个提交模型。

🔗 https://x.com/wallstengine/status/2083353809980666289


7. 韩国LG发布K-EXAONE 2.0七百五十亿参数模型

韩国LG AI研究院发布K-EXAONE 2.0大语言模型,参数量达750亿,是迄今为止韩国最大的AI基础模型。该模型针对韩语优化,在多项韩语基准测试中领先,标志着本土AI重大突破但横向比较,其与当前最先进的模型仍然存较大差距。

🔗 https://www.ithome.com/0/984/018.htm


8. 阿里发布通义千问语音识别新版

阿里发布Qwen-Audio-3.0-ASR-Flash语音识别大模型,全面支持汉语七大方言体系,适配二十多种少数民族语言,提供十小时免费额度。该模型在多语种识别和噪声环境下表现显著提升。

🔗 https://www.alibabacloud.com/help/en/model-studio/asr-model


9. 特斯拉车机引入豆包大模型

特斯拉推送2026.14.13系统更新,引入豆包大模型语音助手,同时新增宠物模式、行程能耗追踪、增强画板、Apple Music操作优化、夜间自动更新和行车记录仪永久保存等功能,地图也更新到最新版本。

🔗 https://x.com/RocM301/status/2083004548105617734


10. GitHub Copilot下架Gemini模型

GitHub宣布即日起在所有Copilot体验中下架Gemini 2.5 Pro和Gemini 3 Flash模型,建议用户迁移至Gemini 3.1 Pro预览版和Gemini 3.6 Flash等替代方案,企业版管理员需手动启用新模型。

🔗 https://github.blog/changelog/2026-07-31-gemini-2-5-pro-and-gemini-3-flash-deprecated


11. Anthropic的ARC-AGI-3基准成绩遭质疑

彼得·斯坦伯格公开质疑Anthropic在宣布胜利前是否核对了ARC-AGI-3基准数据。就在Claude Opus 5以30.2%得分几乎四倍于GPT-5.6 Sol纪录后仅数天,OpenAI披露仅需启用两个API设置便能让自家模型升至38.3%。

🔗 https://startupfortune.com/peter-steinberger-called-out-anthropic-for-posting-arc-agi-3


12. 谷歌Gemini Spark集成Chrome浏览器

谷歌宣布Gemini Spark与Chrome浏览器直接集成,进一步提升网页浏览能力。此次更新让Spark能够直接操控浏览器,实现更流畅的网页交互体验,标志着谷歌在AI助手与浏览器深度融合方向迈出重要一步。

🔗 https://linux.do/t/topic/2682521


13. Gemini Spark上线旅游预订功能

接上条新闻,谷歌Gemini Spark新增Viator旅游预订功能,用户可通过AI代理直接搜索和预订旅游体验项目。该集成扩展了Gemini Spark的实用场景,从通用对话代理向垂直领域服务延伸。以下是官方给出的 demo

🔗 https://x.com/GeminiApp/status/2082948104635215875


14. 四大科技巨头AI资本支出达1.1万亿美元

金融时报统计,谷歌、亚马逊、微软和Meta自2023年AI热潮开始至2026年6月,资本支出合计达1.1万亿美元,并计划今年再支出7450亿美元,大幅增加了在AI基础设施领域的投资规模。

🔗 https://www.techmeme.com/260731/p2#a260731p2


15. ChatGPT 桌面应用升级浏览器与图片编辑功能

OpenAI为ChatGPT桌面应用推送重大更新,新增内置浏览器和图片编辑功能。用户可在应用内直接浏览网页和编辑生成的图片,无需切换外部工具,标志着ChatGPT向全能型AI工作台方向的持续演进。

🔗 https://x.com/OpenAIDevs/status/2082944138635595782


16. 苹果获批在中国推出Apple Intelligence

库克确认苹果已获准在中国推出首批Apple Intelligence功能,Siri AI仍处于起步阶段。此举标志着苹果AI服务正式进入中国市场,但功能范围和上线时间仍受监管审批限制,首批功能预计随iOS更新逐步推出。

🔗 https://www.ithome.com/0/983/944.htm


17. MCP协议升级为无状态架构

模型上下文协议MCP宣布升级为无状态架构,这是该协议发布以来AI代理与外部工具通信方式的最大变革。无状态化简化了服务端实现,降低了部署成本,使MCP服务器更易扩展和维护。

🔗 https://x.com/Mayhem4Markets/status/2083013232122343444


18. NovelAI内测第五代图像模型

NovelAI开始内测Diffusion V5图像生成模型,新版在角色一致性和细节渲染方面有显著提升。NovelAI在二次元和插画生成领域拥有活跃用户群体,V5版本有望进一步巩固其在垂直图像生成市场的地位。

🔗 https://linux.do/t/topic/2682750


19. GPT-5.4模型从Codex订阅移除

OpenAI将于本月底把GPT-5.4和5.4 mini两款模型从ChatGPT Codex订阅服务中正式移除。此次调整意味着订阅用户无法再在Codex环境中使用这两款模型,OpenAI可能在为新一代模型腾出资源空间。

🔗 https://linux.do/t/topic/2686921


20. 微软宣布年内推出Copilot超级应用

微软计划在今年晚些时候推出Copilot AI超级应用,集合对话聊天、代码编写、协作工具Cowork及自主智能体Autopilots于一体。CEO纳德拉在财报电话会上披露此战略。付费Copilot用户约3000万,仍落后于ChatGPT规模。

🔗 https://www.163.com/dy/article/L380C3NT0511BLFD.html


🧪 芯片半导体

21. 长鑫存储市值突破六百亿元

长鑫存储股价触及六十点六元,市值突破六百亿元人民币。作为中国本土DRAM存储芯片龙头企业,长鑫存储的市值增长反映出国产存储芯片产业在技术突破和市场需求双驱动下的强劲发展态势。

🔗 https://x.com/poezhao0605/status/2083050861903954035


📦 开源项目

22. Search-R1开源强化学习搜索框架

Search-R1是一个开源强化学习框架,将搜索引擎与语言模型训练深度融合,使模型学会在推理过程中主动检索外部信息。该框架在开放域问答和事实核查任务上取得显著提升,为构建可靠AI搜索系统提供了新范式。

🔗 https://x.com/GithubProjects/status/2083055068761497877


23. Tailscale开源核心网络组件

Tailscale宣布开源其核心网络守护进程和命令行工具,支持构建私有WireGuard网络,覆盖Linux、Windows和macOS等主流平台。开源组件与商业版使用同一套核心代码,仅去除了图形界面。

🔗 https://x.com/GithubProjects/status/2083033555475812505


📌 模型排行榜

24. Artificial Analysis AI模型能力排行榜

Claude Opus 5以智力61分、代码78.0分、智能体55.3分全面领跑,Claude Fable 5和GPT-5.6 Sol紧随其后三榜均居前列。国产Kimi K3表现亮眼,三榜均位列第四。GLM-5.2跻身智力榜第十,DeepSeek V4 Flash新晋智能体榜第九。

🔗 https://artificialanalysis.ai/?intelligence=artificial-analysis-intelligence-index#intelligence-tabs

以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。

相关推荐
达子6662 小时前
第25章_HarmonyOs开发图解之 电话服务
华为·harmonyos
HMS Core20 小时前
基于人体骨骼点识别与跟踪,实现低时延体感游戏
游戏·华为·harmonyos
XR12345678820 小时前
政府办公楼网络搭建方案对比:信锐、华为、华三选型指南
网络·华为
达子66620 小时前
第23章_HarmonyOs开发图解之 WLAN
华为·harmonyos
小雨青年1 天前
【HarmonyOS 7 沉浸光感深度实战】 01 ArkUI 与 HDS 两套接口如何选择
华为·harmonyos
云端漫步19871 天前
HarmonyOS NEXT AI 智能生活助手:AI 代码解释
人工智能·华为·生活·harmonyos
木合塔尔 麦麦提1 天前
鸿蒙关系数据库代码案例
华为·harmonyos
云_杰1 天前
鸿蒙截图工具开发实战 02:截屏权限 CUSTOM\_SCREEN\_CAPTURE——"检查"和"申请"为什么必须是两个函数
华为·harmonyos
云端漫步19871 天前
HarmonyOS NEXT AI 智能生活助手:AI 待办事项生成
人工智能·华为·生活·harmonyos