谷歌内测Gemini 3.8 Flash,智谱开源GLM-5.3权重,腾讯亮剑Hy4,开源大模型神仙打架 | 8月29日 AI日报

💡 今日趋势速览:谷歌开始内测Gemini 3.8 Flash,试用者称其明显好于上代;智谱正式开源GLM-5.3旗舰权重,主打智能体编码与网络防御;腾讯混元发布770B参数的Hy4 Preview并开源,能力对标GLM-5.3-Flash,开源大模型竞争持续升温。

🎯 今日要点

  1. 谷歌内测 Gemini 3.8 Flash 曝光
  2. 智谱开源 GLM-5.3 旗舰模型
  3. 腾讯开源 Hy4 Preview 模型

📋 今日内容汇总

🤖 AI动态

  1. 谷歌内测 Gemini 3.8 Flash 曝光
  2. 智谱开源 GLM-5.3 旗舰模型
  3. 腾讯开源 Hy4 Preview 模型
  4. Qwen3.8-Flash 登陆 OpenCode Go
  5. Qwen3.8-Flash-Next 权重开源
  6. 英伟达发布 NVFP4 量化 Qwen3.8
  7. MiniMax 开源 FastH3 v1 视频模型
  8. FastH3 将引入 vLLM-Omni
  9. Meta Muse 图像模型上线 API
  10. KimiCode 新增多 Agent 编排模式
  11. Kimi Code 新增远程控制功能
  12. Midjourney V8.2 编辑模型开测
  13. Wan 3.0 登顶视频编辑竞技场
  14. 蚂蚁百灵推出金融模型Ling-3.0-flash-Fin
  15. Agnes 2.5 Pro Beta 智能指数达 49 分
  16. Grok 全线升级至 4.6 模型

🔌 AI基础设施

  1. AMD 发布 ROCm 10.0.0

📌 模型排行榜

  1. Artificial Analysis AI 模型能力排行榜

🤖 AI动态

1. 谷歌内测 Gemini 3.8 Flash 曝光

来源:原文 | thisisdimm

商业内幕获得内部截图:谷歌已开始内部测试 Gemini 3.8 Flash Preview,向部分员工开放并出现在内部编程平台 Jetski 上。试用者称其明显好于 3.7 Flash,但尚早无法完整评价------距 3.7 Flash 正式发布仅过去两周。

🔗 https://x.com/0xLogicrw/status/2093322334455427233


2. 智谱开源 GLM-5.3 旗舰模型

来源:原文 | Zai_org

智谱正式开放 GLM-5.3 权重:面向智能体编码与网络防御的最强旗舰,支持下载、本地运行与定制,权重当日登陆 Hugging Face 与 ModelScope,采用全新 GLM-5.3 License,Day-0 获得 vLLM、SGLang、OpenRouter 等平台支持。

🔗 https://x.com/Zai_org/status/2093354097122455713


3. 腾讯开源 Hy4 Preview 模型

来源:原文 | op7418 (Twitter)

腾讯混元发布并开源 Hy4 Preview:总参数 770B、激活 49B、100 万上下文,在 Arena WebDev 评测排第五、与 GLM-5.3-Flash 相当;官方盲测显示 163 名内部专家在 203 个真实工程任务上略胜 GLM-5.3 与 Kimi K3。

🔗 https://x.com/op7418/status/2093237037378007461


4. Qwen3.8-Flash 登陆 OpenCode Go

来源:原文 | Alibaba_Qwen

Qwen3.8-Flash 现已登陆 OpenCode Go:125B 总参数激活 6B、100 万上下文、原生多模态,开发者可在终端编码智能体中直接使用这一高性价比模型。

🔗 https://x.com/Alibaba_Qwen/status/2093227357951897687


5. Qwen3.8-Flash-Next 权重开源

阿里开放 Qwen3.8-Flash-Next 权重,作为 Qwen4 新架构的预览:125B MoE 每步激活约 6B,创新引入 51B N-gram Embedding 参数(灵感源自 DeepSeek 的 Engram 技术)增强局部模式捕捉,一张 4090 免量化即可运行。

🔗 https://hub.baai.ac.cn/view/57507


6. 英伟达发布 NVFP4 量化 Qwen3.8

英伟达在 Hugging Face 发布 NVFP4 量化的 Qwen3.8:2.4 万亿参数的 MoE 模型现支持 4 位推理,显著降低部署所需显存与算力门槛,为超大规模开源模型在单机与边缘侧的落地铺路。

🔗 https://x.com/HuggingPapers/status/2093182766913622115


7. MiniMax 开源 FastH3 v1 视频模型

来源:原文 | haoailab

MiniMax 开放 FastH3 v1 权重:13 秒生成 15 秒 768p 视频,FastVideo 与 Nuvalab 合作、配合 FastGen 在英伟达 Blackwell GPU 上最高实现 14 倍加速,完全开放供社区运行与改进,官方称开放权重视频模型的后训练时代才刚开始。以下是官方给出的 demo

🔗 https://x.com/haoailab/status/2093391548289540596


8. FastH3 将引入 vLLM-Omni

接上条新闻,vLLM-Omni 团队祝贺 FastVideo 发布 FastH3,并宣布正与其紧密合作把 FastH3 引入 vLLM-Omni 生态。开放权重视频模型与主流推理框架的加速路径进一步打通,社区后训练空间随之扩大。

🔗 https://x.com/vllm_project/status/2093430388391825797


9. Meta Muse 图像模型上线 API

来源:原文 | alexandr_wang

Meta 的 Muse 图像模型现已在 Meta 模型 API 上线,每张图 0.01 美元,官方称其为生产级规模下性价比最佳的图像模型之一,进一步降低应用侧的图像生成成本。

🔗 https://x.com/alexandr_wang/status/2093390371875414501


10. KimiCode 新增多 Agent 编排模式

KimiCode 新增实验性 tower 多 Agent 编排模式:设置环境变量后通过 /tower on 与 /tower 命令即可启动,让多个编码智能体围绕同一目标协同分工,探索复杂工程任务的并行完成方式。

🔗 https://x.com/Young_AGI/status/2093255429342261727


11. Kimi Code 新增远程控制功能

接上条新闻,Kimi Code 0.39.0 新增实验性远程控制功能,用于远程访问本地 Web 会话:设置环境变量后通过 kimi rc、kimi web --remote-control 或 /remote-control 命令即可启动,方便跨设备接管编码会话。

🔗 https://x.com/KimiDevs/status/2093184808419746164


12. Midjourney V8.2 编辑模型开测

Midjourney 开始测试 V8.2 编辑模型:支持指令式编辑、基于其他图像生成图像、笔刷局部重绘与扩图,并兼容个性化设置、情绪板与风格参考,图像编辑能力迎来大版本升级。

🔗 https://x.com/DavidSHolz/status/2093119067125424173


13. Wan 3.0 登顶视频编辑竞技场

阿里 Wan 3.0 以 1414 分登顶视频编辑竞技场:领先 dreamina-seedence-2.5 四分、领先 MiniMax-H3 二十二分。这是阿里首次进入该竞技场------目前汇聚 8 家实验室 10 个模型,共同推动视频编辑前沿。

🔗 https://x.com/arena/status/2093143153167810608


14. 蚂蚁百灵推出金融模型Ling-3.0-flash-Fin

蚂蚁百灵推出金融模型Ling-3.0-flash-Fin,基于Ling-3.0-flash,加入金融数据训练和工具调用优化,可自主查资料、读年报、做投研估值,并直接处理Excel财务模型。其在部分 Finance Agent 等任务上已经超过部分旗舰模型官方称模型权重下周开源

🔗 https://x.com/0xLogicrw/status/2093292146682138805


15. Agnes 2.5 Pro Beta 智能指数达 49 分

新加坡实验室 Agnes AI 的 Agnes 2.5 Pro Beta 在 Artificial Analysis 智能指数获得 49 分,较 Alpha 版提升 9 分,主要来自智能体能力的大幅进步,但输出 token 用量约为原来的两倍。

🔗 https://x.com/ArtificialAnlys/status/2093157744471851476


16. Grok 全线升级至 4.6 模型

xAI 把整个 Grok 体验全面升级到新 Grok 4.6 模型:所有模式现在均运行 4.6,聊天、搜索与智能体能力统一换代,用户无需手动切换即可获得最新模型体验。

🔗 https://x.com/XFreeze/status/2093429341887611232


🔌 AI基础设施

17. AMD 发布 ROCm 10.0.0

AMD本周发布了GPU加速计算开放软件堆栈ROCm的10.0.0版本,新版本重点关注Instinct、Radeon与Ryzen AI平台上的AI推理、开发者工具与性能分析能力。ROCm 10.0.0扩展了对GPU、虚拟化的支持,将8GB与4GB显存版本的Radeon RX 9050显卡纳入其中

🔗 https://www.ithome.com/0/995/683.htm


📌 模型排行榜

18. Artificial Analysis AI 模型能力排行榜

最后是今日的 AI 模型能力排行榜单,智力榜:Claude Opus 5以63分登顶,智能体榜:Opus 5、GLM-5.3、Grok 4.6均59分并列第一。开源方面,Kimi K3居智力榜第5名60分,GLM-5.3-Flash列智能体榜第4名58分,开源梯队已逼近闭源头部。

🔗 https://artificialanalysis.ai/?intelligence=artificial-analysis-intelligence-index#intelligence-tabs

以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。

相关推荐
AI日报派送佬8 小时前
2026年10月8日AI行业日报|GPT-6可视化UI全面上线、AI PC硬件革新、智能体安全与商业化提速
人工智能·gpt·openai·谷歌·deepseek·ai日报·智能体技术
云卷云舒___________17 小时前
Gemini 4 今日上线?Claude Haiku 5.5发布!Sonnet 缓存半价,Mythos 5.1开放申请 | 10月8日 AI日报
grok·anthropic·ai日报·gemini4·claudehaiku5·mythos·sonnet
云卷云舒___________2 天前
Mistral Large 4 发布:1T 参数 MoE,欧美开源权重新旗手
ai日报·加急快讯
Summer-Bright2 天前
拆解 | 谷歌3590兆瓦核电协议:真正的新增核电只有890兆瓦,「最大核能协议」四分之三是包装
人工智能·谷歌·核电·pjm
夏文强2 天前
国产开源反攻海外:GLM-5.3 进 Cursor,CursorBench 开放权重第一
人工智能·开源·大模型·glm·智谱
技术小事4 天前
FrugalEvo:AI 如何按成本进化
人工智能·ai编程·腾讯
AI日报派送佬4 天前
2026年10月5日AI行业日报|中美模型差距缩至3%,物理AI百亿估值爆发,决策模型国产开源竞速
人工智能·openai·ai智能体·ai日报·物理ai·算力基建·ai商业化
云卷云舒___________4 天前
Astra-lite疑似GPT-6.1 Terra? Haiku 5.5 与 Gemini 4 Argon 灰测? | 10月5日 AI日报
ai·anthropic·ai日报·terra·gemini4·gpt61·haiku55
飞塔老梅子4 天前
17. Unsloth下载、安装及加载本地大模型 ❀ 老梅子学AI
人工智能·glm·lm studio·5.3·unsolth
AI日报派送佬5 天前
2026年10月4日AI行业日报|AI智能体自主能力升级,模型落地与安全规范双向迭代
人工智能·智能体·ai安全·开源ai·ai日报·人工智能前沿·ai科研