【LLM】GLM-5.3-Flash模型

note

  • GLM-5.3-Flash模型:320B总参数,19B激活参数。在编码和智能体评估方面,GLM-5.3-Flash 的表现接近 Claude Opus 4.8 的水平。
  • 基准上 MVBench 约 77.8,MMVU 约 80.5,属 Flash 级多模态视频理解可用水平,但不支持音频输入
  • GLM-5.3-Flash 在多个方面进行了架构改进。首次引入了混合式架构,结合了稀疏注意力机制和线性注意力机制,从而显著降低了长上下文服务的成本,同时保留了精确的长上下文处理能力。此外,采用了 Manifold-Constrained Hyper-Connections(mHC)技术,进一步提升了扩展效率。结合最新的 30T 令牌多模态预训练语料库,这些改进使得 GLM-5.3-Flash 能够在较少的计算资源下实现更强大的性能。

文章目录

一、模型架构

二、效果

MVBench 和 MMVU:我们使用的参数设置为温度=1.0,top_p=0.95,最大上下文长度为 256K 个令牌。对于那些原生支持视频输入的模型,比如 Gemini 3.7 Flash,我们可以直接将原始视频作为输入进行评估。而对于那些不支持视频输入的模型,我们会采用默认的 1 帧每秒的提取策略。如果提取出的帧数超过 API 的最大限制,我们会在整个视频范围内进行均匀采样,直到达到这个最大帧数限制为止。

Reference

1 https://docs.z.ai/guides/vlm/glm-5.3-flash

2 https://huggingface.co/zai-org/GLM-5.3-Flash

3 GLM-5.3: Frontier Coding with Emergent Cyber Capabilities:https://z.ai/blog/glm-5.3

相关推荐
pnoker25 分钟前
IoT DC3 AI 能力:Agentic Center 的设计与边界
java·人工智能·物联网·大模型·spring ai
张忠琳34 分钟前
【deepseek-harness】Cordis 时空可组合性编程范式 — 三段式精读笔记(四)
ai·agent·deepseek·harness·cordis·dsh
阿里云云原生1 小时前
从手工回测到全自动化:AgentLoop 在 Agent Engineering 中的落地与实践总结
云原生·agent
plainGeekDev1 小时前
Agent调试、错误处理与成本优化
agent·ai编程·claude
番茄不是西红柿kk1 小时前
GLM-5.3-Flash 20分钟复刻《我的世界》实录
人工智能·ai·aigc·agent·我的世界
阿里云大数据AI技术1 小时前
DataWorks Data Agent 实战课堂(六):数据集成定时任务巡检
人工智能·agent
张忠琳3 小时前
【deepseek-harness】Cordis 时空可组合性编程范式 — 三段式精读笔记(五)
ai·agent·deepseek·harness·cordis·dsh
武子康3 小时前
把生产 Agent 事故 Trace 变成可重放的回归测试集
人工智能·llm·agent
一个处女座的程序猿4 小时前
Agent之Human-Agent Teaming:Cumora(面向人类与 AI Agent 协作的聊天应用)的简介、安装和使用方法、案例应用之详细攻略
人工智能·agent·cumora