智谱又发模型了,GLM-5.3。
它沿用 GLM-5.2 的同一基座,参数也没有增加,仅靠继续加码后训练,就在官方自建 Coding 榜单上实现了 50% 的提升,堪称后训练之王。
Coding 仍是主线,但这个新模型最抢眼的能力是网络安全。
发布前两周,智谱联合国内安全团队对 GLM-5.3 进行测试。
在国内外各大项目上一共发现了 2404 个潜在漏洞,其中 1088 个为中高危漏洞。

最早的风险可以追溯到 40 多年前,涉及 DNS、邮件与办公系统、通信软件、操作系统等每天都在使用的东西。
这个方向就很有意思了。
现在,最新一代的 GLM 模型开始读懂复杂系统,在海量代码里找风险、排查异常路径,还能参与后续的验证和修复。
GLM-5.3 持续推动 Coding 能力迈向生产级,并在此基础上自然延伸出一套安全能力。
01
GLM-5.3 模型简介
GLM-5.3 是智谱最新一代基座模型。这一代可以用三个关键词概括:Coding、网络安全、开源。
GLM-5.3 已经来到开源模型 Coding 能力的第一梯队。在评测 Z.ai Code Bench上比 GLM-5.2 提升50%。
它沿用了 GLM-5.2 同一套基座,没有扩大参数规模,也没有重新做预训练,所有新增能力都来自后训练。
它证明了:大模型的能力上限,并不完全在基座预训练结束时就被确定,成熟的后训练同样可以持续榨出基座中尚未释放的智能。

在白盒代码审查、漏洞定位和安全推理等任务里,它又进入了一个更专业的场景。
我觉得这比单纯刷新一张榜单更值得看。
而且网络安全又把难度往上抬了一层。模型得读懂系统、提出假设、调用工具验证,再根据结果修正路线。
这套能力,和一个靠谱工程师处理真实项目时的工作方式越来越像了。
02
实测一下效果
复刻一个 Windows 98 的操作系统,应用和游戏都能点击玩耍。
做一个第一人称的 FPS 射击游戏
使用 Three.js 做一个第三人称群岛探索的宣传 Demo 演示。


03
两周发现了 2404 个漏洞
网络安全可以看作 Coding 能力变得越来越强后能做好的场景。
普通 Coding 任务关注功能有没有实现。
安全任务还需要顺着复杂逻辑寻找那些平时很难触发、出问题时后果又很严重的异常路径。
整个过程包含很多环节,对工具使用和长程规划的要求挺高的。
从目前公布的信息看,GLM-5.3 在白盒代码审查、漏洞定位和基础安全推理上,它已经达到全球前沿模型的水平。
到了复杂漏洞利用和完整攻防闭环,和最强闭源模型之间仍然存在差距。
安全能力很强,距离模型自己完成所有事情还有很远。
不过,发布前两周的测试结果已经足够夸张。
智谱联合国内安全团队发现了 2404 个潜在漏洞,其中 1088 个为中高危,覆盖 220 个项目。

比如安全研究团队借助 GLM,在 1983 年形成的 DNS 协议中发现了一类潜伏 40 多年的协议级风险。
少量特殊请求就可能把服务器的计算压力最高放大近 8 万倍,潜在影响超过 1000 万处公网 DNS 服务。
还有借助 GLM 3.5 发现了三枚微软重大漏洞,包括邮件预览、文档处理和服务端远程访问。
相关漏洞已经完成修复了,微软也公开致谢了 Kunlun Lab 与 GLM。

04
普通人怎么用上 GLM-5.3
目前最省事的入口是 ZCode。

GLM-5.3 会面向 GLM Coding Plan 用户开放,API 和完整模型权重也将按发布计划陆续提供。
第三方 Coding 平台会逐步接入。
ruby
体验入口:https://zcode.z.ai/cn
编程套餐:https://docs.bigmodel.cn/cn/coding-plan/overview
GLM 系列从 Coding 出发,已经开始进入网络安全这种更专业、更高价值的场景。
当攻击者已经开始使用 AI,防御者也需要一套能够自己掌握、随时调用的模型能力。
这可能才是 GLM-5.3 最有价值的地方。