前阵子海外社区传得神乎其神的匿名模型 Ox-Alpha,今天终于落锤了 ------ 就是智谱刚全量上线的 GLM-5.3-Flash。
扒出来的时候我还愣了一下,毕竟之前盲测的时候不少人猜是哪家的下一代旗舰,结果是个主打性价比的 Flash 版本。
讲真,这波最狠的不是性能,是把顶级模型的价格直接打下来了。个人开发者和小团队终于不用抠抠搜搜算 token 了。
300B 参数,干翻上代旗舰
先聊硬实力。
总参数 300B 级别,MoE 架构,实际激活的参数不多,但能力直接全面超过上代旗舰 GLM-5.2,综合水平对标 Opus 4.8,稳稳站在第一梯队里。
不是纸面数据好看那种。实测下来,复杂工程代码、终端操作、跑 Agent 任务这些硬核场景,提升都很明显,不是那种只能写个小函数的花架子。
之前处理数据预处理的特征工程,用上一代模型要反复调 bug,这次用 Flash 版基本一次跑通,逻辑给得很顺。
价格才是真正的王炸
这部分我看到的时候真的没忍住,这定价完全是来卷市场的。
常规定价就是 GLM-5.3 原版的1/10 ,现在限时折扣直接打到1/20 。算下来,差不多是 Opus 4.8 价格的1/40。
这什么概念?
以前用顶级大模型,跑长任务、批量调接口都得悠着来,生怕月底账单超预算。现在这个价格,基本可以放开手用,个人开发者、学生党都没什么压力。
做批量测试、跑大仓库分析、挂 Agent 自动化任务,终于不用再算着 token 省着用了。
最惊喜的:原生多模态,写代码终于能看图了
这是我个人觉得最实用的升级,没有之一。
GLM 系列第一个原生多模态模型,不是后面拼接的那种。能直接读界面截图、渲染效果图、页面成品图,真正做到边看边写代码。
懂的都懂这有多香。之前写前端复现页面,得左边放设计稿右边写代码,来回切着对比,AI 还经常理解错布局。现在直接丢截图进去,它自己能看懂元素位置、样式层级,写出来的代码还原度高很多,调样式的时间省了一大半。
排查 UI bug、看报错截图改代码也好用,不用再大段文字描述界面长什么样。
开发者福利直接拉满
已经订了 Coding Plan 的用户也有好处。
用 GLM-5.3-Flash 的话,可用额度直接翻 3 倍。
本来 Pro 套餐的额度日常开发就够用,现在直接乘三,跑复杂项目、多轮调试、整库分析都不用抠额度,放心爽跑就行。
不止写代码,办公文档也能直接交付
这次更新不只是给开发者用的。
Office 文档、金融研报、专业资料这些场景也覆盖到了,支持直接输出 PPTX、PDF、DOCX、XLSX 成品文件,不用生成文字再自己复制排版。
写周报、做数据报表、出方案初稿,效率能涨不少,算是附赠的惊喜。
免费体验卡,0 成本上手
最后说下福利。
🎁针对未订阅套餐的用户免费发放7天体验卡,0 成本上手,每天限量 10,000 张 领取入口:bigmodel.cn/activity/tr...
最后说两句
现在大模型市场挺有意思的,要么能力够强但贵得肉疼,要么便宜但能力跟不上。GLM-5.3-Flash 这次算是卡在了一个很舒服的位置上。
原生多模态编码 + 越级的性能 + 碾压级的定价,对于日常开发提效、做项目原型、甚至单纯学习体验来说,都算是性价比很高的选择。
我已经领了体验卡跑了两天前端了,你们感兴趣的也可以试试,反正免费。