**摘要:**本文以武侠章回体讲述 2026 年 7 月末至 8 月末三十二天内,智谱与 DeepSeek 围绕大模型 API 定价展开的攻防战。智谱先以"低价竞争不利于行业发展"为由涨价三档,DeepSeek 随即以 V4-Flash 一元低价"钉线"抢量;随后智谱借第三方渠道骨折价"探路",DeepSeek 亮出旗舰 V4-Pro 后于 8 月 17 日大幅涨价,缓存命中档涨幅高达 1100%,却因此腾出"高性价比"空位。8 月 20 日匿名模型 Ox Alpha 免费上线并登顶,技术指纹指向智谱;8 月 26 日智谱摘下面罩,发布 GLM-5.3-Flash,以旗舰十分之一价格对标 Claude Opus 4.8。8 月 27 日 DeepSeek 账本曝光,API 毛利率 82.9%、估值 740 亿美元,揭示其涨价实为上市铺路。全文以"谁都没站在道德高地上,大家都在牌桌上"收束,点明两家各自赶路的真实意图。
DeepSeek 涨了 1100%,26 天后智谱掀了桌
AI江湖录 ① · 斩杀线
八月,两个屠夫互相追杀的三十二天
七月末,有个人站出来说:便宜不是好事。同一个月,另一个人把刀插在桌上说:便宜就是好事。
这三十二天里,两个人交换了刀,各捅了对方一刀。
我在城门口摆茶摊,看得清清楚楚。
楔子 · 八月二十六日,一夜三件事
话说八月二十六日夜里,江湖上出了三件事。
头一件,蒙面人自己摘了面罩。
他在城中的模型大卖场(OpenRouter)免费摆了六天摊,不要钱。六天里全城一半的客人都跑了过去,把原来坐头把交椅的那位挤了下来。这六天,全城吃掉了四十二万亿个 token------这个词您不必懂,就当是四十二万亿个字。
然后他摘了面罩。
是智谱。
七月末刚刚说过"低价竞争不利于行业发展"的那一家,八月末掀了桌子,把价格砍到自家旗舰的十分之一。
同一晚阿里也下了场,掏出 Qwen3.8-Flash,一块钱三块钱。英伟达同天发财报,说下季度要卖一千零八十亿美元------上游卖铲子的赚疯了,下游挖金的在互相砍。
还有一件事更要命,隔了一天才浮出水面。
DeepSeek 的账本,被人翻出来了。
前七个月收入四亿七千五百万,是去年全年的十倍;净亏七个多亿。看着挺惨。往下再翻一行------
API 毛利率,82.9%。
同一时间,它正在谈一笔七十四亿美元的融资,估值七百四十亿美元,准备上科创板。
所以八月十七号那次涨价,不是活不下去了。
是要上市了。
三件事压在同一周里,把七月末到八月末这三十二天,串成了一出完整的戏。
茶续上,我从头说。
第一回 · 立牌坊
七月三十日到三十一日,二十四小时。
先动手的是智谱。三件事,一件比一件响。
头一件,撤门槛。GLM Coding Plan 从一月二十三日起搞了半年多的"每天上午十点抢库存",正式取消。以前是有钱也不一定买得到,现在是随时能买。
第二件,涨价。
| 档位 | 原价 | 新价 | 涨幅 |
|---|---|---|---|
| Lite | 49 元 | 118 元 | +141% |
| Pro | 149 元 | 538 元 | +261% |
| Max | 469 元 | 1078 元 | +130% |
Pro 那一档,一年按月付是六千四百五十六块,够买一台中高配开发机。
第三件,也是响得最远的一件------它给这次涨价配了一套说法:
"低价竞争不利于行业发展,价格需要回归正常商业价值区间。"
这话得放在当时的背景里听。
同一天,OpenAI 把 GPT-5.6 的 Luna 砍到了二折。
输入从一美元降到两毛,输出从六美元降到一块二。这款模型七月九号才上架,从上架到砍价,二十一天。Altman 同天发了篇博客,意思是智能就该管够、就该便宜。
一边砍到二折,一边翻三倍多。隔着一个太平洋,同一天。
那天媒体的标题是:《今日 AI 圈:GPT 5.6 骨折降价,智谱涨价翻倍》。
评论区炸了。有人翻旧账:二月、三月、四月,它涨过三回,一季度 API 定价累计提了 83%。
但资本市场认。港股开盘,涨了 23%。
摩根大通七月那份研报说得最实在:GLM-5.2 的平均收费比上一代高了约 13%,公司"展现出更强的定价能力"。
什么叫定价能力?就是我涨价,你还来。
数据也撑得住------涨了这么多,调用量反而涨了四倍。
话说到这份上,逻辑是通的。
可就在智谱在台上讲这套道理的同一天,台下有人往墙上贴了张纸。
七月三十一日,DeepSeek 上架 V4-Flash 正式版。
纸上写着:输入一块钱,输出两块钱。
(计量单位都是每百万 token,您就当是"每百万个字收多少"。)
这个价有多狠?同一天 OpenAI 刚把 Luna 砍到二折,输入折成人民币还一块三。DeepSeek 一块。而且 V4-Flash 是个两千八百四十亿总参数的模型,每回答一个字只叫醒一百三十亿个参数干活------这设计叫 MoE,您就理解成"三千人的编制,每单活只派一百三十个人上"。
它一句话没解释。没开发布会,没讲行业道理,没谈商业价值。
就贴了张价目表。
江湖上有句话:讲道理的人,最怕不讲道理的。
智谱刚把"价格要回归商业价值"的牌坊立起来,DeepSeek 就在牌坊底下钉了根钉子。
这根钉子后来有个名字,叫斩杀线。
第二回 · 钉线
钉子钉下去,只用了一周。
八月三日,V4-Flash 登顶全球调用量第一。浙商证券那个礼拜的口径是:七点二二万亿 token / 周。八月初,OpenRouter 上过去一周全球调用量前五名,全是中国模型。
那几天开发者群里流传一句话:一块钱两块钱,这还怎么打?
V4-Flash 就成了那根"性价比斩杀线"------低于这条线,你有得赚;高于这条线,客人扭头就走。全行业被钉在这根线上,动弹不得。
这时候,第一个意外来了。
八月六日,DeepSeek 在 API 文档里挂了条提示:
计划近期整体上调 API 服务定价,预计涨幅较大,具体方案另行通知。
屠夫说:刀要收了。
同一天,智谱的创始人唐杰发了句话:新一代模型即将发布,定位是"史诗级 Plus"升级。
两条消息撞在同一天,当时没人在意。回头看,这是两个人隔着街,互相亮了个眼神。
一个说我要涨价了。一个说我有个大的。
八月六日到八月十七日,中间隔了十一天。这十一天里发生的事,是整出戏里最诡异的一段。
第三回 · 摆摊
八月九日到十日。
大卖场上出事了。智谱的上一代旗舰 GLM-5.2,价格牌上突然挂出个红标:95% off 。原价输入一块四美元、输出四块四美元,压到了 0.07 / 0.22。
七分钱。跑一百万个字,约合人民币两毛五。比 DeepSeek 的一块钱还低。
消息传开,一片"GLM 降 95%""跳楼价式内卷"。
但这里有个蹊跷处:智谱从头到尾没吭声。
浙商证券八月十日那份研报把事说透了------智谱官方 API 定价维持 1.40/4.40,未作调整 。卖场上那场"暴降",系第三方 hosting provider 行为,最低价那家叫 StreamLake。
翻译过来:降价的是摆摊的,不是开店的。
GLM-5.2 的权重是 MIT 协议开源的。谁都能下载,谁都能自己买卡、自己部署、自己定价。大卖场里二十多家服务商各摆各的摊,标价各不相同:那天 StreamLake 压到骨折,Novita 压到九四折,百度千帆压到九二折。便宜的是摊位,不是出厂价。
有意思的就在这儿。
七月末,智谱刚在台上说完"低价竞争不利于行业发展"。八月初,它的货在卖场里被打到九五折。
按常理,厂家该出来管一管,发个声明,撇清关系。
智谱没有。既没承认,也没否认。
研报里那句分析,我读完笑出了声:第三方渠道商"在DeepSeek 涨价窗口 以 GLM-5.2 极限低价卡位,有助于承接对价格敏感的开发者需求,为 GLM-5.3 上市铺路"。
您品品。
DeepSeek 八月六日刚喊"我要涨价了"。三天后,卖场门口就有人摆了个摊,卖智谱的货,骨折价,专接那些被涨价赶出来的客人。
至于是谁让摆的,没人说。摊主不说,厂家不说。
我当时跟朋友说了句:这不像降价,这像探路。
拿别人的摊子试试水,看客人肯不肯来、来多少、留不留得住。成了,说"那是渠道行为,与我们无关";砸了,也说"那是渠道行为,与我们无关"。
进可攻,退可守,还不脏手。
十一天,静得有点吓人。
第四回 · 亮剑
八月十二日晚,刀出了鞘。
DeepSeek 更新 API 文档,V4-Pro 正式版上线。
配置给足了:一点六万亿总参数、四百九十亿激活,一万亿 token 的超长上下文。原生支持 OpenAI 的 Responses 接口,能直接接 Codex------对程序员来说,等于插上就能用。同时开源的还有个叫 Harness 的东西,您就理解成模型的"操作系统",招商证券后来管它叫"Agent 时代的安卓"。
它要抢的不是订单,是"你在谁的地盘上干活"。
价格呢?
输入三块,输出六块。缓存命中两分五厘。
("缓存命中":你问过的话、喂过的材料,模型记住了不用重算,这部分按超低价收。聊天机器人、编程助手这类应用重复内容极多,命中率往往超过九成------所以这一档才是真正的命门。)
三块六块是什么分量?智谱 GLM-5.2 / 5.3 的官方标价是 1.4 美元 / 4.4 美元,按当时汇率折人民币,大约十块和三十一块。
DeepSeek 用旗舰级的配置,卖出了智谱三分之一的价。
而且它已经在文档里预告了:这价,八月十七号要涨。
所以这一刀的真正意思是------我先让你看一眼刀有多快,然后告诉你,下次要收钱了。
八月十三日出了个小插曲:官宣内容被技术博主挑出错处,回撤重发了一遍。风波没动到基本盘,但留下个后遗症------从这天起,大家开始盯着它的每一个数字。
然后,四十八小时不到,对面还手了。
八月十四日,智谱 GLM-5.3。
这版模型有意思的地方在于:基座和 GLM-5.2 一模一样,都是七百四十三亿参数,一个字都没改。全靠后训练堆性能。
什么叫后训练?人还是那个人,骨头没换,但这半年练了套新拳法。结果编程能力提了约五成,Terminal-Bench 3.0 拿到开源第一,网络安全侧 CyberGym 八十四点五分,比 Anthropic 的 Mythos 5 还高一点。
硬要论招式,这叫不动架构,只加内功。
跑分表一贴出来,两边粉丝开吵。吵到最后发现个尴尬事------两边的跑分根本不是同一张卷子。智谱考 Terminal-Bench 3.0、CyberGym,DeepSeek 考 Terminal Bench 2.1、Harness 极简模式那套。量表不同,分数没法比。
唯一能放在同一张表上的,是第三方 Artificial Analysis 的综合智能指数。那上面:
GLM-5.2:53 分。V4-Pro 正式版:53 分。
平手。
界面新闻那天的标题最诚实:《DeepSeek 和智谱接连更新模型,但都没能炸场》。
四十八小时内相继发版,谁也没把谁打趴下。
这一回合,两人隔街对了一掌,各自退了半步。
茶凉了。可真正的戏,第二天才开始。
第五回 · 收刀
八月十七日,零点。
新定价生效。整个开发者社区看着那张表,愣了半天。
| 模型 | 时段 | 输入(缓存未命中) | 输出 | 缓存命中 |
|---|---|---|---|---|
| V4-Pro | 高峰 | 9.0 元 | 27.0 元 | 0.3 元 |
| V4-Pro | 空闲 | 4.5 元 | 13.5 元 | 0.15 元 |
| V4-Flash | 高峰 | 3.0 元 | 9.0 元 | 0.1 元 |
| V4-Flash | 空闲 | 1.5 元 | 4.5 元 | 0.05 元 |
高峰时段:北京时间 9:00-12:00、14:00-18:00。其余时间半价。
对照涨价前的三块六块:
- 高峰输出:6 元 → 27 元,涨 350%
- 高峰输入:3 元 → 9 元,涨 200%
- 缓存命中:0.025 元 → 0.3 元,涨 1100%
一千一百。
不是百分之一百一。是一千一百。
最后这个数,才是真正的杀招。
前面说过,编程助手这类应用的缓存命中率普遍超过九成。你把最常用、最量大、最不起眼的那一档,从两分五抬到三毛------涨了十一倍。
V4-Flash 的输出从两块涨到九块。七月末被钉在地上的那条"斩杀线",一夜之间被自己拔起来,往上抬了三倍半。
官方说法是"优化算力资源调配,引导错峰调度"。有券商分析,缓存命中涨这么多,多半是因为要存的东西太多------内存涨价了。
理由都成立。但江湖不看理由,江湖看结果。
结果来得很快。据《晚点 LatePost》报道:提价之后,V4-Flash 在 OpenCode 上的调用量掉了一半。
一半。
这些客人去了哪儿?答:去了其他国产模型那儿。
八月二十三日,DeepSeek 补了条新规:**周末全天按离峰价计费。**距涨价隔了六天。
这是找补。但既成事实已经落地了。
我把这一回单独拎出来说,是因为它是整出戏的转轴。
八月十七日之前,DeepSeek 是那个"替大家把价格打下来的人"。八月十七日之后,它变成了"涨价的人"。
而"高性价比"这个位子,它腾出来了。
空位不会一直空着。江湖里没有空位。
第六回 · 牛来
八月二十日。
大卖场来了个新摊主。
没名字。登记的身份是 stealth/ox-alpha------"隐身"。没有厂家,没有发布会,没有技术报告,连个官网都没有。
挂出来就三行字:一万亿 token 上下文,能吃文字、图片、视频,免费。
就这三行。
然后第一个小时,人挤爆了。
上线首日,冲上 OpenRouter 调用量榜首,创下单日历史纪录。
同时,终结了 DeepSeek 在 OpenCode 上连续五十六天的霸榜。
五十六天。那是 V4-Flash 从七月底一路坐到八月二十日的位子。
一天,就断了。
而且它是免费的。DeepSeek 刚把价抬了三倍半,这边直接不要钱。
全网开始猜它是谁。小米的 MiMo V3 Pro?谷歌的 Gemini 新版(连谷歌员工都下场发文暗示,被网友骂"碰瓷")?微软 MAI 的小模型?
不到二十四小时,破案了。
有独立研究员发了份技术指纹报告:拿它的分词器跑了二十五组提示词,token 计数与 GLM-5.3 完全一致 ;十一项探针交叉测试,与 GLM 家族全部匹配。结论:"99% 把握,指向智谱。"
("分词器指纹":每个模型切字的方式都不一样,就像笔迹。你让它数一句话有几个字,数出来的结果跟谁一模一样,你就是谁家的。)
智谱还是不说话。
那六天,江湖上出现了我这辈子没见过的场面。
全世界的程序员在疯狂薅一头匿名牛的羊毛。有人一天跑几个亿 token,有人把它接进生产系统,有人拿它写完了整个项目。
到第八天,OpenCode 的计数器上显示:五十万五千个独立用户标识,累计消耗四十四万亿 token,完成一千三百万次会话。
而这六天,这些请求跑在哪儿?
十万张国产芯片上。
华为、海光、摩尔线程------这是《科创板日报》从相关人士那儿打听来的,未经官方确认。但"十万张国产卡扛住全球生产流量"这件事,智谱是认的。(国产芯片的老评价是"能训练,扛不了在线服务"。这一条我下一篇单说。)
八月二十六日晚,面罩摘了。
智谱的公众号发了一篇,《GLM-5.3-Flash:前沿智能进入普惠时代》。
第一段是这样写的:
"大家好像已经习惯将前沿智能与前沿价格绑定,并认为这是技术进步必须支付的成本。今天,GLM-5.3-Flash 来了。"
我第一次读这句,愣了两秒。
"大家"是谁?
"已经习惯将前沿智能与前沿价格绑定"------这不就是七月末它自己说的吗?
七月三十一日,它说:低价竞争不利于行业发展,价格要回归正常商业价值区间。
八月二十六日,它说:你们居然习惯了智能越贵越好,我来打破这个规矩。
同一家公司,二十七天,两句话。
然后它报数。
GLM-5.3-Flash,三千二百亿总参数,每回答一个字只叫醒一百八十亿个参数,是 GLM-5 系列第一个原生多模态模型,权重 MIT 协议开源。架构上做了两件狠事:读长文章不再每个字都跟前面所有字比对,而是挑重点比对,注意力计算量降到 GLM-5.3 的三分之一;层数从九十二层砍到四十五层,几乎砍半。
成本就是这么压下来的。
然后是分数。
| 模型 | AA 指数 |
|---|---|
| GLM-5.3-Flash | 57 |
| Claude Opus 4.8 | 57 |
| GLM-5.2 | 53 |
| DeepSeek V4-Pro 正式版 | 53 |
| DeepSeek V4-Flash | 52 |
57 分。和 Anthropic 最贵的 Claude Opus 4.8 打平。比 DeepSeek V4-Pro 高 4 分。
然后是价格。
| 输入 | 输出 | 缓存命中 | |
|---|---|---|---|
| GLM-5.3-Flash 常规价 | ¥0.8 | ¥2.8 | ¥0.23 |
| GLM-5.3-Flash 首发五折(至 9/9) | ¥0.4 | ¥1.4 | ¥0.115 |
| DeepSeek V4-Flash 闲时 | ¥1.5 | ¥4.5 | ¥0.05 |
| DeepSeek V4-Flash 高峰 | ¥3.0 | ¥9.0 | ¥0.1 |
(单位:元 / 每百万 token)
常规价是 DeepSeek 闲时价的 53% 和 62%。五折期,降到 27% 和 31%。高峰时段比,GLM 的输出价只有 DeepSeek 的六分之一。
智谱对外统一口径:这是自家旗舰 GLM-5.3 的十分之一,五折期二十分之一,是 Claude Opus 4.8 的四十分之一。
原话是:
"同样智力,1/40 价格,前沿智能,第一次不需要省着用。"
港股第二天大涨。
这一刀捅在哪儿?
捅在八月十七日 DeepSeek 涨价之后腾出来的那个位子上。
能力高一档,价格比你的闲时还便宜三成半,而你六天前刚涨过价。
最妙的是------智谱从头到尾,一个字都没提 DeepSeek。
可那一晚,所有媒体的标题都是同一句:第一刀,砍向 DeepSeek。
第七回 · 账本
我以为戏到这儿就完了。
八月二十七日到二十八日,真正的底牌翻了出来。
DeepSeek 的财务数据,经量子位、松果投研这些渠道流出:
| 项目 | 数字 |
|---|---|
| 2026 年前 7 个月收入 | 4.75 亿元(2025 全年的 10 倍) |
| 净亏损 | 7.15 亿元 |
| API 毛利率 | 82.9% |
| 新融资 / 估值 | 74 亿美元 / 740 亿美元 |
| IPO | 已启动筹备,瞄准科创板 |
| 参保人数 | 2023 年 4 人 → 2025 年 46 人 |
八十二点九的毛利率。
一百块钱的 API 收入,成本不到十八块。
我不是说它不该赚钱。做模型不赚钱,那才是行业悲剧。
但您把这张表,和八月十七日那张涨价表,并排放。
一边是:那一档从两分五涨到三毛,涨了十一倍,说这是成本压顶的必然选择。
一边是:一百块的买卖,本钱不到十八块;七百四十亿美元的身价;科创板的门已经敲了;全店四十六个人。
所以那次涨价,不是"活不下去了"。
是"账要做漂亮了"。
我不是在骂它。换我我也这么干。公司要上市,收入曲线得陡,毛利得厚,故事得讲圆。成本涨不涨是次要的,投资人看的是趋势。
我只想说明一件事:
江湖上最好听的话,都是讲给别人听的。
"低价竞争不利于行业发展"------七月末智谱说的,八月末它自己用十分之一的价格掀了桌。
"成本变化的自然结果"------八月十七日 DeepSeek 涨价的理由,八月二十七日账本出来,毛利率八十二点九。
谁都没站在道德高地上。大家都在牌桌上。
尾声 · 谁是谁
三十二天,缩成一张表。
| 时间 | 谁出手 | 做了什么 | 那一刻它是谁 |
|---|---|---|---|
| 7/30-31 | 智谱 | 涨价三档,最高 +261%,说"低价不利于行业" | 涨价的人 |
| 7/31 | DeepSeek | 上架 V4-Flash,1 元 / 2 元,一句话没说 | 钉线的人 |
| 8/6 | 两边 | 一个预告涨价,一个预告"史诗级 Plus" | 隔着街亮眼神 |
| 8/9-10 | (渠道) | GLM-5.2 被打到 95% off,智谱不认不否 | 摊子摆出去了 |
| 8/12-14 | 两边 | V4-Pro 旗舰卖 1/3 价 → GLM-5.3 四十八小时应战 | 对了一掌,各退半步 |
| 8/17 | DeepSeek | 峰谷定价生效,缓存命中 +1100% | 涨价的人 |
| 8/20 | ? | Ox Alpha 匿名上线,免费,首日登顶,断 56 天霸榜 | 蒙面人 |
| 8/23 | DeepSeek | 周末全天按离峰价 | 找补的人 |
| 8/26 | 智谱 | 摘面罩:GLM-5.3-Flash,0.8 / 2.8 元,AA 57 分 | 掀桌的人 |
| 8/27-28 | --- | DeepSeek 账本曝光:毛利率 82.9%,估值 740 亿美元 | 牌底亮了 |
| 8/31 | 智谱 | 中期业绩 | 该它交卷了 |
看出来了吗?
两边各自把对方七月末干过的事,重做了一遍。
智谱七月末说"便宜不好",八月末自己用便宜掀了桌。
DeepSeek 八月中用便宜戳别人的涨价,八月十七日自己涨得更狠,八月二十七日账本出来,毛利率八十二点九。
这不是谁背叛了谁。这就是牌桌上的规矩------你手里有什么牌,就打什么牌。
收摊
七月末智谱涨价的时候,没人想到八月末它自己会把价格砍到十分之一,更没人想到那一巴掌最后落到了刚涨完价的 DeepSeek 脸上。
最没人想到的是,当 DeepSeek 的账本摊在桌上,我们才看明白:这两个人从一开始就不是在打架,是在各自赶路。
一个要上市,得让账好看。
一个要翻身,得让市场记住它。
刀法看着是冲对方去的,其实都是在给自己的路开山。
那我们这些在门口喝茶的怎么办?
搬个小板凳,续上茶,看明天那份财报。
心里默念一句:
打,再打凶点。反正最后便宜的是我。
只是那个被腾出来的位子,不止一个人在抢。
正是:
涨价的都是勇士,下一秒就有人掀桌。
声明:纯属虚构,博君一乐。