AI江湖录①·斩杀线

**摘要:**本文以武侠章回体讲述 2026 年 7 月末至 8 月末三十二天内,智谱与 DeepSeek 围绕大模型 API 定价展开的攻防战。智谱先以"低价竞争不利于行业发展"为由涨价三档,DeepSeek 随即以 V4-Flash 一元低价"钉线"抢量;随后智谱借第三方渠道骨折价"探路",DeepSeek 亮出旗舰 V4-Pro 后于 8 月 17 日大幅涨价,缓存命中档涨幅高达 1100%,却因此腾出"高性价比"空位。8 月 20 日匿名模型 Ox Alpha 免费上线并登顶,技术指纹指向智谱;8 月 26 日智谱摘下面罩,发布 GLM-5.3-Flash,以旗舰十分之一价格对标 Claude Opus 4.8。8 月 27 日 DeepSeek 账本曝光,API 毛利率 82.9%、估值 740 亿美元,揭示其涨价实为上市铺路。全文以"谁都没站在道德高地上,大家都在牌桌上"收束,点明两家各自赶路的真实意图。

DeepSeek 涨了 1100%,26 天后智谱掀了桌

AI江湖录 ① · 斩杀线

八月,两个屠夫互相追杀的三十二天
七月末,有个人站出来说:便宜不是好事。

同一个月,另一个人把刀插在桌上说:便宜就是好事。

这三十二天里,两个人交换了刀,各捅了对方一刀。

我在城门口摆茶摊,看得清清楚楚。


楔子 · 八月二十六日,一夜三件事

话说八月二十六日夜里,江湖上出了三件事。

头一件,蒙面人自己摘了面罩。

他在城中的模型大卖场(OpenRouter)免费摆了六天摊,不要钱。六天里全城一半的客人都跑了过去,把原来坐头把交椅的那位挤了下来。这六天,全城吃掉了四十二万亿个 token------这个词您不必懂,就当是四十二万亿个字。

然后他摘了面罩。

是智谱。

七月末刚刚说过"低价竞争不利于行业发展"的那一家,八月末掀了桌子,把价格砍到自家旗舰的十分之一。

同一晚阿里也下了场,掏出 Qwen3.8-Flash,一块钱三块钱。英伟达同天发财报,说下季度要卖一千零八十亿美元------上游卖铲子的赚疯了,下游挖金的在互相砍。

还有一件事更要命,隔了一天才浮出水面。

DeepSeek 的账本,被人翻出来了。

前七个月收入四亿七千五百万,是去年全年的十倍;净亏七个多亿。看着挺惨。往下再翻一行------

API 毛利率,82.9%。

同一时间,它正在谈一笔七十四亿美元的融资,估值七百四十亿美元,准备上科创板。

所以八月十七号那次涨价,不是活不下去了。

是要上市了。

三件事压在同一周里,把七月末到八月末这三十二天,串成了一出完整的戏。

茶续上,我从头说。


第一回 · 立牌坊

七月三十日到三十一日,二十四小时。

先动手的是智谱。三件事,一件比一件响。

头一件,撤门槛。GLM Coding Plan 从一月二十三日起搞了半年多的"每天上午十点抢库存",正式取消。以前是有钱也不一定买得到,现在是随时能买。

第二件,涨价。

档位 原价 新价 涨幅
Lite 49 元 118 元 +141%
Pro 149 元 538 元 +261%
Max 469 元 1078 元 +130%

Pro 那一档,一年按月付是六千四百五十六块,够买一台中高配开发机。

第三件,也是响得最远的一件------它给这次涨价配了一套说法

"低价竞争不利于行业发展,价格需要回归正常商业价值区间。"

这话得放在当时的背景里听。

同一天,OpenAI 把 GPT-5.6 的 Luna 砍到了二折。

输入从一美元降到两毛,输出从六美元降到一块二。这款模型七月九号才上架,从上架到砍价,二十一天。Altman 同天发了篇博客,意思是智能就该管够、就该便宜。

一边砍到二折,一边翻三倍多。隔着一个太平洋,同一天。

那天媒体的标题是:《今日 AI 圈:GPT 5.6 骨折降价,智谱涨价翻倍》。

评论区炸了。有人翻旧账:二月、三月、四月,它涨过三回,一季度 API 定价累计提了 83%。

但资本市场认。港股开盘,涨了 23%。

摩根大通七月那份研报说得最实在:GLM-5.2 的平均收费比上一代高了约 13%,公司"展现出更强的定价能力"。

什么叫定价能力?就是我涨价,你还来。

数据也撑得住------涨了这么多,调用量反而涨了四倍。

话说到这份上,逻辑是通的。

可就在智谱在台上讲这套道理的同一天,台下有人往墙上贴了张纸。

七月三十一日,DeepSeek 上架 V4-Flash 正式版。

纸上写着:输入一块钱,输出两块钱。

(计量单位都是每百万 token,您就当是"每百万个字收多少"。)

这个价有多狠?同一天 OpenAI 刚把 Luna 砍到二折,输入折成人民币还一块三。DeepSeek 一块。而且 V4-Flash 是个两千八百四十亿总参数的模型,每回答一个字只叫醒一百三十亿个参数干活------这设计叫 MoE,您就理解成"三千人的编制,每单活只派一百三十个人上"。

它一句话没解释。没开发布会,没讲行业道理,没谈商业价值。

就贴了张价目表。

江湖上有句话:讲道理的人,最怕不讲道理的。

智谱刚把"价格要回归商业价值"的牌坊立起来,DeepSeek 就在牌坊底下钉了根钉子。

这根钉子后来有个名字,叫斩杀线


第二回 · 钉线

钉子钉下去,只用了一周。

八月三日,V4-Flash 登顶全球调用量第一。浙商证券那个礼拜的口径是:七点二二万亿 token / 周。八月初,OpenRouter 上过去一周全球调用量前五名,全是中国模型。

那几天开发者群里流传一句话:一块钱两块钱,这还怎么打?

V4-Flash 就成了那根"性价比斩杀线"------低于这条线,你有得赚;高于这条线,客人扭头就走。全行业被钉在这根线上,动弹不得。

这时候,第一个意外来了。

八月六日,DeepSeek 在 API 文档里挂了条提示:

计划近期整体上调 API 服务定价,预计涨幅较大,具体方案另行通知。

屠夫说:刀要收了。

同一天,智谱的创始人唐杰发了句话:新一代模型即将发布,定位是"史诗级 Plus"升级。

两条消息撞在同一天,当时没人在意。回头看,这是两个人隔着街,互相亮了个眼神

一个说我要涨价了。一个说我有个大的。

八月六日到八月十七日,中间隔了十一天。这十一天里发生的事,是整出戏里最诡异的一段。


第三回 · 摆摊

八月九日到十日。

大卖场上出事了。智谱的上一代旗舰 GLM-5.2,价格牌上突然挂出个红标:95% off 。原价输入一块四美元、输出四块四美元,压到了 0.07 / 0.22

七分钱。跑一百万个字,约合人民币两毛五。比 DeepSeek 的一块钱还低。

消息传开,一片"GLM 降 95%""跳楼价式内卷"。

但这里有个蹊跷处:智谱从头到尾没吭声。

浙商证券八月十日那份研报把事说透了------智谱官方 API 定价维持 1.40/4.40,未作调整 。卖场上那场"暴降",系第三方 hosting provider 行为,最低价那家叫 StreamLake。

翻译过来:降价的是摆摊的,不是开店的。

GLM-5.2 的权重是 MIT 协议开源的。谁都能下载,谁都能自己买卡、自己部署、自己定价。大卖场里二十多家服务商各摆各的摊,标价各不相同:那天 StreamLake 压到骨折,Novita 压到九四折,百度千帆压到九二折。便宜的是摊位,不是出厂价。

有意思的就在这儿。

七月末,智谱刚在台上说完"低价竞争不利于行业发展"。八月初,它的货在卖场里被打到九五折。

按常理,厂家该出来管一管,发个声明,撇清关系。

智谱没有。既没承认,也没否认。

研报里那句分析,我读完笑出了声:第三方渠道商"在DeepSeek 涨价窗口 以 GLM-5.2 极限低价卡位,有助于承接对价格敏感的开发者需求,为 GLM-5.3 上市铺路"。

您品品。

DeepSeek 八月六日刚喊"我要涨价了"。三天后,卖场门口就有人摆了个摊,卖智谱的货,骨折价,专接那些被涨价赶出来的客人。

至于是谁让摆的,没人说。摊主不说,厂家不说。

我当时跟朋友说了句:这不像降价,这像探路

拿别人的摊子试试水,看客人肯不肯来、来多少、留不留得住。成了,说"那是渠道行为,与我们无关";砸了,也说"那是渠道行为,与我们无关"。

进可攻,退可守,还不脏手。

十一天,静得有点吓人。


第四回 · 亮剑

八月十二日晚,刀出了鞘。

DeepSeek 更新 API 文档,V4-Pro 正式版上线。

配置给足了:一点六万亿总参数、四百九十亿激活,一万亿 token 的超长上下文。原生支持 OpenAI 的 Responses 接口,能直接接 Codex------对程序员来说,等于插上就能用。同时开源的还有个叫 Harness 的东西,您就理解成模型的"操作系统",招商证券后来管它叫"Agent 时代的安卓"。

它要抢的不是订单,是"你在谁的地盘上干活"。

价格呢?

输入三块,输出六块。缓存命中两分五厘。

("缓存命中":你问过的话、喂过的材料,模型记住了不用重算,这部分按超低价收。聊天机器人、编程助手这类应用重复内容极多,命中率往往超过九成------所以这一档才是真正的命门。)

三块六块是什么分量?智谱 GLM-5.2 / 5.3 的官方标价是 1.4 美元 / 4.4 美元,按当时汇率折人民币,大约十块和三十一块。

DeepSeek 用旗舰级的配置,卖出了智谱三分之一的价。

而且它已经在文档里预告了:这价,八月十七号要涨。

所以这一刀的真正意思是------我先让你看一眼刀有多快,然后告诉你,下次要收钱了。

八月十三日出了个小插曲:官宣内容被技术博主挑出错处,回撤重发了一遍。风波没动到基本盘,但留下个后遗症------从这天起,大家开始盯着它的每一个数字。

然后,四十八小时不到,对面还手了。

八月十四日,智谱 GLM-5.3。

这版模型有意思的地方在于:基座和 GLM-5.2 一模一样,都是七百四十三亿参数,一个字都没改。全靠后训练堆性能。

什么叫后训练?人还是那个人,骨头没换,但这半年练了套新拳法。结果编程能力提了约五成,Terminal-Bench 3.0 拿到开源第一,网络安全侧 CyberGym 八十四点五分,比 Anthropic 的 Mythos 5 还高一点。

硬要论招式,这叫不动架构,只加内功

跑分表一贴出来,两边粉丝开吵。吵到最后发现个尴尬事------两边的跑分根本不是同一张卷子。智谱考 Terminal-Bench 3.0、CyberGym,DeepSeek 考 Terminal Bench 2.1、Harness 极简模式那套。量表不同,分数没法比。

唯一能放在同一张表上的,是第三方 Artificial Analysis 的综合智能指数。那上面:

GLM-5.2:53 分。V4-Pro 正式版:53 分。

平手。

界面新闻那天的标题最诚实:《DeepSeek 和智谱接连更新模型,但都没能炸场》。

四十八小时内相继发版,谁也没把谁打趴下。

这一回合,两人隔街对了一掌,各自退了半步。

茶凉了。可真正的戏,第二天才开始。


第五回 · 收刀

八月十七日,零点。

新定价生效。整个开发者社区看着那张表,愣了半天。

模型 时段 输入(缓存未命中) 输出 缓存命中
V4-Pro 高峰 9.0 元 27.0 元 0.3 元
V4-Pro 空闲 4.5 元 13.5 元 0.15 元
V4-Flash 高峰 3.0 元 9.0 元 0.1 元
V4-Flash 空闲 1.5 元 4.5 元 0.05 元

高峰时段:北京时间 9:00-12:00、14:00-18:00。其余时间半价。

对照涨价前的三块六块:

  • 高峰输出:6 元 → 27 元,涨 350%
  • 高峰输入:3 元 → 9 元,涨 200%
  • 缓存命中:0.025 元 → 0.3 元,涨 1100%

一千一百。

不是百分之一百一。是一千一百。

最后这个数,才是真正的杀招。

前面说过,编程助手这类应用的缓存命中率普遍超过九成。你把最常用、最量大、最不起眼的那一档,从两分五抬到三毛------涨了十一倍。

V4-Flash 的输出从两块涨到九块。七月末被钉在地上的那条"斩杀线",一夜之间被自己拔起来,往上抬了三倍半。

官方说法是"优化算力资源调配,引导错峰调度"。有券商分析,缓存命中涨这么多,多半是因为要存的东西太多------内存涨价了。

理由都成立。但江湖不看理由,江湖看结果。

结果来得很快。据《晚点 LatePost》报道:提价之后,V4-Flash 在 OpenCode 上的调用量掉了一半。

一半。

这些客人去了哪儿?答:去了其他国产模型那儿。

八月二十三日,DeepSeek 补了条新规:**周末全天按离峰价计费。**距涨价隔了六天。

这是找补。但既成事实已经落地了。

我把这一回单独拎出来说,是因为它是整出戏的转轴。

八月十七日之前,DeepSeek 是那个"替大家把价格打下来的人"。八月十七日之后,它变成了"涨价的人"。

而"高性价比"这个位子,它腾出来了。

空位不会一直空着。江湖里没有空位。


第六回 · 牛来

八月二十日。

大卖场来了个新摊主。

没名字。登记的身份是 stealth/ox-alpha------"隐身"。没有厂家,没有发布会,没有技术报告,连个官网都没有。

挂出来就三行字:一万亿 token 上下文,能吃文字、图片、视频,免费

就这三行。

然后第一个小时,人挤爆了。

上线首日,冲上 OpenRouter 调用量榜首,创下单日历史纪录。

同时,终结了 DeepSeek 在 OpenCode 上连续五十六天的霸榜。

五十六天。那是 V4-Flash 从七月底一路坐到八月二十日的位子。

一天,就断了。

而且它是免费的。DeepSeek 刚把价抬了三倍半,这边直接不要钱。

全网开始猜它是谁。小米的 MiMo V3 Pro?谷歌的 Gemini 新版(连谷歌员工都下场发文暗示,被网友骂"碰瓷")?微软 MAI 的小模型?

不到二十四小时,破案了。

有独立研究员发了份技术指纹报告:拿它的分词器跑了二十五组提示词,token 计数与 GLM-5.3 完全一致 ;十一项探针交叉测试,与 GLM 家族全部匹配。结论:"99% 把握,指向智谱。"

("分词器指纹":每个模型切字的方式都不一样,就像笔迹。你让它数一句话有几个字,数出来的结果跟谁一模一样,你就是谁家的。)

智谱还是不说话。

那六天,江湖上出现了我这辈子没见过的场面。

全世界的程序员在疯狂薅一头匿名牛的羊毛。有人一天跑几个亿 token,有人把它接进生产系统,有人拿它写完了整个项目。

到第八天,OpenCode 的计数器上显示:五十万五千个独立用户标识,累计消耗四十四万亿 token,完成一千三百万次会话。

而这六天,这些请求跑在哪儿?

十万张国产芯片上。

华为、海光、摩尔线程------这是《科创板日报》从相关人士那儿打听来的,未经官方确认。但"十万张国产卡扛住全球生产流量"这件事,智谱是认的。(国产芯片的老评价是"能训练,扛不了在线服务"。这一条我下一篇单说。)

八月二十六日晚,面罩摘了。

智谱的公众号发了一篇,《GLM-5.3-Flash:前沿智能进入普惠时代》。

第一段是这样写的:

"大家好像已经习惯将前沿智能与前沿价格绑定,并认为这是技术进步必须支付的成本。今天,GLM-5.3-Flash 来了。"

我第一次读这句,愣了两秒。

"大家"是谁?

"已经习惯将前沿智能与前沿价格绑定"------这不就是七月末它自己说的吗?

七月三十一日,它说:低价竞争不利于行业发展,价格要回归正常商业价值区间。

八月二十六日,它说:你们居然习惯了智能越贵越好,我来打破这个规矩。

同一家公司,二十七天,两句话。

然后它报数。

GLM-5.3-Flash,三千二百亿总参数,每回答一个字只叫醒一百八十亿个参数,是 GLM-5 系列第一个原生多模态模型,权重 MIT 协议开源。架构上做了两件狠事:读长文章不再每个字都跟前面所有字比对,而是挑重点比对,注意力计算量降到 GLM-5.3 的三分之一;层数从九十二层砍到四十五层,几乎砍半。

成本就是这么压下来的。

然后是分数。

模型 AA 指数
GLM-5.3-Flash 57
Claude Opus 4.8 57
GLM-5.2 53
DeepSeek V4-Pro 正式版 53
DeepSeek V4-Flash 52

57 分。和 Anthropic 最贵的 Claude Opus 4.8 打平。比 DeepSeek V4-Pro 高 4 分。

然后是价格。

输入 输出 缓存命中
GLM-5.3-Flash 常规价 ¥0.8 ¥2.8 ¥0.23
GLM-5.3-Flash 首发五折(至 9/9) ¥0.4 ¥1.4 ¥0.115
DeepSeek V4-Flash 闲时 ¥1.5 ¥4.5 ¥0.05
DeepSeek V4-Flash 高峰 ¥3.0 ¥9.0 ¥0.1

(单位:元 / 每百万 token)

常规价是 DeepSeek 闲时价的 53% 和 62%。五折期,降到 27% 和 31%。高峰时段比,GLM 的输出价只有 DeepSeek 的六分之一。

智谱对外统一口径:这是自家旗舰 GLM-5.3 的十分之一,五折期二十分之一,是 Claude Opus 4.8 的四十分之一

原话是:

"同样智力,1/40 价格,前沿智能,第一次不需要省着用。"

港股第二天大涨。

这一刀捅在哪儿?

捅在八月十七日 DeepSeek 涨价之后腾出来的那个位子上。

能力高一档,价格比你的闲时还便宜三成半,而你六天前刚涨过价。

最妙的是------智谱从头到尾,一个字都没提 DeepSeek。

可那一晚,所有媒体的标题都是同一句:第一刀,砍向 DeepSeek。


第七回 · 账本

我以为戏到这儿就完了。

八月二十七日到二十八日,真正的底牌翻了出来。

DeepSeek 的财务数据,经量子位、松果投研这些渠道流出:

项目 数字
2026 年前 7 个月收入 4.75 亿元(2025 全年的 10 倍
净亏损 7.15 亿元
API 毛利率 82.9%
新融资 / 估值 74 亿美元 / 740 亿美元
IPO 已启动筹备,瞄准科创板
参保人数 2023 年 4 人 → 2025 年 46 人

八十二点九的毛利率。

一百块钱的 API 收入,成本不到十八块。

我不是说它不该赚钱。做模型不赚钱,那才是行业悲剧。

但您把这张表,和八月十七日那张涨价表,并排放。

一边是:那一档从两分五涨到三毛,涨了十一倍,说这是成本压顶的必然选择。

一边是:一百块的买卖,本钱不到十八块;七百四十亿美元的身价;科创板的门已经敲了;全店四十六个人。

所以那次涨价,不是"活不下去了"。

是"账要做漂亮了"。

我不是在骂它。换我我也这么干。公司要上市,收入曲线得陡,毛利得厚,故事得讲圆。成本涨不涨是次要的,投资人看的是趋势

我只想说明一件事:

江湖上最好听的话,都是讲给别人听的。

"低价竞争不利于行业发展"------七月末智谱说的,八月末它自己用十分之一的价格掀了桌。

"成本变化的自然结果"------八月十七日 DeepSeek 涨价的理由,八月二十七日账本出来,毛利率八十二点九。

谁都没站在道德高地上。大家都在牌桌上。


尾声 · 谁是谁

三十二天,缩成一张表。

时间 谁出手 做了什么 那一刻它是谁
7/30-31 智谱 涨价三档,最高 +261%,说"低价不利于行业" 涨价的人
7/31 DeepSeek 上架 V4-Flash,1 元 / 2 元,一句话没说 钉线的人
8/6 两边 一个预告涨价,一个预告"史诗级 Plus" 隔着街亮眼神
8/9-10 (渠道) GLM-5.2 被打到 95% off,智谱不认不否 摊子摆出去了
8/12-14 两边 V4-Pro 旗舰卖 1/3 价 → GLM-5.3 四十八小时应战 对了一掌,各退半步
8/17 DeepSeek 峰谷定价生效,缓存命中 +1100% 涨价的人
8/20 Ox Alpha 匿名上线,免费,首日登顶,断 56 天霸榜 蒙面人
8/23 DeepSeek 周末全天按离峰价 找补的人
8/26 智谱 摘面罩:GLM-5.3-Flash,0.8 / 2.8 元,AA 57 分 掀桌的人
8/27-28 --- DeepSeek 账本曝光:毛利率 82.9%,估值 740 亿美元 牌底亮了
8/31 智谱 中期业绩 该它交卷了

看出来了吗?

两边各自把对方七月末干过的事,重做了一遍。

智谱七月末说"便宜不好",八月末自己用便宜掀了桌。

DeepSeek 八月中用便宜戳别人的涨价,八月十七日自己涨得更狠,八月二十七日账本出来,毛利率八十二点九。

这不是谁背叛了谁。这就是牌桌上的规矩------你手里有什么牌,就打什么牌。


收摊

七月末智谱涨价的时候,没人想到八月末它自己会把价格砍到十分之一,更没人想到那一巴掌最后落到了刚涨完价的 DeepSeek 脸上。

最没人想到的是,当 DeepSeek 的账本摊在桌上,我们才看明白:这两个人从一开始就不是在打架,是在各自赶路。

一个要上市,得让账好看。

一个要翻身,得让市场记住它。

刀法看着是冲对方去的,其实都是在给自己的路开山。

那我们这些在门口喝茶的怎么办?

搬个小板凳,续上茶,看明天那份财报。

心里默念一句:

打,再打凶点。反正最后便宜的是我。

只是那个被腾出来的位子,不止一个人在抢。

正是:

涨价的都是勇士,下一秒就有人掀桌。

声明:纯属虚构,博君一乐。

相关推荐
Agudamu116140 分钟前
B站学习视频怎么变笔记:用 Ai好记 + Obsidian 搭建个人知识库的完整教程
人工智能·笔记·学习·音视频
我才是银古44 分钟前
让大模型"看懂"工程图纸:SVG + MD 双载体记录方法论
ai·cad·dwg
麦豆GEO1 小时前
GEO优化流量密码:吃透4大用户提问模型,精准拿捏AI自然流量
大数据·人工智能
dh2711987791 小时前
南京企业AI搜索“可见度之战”:GEO服务商竞合格局与选型逻辑
大数据·人工智能
Dawson Zhu1 小时前
多Agent系统共享记忆架构:从存储范式到分布式共识的技术剖析
人工智能·语言模型·架构·aigc·agi
数字游民95271 小时前
史诗级更新:微信小程序支持个人主体接入虚拟支付
ai·微信小程序·小程序·opc·数字游民9527
小道士写程序1 小时前
自然语言处理NLP - 第4章 NLP任务地图:先定义输出再挑模型
人工智能
具身AGI1 小时前
模型懂物理吗?物理AI 物理推理 的新赛点
人工智能·深度学习·计算机视觉
lincats1 小时前
大白话讲解Addy Osmani 的循环工程Loop Engineering工作流
人工智能·驱动开发·架构·prompt·状态模式·知识图谱