LLM13-2026年8月国内AI大模型性价比排行榜:DeepSeek涨价之后
2026 年 8 月 17 日,DeepSeek 一纸公告让整个开发者圈 sub 了一下------V4 系列告别「白菜价」,正式引入峰谷定价(Peak/Off-peak Pricing)⏰。曾经以 1 元/2 元横扫市场的 V4-Flash,一夜之间变成 1.5 元/4.5 元起,输出价格最高涨了 3.5 倍 💸。那个「无脑选 DeepSeek」的时代,结束了。
所以问题来了:涨价之后,国内大模型性价比之王还是它吗? 本文基于 8 月 14 日更新的 AA Intelligence Index(AA 智能指数) v4.1.1、SuperCLUE 2026 年 8 月中文大模型排行榜,以及各厂商 8 月最新公开 API 定价,重新算了一笔「性价比账」,给你一份 2026 年 8 月版的国内大模型性价比 Top 10 排行榜 🏆。
数据截止时间 :2026 年 8 月 21 日(Benchmark 数据、API 定价均为截至该日期的最新公开信息) 📅 综合成本计算 :3:1 加权(输入价 × 0.75 + 输出价 × 0.25),单位 RMB/百万 Token(词元) 免责声明:API 定价随时可能调整,请以各厂商官方页面为准 ⚠️
1. 📉 涨价事件回顾:DeepSeek 的「峰谷定价」到底贵了多少
8 月 17 日起,DeepSeek 将 V4 系列调整为峰谷两档价格 🌗:高峰时段(北京 09:00-12:00、14:00-18:00)价格为闲时的 2 倍,相当于给「打工人的白天」加了价,给「夜猫子的深夜」留了便宜。
| 模型 | 计费项 | 旧价(元) | 新价-闲时(元) | 新价-峰时(元) | 最高涨幅 |
|---|---|---|---|---|---|
| V4-Pro | 输入(缓存命中) | 0.025 | 0.15 | 0.30 | 1100% 💀 |
| V4-Pro | 输入(缓存未命中) | 3 | 4.5 | 9 | 200% |
| V4-Pro | 输出 | 6 | 13.5 | 27 | 350% |
| V4-Flash | 输入(缓存命中) | 0.025 | 0.05 | 0.10 | 300% |
| V4-Flash | 输入(缓存未命中) | 1 | 1.5 | 3 | 200% |
| V4-Flash | 输出 | 2 | 4.5 | 9 | 350% |
用一句人话总结:缓存命中的「羊毛」彻底没了,输出 Token(词元) 直接翻倍起步 🐑✂️。V4-Pro 的缓存命中输入价最高涨了 11 倍,从「免费的午餐」变成了「得好好算算」的程度。
按 3:1 加权算一笔总账(闲时价):
- V4-Flash :综合成本从 1.25 元 → 2.25 元,涨幅 80% 📈
- V4-Pro :综合成本从 3.75 元 → 6.75 元,涨幅 80% 📈
好,涨价幅度清楚了。接下来就是重头戏------涨价后的性价比大洗牌 🔄。
2. 🏆 排行榜一:性价比 Top 10(AA Intelligence Index 视角)
按「AA Intelligence Index(智能指数) v4.1.1 得分 ÷ 3:1 加权综合成本」降序排列,筛选可通过公开 API 直接调用的模型,排除完全免费模型(免费的不叫性价比,叫慈善 🎁)。
score 说明:主榜单采用 AA Intelligence Index v4.1.1(2026-08-14 发布),覆盖国产头部模型最全;Doubao-Seed-2.1-Pro 未收录于 AA 榜,使用 SuperCLUE 2026 年 8 月总分(标注 ~)📊
| 排名 | 模型 | 厂商 | 综合得分 | 输入价 | 输出价 | 综合成本 | 性价比 |
|---|---|---|---|---|---|---|---|
| 1 | 腾讯混元 Hy3 | 腾讯 | 42 | 1 元 | 4 元 | 1.75 元 | 24.00 👑 |
| 2 | DeepSeek V4-Flash | 深度求索 | 50 | 1.5 元 | 4.5 元 | 2.25 元 | 22.22 |
| 3 | MiniMax M3 | 稀宇科技 | 45 | 2.1 元 | 8.4 元 | 3.68 元 | 12.24 |
| 4 | DeepSeek V4-Pro | 深度求索 | 53 | 4.5 元 | 13.5 元 | 6.75 元 | 7.85 |
| 5 | Qwen3.7 Max | 阿里巴巴 | 47 | 6 元* | 18 元* | 9.00 元 | 5.22 |
| 6 | GLM-5.2 | 智谱 AI | 53 | 8 元 | 28 元 | 13.00 元 | 4.08 |
| 7 | Kimi K2.6 | 月之暗面 | 45 | 6.5 元 | 27 元 | 11.63 元 | 3.87 |
| 8 | Qwen3.8 Max | 阿里巴巴 | 58 | 12 元 | 36 元 | 18.00 元 | 3.22 |
| 9 | Doubao-Seed-2.1-Pro | 字节跳动 | ~65.94 | 6 元 | 30 元 | 12.00 元 | 5.50~ |
| 10 | Kimi K3 | 月之暗面 | 60 | 20 元 | 100 元 | 40.00 元 | 1.50 |
*Qwen3.7 Max 标注价格为限时五折价(原价 12/36 元),促销结束后将按原价计算 📉 ~Doubao-Seed-2.1-Pro 得分来源为 SuperCLUE 8 月总分(65.94),与 AA 体系存在口径差异,性价比仅供参考 🤏
重大变化解读 🤯:
- DeepSeek V4-Flash 让出了榜首:性价比从涨价前的 64.00(1.25 元成本)暴跌至 22.22,被腾讯混元 Hy3 以 24.00 微弱反超。
- 但差距其实极小:Hy3 与 V4-Flash 只差 1.78 分------用一句话说,涨价后的 V4-Flash 依然是「准性价比之王」,只是从「绝对领先」变成了「贴身肉搏」🤼。
- MiniMax M3 成最大黑马:45 分 + 五折后 3.68 元成本,稳稳站在第三,比两个 Max 级旗舰还划算。
- 旗舰级(Max) 集体垫底:Qwen3.8 Max、Kimi K3 能力确实顶级,但 18 元/40 元的综合成本把性价比拖到了地板------能力强,钱包疼 💸。
3. 🏆 排行榜二:SuperCLUE 8 月视角(可排名的 5 强)
如果你更信任 SuperCLUE 中文榜(8 月最新,max 模式总分),在「有官方得分」的 5 个模型里再算一遍:
| 排名 | 模型 | SuperCLUE 得分 | 综合成本 | 性价比 |
|---|---|---|---|---|
| 1 | DeepSeek V4-Flash | 65.60 | 2.25 元 | 29.16 👑 |
| 2 | DeepSeek V4-Pro | 70.10 | 6.75 元 | 10.39 |
| 3 | Doubao-Seed-2.1-Pro | 65.94 | 12.00 元 | 5.50 |
| 4 | Qwen3.8 Max | 71.48 | 18.00 元 | 3.97 |
| 5 | Kimi K3 | 70.68 | 40.00 元 | 1.77 |
有意思了 😏:SuperCLUE 视角下,DeepSeek V4-Flash 依然是性价比第一(29.16 断层领先)。同一个模型,两套 Benchmark(基准测试) 给出两个「第一」------所以结论取决于你信哪把尺子 📏。
4. 📋 各模型详情
① 腾讯混元 Hy3 --- 涨价后的新晋「性价比之王」👑
- 推荐理由:295B 总参数/21B 激活 MoE(混合专家) 架构,1 元/4 元的价格在国产模型里属于「地板级」,SWE-bench Verified 78.0、GPQA Diamond 90.4。DeepSeek 涨价后,它成了「最便宜的够用」首选------对,就是那种「食堂涨价后隔壁快餐店爆满」的既视感 🍜。
- 可用渠道:腾讯云 API、元宝 App、WorkBuddy
- 参考定价:输入 1 元,输出 4 元,缓存命中 0.25 元(综合成本 1.75 元)
② DeepSeek V4-Flash --- 跌下神坛,但没摔死 🤕
- 推荐理由 :涨价后综合成本从 1.25 元涨到 2.25 元,性价比从 64.00 掉到 22.22------「神」确实跌了,但 50 分的 AA 得分依然吊打一众同价位对手,且 Agent(智能体) 任务表现接近 V4-Pro。一句话:它不再是绝对之王,却依然是 Flash 之王 ⚡。
- 可用渠道:DeepSeek API(OpenAI 兼容)、网页端 chat.deepseek.com
- 参考定价:输入 1.5 元,输出 4.5 元(闲时,综合成本 2.25 元);峰时翻倍,记得错峰调用 🌙
③ MiniMax M3 --- 本季最大黑马 🐎
- 推荐理由:五折后 2.1/8.4 元的定价 + 45 分 AA 得分,性价比 12.24 稳居第三。1M 超长上下文,Agent 场景深度优化,是「花小钱办大事」的典型代表------DeepSeek 涨价的最大赢家,可能就是它 😂。
- 可用渠道:MiniMax API、阿里云百炼等第三方平台
- 参考定价:输入 2.1 元,输出 8.4 元(五折后,综合成本 3.68 元)
④ DeepSeek V4-Pro --- 旗舰守门员 🧤
- 推荐理由:53 分 AA 得分与 GLM-5.2 并列国产第二梯队,1.6T 总参数/49B 激活 MoE 架构,1M 上下文,MIT 开源。涨价后综合成本 6.75 元,性价比 7.85------旗舰里最便宜的,但「便宜」的幅度已大不如前 😮💨。
- 可用渠道:DeepSeek API(OpenAI 兼容)、网页端 chat.deepseek.com
- 参考定价:输入 4.5 元,输出 13.5 元(闲时,综合成本 6.75 元)
⑤ Qwen3.7 Max --- 限时五折的「性价比刺客」🗡️
- 推荐理由:原价 12/36 元,限时五折 6/18 元,47 分 AA 得分,综合成本仅 9 元,性价比 5.22 冲进前五。阿里生态(钉钉、淘宝、百炼平台)深度集成,促销期内是「中价位高能力」的优选------不过促销结束就现原形,且用且珍惜 ⏳。
- 可用渠道:阿里云百炼平台、通义千问网页端
- 参考定价:输入 6 元(五折),输出 18 元(五折),综合成本 9.00 元
⑥ GLM-5.2 --- 开源第二,Agent(智能体) 工具链成熟 🛠️
- 推荐理由:53 分 AA 得分与 V4-Pro 平起平坐,开源权重第二(仅次于 Kimi K3),MCP(模型上下文协议) 原生支持、多 Agent 协作框架成熟度国产最高。13 元的综合成本中规中矩,胜在「开源可私有化 + 工具链顺滑」。
- 可用渠道:智谱 API、网页端 chatglm.cn
- 参考定价:输入 8 元,输出 28 元(综合成本 13.00 元)
⑦ Kimi K2.6 --- 长文本与代码的「老黄牛」🐂
- 推荐理由:百万级上下文无损解析,SWE-bench Verified 80.2%,代码能力国产前列。45 分 AA 得分 + 11.63 元成本,性价比 3.87------能力没得说,就是价格不便宜,适合「长文本刚需」场景 🧻。
- 可用渠道:Kimi API、Web/App 端
- 参考定价:输入 6.5 元,输出 27 元(综合成本 11.63 元)
⑧ Qwen3.8 Max --- 国产最强旗舰,但钱包遭不住 💎
- 推荐理由 :AA 58 分国产第二、SuperCLUE 8 月 71.48 分国产第一,2.4 万亿总参数/950 亿激活,是目前国内参数规模最大的模型之一。8 月 3 日发布即开源(8/12 权重放出)。但 12/36 元的定价让综合成本高达 18 元,性价比 3.22------旗舰的尊严,是钱包的眼泪 😭。
- 可用渠道:阿里云百炼平台(DashScope API)、千问 AI 平台
- 参考定价:输入 12 元,输出 36 元,隐式缓存命中 1.5 元(综合成本 18.00 元)
⑨ Doubao-Seed-2.1-Pro --- 多模态标杆,SuperCLUE 视角挤进前三 🎨
- 推荐理由:SuperCLUE 8 月 65.94 分,LMArena 视觉理解维度全球第 4,多模态能力全面领先。6/30 元的定价(缓存命中 1.2 元)使综合成本 12 元,SuperCLUE 视角下性价比 5.50 排第三。345M MAU 的中国最大 AI 助手,「用脚投票」的群众基础摆在那 🤳。
- 可用渠道:火山引擎 API、豆包 App
- 参考定价:输入 6 元,输出 30 元(综合成本 12.00 元)
⑩ Kimi K3 --- 全球第五,贵得有理但贵 🤷
- 推荐理由 :AA 60 分全球排名第 5、国产最强,7 月 27 日开源后权重霸榜,Agent(智能体) 能力业界公认。但 20/100 元的定价堪称「奢侈品」级别,综合成本 40 元,性价比 1.50------能力天花板,价格也是天花板 🏔️。适合「效果优先、预算无上限」的场景。
- 可用渠道:Kimi API、Web/App 端
- 参考定价:输入 20 元,输出 100 元,缓存命中 2 元(综合成本 40.00 元)
5. 🎯 总结:全场景性价比最高模型
回到开头的灵魂拷问------「DeepSeek 涨价了,现在性价比最高的还是它吗?」 答案要分三句话讲 🎤:
- 极致性价比(AA 视角) :腾讯混元 Hy3 以 24.00 登顶,成了涨价后的新「性价比之王」👑。它用 1.75 元的综合成本拿到了 42 分,属于「食堂涨价后,隔壁快餐店爆满」的典型受益者 🍱。
- 能力与价格平衡(SuperCLUE 视角) :DeepSeek V4-Flash 依然以 29.16 断层领先,只是从「绝对碾压」变成了「险胜」。它不再是唯一答案,但仍是 Flash 级最强答案 ⚡。
- 综合建议 :轻量任务、高频调用选 Hy3 (更便宜)或 V4-Flash (能力更强);中端 Agent(智能体) 场景选 MiniMax M3 (黑马之选);不差钱、要顶配就上 Kimi K3 / Qwen3.8 Max 💰。
一句话总结:DeepSeek 让出了「性价比之王」的绝对王座,但没让出「能力价格比最均衡」的江湖地位------现在是「群雄割据」的时代,选谁取决于你的钱包厚度和任务强度 🥊。