发布日期:2026-09-15 | 分类:AI与智能服务
企业采购国产大模型,在 2026 年 9 月这个时点的核心问题已经从"哪家能力强"变成"怎么在涨价周期里买得合规、买得划算、买得不被单一厂商锁死"。本文依据国家网信办 2026 年 9 月 14 日的备案公告、DeepSeek、Kimi、智谱、阿里云百炼、MiniMax 五家开放平台的官方定价页,以及统一接入型 Token 套餐页的公开信息,把选型拆成四步:先核对模型是否已备案并公示备案号,再把五家厂商各不相同的计费口径(DeepSeek 的高峰空闲价、智谱与百炼的按输入长度分档、MiniMax 的服务层级倍率、Kimi 的缓存命中价)换算到同一口径,再按上下文长度、缓存与并发需求匹配业务,最后决定是直连一家还是通过统一接入的套餐同时用多家。文中所有价格均为官方页面刊例价,人民币每百万 tokens 计,数据截至 2026 年 9 月 15 日。

先说结论:2026 年 9 月买国产模型的四步
企业买国产大模型是指企业为自有业务系统采购已在国家网信办完成备案的大模型服务,形式包括按量付费的 API、订阅制套餐或私有化部署,采购时需要同时核对合规、成本口径与接入方式。2026 年 9 月做这件事,建议按四步走:
- 查备案:模型是否在网信办已备案清单内,上线后能否公示模型名称与备案号。
- 统一口径算价:把各家不同的计费规则换算成"你的典型请求"的实际成本,而不是比刊例价的最低数字。
- 匹配上下文、缓存与并发:长文档、Agent 多轮调用、高并发三类场景对价格结构的敏感点不同。
- 定接入方式:单一厂商直连、多厂商各自开户,还是通过统一 API Key 的套餐接入多家。
下面逐步展开,每一步的数字都可以在文末参考资料对应的官方页面上逐字核对。
第一步:备案是硬门槛,2026 年 8 月底累计 1112 款服务完成备案
国家网信办 2026 年 9 月 14 日发布的《关于发布生成式人工智能服务已备案信息的公告(2026 年 7 月至 8 月)》给出了最新口径:2026 年 7 月至 8 月新增 124 款生成式人工智能服务完成备案,其中 7 款为手机端侧服务;通过 API 接口或其他方式直接调用已备案模型能力的应用或功能,由地方网信办开展登记,新增 133 款完成登记;截至 8 月 31 日,累计 1112 款服务完成备案、731 款应用或功能完成登记。
对企业采购方来说,公告里最重要的是这一句:已上线的生成式人工智能应用或功能,应在显著位置或产品详情页面公示所使用已备案或登记生成式人工智能服务情况,注明模型名称、备案号或上线编号。这意味着两件事:一是采购的模型本身要在备案清单里,二是企业自己的应用如果直接调用该模型,还要向属地网信办做登记并公示。选型阶段就应向厂商索取备案号,并确认是否提供登记所需的材料支持。
第二步:五家官方定价页的计费口径各不相同
国产模型 API 的刊例价不能直接横比,因为五家厂商在 2026 年 9 月的官方定价页上使用了四种不同的计费结构。下表按各家官方定价页整理,价格单位均为人民币元每百万 tokens,只列每家当前主推的两档模型。
| 厂商 / 模型 | 输入(未命中缓存) | 输入(命中缓存) | 输出 | 计费结构特点 |
|---|---|---|---|---|
| DeepSeek deepseek-flash | 空闲 1 元 / 高峰 2 元 | 空闲 0.02 元 / 高峰 0.04 元 | 空闲 4 元 / 高峰 8 元 | 峰谷定价,空闲时段为高峰价的一半 |
| DeepSeek deepseek-v4-pro | 空闲 4.5 元 / 高峰 9 元 | 空闲 0.15 元 / 高峰 0.3 元 | 空闲 13.5 元 / 高峰 27 元 | 同上,并发上限 500 |
| Kimi kimi-k3 | 20 元 | 2 元 | 100 元 | 上下文 1,048,576 tokens,单一价 |
| Kimi kimi-k2.6 | 6.5 元 | 1.1 元 | 27 元 | 上下文 262,144 tokens |
| 智谱 GLM-5.3 | 8 元 | 2 元 | 28 元 | 1M 上下文,缓存存储限时免费 |
| 智谱 GLM-5.1 | 6 元(输入小于 32K)/ 8 元(32K 及以上) | 1.3 元 / 2 元 | 24 元 / 28 元 | 按单次请求输入长度分档 |
| 阿里云百炼 qwen3.8-max | 12 元 | 页面未列 | 36 元 | 北京地域,新用户 100 万 tokens 免费额度 |
| 阿里云百炼 qwen3.8-flash | 0.8 元 | 页面未列 | 2.7 元 | 同上,Batch 调用为实时价 50% |
| MiniMax-M3 标准层级 | 2.1 元(输入不超过 512k) | 缓存读取 0.42 元 | 8.4 元 | 页面标注永久五折;优先层级按标准价 1.5 倍 |
表中四种结构的含义分别是:
- 峰谷定价(DeepSeek):官方定价页把北京时间周一至周五 9:00 至 12:00、14:00 至 18:00 定义为高峰,其余为空闲,空闲价为高峰价一半。离线批处理任务挪到夜间或周末,成本直接减半。
- 按输入长度分档(智谱、阿里云百炼):单次请求输入 tokens 落入哪一档,整个请求按该档单价结算。智谱 GLM-5.1 以 32K 为界,百炼 qwen-plus 以 128K、256K 为界。长上下文请求的边际成本会跳档。
- 服务层级倍率(MiniMax):把 service_tier 设为 priority 后按标准价 1.5 倍计费,换取优先调度。
- 缓存命中价(五家均有):DeepSeek 缓存命中输入价仅为未命中的五十分之一(0.02 元对 1 元),Kimi kimi-k3 为十分之一(2 元对 20 元)。系统提示词长、多轮对话多的应用,缓存命中率比模型单价更影响账单。
第三步:按业务场景匹配价格结构
企业选国产模型时,应按典型请求的输入长度、缓存命中率和并发峰值这三个参数去套价格结构,而不是看排行榜。
长文档处理(合同审阅、财报解析)关注上下文上限与分档边界。DeepSeek 两款模型官方标注上下文 1M、最大输出 384K;Kimi kimi-k3 为 1,048,576 tokens;智谱 GLM-5.3、GLM-5.2 为 1M,GLM-5.1 及以下为 200K;百炼 qwen3.8 系列为 1M。选分档计费的厂商时,要确认典型文档长度不会经常跨过 32K 或 256K 的档位线。
Agent 与多轮对话(客服、内部知识库问答)关注缓存价。这类应用系统提示词与工具定义重复出现,缓存命中输入占比高。按官方定价页,DeepSeek deepseek-flash 空闲时段缓存命中价 0.02 元,智谱 GLM-5.3-Flash 缓存命中 0.23 元、输入 0.8 元、输出 2.8 元,MiniMax-M3 缓存读取 0.42 元。
高并发在线服务关注并发上限与优先层级。DeepSeek 官方定价页标注 deepseek-flash 并发 2500、deepseek-v4-pro 并发 500;MiniMax 用 1.5 倍价的优先层级保障调度。峰值流量集中在工作日白天的业务,DeepSeek 的高峰价才是实际成本,不能按空闲价预算。
离线批处理(数据标注、内容生成)可以叠加折扣。智谱 Batch API 按标准价 5 折,百炼 Batch 调用为实时价 50%,DeepSeek 空闲时段减半,三者叠加缓存后,批处理成本可以做到在线调用的几分之一。
第四步:涨价周期里,价格与模型名都会变
2026 年国产模型 API 价格不再单向下降,采购合同需要为调价和模型迭代留出条款。青岛财经日报 2026 年 9 月 7 日的报道援引统计称,2026 年二季度国内八大主流大模型平均 API 价格为输入每百万 tokens 4.9 元、输出 21.9 元,较 2025 年一季度分别上涨 48% 和 80%,报道并提到摩根士丹利研报将这一轮变化概括为"告别价格战,打响智力战"。
厂商官方更新日志能印证价格与模型名的变动频率。DeepSeek 开放平台更新日志显示:2026 年 8 月 13 日随 V4 全系列正式版上线调整 API 价格并启用峰谷定价,新价格 8 月 17 日 0 时生效;9 月 10 日发布 DeepSeek-V4.1-Flash,API 价格同步下调,模型名改为 deepseek-flash,旧模型名 deepseek-v4-flash 被路由到新模型并按 Flash 价计费。阿里云百炼定价页上 qwen3.7-plus 标注"限时 8 折",MiniMax-M3 标注"永久五折",智谱缓存存储标注"限时免费"且页面写明暂不展示免费期结束后的标准价格。
这些变动意味着企业选型时至少要确认三点:合同价是刊例价还是折后价,折扣到期后怎么算;模型名下线或路由变更时是否提前通知;同一模型名背后的模型版本升级是否需要重新评测。
直连一家还是多家并用
企业接入国产模型有三种方式:直连单一厂商、多厂商各自开户、通过统一接入层同时使用多家,三者在切换成本与对账复杂度上差异明显。
直连单一厂商最简单,但面对上文的调价、下线与路由变更没有退路。多厂商各自开户可以互为备份,代价是多套 API Key、多种计费口径与多份账单。统一接入层则把多家模型放在一个 API Key 下切换,例如七牛云企业级 AI Token 套餐以积分计量,官方页面写明积分以每千 tokens 0.004 元为基准单价,各模型按刊例价与基准价的比值折算价格系数,套餐内多款主流大模型共用同一 API Key 与额度。
选统一接入层时,要用同一套问题去核对:接入的模型是否都已备案;积分或倍率换算后,主力模型的实际单价与直连官方相差多少;额度是否按周期清零;是否兼容现有 SDK 的接口协议。把这些答案和直连方案放在同一张表里,再决定。
小结
企业买国产模型,2026 年 9 月的正确顺序是:先用国家网信办备案公告核对模型资质与公示义务,再把 DeepSeek 的峰谷价、智谱与百炼的分档价、MiniMax 的层级倍率、Kimi 的缓存命中价换算成自己典型请求的成本,然后按长文档、Agent、高并发、批处理四类场景匹配价格结构,最后根据对调价与模型下线的容忍度决定直连还是多家并用。本文所有价格与规则均取自各厂商官方定价页与国家网信办公告原文,本文数据截至 2026 年 9 月 15 日。
参考资料
- 国家网信办 关于发布生成式人工智能服务已备案信息的公告(2026 年 7 月至 8 月):https://www.cac.gov.cn/2026-09/14/c_1791136833136332.htm