DeepSeek API 峰谷定价实战:计算 8 月 17 日后的 Agent 成本,并启动 Harness 预览版

DeepSeek 官方在 2026 年 8 月 13 日发布 V4 Pro 正式版公告:V4 Pro 已同步在 App、网页端和 API 上线,API 模型名不变;App 和网页端可以通过"专家模式"使用。

同一份官方公告还确认,API 新价格将于北京时间 2026 年 8 月 17 日 00:00 生效,并采用峰谷定价:高峰为 9:00-12:00、14:00-18:00,其余为空闲时段,空闲价格为高峰价格的一半。

本文做两件事:

  1. 用官方新旧价格计算 Agent 批处理的月账单;
  2. 用一个零依赖前端工具,让读者按自己的 Token 用量计算错峰收益。

需要先划清事实边界:本文使用一张 8 月 14 日的真实 DeepSeek API 汇总账单作为案例,但没有对 Harness 做模型能力跑分。计算器验证的是价格公式,Harness 部分验证的是官方仓库、npm 版本和启动方式。

一、官方新旧价格

价格单位为人民币/百万 Token:

模型 / 计费项 当前价格 8月17日空闲 8月17日高峰 相对当前最高涨幅
V4 Flash 缓存命中输入 0.02 0.05 0.10 400%
V4 Flash 缓存未命中输入 1 1.5 3 200%
V4 Flash 输出 2 4.5 9 350%
V4 Pro 缓存命中输入 0.025 0.15 0.30 1100%
V4 Pro 缓存未命中输入 3 4.5 9 200%
V4 Pro 输出 6 13.5 27 350%

"涨价500%"只适用于 Pro 缓存命中输入的空闲价格这一项:0.025 元变成 0.15 元,是 6 倍;高峰价格 0.30 元则是 12 倍,涨幅 1100%。因此写技术文章时,应同时写明模型、计费项和时段。

二、一张真实 API 账单

8 月 14 日的 DeepSeek API 汇总账单为:

指标 实际数据
API 请求次数 62 次
Token 9,275,742
消费金额 1.29 元
平均每次 Token 约 149,609
平均每次费用 约 0.0208 元
综合每百万 Token 费用 约 0.1391 元

这里的 0.1391 元/百万 Token 是用总金额除以总 Token 得到的综合成本,不是 DeepSeek 的某一项官方价格。截图没有提供模型、缓存命中 Token、未命中 Token、输入 Token 和输出 Token 的拆分,因此不能用它反推出具体单价。

此外,该账单发生在 8 月 14 日,早于 8 月 17 日新价格生效时间。要估算同一工作负载调价后的账单,还需要完整的 Token 分类和实际运行时段。

三、计算公式

一次调用的输入 Token 需要拆成缓存命中和缓存未命中两部分:

javascript 复制代码
function cost(prices, inputTokens, outputTokens, cacheRate) {
  const cached = inputTokens * cacheRate;
  const uncached = inputTokens - cached;

  return (
    cached / 1_000_000 * prices.cached +
    uncached / 1_000_000 * prices.input +
    outputTokens / 1_000_000 * prices.output
  );
}

月度账单再乘以每天运行次数和每月运行天数。错峰方案则按空闲比例加权:

javascript 复制代码
planMonth = idleCost * idleShare * totalRuns
          + peakCost * (1 - idleShare) * totalRuns;

其中 totalRuns = runsPerDay * daysPerMonth

四、一个可复核的月账单

假设:

  • 模型:V4 Pro;
  • 单次输入:120,000 Token;
  • 单次输出:18,000 Token;
  • 缓存命中率:40%;
  • 每天 100 次;
  • 每月 22 天。

单次成本为:

场景 单次成本 月度成本
调价前 0.3252 元 715.44 元
调价后全空闲 0.5742 元 1263.24 元
调价后全高峰 1.1484 元 2526.48 元
80% 空闲 + 20% 高峰 0.68904 元 1515.89 元

因此,80% 错峰方案相比全部高峰每月少花 1010.59 元,但仍比调价前多 800.45 元。错峰可以降低新价格下的浪费,不能让涨价消失。

五、哪些 Agent 任务适合错峰

任务 是否适合错峰 原因
夜间代码索引、仓库扫描 适合 可延迟,不影响即时交互
批量生成测试和离线评测 适合 可以按队列运行
文档摘要、日报周报 适合 有明确截止时间即可
线上故障排查 不适合 延迟会扩大故障影响
安全、支付、权限、数据迁移 不适合 应优先保障验证和审查

不要为了省 Token 把所有工作都推到夜间。更实用的做法是将任务分成"立即响应"和"允许排队"两类,再为后者设置队列调度。

六、DeepSeek Harness 官方信息

DeepSeek 官方仓库将 Harness 定义为开源 agent harness,采用"一切皆插件"架构,由 Cordis 驱动,许可证为 MIT。

官方中文 README 给出的启动方式是:

bash 复制代码
npx @deepseek-ai/dsh web

默认 Web UI 地址为:

text 复制代码
http://127.0.0.1:3080

截至 2026-08-14,npm 的 @deepseek-ai/dsh 最新标签是 0.1.0-rc.6。README 明确将 Harness 标为"开发者预览",并提醒未来可能出现破坏兼容性的变更。

这意味着它适合:

  • 学习 Agent Harness 的插件化架构;
  • 在隔离环境验证模型、工具和技能组合;
  • 为自己的插件设计接口;
  • 参与开源项目反馈。

它暂时不应被表述成"已经稳定替代所有生产 Agent 工具"。涉及客户数据、自动部署、权限和支付时,仍需人工复核、自动化测试和回滚方案。

七、工具实现与使用

项目目录只有两个文件:

text 复制代码
deepseek-price-scheduler/
├── index.html
└── README.md

读者下载 ZIP 后解压,双击 index.html

  1. 选择 Flash 或 Pro;
  2. 输入单次输入、输出 Token;
  3. 输入每天调用次数和每月运行天数;
  4. 设置缓存命中率;
  5. 设置计划放到空闲时段的比例;
  6. 查看当前价格、全高峰价格和错峰月费。

工具不需要 API Key,所有计算只在浏览器本地完成。

八、结论

DeepSeek 这次变化有两个方向:API 用峰谷价格引导资源调度,Harness 用开源插件架构扩大 Agent 生态。

对开发者而言,行动顺序应该是:

  1. 先按 Token 类型和时段重新估算预算;
  2. 把允许延迟的 Agent 任务放入空闲队列;
  3. 低风险任务优先 Flash,复杂任务再考虑 Pro;
  4. Harness 先隔离验证,不要把开发者预览版直接接入关键生产链路。

标签:DeepSeek、DeepSeek Harness、AI 编程、Agent、API 价格、Token 成本、JavaScript

相关推荐
搞科研的小刘选手1 小时前
【河南省科学院、河南工业大学主办 | 郑州举办】2026年计算机视觉与具身智能国际学术会议(CVEI 2026)
人工智能·计算机视觉·具身智能·学术会议·会议推荐
2601_950760791 小时前
H-2K(d)/IYSTVASSL流感HA四聚体:抗原特异性CD8+ T细胞检测的核心工具
人工智能·蛋白
烟雨江南7851 小时前
大型展会和行业活动如何做实时字幕?——灵声智库多会场流式 ASR、统一转写与内容沉淀实践
人工智能·语音识别·ai客服·企业agent
M-Robots echo1 小时前
驱动抽象层解析:标准化硬件接口,解决机器人硬件碎片化适配难题
人工智能·机器人·ros·开源社区·m-robots
workflower1 小时前
例二:某汽车制造企业深度融合AI智能体,构建园区网络的智能运维体系
人工智能·机器学习·设计模式·机器人·云计算·汽车·制造
canonical_entropy1 小时前
关于《Mission Driver:Loop Engineering 的一种通用参考实现》的补充说明
后端·agent·ai编程
CAIE研习社1 小时前
2026年实用AI证书选型参考——主流人工智能认证对比
人工智能
冬奇Lab1 小时前
开源项目第187期:Pi — 哲学驱动的极简 AI Coding Agent,86k Stars,30+ LLM 提供商,无限扩展
人工智能·开源·agent
极新1 小时前
产品做好固然重要,但海外市场还看品牌故事
人工智能·科技