DeepSeek 官方在 2026 年 8 月 13 日发布 V4 Pro 正式版公告:V4 Pro 已同步在 App、网页端和 API 上线,API 模型名不变;App 和网页端可以通过"专家模式"使用。
同一份官方公告还确认,API 新价格将于北京时间 2026 年 8 月 17 日 00:00 生效,并采用峰谷定价:高峰为 9:00-12:00、14:00-18:00,其余为空闲时段,空闲价格为高峰价格的一半。
本文做两件事:
- 用官方新旧价格计算 Agent 批处理的月账单;
- 用一个零依赖前端工具,让读者按自己的 Token 用量计算错峰收益。
需要先划清事实边界:本文使用一张 8 月 14 日的真实 DeepSeek API 汇总账单作为案例,但没有对 Harness 做模型能力跑分。计算器验证的是价格公式,Harness 部分验证的是官方仓库、npm 版本和启动方式。
一、官方新旧价格
价格单位为人民币/百万 Token:
| 模型 / 计费项 | 当前价格 | 8月17日空闲 | 8月17日高峰 | 相对当前最高涨幅 |
|---|---|---|---|---|
| V4 Flash 缓存命中输入 | 0.02 | 0.05 | 0.10 | 400% |
| V4 Flash 缓存未命中输入 | 1 | 1.5 | 3 | 200% |
| V4 Flash 输出 | 2 | 4.5 | 9 | 350% |
| V4 Pro 缓存命中输入 | 0.025 | 0.15 | 0.30 | 1100% |
| V4 Pro 缓存未命中输入 | 3 | 4.5 | 9 | 200% |
| V4 Pro 输出 | 6 | 13.5 | 27 | 350% |
"涨价500%"只适用于 Pro 缓存命中输入的空闲价格这一项:0.025 元变成 0.15 元,是 6 倍;高峰价格 0.30 元则是 12 倍,涨幅 1100%。因此写技术文章时,应同时写明模型、计费项和时段。
二、一张真实 API 账单
8 月 14 日的 DeepSeek API 汇总账单为:
| 指标 | 实际数据 |
|---|---|
| API 请求次数 | 62 次 |
| Token | 9,275,742 |
| 消费金额 | 1.29 元 |
| 平均每次 Token | 约 149,609 |
| 平均每次费用 | 约 0.0208 元 |
| 综合每百万 Token 费用 | 约 0.1391 元 |

这里的 0.1391 元/百万 Token 是用总金额除以总 Token 得到的综合成本,不是 DeepSeek 的某一项官方价格。截图没有提供模型、缓存命中 Token、未命中 Token、输入 Token 和输出 Token 的拆分,因此不能用它反推出具体单价。
此外,该账单发生在 8 月 14 日,早于 8 月 17 日新价格生效时间。要估算同一工作负载调价后的账单,还需要完整的 Token 分类和实际运行时段。

三、计算公式
一次调用的输入 Token 需要拆成缓存命中和缓存未命中两部分:
javascript
function cost(prices, inputTokens, outputTokens, cacheRate) {
const cached = inputTokens * cacheRate;
const uncached = inputTokens - cached;
return (
cached / 1_000_000 * prices.cached +
uncached / 1_000_000 * prices.input +
outputTokens / 1_000_000 * prices.output
);
}
月度账单再乘以每天运行次数和每月运行天数。错峰方案则按空闲比例加权:
javascript
planMonth = idleCost * idleShare * totalRuns
+ peakCost * (1 - idleShare) * totalRuns;
其中 totalRuns = runsPerDay * daysPerMonth。
四、一个可复核的月账单
假设:
- 模型:V4 Pro;
- 单次输入:120,000 Token;
- 单次输出:18,000 Token;
- 缓存命中率:40%;
- 每天 100 次;
- 每月 22 天。
单次成本为:
| 场景 | 单次成本 | 月度成本 |
|---|---|---|
| 调价前 | 0.3252 元 | 715.44 元 |
| 调价后全空闲 | 0.5742 元 | 1263.24 元 |
| 调价后全高峰 | 1.1484 元 | 2526.48 元 |
| 80% 空闲 + 20% 高峰 | 0.68904 元 | 1515.89 元 |
因此,80% 错峰方案相比全部高峰每月少花 1010.59 元,但仍比调价前多 800.45 元。错峰可以降低新价格下的浪费,不能让涨价消失。

五、哪些 Agent 任务适合错峰
| 任务 | 是否适合错峰 | 原因 |
|---|---|---|
| 夜间代码索引、仓库扫描 | 适合 | 可延迟,不影响即时交互 |
| 批量生成测试和离线评测 | 适合 | 可以按队列运行 |
| 文档摘要、日报周报 | 适合 | 有明确截止时间即可 |
| 线上故障排查 | 不适合 | 延迟会扩大故障影响 |
| 安全、支付、权限、数据迁移 | 不适合 | 应优先保障验证和审查 |
不要为了省 Token 把所有工作都推到夜间。更实用的做法是将任务分成"立即响应"和"允许排队"两类,再为后者设置队列调度。
六、DeepSeek Harness 官方信息
DeepSeek 官方仓库将 Harness 定义为开源 agent harness,采用"一切皆插件"架构,由 Cordis 驱动,许可证为 MIT。
官方中文 README 给出的启动方式是:
bash
npx @deepseek-ai/dsh web
默认 Web UI 地址为:
text
http://127.0.0.1:3080
截至 2026-08-14,npm 的 @deepseek-ai/dsh 最新标签是 0.1.0-rc.6。README 明确将 Harness 标为"开发者预览",并提醒未来可能出现破坏兼容性的变更。
这意味着它适合:
- 学习 Agent Harness 的插件化架构;
- 在隔离环境验证模型、工具和技能组合;
- 为自己的插件设计接口;
- 参与开源项目反馈。
它暂时不应被表述成"已经稳定替代所有生产 Agent 工具"。涉及客户数据、自动部署、权限和支付时,仍需人工复核、自动化测试和回滚方案。

七、工具实现与使用
项目目录只有两个文件:
text
deepseek-price-scheduler/
├── index.html
└── README.md
读者下载 ZIP 后解压,双击 index.html:
- 选择 Flash 或 Pro;
- 输入单次输入、输出 Token;
- 输入每天调用次数和每月运行天数;
- 设置缓存命中率;
- 设置计划放到空闲时段的比例;
- 查看当前价格、全高峰价格和错峰月费。
工具不需要 API Key,所有计算只在浏览器本地完成。

八、结论
DeepSeek 这次变化有两个方向:API 用峰谷价格引导资源调度,Harness 用开源插件架构扩大 Agent 生态。
对开发者而言,行动顺序应该是:
- 先按 Token 类型和时段重新估算预算;
- 把允许延迟的 Agent 任务放入空闲队列;
- 低风险任务优先 Flash,复杂任务再考虑 Pro;
- Harness 先隔离验证,不要把开发者预览版直接接入关键生产链路。
标签:DeepSeek、DeepSeek Harness、AI 编程、Agent、API 价格、Token 成本、JavaScript