Open‑AI GPT‑5.6 Luna永久性降价80%

一、两件行业大事鲜明对比

一边 OpenAI永久大幅降价,另一边国产DeepSeek官宣将要上调API定价,形成极具戏剧性的行业反差:

1、Open‑AI GPT‑5.6 Luna永久性降价80%

价格参数(7月30日正式生效,永久调价,并非短期营销)

计费项目 旧价格 降价之后 降幅
每百万Token‑输入 $1.00 $0.20 下降80%
每百万Token‑输出 $6.00 $1.20 下降80%
  • 中档模型 Terra:降价20%,输入 2、输出2、输出 2、输出12 /百万token
  • 顶配旗舰 Sol 售价保持原样;新增Fast极速模式,速度提升至2.5倍,费用翻倍

推文信息解读

截图第一条帖子(蒂博)澄清关键点:这次80%降价是永久政策 ,推理效率优化不会收回。 第二条用户对比跑分:GPT‑5.4完整版跑分和现在低价版Luna‑Max持平; GPT‑5.4当初售价输入2.5美元,如今Luna仅0.2美元,价格只剩从前十三分之一。

2、DeepSeek 官宣计划整体上调API定价

"计划近期整体上调 DeepSeek API服务的定价预计涨幅较大,请合理安排您的使用。具体方案以正式通知为准。"

此前已经进行过一轮价格管控

早在7月上线V4正式版的时候就已经推出峰谷分时计价:

  • 高峰时段(北京时间 9:00‑12:00、14:00‑18:00)API调用费用直接翻倍,用来分流服务器压力、错峰消耗算力资源。 现在则准备开启全面涨价。

二、背后行业博弈分析

  1. 海外巨头依靠推理优化摊薄成本 OpenAI通过底层推理架构、GPU调度优化压低运行成本,所以敢于永久大幅度下调入门旗舰Luna的定价,发起价格冲击。现在Luna拥有极高跑分,却做到极低调用成本。
  2. 国内大模型算力承压 DeepSeek选择涨价,本质是高峰期算力负载过高、GPU资源成本居高不下,先靠峰谷定价分流流量,现在打算整体抬升API售价,缓解算力成本压力。

三、 DeepSeek‑V4 与 GPT‑5.6 完整API价格对比

(汇率按1美元≈6.75元人民币,2026‑08‑06现行市价)

重点现状:OpenAI Luna永久降价80%;DeepSeek近期通知即将大幅度上调整体API售价,当前还有峰时翻倍计费规则

1、OpenAI‑GPT‑5.6 全系列定价(7‑30永久生效)

模型 输入(每百万Token) 输出(每百万Token) 人民币换算 备注
GPT‑5.6 Luna(旗舰入门,跑分对标旧版GPT‑5.4) $0.20 $1.20 输入≈1.35元 、输出≈8.1元 本次降幅‑80%、永久定价
GPT‑5.6 Terra(中端) $2.00 $12.00 输入≈13.5元、输出≈81元 降幅‑20%
GPT‑5.6 Sol(顶配旗舰) $5.00 $30.00 输入≈33.8元、输出≈202.5元 原价不变;Fast加速版价格翻倍

2、DeepSeek‑V4 当前现行定价(北京时间高峰9‑12、14‑18点价格直接翻倍)

缓存命中=重复上下文,价格极低;缓存未命中=全新提问 |模型|缓存命中‑输入|缓存未命中‑输入|输出(百万Token)|高峰时段全部×2| |---|---|---|---|---| |V4‑Flash(性价比版)|0.02元|1元|2元|输入最高2元,输出4元| |V4‑Pro(高性能旗舰)|0.025元|3元|6元|输入最高6元,输出12元|

四、横向对比总结

1、全新请求(缓存没有命中,最普遍场景)

  1. 输入成本:GPT‑5.6 Luna ≈1.35元 > DeepSeek‑Flash 1元 输入侧Flash仍然微弱便宜;但Luna经过降价之后差距已经极小
  2. 输出成本差距巨大
    • Luna:8.1元 /百万token
    • DeepSeek‑Flash:2元 /百万token
    • DeepSeek‑Pro:6元 /百万token

结论:常规全新调用,DeepSeek‑Pro输出依旧比Luna便宜,Flash性价比碾压Luna

2、上下文复用(缓存命中、聊天/循环调用)

DeepSeek优势极大,命中后输入仅需0.02~0.025元,成本几乎可以忽略,GPT‑Luna没有低价缓存优惠。

3、接下来行情反转风险

DeepSeek官方通知近期整体大幅上调API定价。 涨价落地之后,很有可能:

DeepSeek‑Pro全新输入>3元、输出>6元,整体调用成本高于GPT‑5.6‑Luna

五、通俗选购建议

  1. 长上下文多轮对话、知识库问答 → DeepSeek(缓存命中之后成本极低)
  2. 一次性简短提问、海外环境、追求顶尖推理跑分 → GPT‑5.6 Luna(现已永久低价)
  3. 高峰工作时间(白天工作日9‑18点)尽量避开DeepSeek调用,否则价格翻倍。
相关推荐
沧沧凉凉1 天前
一段需求、零素材,Claude Code 派了 33 个代理给我做了个 3D 动作游戏
游戏·ai编程·three.js
小虎AI生活1 天前
315 之后 AI 改规矩了,怎么让豆包和 DeepSeek 认得出你
aigc·ai编程
郑州光合科技余经理1 天前
海外版外卖加盟:总站与分站配送规则怎么分开管
java·开发语言·前端·后端·uni-app·php·ai编程
熊猫钓鱼>_>1 天前
Kotlin Multiplatform for OpenHarmony 实战:为 Reaktive 实现响应式原语适配(完整版 · 含摘要目录与技术图表)
华为·kotlin·大模型·ai编程·harmonyos·适配·reaktive
姜楠聊AI转型1 天前
AI 编程安全合规怎么落地?三大风险 + 四道防线(数据脱敏 / 漏洞左移 / 审计 / 权限路由)
ai编程·vibe coding·ai coding·coding agent
熊猫钓鱼>_>2 天前
Kotlin Multiplatform for OpenHarmony 实战:为 MVIKotlin 实现单向数据流适配
华为·ai编程·鸿蒙·openharmony·适配·数据流·mvkotlin
Alice-YUE2 天前
前端 × AI:从 Cursor 到 Transformer,一份完整认知路径
前端·人工智能·transformer·ai编程·前端开发·cursor
FanetheDivine2 天前
学习Agent开发 10.延迟工具 deferred tools
agent·ai编程