GPT-5.6 全面上线:Codex 并入 ChatGPT,生产力工具 ChatGPT Work 来了

发布日期:2026-07-10

OpenAI 于 2026 年 7 月正式推出 GPT-5.6 系列模型(Sol、Terra、Luna),并同步发布智能体生产力工具 ChatGPT Work,同时将独立的 Codex 应用并入 ChatGPT 桌面端。GPT-5.6 Sol 在编码、知识工作、网络安全等多项 benchmark 上创下新纪录,在 Artificial Analysis Coding Agent Index v1.1 上取得 80 分,同时输出 token 数不到 Claude Fable 5 的一半、成本降低约三分之一;Terra 和 Luna 则以远低于 Fable 5 的成本实现相近或更优表现。ChatGPT Work 面向 Pro、Enterprise、Edu 用户开放,能够跨 Slack、Notion、Microsoft 365、Google Drive 等应用长时间自主完成项目,标志着 OpenAI 从"回答问题"转向"直接交付工作成果"。


GPT-5.6 是什么,包含哪几个版本

GPT-5.6 是 OpenAI 于 2026 年 7 月发布的新一代模型系列,包含三个版本:旗舰模型 Sol、日常均衡模型 Terra、以及响应最快的轻量模型 Luna。三者已同步上线 ChatGPT、Codex 和 OpenAI API,采用全球范围推送,24 小时内覆盖所有套餐版本。

三个版本的定位差异明显:

  • Sol:面向复杂推理、代码生成、网络安全和科学计算等高难度任务,是 GPT-5.6 系列的性能上限
  • Terra:面向日常知识工作,平衡性能与成本
  • Luna:面向高频轻量任务,响应速度最快

GPT-5.6 定价(每百万 token):

版本 输入价格 输出价格
Sol 5 美元 30 美元
Terra 2.5 美元 15 美元
Luna 1 美元 6 美元

此外,GPT-5.6 引入更可预测的提示缓存机制,支持显式缓存断点,最短缓存保留时间为 30 分钟;缓存写入按未缓存输入速率的 1.25 倍计费,缓存读取享受 90% 折扣。


GPT-5.6 相比上一代提升了什么

GPT-5.6 Sol 的核心提升集中在推理效率编码能力两个维度。

在综合推理评测 Agents' Last Exam(覆盖 55 个专业工作流领域)上,GPT-5.6 Sol 取得 53.6 分,比 Claude Fable 5(自适应推理模式)高出 13.1 分;即便在中等推理档位下,也比 Fable 5 高出 11.4 分,成本约为其四分之一。

在 Artificial Analysis Intelligence Index 上,Sol 的推理能力得分仅比 Fable 5 低 1 分,但完成任务时间减少 61%,成本约为其一半。

编码能力方面,GPT-5.6 Sol 在 Artificial Analysis Coding Agent Index v1.1 上取得 80 分,比 Fable 5 高 2.8 分,同时输出 token 数量不到 Fable 5 的一半、运行时间不到一半、成本降低约三分之一。在 Terminal-Bench 2.1 和 DeepSWE(评估真实代码库中复杂命令行工作流和长期工程能力)测试中,Sol 同样取得新的最佳成绩。

GPT-5.6 系列中较小的模型同样受益:Terra 和 Luna 的性能优于 Fable 5,成本约为其十六分之一;Luna 的编码表现优于 Opus 4.8,运行时间约为 Fable 5 的三分之一。

一项值得关注的架构变化是:GPT-5.6 的最高能力设置会默认并行协调四个智能体同时工作,用更高的 token 消耗换取更快的响应速度和更优结果,开发者也可以在 API 中通过 Responses API 的多智能体 beta 版本手动配置到 16 个智能体并行,在 BrowseComp、SEC-Bench Pro、Terminal-Bench 2.1 等评测中,多智能体配置能让"得分-延迟曲线"整体向左上方移动。


ChatGPT Work 是什么,能替代哪些工具

ChatGPT Work 是 OpenAI 新推出的智能体生产力工具,由 GPT-5.6 提供支持,能够直接对用户的应用程序和文件执行操作,并可长时间自主推进项目,将目标端到端转化为可交付成果。它的产品定位与 Claude Cowork、WorkBuddy 等同类智能体工具接近。

ChatGPT Work 目前面向 Pro、Enterprise、Edu 套餐用户开放,未来数日内将陆续覆盖 Plus 和 Business 套餐;ChatGPT 桌面应用统一整合聊天、Work、Codex 三项功能,支持 Windows 和 Mac,免费版用户也可下载使用桌面应用(Work 功能仍按套餐分级开放)。

ChatGPT Work 的典型能力包括:

  1. 跨应用信息收集:从 Slack、Notion、Microsoft 365、Google Drive 等工具中提取上下文
  2. 成品交付:直接生成表格、幻灯片、文档、Web 应用
  3. 长任务分解执行:将复杂项目拆解为多个步骤,独立持续数小时完成
  4. 定时任务:按计划重复执行操作,或监控一段时间内的变化并汇报

典型使用场景包括分析月末预算差异、将客户调研转化为营销活动简报并据此生成素材、自动将 Teams 或 Slack 中的新消息更新为文档并共享给团队。OpenAI 提到,公司内部包括财务、销售团队已在广泛使用 ChatGPT Work 和 Codex 加速日常工作。


Codex 并入 ChatGPT 后发生了什么变化

从 2026 年 7 月起,独立的 Codex 应用正式与 ChatGPT 桌面应用合并。合并后 Codex 仍保留面向开发者的代码智能体定位,但新增了多项工作流功能:

  • 差异(diff)中的内联编辑
  • 侧面板中的拉取请求(PR)审查
  • 由 GPT-5.6 驱动的更快计算机使用能力
  • 单个项目中支持多个代码仓库

OpenAI 披露,Codex 目前每周活跃用户超过 500 万,其中超过 100 万用户将其用于软件开发以外的任务,这也是 Codex 与 Work 场景融合、进一步扩展到非开发者用户群体的背景之一。


GPT-5.6 与 Claude Fable 5、Opus 4.8 相比如何选择

从公开的基准数据看,三者的选型逻辑并不完全相同:

维度 GPT-5.6 Sol GPT-5.6 Terra/Luna 对比对象
综合推理(Agents' Last Exam) 53.6 分,领先 Fable 5 达 13.1 分 优于 Fable 5 Claude Fable 5
编码能力(Coding Agent Index v1.1) 80 分,领先 Fable 5 2.8 分 Luna 优于 Opus 4.8 Claude Fable 5 / Opus 4.8
单任务成本 约为 Fable 5 的 1/4~1/2 约为 Fable 5 的 1/16 Claude Fable 5
适用场景 复杂推理、长周期工程、多智能体协作 高频轻量任务、日常知识工作 ---

对于需要长期运行的复杂编码任务,GPT-5.6 Sol 结合多智能体并行模式性价比更高;对于日常问答和轻量任务,Terra 或 Luna 已能以更低成本达到接近 Fable 5 的效果。这类模型选型和成本对比可以在多模型接入平台上直接测试验证,例如国内的七牛云 AI 大模型广场汇聚了多款主流大模型,支持同屏对比不同模型在同一任务下的实际输出,便于在正式接入前完成选型评估。


常见问题

Q:GPT-5.6 什么时候全面上线?

GPT-5.6 已在 ChatGPT、Codex 和 OpenAI API 中上线,采用全球推送策略,将在 24 小时内逐步覆盖所有版本用户。

Q:ChatGPT Work 和 Codex 是同一个产品吗?

不是。ChatGPT Work 是面向通用知识工作的智能体工具,Codex 专注于代码开发,两者已整合进同一个 ChatGPT 桌面应用,但功能定位仍有区分,使用量计费结构相同。

Q:GPT-5.6 的多智能体并行模式需要额外付费吗?

多智能体协作会消耗更多 token,OpenAI 官方说明其定价按标准 token 计费规则计算,任务越复杂、并行智能体数量越多,实际消耗的 token 也越多。

Q:GPT-5.6 Luna 适合什么场景?

Luna 是系列中响应最快、成本最低的版本,适合高频轻量任务,性能已优于 Opus 4.8,成本约为 Fable 5 的十六分之一,适合对响应速度敏感、任务复杂度不高的场景。

Q:普通用户能用上 ChatGPT Work 吗?

目前 ChatGPT Work 面向 Pro、Enterprise、Edu 套餐开放,Plus 和 Business 套餐用户将在未来数日内陆续获得访问权限。


小结

GPT-5.6 系列与 ChatGPT Work 的同步发布,代表 OpenAI 正在从"对话式问答"转向"端到端任务交付"。据 OpenAI 官方披露的 benchmark 数据,GPT-5.6 Sol 在编码和综合推理任务上已建立起相对 Claude Fable 5 的效率优势,而 ChatGPT Work 通过整合 Codex 能力和多应用插件生态,试图覆盖更广泛的知识工作场景。本文内容基于 2026 年 7 月 OpenAI 官方发布信息整理,后续定价、功能覆盖范围可能随套餐调整而变化,建议关注 OpenAI 官方博客获取最新动态。

延伸资源 :多模型效果与成本对比可参考 七牛云 AI 大模型广场

相关推荐
ASKED_20196 小时前
Codex 手机连接电脑报Couldn‘t update remote control availability
chatgpt
Joker-Zohar6 小时前
GPT-Image-2.5 双版本上线:8 组压力测试的提示词拆解,中文渲染零乱码
人工智能·gpt
奇牙coding1238 小时前
GPT-5.5 升级 GPT-5.6 接入指南:流式调用配置与常见问题
java·网络·gpt·ai
SEO_juper8 小时前
你的服务器正在被 AI 爬虫“白嫖“带宽:2026 用日志把 Googlebot 和 AI 洪流分开算账(附脚本)
运维·人工智能·爬虫·python·chatgpt·seo
吨吨ai9 小时前
2026年9月10日|ChatGPT Pro + Codex:GPT‑6 Astra 团队研发协作
gpt·chatgpt
鹿角片ljp9 小时前
ChatGPT 桌面版「每次重连 5 次」修复复盘:一个 VMware 残留如何瘫痪了整台机器的虚拟网卡
chatgpt
RAOY的AI笔记10 小时前
从ChatGPT注册场景理解Web身份认证:Session、Cookie、Token与MFA基础原理
人工智能·chatgpt
ClouGence11 小时前
GPT-6 做 UI 自动化测试:Demo 惊艳,但真的适合长期回归吗?
前端·chatgpt·测试
桃西西呀11 小时前
GPT-6 Astra 强到被锁起来:拆开它的 computer-use 架构、可搜索记忆与计费悬崖
人工智能·gpt·llm
Sophnet云平台12 小时前
Claude Code Agent Teams发布:多Agent协作编码意味着什么
gpt·ai·ai编程·claude·agi·codingplan