DeepSeek V4-Flash 正式版发布:Agent 基准、价格与 Codex 接入保姆级教程

前言

2026 年 7 月 31 日,DeepSeek 发布了 V4-Flash 的正式版。

不少社群一片热议,网友对梁文锋的称呼从 梁子 又变成了 梁圣---这变脸速度简直比翻书还快......

不过 V4-Pro 还得再等等,预计在 8 月初发布。希望这次能够如期上线,不要再跳票了

(毕竟,此前预告的发布时间可是 7 月中旬...... -_-)


基准测试与价格

虽然 V4-Pro 尚未正式发布,但就目前公布的结果来看,V4-Flash 正式版的 Agent 能力已经有了显著提升 ,且远超 V4-Pro 的预览版,贴上官方的基准测试图,大家感受一下:

图中基准项目说明:

  • Terminal Bench 2.1:终端操作、编程及系统任务
  • NL2Repo:根据自然语言需求生成或修改代码仓库
  • DeepSWE:软件工程、代码修复与开发任务
  • DSBench-FullStack:全栈开发测试
  • DSBench-Hard:高难度 Coding Agent 测试

价格

正式版与预览版价格一致,Agent 基准成绩却有了明显提升,依然是妥妥的 价格屠夫

美中不足的是,V4-Flash 目前仍不支持图像等多模态输入。不过这个价格,还要啥自行车?

Responses API 支持

这次更新中,一个很重要的变化是:DeepSeek 官方接口新增了对 Responses API 的原生支持。

此前,如果要将仅支持 Chat Completions 的模型服务接入 Codex,常见做法是使用旧版 Codex CLI,或者通过代理将 Chat Completions 接口转换为 Responses 接口。

前者在功能和稳定性方面不及新版本,后者则增加了一层适配,可能在工具调用、流式输出等环节出现兼容性问题。

因此,对于希望在 Codex 中获得完整 Agent 体验 的用户来说,原生支持 Responses API 是一个非常重要的改进。

接下来,就手把手教大家如何将 V4-Flash 接入 Codex

安装 Codex

目前可以通过两种方式使用 Codex:

  1. Codex CLI
  2. 集成了 Codex 的 ChatGPT 桌面应用

CLI 的安装方式非常简单。如果已经安装了 Node.js 和 npm,可以在终端中执行:

bash 复制代码
npm i -g @openai/codex

桌面端的 Codex 功能现已集成至 ChatGPT 应用中。你可以前往官网下载适用于自己操作系统的版本并完成安装。

chatgpt.com/download

生成 DeepSeek API Key

platform.deepseek.com/usage

打开并登录 DeepSeek 开放平台,确保账户余额充足。初次体验可以先充值 10 元,实际消耗取决于调用频率、Token 用量及缓存命中情况。(DeepSeek 的 缓存命中率非常高)

在左侧菜单栏中进入 API Keys,选择 创建 API Key,输入名称(如 Codex)后完成创建

注意:API Key 只会完整显示一次,请立即复制并妥善保存。若密钥丢失,应撤销旧密钥并重新创建。

API Key 属于敏感凭证,请勿截图分享或上传至公开仓库。若怀疑已经泄露,应立即在控制台撤销旧密钥并创建新密钥。

安装 cc-switch

cc-switch 是一个开源配置管理工具,可在 Codex、Claude Code 等 Agent 工具使用的第三方 API 提供商之间快速切换。在 GitHub 上已经收获了 123k star

可以在官方的 Releases 页面下载适用于自己操作系统的版本。

github.com/farion1231/...

安装并打开 cc-switch 后,点击 OpenAI 图标进入 Codex 配置区域,再点击加号新建供应商配置

供应商选择 DeepSeek

然后在 API Key 这一栏中输入刚才生成的 API Key

将默认模型设置为 deepseek-v4-flash,并将上游格式设置为 Responses(原生)

在模型映射处只保留一个 flash 即可

滚动至页面底部,在 config.toml 配置区域中设置推理强度(即 model_reasoning_effort 字段):

三个档位可选,分别是:low、high、max

值越高,模型思考越深入,回答质量越高,耗时也越长,Token 消耗也可能更多。

配置完成后,点击右下角的添加。返回供应商列表后,找到 DeepSeek 配置并点击启用。

测试

如果使用 Codex CLI,请在终端中执行 codex。进入交互界面后输入 /model 并回车,确认当前模型或供应商配置是否已经切换。

如果你是桌面端用户,打开应用后,输入框的模型栏显示 自定义,说明应用已经读取到第三方配置。再发送一条测试消息,并确认正常产生回复,即可验证接口已经成功连通。

开始愉快的 Vibe Coding 吧!

下载资料

建议优先 从官网 或 GitHub Releases 下载客户端,以确保版本最新、来源可信。

但考虑到部分读者可能访问不便 ,我也将本文使用的版本整理到了网盘中,仅作为备用下载渠道。

夸克网盘链接:

pan.quark.cn/s/3575c7ff9...

提取码: c3Ar


最后,附上 DeepSeek 在 V4 预览版公众号文章结尾引用的一句话:

"不诱于誉,不恐于诽,率道而行,端然正己。"

------《荀子·非十二子》

如果本文对你有所帮助,欢迎点赞、收藏和转发~

相关推荐
Bug收容所1 小时前
AI-Agent-是怎么工作的
agent·functioncalling·mcp
zhangfeng11331 小时前
国产GPU/AI算力芯片现状(修订完整版 · 截至2026年9月
人工智能·算法·ai编程·npu
Erishen1 小时前
用 Lume 写一个完整 CRM:Web 与 Agent 共用同一套业务逻辑
开源·agent
看浪的路人2 小时前
第6讲:日志结构化与存储
agent
醒雷工程师2 小时前
用了AI辅助做项目的感想
ai编程
ZzT3 小时前
Claude Code Mods 是什么:给 Claude 加工具、在终端画界面
人工智能·ai编程·claude
AC赳赳老秦4 小时前
数据采集全链路审计留痕:用 OpenClaw 实现合规审计与追溯
开发语言·汇编·python·php·swift·deepseek·openclaw
明月_清风4 小时前
DuckDB:一个正在改变数据分析方式的数据库
数据库·数据分析·ai编程
熊猫钓鱼>_>5 小时前
MetaAI深度研究研究报告
ai·meta·大模型·llm·agent·web·metaai
zhanghaha13146 小时前
AI Agent_6 AI 底层架构
ai·agent