Back

DeepSeek-V4-Flash 正式版发布

DeepSeek V4-Flash 正式版 API 上线,主要升级集中在代码开发、工具调用和自动化任务上,原生支持 Codex 且保持超低价格。

DeepSeek AI 模型
Enivia
2 分钟阅读

今年 4 月,DeepSeek 发布了 V4 系列预览版,其中包括 V4-Pro 和体量更小的 V4-Flash。

7 月 31 日,DeepSeek V4-Flash 正式版 API 上线。新版本的主要升级集中在代码开发、工具调用和自动化任务上,并依然保持超低价格。

Agent 能力

从官方公布的结果看,这次提升最明显的是 Agent 能力。

DeepSeek 给出的测试跑分数据

在 Terminal Bench 2.1 的测试中,V4-Flash-0731 跑分提升至 82.7,超过 4 月公布的高级模型 V4-Pro。

Pro 的正式版还没出,所以这个对比有时间差,但至少可以看出,DeepSeek 对 V4-Flash 的训练重点相当明确,他们希望把 Flash 做成一个能够长时间调用终端、修改代码和执行复杂工作流的经济型 Agent 模型。

原生支持 Codex

另一个看点是 DeepSeek 专门针对 OpenAI 的 Codex 做了适配,V4-Flash 现在原生支持 Responses API 格式。

之前 DeepSeek 的 API 只兼容 OpenAI ChatCompletions 和 Anthropic 两种格式,想接入 Codex 得走代理转换。原生支持后就不需要这个中间层了。

DeepSeek 官网提供的 Codex 一键配置脚本

DeepSeek 甚至在官网中提供了接入 Codex 的一键配置脚本,跑完之后 Codex 所有客户端会自动切换到 DeepSeek 模型。

超低价格

在各类国产大模型都对标国外模型价格开始涨价的今天,DeepSeek 的 API 仍然是难得的白菜价。

各类大模型定价对比

使用 DeepSeek,你可以以每百万 Token 输入 0.14 美元、输出 0.28 美元的价格运行 AI 编程任务,同时享受 100 万 Token 的上下文窗口。

DeepSeek API 价格

对比 Codex 默认使用的 ChatGPT,同等量级的价格要贵上一个数量级。

OpenAI API 价格

Artificial Analysis 最新数据显示,在同一套 AI 综合能力评测中,DeepSeek V4-Flash-0731 的平均任务成本只有$0.03,综合得分 50。

而 Claude Fable 5 的平均任务成本则达到 $3.15,综合得分 60。

也就是说,DeepSeek 仅用不到 1% 的成本,拿到了 Fable 约 83% 的综合能力评分。

Artificial Analysis 最新数据展示的价格对比

最后

过去我们习惯把 Flash 理解为旗舰模型的缩水版本,通常速度更快但能力较弱。

DeepSeek-V4-Flash-0731 展现出另一种可能:通过更有针对性的后训练,让一个激活参数较少的模型在特定 Agent 场景中反而能超过更大的通用模型。

它可能仍然不适合承担最复杂的知识任务,但对于需要大量调用、长上下文的应用,模型是否足够稳定、是否便宜,往往比单项能力更重要。

没人会不喜欢便宜。成本压下来之后,验证、纠错、多轮工具调用反而可能因此有更多的预算空间,Agent 在日常体验上说不定会有更大进步。