2026年7月31日,深度求索(DeepSeek)正式发布更新日志,宣布 DeepSeek-V4-Flash 正式版 API 上线公测,国产开源模型在 Agent 能力上再下一城。作为 V4 系列的轻量化版本,V4-Flash 正式版主打 Agent 任务场景,在 Terminal Bench 2.1、NL2Repo、Cybergym、DeepSWE、Toolathlon 等多项公开与内部基准上,超越了 V4-Pro-Preview。本次升级的最大亮点在于:保留 V4-Flash-0731 全部模型结构与上下文窗口,仅通过后训练重对齐与 DeepSeek Harness 极简框架(即将发布)进行强化。
DeepSeek 官方在更新日志中明确披露,V4-Flash 正式版 API 当前已对外开放,定价为缓存命中输入 0.2 元/百万 tokens、输出 2 元/百万 tokens,延续了 V4 系列的极致性价比策略。同时正式版原生支持 OpenAI Responses API 格式,并针对 Codex 框架做了针对性适配,开发者可将 V4-Flash 无缝集成到 Codex CLI、IDE 插件及自动化代码工作流中,在 IDE 智能补全、终端命令解释、CI 代码审查等高频场景下几乎"零成本"承担主力模型角色。

一、Agent 能力九项基准全面超越 V4-Pro-Preview
本次 V4-Flash 正式版的核心亮点,是 Agent 能力九个测试维度的全面提升。官方日志显示,新版本在 Terminal Bench 2.1 中拿到 82.7 分,在 NL2Repo 中拿到 54.2 分,在 Cybergym 中拿到 76.7 分,在 DeepSWE 中拿到 54.4 分,在 Toolathlon verified 中拿到 70.3 分;Agent Last Exam、Automation Bench Public、DSBench-FullStack、DSBench-Hard 四个测试集也分别拿到 25.2、25.1、68.7、59.6 分。其中 DSBench-FullStack 是 DeepSeek 内部使用的全栈开发测试集,DSBench-Hard 是 Coding Agent 难题测试集,均属于实战级基准。
对比更高级别的 V4-Pro-Preview,V4-Flash 正式版在 Agent 任务的多项基准上实现反超,是本次更新最具冲击力的信号。考虑到 V4-Flash 在模型结构、参数量、上下文窗口上并未大改,只是通过 DeepSeek Harness 极简模式(测试中使用 max 档位、topp=0.95、temperature=1.0)进行后训练,这说明 Agent 能力的提升更依赖训练框架 + 数据组合而非单纯的"模型参数堆叠",为开源社区提供了新的优化方向。
二、Responses API 与 Codex 双原生适配,加速生态融合
生态兼容性是 V4-Flash 正式版另一项关键升级。正式版原生支持 Responses API 格式并针对性适配 Codex 框架。Responses API 是 OpenAI 推出的新一代协议规范,支持 response 对象、tool_calls 流式输出、function calling schema 校验等模块。V4-Flash 直接对齐该协议,意味着开发者既有的 OpenAI 生态代码、SDK、参考实现都可以零成本迁移到 DeepSeek 平台。
Codex 框架的针对性适配,则进一步强化了 V4-Flash 在编程任务中的实战能力。在 Codex CLI、IDE 插件或自动化代码工作流中调用 V4-Flash 时,框架会自动启用针对编程任务优化过的提示词与工具调用策略,编程任务的成功率与代码质量都有显著提升。这意味着国产开源模型首次在"编程 Agent 框架"层面与全球主流生态达成深度协同。
三、模型结构与 0731 一致,极致性价比延续
DeepSeek 在日志中明确强调,"DeepSeek-V4-Flash-0731 的模型结构、尺寸和 DeepSeek-V4-Flash-preview 保持一致,仅重新进行了后训练"。这意味着开发者基于 0731 的所有工程经验(prompt 模板、缓存策略、限流配置)都可以平滑迁移到正式版;同时 V4-Flash 正式版并非"新一代模型",而是 0731 的"全面升级版",定位于"小、快、专"。
价格方面,V4-Flash 正式版延续了 V4 系列的极致定价策略:缓存命中输入 0.2 元/百万 tokens、输出 2 元/百万 tokens。相较 GPT-5、Claude Opus 等闭源主力的 30-100 元/百万 tokens 区间,V4-Flash 的成本优势超过 50 倍,特别适合 IDE 实时补全、日志自动分析、CI 代码审查等"高频次、小调用"的 Agent 场景。DeepSeek 同时提到"V4-Pro 正式版将会尽快发布",V4-Flash 正式版可以视为 V4-Pro 正式版发布前的"过渡王牌"。
综合来看,DeepSeek-V4-Flash 正式版 API 把"Agent 能力 + 极致性价比 + 生态兼容"三件事都做到了位,既为独立开发者提供了近乎零成本的 AI 编程工具基座,也为企业研发团队提供了与 OpenAI 生态对齐、安全可控的部署选项,稳稳占据了 2026 年下半年国产开源模型"V4 系列轻量化主力"的位置。


