DeepSeek V4 Pro正式版发布:多项对标Claude Fable 5,性能逼近旗舰水平

2026年8月13日,国产大模型公司 DeepSeek 宣布将 V4 Pro 从预览版正式转正,发布 DeepSeek V4 Pro 正式版。新版本大幅增强了 Agent 能力,在多项 Agent 专项基准测试中逼近 Anthropic 旗舰模型 Claude Fable 5,部分任务甚至实现了反超。

DeepSeek V4 Pro 正式版的核心亮点在于其Agent 能力的大幅提升。在官方发布的基准测试中,V4 Pro 在 HLE(高层次推理)、Terminal Bench、Cybergym、DeepSWE 等多项 Agent 专项测试中表现优异,综合得分与 Claude Fable 5 差距缩小至 3% 以内,在代码补全和工具调用两项子任务上实现了反超。这一成绩验证了 DeepSeek 在 Agent 架构优化上的技术突破。

一、Agent 能力全面增强:从对话到自主执行

DeepSeek V4 Pro 正式版在原有 V4 基础能力之上,重点强化了多步骤任务规划工具调用长程记忆三大核心能力。在复杂任务处理上,V4 Pro 能够将用户的高层次目标自动分解为可执行的子任务序列,并自主调用代码执行、文件搜索、网络检索等外部工具完成任务,真正从"对话助手"进化为"自主智能体"。

长程记忆能力也有所突破:V4 Pro 支持在多轮对话中保持跨会话的上下文记忆,用户无需反复说明背景信息,AI 能够主动关联此前对话中积累的偏好和项目信息,显著提升了协作效率。此外,新版本还优化了上下文窗口管理,在处理超长文档时能够智能压缩低价值信息,确保关键上下文不被稀释。

二、多项基准测试逼近 Claude Fable 5

在 DeepSeek 官方公布的基准测试中,V4 Pro 正式版与 Claude Fable 5 的对标结果令人瞩目。在 Terminal Bench(终端命令推理)、DeepSWE(软件工程任务)和 Cybergym(网络安全任务)三项测试中,V4 Pro 的得分已经与 Claude Fable 5 持平甚至小幅超越。

值得关注的是,在代码补全工具调用两项实际开发场景的高频任务上,V4 Pro 的表现优于 Claude Fable 5,这在国产大模型中尚属首次。这也得益于 DeepSeek 团队针对代码场景的专项优化和对中文开发环境的深度适配。同时,V4 Pro 在中文自然语言理解和中文编程辅助方面的表现也明显优于 Claude Fable 5,对国内开发者更加友好。

三、价格下调 75%,API 成本优势扩大

在发布 V4 Pro 正式版的同时,DeepSeek 还宣布 V4 系列全线下调 API 价格,降幅达 75%。这意味着开发者使用 DeepSeek V4 系列进行 Agent 开发的成本大幅降低,结合 V4 Pro 逼近旗舰模型的性能表现,DeepSeek 的性价比优势进一步扩大。对于需要大规模部署 AI Agent 的企业用户而言,低成本的国产方案具有显著的吸引力。

对于国内开发者而言,DeepSeek V4 Pro 正式版的发布提供了与 Claude Fable 5 性能相近但成本更低的 Agent 开发选择,有望加速国内 AI Agent 应用的规模化落地,同时推动国内 AI 生态与国际主流标准的接轨。

AD:精心整理了2000+好用的AI工具!点此获取

相关推荐

1 1

免费AI工具合集,点击进入

AI对话

玉米AI助手