8月6日,DeepSeekDeepSeek-V4-Flash 正式版 API发布调价预告:计划近期整体上调API定价,预计涨幅较大。距离上一次震动行业的"价格屠杀",仅仅过去七天。7月31日,DeepSeek-V4-Flash正式版悄然上线公测——模型结构与参数规模与预览版完全一致,2840亿总参数、130亿激活参数的MoE架构,唯一的变化来自后训练优化。但这"唯一的变化",却让整个行业再次破防。

在官方公布的9项Agent基准测试中,V4-Flash正式版全面超越自家旗舰V4-Pro预览版:在Terminal Bench 2.1测试中得分82.7,高于V4-Pro-Preview的72.1和GLM-5.2的81.0;在DeepSWE编程能力测试中,得分从预览版的7.3分飙升至54.4分,提升超过6倍。更重要的是,正式版原生支持OpenAI Responses API格式,并针对Codex框架做了专项适配,开发者可以在ChatGPT桌面端或VS Code插件里,将底层引擎无缝切换为DeepSeek,中间无需任何代理。
实测数据同样亮眼。有开发者用V4-Flash正式版修复生产环境bug,从定位问题到给出完整修复方案,全程不到3分钟,一次修复成功。整个过程消耗不到21.7万Token,缓存命中率高达99.8%,总成本仅约0.88元人民币(约0.13美元)。
价格依然是DeepSeek的杀手锏。V4-Flash正式版定价为:输入1元/百万Token(缓存命中仅0.02元)、输出2元/百万Token。按Artificial Analysis的综合评测口径,完成一项任务平均成本约0.03美元,而Anthropic Claude Opus 5约为3.15美元——两者相差105倍。
然而,低价狂欢背后藏着隐忧。V4-Flash上线后,OpenRouter单周消耗量高达7.1万亿Token,极低价格引发全网开发者"报复性"调用,高峰期服务器一度承压。8月6日,DeepSeek发布调价预告,正是对这场低价战略的一次"急刹车":用价格杠杆筛选高价值客户、抑制低效高频消耗。
与此同时,DeepSeek正在大规模"囤粮"。据钛媒体独家报道,DeepSeek已完成510亿元首轮融资(腾讯、宁德时代等参投),正在推进第二轮500亿元融资,融资将用于自建智算中心、适配国产芯片乃至自研推理芯片。一边是极致低价的API,一边是重资产的算力建设,DeepSeek正在重新定义"大模型公司"的运营逻辑。
一、性能超越旗舰V4-Pro
在官方公布的9项Agent基准测试中,V4-Flash正式版全面超越自家旗舰V4-Pro预览版,在Terminal Bench 2.1测试中得分82.7,在DeepSWE编程能力测试中提升超过6倍。
二、价格优势显著
V4-Flash正式版定价为输入1元/百万Token(缓存命中仅0.02元)、输出2元/百万Token。按Artificial Analysis口径,完成一项任务平均成本约0.03美元,而Anthropic Claude Opus 5约为3.15美元——两者相差105倍。
三、融资与战略调整
DeepSeek已完成510亿元首轮融资,正在推进第二轮500亿元融资。同时,8月6日发布调价预告,预计涨幅较大——极低价格引发的「报复性」调用正在倒逼DeepSeek重新校准定价策略。
如果说V4 Flash是DeepSeek的"尖刀",那么即将到来的V4-Pro正式版则是真正的"重炮"。梁文锋的团队能否在保持价格竞争力的同时,跑通重资产与大模型的商业闭环?这场低价战略的下一章,或许比任何人想象的都要烧钱。


