DeepSeek V4 Flash 正式版今天上线了。模型结构和参数规模没变,还是 MoE 284B、激活 13B、100 万 token 上下文——只重新做了后训练。但改完之后,Agent 能力直接把自家 4 月发的 Pro Preview 给干了。

九项 Agent 基准测试全部反超。Terminal Bench 2.1 从 61.8 涨到 82.7,DeepSWE 从 7.3 涨到 54.4,DSBench-FullStack 从 37.0 涨到 68.7。不说别的,一个 Flash 型号干翻了三个月前代表最高水平的 Pro 预览版,这件事本身就够说明后训练的威力了。
跟它一起来的还有两个关键更新:原生支持 OpenAI Responses API,以及对 Codex 做了专门适配。开发者不用改 Base URL 就能直接把现有 Responses API 客户端指向 DeepSeek。目前只支持 deepseek-v4-flash,Pro 正式版承诺 8 月初。
价格没变。输入命中缓存 0.2 元/百万 token,未命中 1 元,输出 2 元。跟同一天发生的事放在一起看,这组数字更耐人寻味——OpenAI 也在今天宣布 GPT-5.6 Luna 降价 80%。业内普遍认为是国产大模型的价格倒逼。
V4 Flash 在 100 万 token 长上下文下的推理计算量只有 V3.2 的 27%,KV Cache 占用降到约 10%。长链路 Agent 任务的算力成本被压到了之前的三分之一不到。
Flash 正式版用比 Pro Preview 更便宜的价格交出了更强的 Agent 能力,这件事的意义是,低价不等于低能。DeepSeek 选择的路线是先把便宜做透,然后在 Agent 上补课。至少今天的数据说明,这门课补得不错。
Pro 正式版 8 月初到。一个 Flash 后训练就已经这样了,Pro 能拉出多大差距——这个问题从现在开始悬在所有开发者头上。
参考来源: