发生了什么
7月31日下午,DeepSeek 以最克制的方式投下重磅炸弹——仅通过 API 文档更新日志宣布 V4 Flash 正式版上线公测。没有发布会、没有预告,但开发者社区迅速沸腾。这次升级的核心价值不在参数量,而在于后训练优化带来的 Agent 能力质变。
核心性能提升
- Agent 基准测试全面超越自家 V4-Pro-Preview 旗舰,"小弟打赢了大哥"。
- Terminal Bench 2.1 从 61.8 飙升至 82.7(提升34%),逼近 Claude Opus 4.8。
- Artificial Analysis 智能指数 50 分,仅比 OpenAI GPT-5.6 Luna 低 1 分。
- 单任务成本比 GPT-5.6 Luna 低约 60%,受益于 98% 缓存折扣和 token 用量减少 12%。
企业视角
Flash 正式版原生支持 Responses API 格式,并针对 Codex 场景做了深度适配,这意味着将 DeepSeek 集成到代码开发和 Agent 工作流中的门槛大幅降低。结合 MIT 开源许可和极低的 API 定价,Flash 正式版为预算敏感型企业和开发者提供了一个在 Agent 能力上不输闭源模型的选项。DeepSeek 同时表示 V4 Pro 正式版将尽快发布,企业可根据自身任务场景在 Flash(低成本高 Agent 能力)和 Pro(更强推理)之间灵活选择。
竞争格局变化
此次发布发生在 OpenAI 宣布 GPT-5.6 系列降价的同一周,进一步验证了"性能追平、价格碾压"路线正成为开源阵营的核心竞争策略。DeepSeek 官方明确表示正在将竞争重点从传统对话和代码补全转向 Coding Agent、工具调用和自动化执行——模型不再满足于"陪聊",而是直接上手干活。

