发生了什么
7月31日,DeepSeek 在官方 API 更新日志中宣布,DeepSeek-V4-Flash 正式版 API 开启公测。据官方说明,正式版模型结构与参数规模与此前的 V4-Flash 预览版保持一致,但针对接口调用场景完成了专项后训练优化。本次更新仅涉及 V4-Flash 的 API 接口,V4-Pro 的 API 及 App/Web 端模型暂未变动,官方表示 V4-Pro 正式版将尽快发布。
关键变化
- Agent 能力大幅增强:多项代码智能体基准测试优于 V4-Pro 预览版,包括 Terminal Bench 2.1(82.7 分)、NL2Repo(54.2)、Cybergym(76.7)、DeepSWE(54.4)等指标
- 原生支持 Responses API 格式,并完成对 Codex 的适配,降低了开发者接入与迁移成本
- 公测版本地部署与 API 调用同步推进,国家超算互联网也已上线该模型的 API 调用服务和模型文件
为什么重要
V4-Flash 定位于高性价比的轻量旗舰,其正式版在智能体与代码场景的能力跃升,直接回应了企业级 Agent 应用对模型工具调用与长任务执行的刚需。结合业内普遍关注的定价优势,该模型有望在开发者和企业中进一步扩大渗透。需要留意的是,官方公布的基准成绩尚未经过完全独立的第三方复现,实际效果仍待大规模生产环境验证。
不确定性
正式版与预览版的具体差异细节、面向企业的高并发服务承诺以及 V4-Pro 正式版的发布时间表,目前官方尚未完整披露。企业在迁移生产流量前,建议先在测试环境验证模型在自有业务场景中的真实表现。

