返回行业动态
模型与产品

DeepSeek V4 Flash 正式版 API 上线,Agent 能力反超自家旗舰

DeepSeek 于7月31日通过 API 文档悄然宣布 V4 Flash 正式版上线公测。模型结构与尺寸与前版一致(MoE架构、2840亿总参数、130亿激活参数),但通过专项后训练大幅提升了 Agent、终端操作和代码任务能力。在 Terminal Bench 2.1 上得分从 61.8 跃升至 82.7,逼近 Claude Opus 4.8 的 85.0;在 Artificial Analysis 智能指数上得分 50,仅比 OpenAI GPT-5.6 Luna 低 1 分,而单任务成本低约 60%。模型权重以 MIT 许可开源。

来源:DeepSeek 官方 API 文档原标题:DeepSeek-V4-Flash Official API is now LIVE in public beta查看原文
发光AI神经网络节点向外扩散的科技插图,中央有代码和数据流,深蓝色与亮橙色配色,代表开源大模型技术突破

图片来源:北京拓实科技原创

发生了什么

7月31日下午,DeepSeek 以最克制的方式投下重磅炸弹——仅通过 API 文档更新日志宣布 V4 Flash 正式版上线公测。没有发布会、没有预告,但开发者社区迅速沸腾。这次升级的核心价值不在参数量,而在于后训练优化带来的 Agent 能力质变。

核心性能提升

  • Agent 基准测试全面超越自家 V4-Pro-Preview 旗舰,"小弟打赢了大哥"。
  • Terminal Bench 2.1 从 61.8 飙升至 82.7(提升34%),逼近 Claude Opus 4.8。
  • Artificial Analysis 智能指数 50 分,仅比 OpenAI GPT-5.6 Luna 低 1 分。
  • 单任务成本比 GPT-5.6 Luna 低约 60%,受益于 98% 缓存折扣和 token 用量减少 12%。

企业视角

Flash 正式版原生支持 Responses API 格式,并针对 Codex 场景做了深度适配,这意味着将 DeepSeek 集成到代码开发和 Agent 工作流中的门槛大幅降低。结合 MIT 开源许可和极低的 API 定价,Flash 正式版为预算敏感型企业和开发者提供了一个在 Agent 能力上不输闭源模型的选项。DeepSeek 同时表示 V4 Pro 正式版将尽快发布,企业可根据自身任务场景在 Flash(低成本高 Agent 能力)和 Pro(更强推理)之间灵活选择。

竞争格局变化

此次发布发生在 OpenAI 宣布 GPT-5.6 系列降价的同一周,进一步验证了"性能追平、价格碾压"路线正成为开源阵营的核心竞争策略。DeepSeek 官方明确表示正在将竞争重点从传统对话和代码补全转向 Coding Agent、工具调用和自动化执行——模型不再满足于"陪聊",而是直接上手干活。

编辑说明

本文由北京拓实科技根据公开信息整理,核心事实与数据请以原始来源为准。