返回行业动态
模型与产品

谷歌发布Gemini 3.8 Flash:六周内第三代,编程能力逼近Claude Opus 5,同步推出网络安全专用版

谷歌发布Gemini 3.8 Flash及Flash Cyber两款模型,前者在DeepSWE编程测试得分71%逼近Opus 5的74%,后者专攻漏洞发现与自动修复。价格维持0.75/3.75美元每百万Token优惠至年底,Fairwind计划向受信防御者开放Cyber版本。

来源:Google DeepMind原标题:谷歌发布Gemini 3.8 Flash:六周内第三代,编程能力逼近Claude Opus 5,同步推出网络安全专用版查看原文
谷歌发布Gemini 3.8 Flash:六周内第三代,编程能力逼近Claude Opus 5,同步

图片来源:Google DeepMind

发生了什么

当地时间9月2日,谷歌在Google DeepMind官网发布Gemini 3.8 Flash及Gemini 3.8 Flash Cyber两款新模型,这是谷歌在六周内推出的第三款Flash系列模型。

Gemini 3.8 Flash定位为「迄今最聪明的Flash模型」,重点面向长周期软件工程、自主Agent和复杂企业工作流。在DeepSWE v1.1长周期软件工程测试中得分71.0%,较上代3.7 Flash的65.3%提升近6个百分点,距离Claude Opus 5的74.0%仅一步之遥。在HLE-Verified测试中得分54.9%,略高于Opus 5的54.4%。在LVBench长视频理解测试中得分87.8%,超过GPT-5.6 Sol和Opus 5。

谷歌表示,3.8 Flash在复杂任务上会执行更多推理步骤,并反复调用工具,通过长时间运行的Agent循环对自身结果进行评估和优化——更强调「把事做完」而非简单给出答案。

同步推出的Gemini 3.8 Flash Cyber专攻网络安全漏洞发现和自动修复。在CWE-Bench补丁测试中pass@1达47.2%,接近领先前沿模型的47.8%。该版本仅通过Fairwind计划向受信政府机构、关键基础设施运营商和软件维护者开放。

定价方面,Gemini 3.8 Flash维持与3.7 Flash相同的首发优惠价:输入每百万Token 0.75美元、输出每百万Token 3.75美元,优惠持续至2026年底。模型支持最高1M Token上下文窗口和64K Token文本输出。

编辑说明

本文由北京拓实科技根据公开信息整理,核心事实与数据请以原始来源为准。