发生了什么
当地时间9月2日,谷歌在Google DeepMind官网发布Gemini 3.8 Flash及Gemini 3.8 Flash Cyber两款新模型,这是谷歌在六周内推出的第三款Flash系列模型。
Gemini 3.8 Flash定位为「迄今最聪明的Flash模型」,重点面向长周期软件工程、自主Agent和复杂企业工作流。在DeepSWE v1.1长周期软件工程测试中得分71.0%,较上代3.7 Flash的65.3%提升近6个百分点,距离Claude Opus 5的74.0%仅一步之遥。在HLE-Verified测试中得分54.9%,略高于Opus 5的54.4%。在LVBench长视频理解测试中得分87.8%,超过GPT-5.6 Sol和Opus 5。
谷歌表示,3.8 Flash在复杂任务上会执行更多推理步骤,并反复调用工具,通过长时间运行的Agent循环对自身结果进行评估和优化——更强调「把事做完」而非简单给出答案。
同步推出的Gemini 3.8 Flash Cyber专攻网络安全漏洞发现和自动修复。在CWE-Bench补丁测试中pass@1达47.2%,接近领先前沿模型的47.8%。该版本仅通过Fairwind计划向受信政府机构、关键基础设施运营商和软件维护者开放。
定价方面,Gemini 3.8 Flash维持与3.7 Flash相同的首发优惠价:输入每百万Token 0.75美元、输出每百万Token 3.75美元,优惠持续至2026年底。模型支持最高1M Token上下文窗口和64K Token文本输出。

