返回行业动态
模型与产品

Google 连发三款 Gemini 新模型:首发网络安全专用 AI,3.6 Flash 推理效率翻倍

Google DeepMind 于 7 月 21 日发布三款全新 Gemini 轻量模型:Gemini 3.6 Flash 主攻编程与智能体任务,Token 消耗大幅降低且推理速度翻倍;Gemini 3.5 Flash-Lite 主打高吞吐低延迟,每秒输出 350 Token;Gemini 3.5 Flash Cyber 专注于网络安全漏洞发现与修复,初期仅对政府与可信伙伴开放。三款模型均已上线 Google AI Studio 和 Vertex AI。

来源:Google DeepMind原标题:Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber查看原文
Google Gemini三款新模型概念图:三条彩色光带从Google标志延伸而出,代表三种不同定位的AI模型

图片来源:北京拓实科技原创

发生了什么

7 月 21 日,Google DeepMind 正式发布三款基于 Gemini 3 系列优化的全新模型,覆盖通用效率、极致吞吐和垂直安全三大场景,进一步完善了 Flash 产品线布局。三款模型即日起通过 Google AI Studio 和 Vertex AI 向开发者开放。

三款模型定位

  • Gemini 3.6 Flash:作为 3.5 Flash 的迭代升级版,核心优势是 Token 消耗显著降低、推理速度翻倍,同时强化了编程、知识工作和多模态能力,面向企业级 AI Agent 和自动化工作流。
  • Gemini 3.5 Flash-Lite:主打极致吞吐量,每秒可生成 350 个输出 Token,输入价格降至 0.3 美元/百万 Token、输出 2.5 美元/百万 Token,并原生搭载 Computer Use 能力,适合文档批量处理和智能检索等高并发场景。
  • Gemini 3.5 Flash Cyber:行业首个由头部模型厂商发布的网络安全专用大模型,以更低算力开销完成软件漏洞发现、验证与修复,初期仅向政府机构及可信合作伙伴开放,体现了前沿模型在垂直安全领域的落地。

值得关注的信号

本次发布有两个值得企业关注的方向性信号。一是「安全垂直化」:Gemini 3.5 Flash Cyber 的推出表明,头部 AI 厂商开始将大模型能力系统性地武器化到网络安全攻防领域,这与 OpenAI 同日披露的模型失控入侵事件形成呼应——AI 既是攻击者也是防御者。

二是「Flash 系列分层」:Google 正在用不同定位的 Flash 变体覆盖从高并发简单任务到复杂推理的完整频谱。对于企业而言,这意味着可以根据延迟、成本和任务复杂度灵活选择模型,而不必在性能和效率之间妥协。

此外,原定于 6 月发布的 Gemini 3.5 Pro 再度延期,Google 透露已在启动 Gemini 4 的预训练。这暗示 Google 可能正在跳过 3.5 Pro 或将其能力整合到下一代旗舰产品中。

编辑说明

本文由北京拓实科技根据公开信息整理,核心事实与数据请以原始来源为准。