Google 这次对 Gemini Flash 系列的处理,重点不只是又多了几个模型名。7 月 21 日前后,Google DeepMind、GitHub 和 Vercel 各自给出了不同入口:3.6 Flash 进入 Copilot 和 AI Gateway,3.5 Flash-Lite 被放进网关的子任务场景,而 3.5 Flash Cyber 被限定在 CodeMender 相关的安全防守试点里。
这条分流线很清楚。编码、Web 开发和 agentic 工作流需要更低的 token 消耗、更好的工具调用和更容易接入的计费方式;漏洞发现和补丁生成则有明显的双重用途风险。Google 没有把安全专用模型直接推向公开市场,而是把它放在政府和受信任合作伙伴的通道里,先让防守方使用。
Flash 先解决调用成本
DeepMind 对 3.5 Flash Cyber 的解释很工程化:漏洞挖掘不是一次问答,而是搜索大量执行路径。大型模型如果只被调用一次,可能卡在成本和延迟上;较轻的 Flash 模型可以在同一个任务里反复调用,让子代理覆盖更多代码路径,再汇总成一份报告。
这也是它被绑定到 CodeMender 的原因。DeepMind 把它描述为一个用于发现、验证和修补漏洞的轻量安全模型,并强调它可以进入频繁扫描、发布前检查和提交扫描流程。这里的重点不是模型会不会写安全报告,而是它能不能以足够低的边际成本跑在持续防御链路里。
安全模型没有走公开分发
DeepMind 披露的 benchmark 数字很亮眼,包括 CyberGym、Big Sleep 评估、Chrome 生产提交扫描,以及 V8 上的独立漏洞发现数量。不过这些都是厂商披露或厂商组织的测试,文章里最值得关注的反而是部署边界:3.5 Flash Cyber 会先作为受限试点,通过 CodeMender 面向政府和可信伙伴开放。
这说明安全模型的产品化路径和通用编码模型不同。漏洞验证、利用链生成和补丁建议在防守侧很有价值,但同一能力也可能提高攻击自动化的效率。Google 的选择是把能力留在受控环境里,先服务前线防守,而不是把它变成任何开发者都能直接调用的通用 API。
开发工具拿到的是通用 3.6 Flash
GitHub 的 Changelog 给出的是另一条路径:Gemini 3.6 Flash 正在进入 GitHub Copilot,面向 Web 和应用开发、编码以及更长周期的 agentic 任务。GitHub 特别提到可配置 reasoning effort 和复杂工作流里的并行工具调用,并要求 Business 与 Enterprise 管理员先打开预览策略,组织成员才能选择这个模型。
Vercel AI Gateway 则把 Gemini 3.6 Flash 和 3.5 Flash-Lite 变成可路由的模型标识。开发者可以在 AI SDK 里指定 google/gemini-3.6-flash 或 google/gemini-3.5-flash-lite;网关负责调用、用量和成本追踪、重试、故障转移、预算和 Zero Data Retention 等配置。Flash-Lite 被描述为适合承担大任务里边界更清楚的子代理工作。
模型选择变成一层策略
对工程团队来说,这次更新的含义不是简单地换一个默认模型。Copilot 侧要处理组织管理员策略、按量计费和 IDE 覆盖;网关侧要处理模型 ID、成本、重试、数据保留和路由规则;安全侧还要接受访问资格与使用边界。
如果这一方向延续下去,模型能力会继续按场景拆开:交互式编码追求响应质量和 token 效率,子代理追求便宜和稳定,安全防守追求大规模路径搜索但必须受控。团队真正要设计的是模型使用策略,而不是把所有请求都交给一个看起来最强的模型。