Google 上线 Gemini 3.6 Flash 与 3.5 Flash-Lite,公布 Flash Cyber 并启动 Gemini 4 预训练
Google 7 月 21 日在官方博客公布新一轮 Gemini 模型更新,由 Gemini 团队产品高级总监 Tulsee Doshi 署名。主力型号 Gemini 3.6 Flash 定位「agent 时代的工作马」:Artificial Analysis 测得其输出 token 用量较 3.5 Flash 减少 17%;Google 另称在 DeepSWE 等部分测试中最高减少 65%。价格为 $1.50 / 百万输入 token、$7.50 / 百万输出 token。Google 自报 MLE Bench 63.9%(3.5 Flash 为 49.7%)、OSWorld-Verified 83.0%(78.4%)、GDPval-AA v2 1421(1349);computer use 已成为 Gemini API 与 Gemini Enterprise 的内置工具。
第二款 Gemini 3.5 Flash-Lite 主打速度与吞吐:Artificial Analysis 测得 350 输出 token/s;定价为每百万输入/输出 token $0.30 / $2.50。Google 自报其在 SWE-Bench Pro 达 54.2%(Gemini 3 Flash 为 49.6%)、OSWorld-Verified 74.0%(65.1%)、Terminal-Bench 2.1 54%(3.1 Flash-Lite 为 31%),同样内置 computer use 工具;这些速度与 benchmark 数字不代表所有部署环境都能恒定达到。
Google 同时公布 Gemini 3.5 Flash Cyber:这是基于 3.5 Flash、面向漏洞发现与修复的网络安全专用变体,计划与代码安全 agent CodeMender 搭配,由多个 Cyber agent 协同生成合并报告。Google 只定性称其在 CyberGym 上接近前沿水平,没有给出具体分数。该模型当前尚未公开,未来将通过 CodeMender 向政府和可信合作伙伴开展限量试点,官方也没有公布独立 API 或具体开放日期。
发布节奏上还有两条更大的信号:官方确认 Gemini 3.5 Pro 正在合作伙伴中测试、「准备好后立即广泛开放」;同时团队已启动「迄今最雄心勃勃的预训练 run」——Gemini 4。即日起 3.6 Flash 与 3.5 Flash-Lite 已通过 Gemini API(AI Studio / Android Studio)、Gemini Enterprise 与 Gemini app 提供,Flash-Lite 还在向 Google 搜索集成。在本月 Qwen3.8 官宣 2.4T、Kimi K3 与 Claude Fable 5 之后,Google 用「主力模型降价提效 + 旗舰预训练官宣」的组合拳回应,旗舰模型军备竞赛进入暑期密集期。
