
Google DeepMind 于本周二发布了 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款模型。3.6 Flash 被定位为“主力模型”,在代码编写、知识工作和多模态能力上均有提升,同时 Token 用量减少了最多 17%,使用成本也低于前代 3.5 Flash。
3.5 Flash-Lite 是该系列中性价比最高的选项,而 3.5 Flash Cyber 则是一款专精网络安全的微调模型,专注于漏洞发现与修复,定价也颇具竞争力。据 Google 透露,该模型将以限量访问试点项目的形式,仅向zf 机构和可信合作伙伴开放。
Google 方面表示,本轮发布的重点是为大规模构建 AI Agent 的客户提供更高的效率、更低的延迟和更可靠的服务。
三款新模型一览
| 模型 | 定位 | 核心特点 |
|---|---|---|
| Gemini 3.6 Flash | 主力模型 | 代码/知识工作/多模态能力提升,Token 消耗降低 17%,成本更低 |
| Gemini 3.5 Flash-Lite | 高性价比 | 同级别最低成本,适合大规模生产部署 |
| Gemini 3.5 Flash Cyber | 安全专精 | 漏洞发现与修复,仅向zf 及可信伙伴开放 |
旗舰 Pro 更新持续跳票
本次发布值得关注的,不只是更便宜、更快速的三款模型,还有一个显著的缺席——Gemini Pro 旗舰系列自今年 2 月更新之后,至今未见新版本。
在此期间,竞争对手的迭代节奏极为紧凑:OpenAI 已发布 GPT-5.5 并开始推送 GPT-5.6;Anthropic 推出了 Claude Opus 4.8 和 Claude Sonnet 5,并扩大了前沿模型 Fable 5 的访问权限。
Google 曾在 5 月随 3.5 Flash 发布时预告 Pro 版“已在内部使用,预计下月推出”。然而上周彭博社报道,Google 在 3.5 Pro 的发布上正面临内部延迟,尚未达到自身设定的性能目标。
Gemini Pro 通常承载着 Google 在复杂推理和代码任务上的最高能力,而 Flash 系列则优先侧重低成本和快速响应,以满足生产级应用需求。
Google DeepMind 产品负责人 Logan Kilpatrick 周二表示,公司目前正与合作伙伴共同测试 Gemini 3.5 Pro,期待“尽快落地”。他同时透露,团队已启动 Gemini 4 迄今为止最大规模的预训练运行。
影响与建议
- 已有大规模 AI Agent 部署的企业:3.6 Flash 的成本下降和延迟改善是直接利好,建议评估迁移。
- 关注网络安全的zf /机构用户:3.5 Flash Cyber 的专精路径值得关注,但目前仅限试点伙伴。
- 等待旗舰 Pro 的开发者:发布节奏存在不确定性,建议同步关注 Anthropic 和 OpenAI 的替代方案。


评论