Google 发布三款 Gemini 新模型,3.5 Pro 仍未现身

内容管家 AI领域评论7字数 708阅读2分21秒阅读模式
Google 发布三款 Gemini 新模型,3.5 Pro 仍未现身

Google DeepMind 于本周二发布了 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款模型。3.6 Flash 被定位为“主力模型”,在代码编写、知识工作和多模态能力上均有提升,同时 Token 用量减少了最多 17%,使用成本也低于前代 3.5 Flash。

3.5 Flash-Lite 是该系列中性价比最高的选项,而 3.5 Flash Cyber 则是一款专精网络安全的微调模型,专注于漏洞发现与修复,定价也颇具竞争力。据 Google 透露,该模型将以限量访问试点项目的形式,仅向zf 机构和可信合作伙伴开放。

Google 方面表示,本轮发布的重点是为大规模构建 AI Agent 的客户提供更高的效率、更低的延迟和更可靠的服务。

三款新模型一览

模型 定位 核心特点
Gemini 3.6 Flash 主力模型 代码/知识工作/多模态能力提升,Token 消耗降低 17%,成本更低
Gemini 3.5 Flash-Lite 高性价比 同级别最低成本,适合大规模生产部署
Gemini 3.5 Flash Cyber 安全专精 漏洞发现与修复,仅向zf 及可信伙伴开放

旗舰 Pro 更新持续跳票

本次发布值得关注的,不只是更便宜、更快速的三款模型,还有一个显著的缺席——Gemini Pro 旗舰系列自今年 2 月更新之后,至今未见新版本。

在此期间,竞争对手的迭代节奏极为紧凑:OpenAI 已发布 GPT-5.5 并开始推送 GPT-5.6;Anthropic 推出了 Claude Opus 4.8 和 Claude Sonnet 5,并扩大了前沿模型 Fable 5 的访问权限。

Google 曾在 5 月随 3.5 Flash 发布时预告 Pro 版“已在内部使用,预计下月推出”。然而上周彭博社报道,Google 在 3.5 Pro 的发布上正面临内部延迟,尚未达到自身设定的性能目标。

Gemini Pro 通常承载着 Google 在复杂推理和代码任务上的最高能力,而 Flash 系列则优先侧重低成本和快速响应,以满足生产级应用需求。

Google DeepMind 产品负责人 Logan Kilpatrick 周二表示,公司目前正与合作伙伴共同测试 Gemini 3.5 Pro,期待“尽快落地”。他同时透露,团队已启动 Gemini 4 迄今为止最大规模的预训练运行。

影响与建议

  • 已有大规模 AI Agent 部署的企业:3.6 Flash 的成本下降和延迟改善是直接利好,建议评估迁移。
  • 关注网络安全的zf /机构用户:3.5 Flash Cyber 的专精路径值得关注,但目前仅限试点伙伴。
  • 等待旗舰 Pro 的开发者:发布节奏存在不确定性,建议同步关注 Anthropic 和 OpenAI 的替代方案。

延伸阅读

 
内容管家

发表评论