谷歌发布三款Flash模型,Gemini 3.5 Pro延期

谷歌一口气发布三款 Flash 模型,网友吐槽:Gemini 3.6 竟没比 3.5 强?

今天(2025年),谷歌搞了个大动作——一口气发布了三款 Flash 轻量级模型。但有趣的是,原定于今日推出的 Gemini 3.5 Pro 并未如期亮相。这一"反常"操作迅速引发网友吐槽,尤其是当大家发现 Gemini 3.6 Flash 的智能水平似乎并没有超过 Gemini 3.5 Flash 时,舆论更是炸开了锅。

不过,谷歌官方博客很快出来"解释"了一番:Flash 系列的定位从来不是拼绝对智商,而是平衡效率与质量,满足生产环境中 AI 智能体对高 Token 效率、低延迟以及稳定性能的需求。

那么,这次发布的三款新模型到底什么来头?我们逐一拆解。


1. Gemini 3.6 Flash:主力生产任务的新标杆

作为此次发布的旗舰 Flash 模型,Gemini 3.6 Flash 面向的是通用主力生产任务,尤其在编程、知识工作和多模态任务上表现有所提升。

关键数据一览

指标 Gemini 3.5 Flash Gemini 3.6 Flash 提升幅度
Artificial Analysis Index(输出 Token 消耗) 基准 减少 17% ⬇️ 17%
DeepSWE 测试得分 37% 49% ⬆️ +12pp
MLE Bench 成绩 49.7% 63.9% ⬆️ +14.2pp
OSWorld-Verified 成绩 78.4% 83.0% ⬆️ +4.6pp
GDPval-AA v2 得分 1349 1421 ⬆️ +72

价格

  • 输入价格:每 100 万 Token $1.50
  • 输出价格:每 100 万 Token $7.50

可以看出,Gemini 3.6 Flash 在多个权威基准测试中都取得了显著进步,尤其是在代码生成和软件工程师相关任务中表现突出。


2. Gemini 3.5 Flash-Lite:速度最快、成本最低

如果说 3.6 Flash 是"全能型选手",那 Gemini 3.5 Flash-Lite 就是"性价比之王"。它是 Gemini 3.5 系列中速度最快、成本最低的模型。

关键数据

  • 输出速度:高达每秒 350 个 Token(根据 Artificial Analysis 测试)
  • Terminal-Bench 2.1:从 31% 提升至 54%
  • GDM-MRCR v2:从 60.1% 提升至 72.2%
  • GDPval-AA v2:从 642 飙升至 1140
  • SWE-Bench Pro54.2%,高于 Gemini 3 Flash 的 49.6%
  • OSWorld-Verified74.0%,也超过后者的 65.1%

价格

  • 输入价格:每 100 万 Token 仅 $0.30
  • 输出价格:每 100 万 Token 仅 $2.50

这个定价策略非常激进,几乎把成本压到了极致,非常适合大规模部署和对延迟敏感的场景。


3. Gemini 3.5 Flash Cyber:网络安全专项微调

第三款模型 Gemini 3.5 Flash Cyber 则走的是垂直领域路线——它针对网络安全漏洞发现和修复进行了专项微调。

  • CyberGym 基准测试上取得接近前沿水平的竞争力表现
  • 每个 Token 使用成本低于更大规模模型
  • 近期将通过 CodeMender 面向政府机构和受信任合作伙伴限量试点推出

这款模型的发布,说明谷歌正在将 Flash 系列的能力延伸到专业安全领域,这是一个非常有前景的方向。


为什么网友在吐槽?

问题的核心在于:Gemini 3.6 Flash 在多项基准上的提升,看起来并没有超越人们对其"下一代"的期待。尤其是当有人对比发现其"智能水平"与 Gemini 3.5 Flash 差距不大时,质疑声便随之而来。

但谷歌的回应也很明确:Flash 系列的核心价值不在于"谁更聪明",而在于在真实生产环境中能否高效、稳定、低成本地运行。对于 AI 智能体(Agent)而言,Token 效率、响应速度和稳定性往往比极限 benchmark 分数更重要。


未来展望

谷歌也透露了一些令人期待的消息:

  • Gemini 3.5 Pro 正在与合作伙伴开展测试,待准备充分后将尽快面向更多用户开放
  • 下一代模型 Gemini 4 已启动预训练任务,这是迄今规模最大、目标最具挑战性的预训练项目

换句话说,Flash 系列只是谷歌 AI 战略的一部分,更强大的 Pro 和未来的 Gemini 4 还在路上。


如何获取?

  • Gemini 3.6 FlashGemini 3.5 Flash-Lite 即日起开放使用
  • 开发者可通过 Google AI StudioAndroid Studio 调用 Gemini API
  • Gemini 3.6 Flash 已登陆 Google Antigravity,企业用户可通过 Gemini Enterprise Agent Platform 使用
  • 普通用户可通过 Gemini 应用 体验
  • Gemini 3.5 Flash-Lite 正在逐步接入 Google 搜索

总的来说,谷歌这次的发布策略更像是"稳扎稳打"而非"激进跃进"。Flash 系列瞄准的是实际生产需求,而非单纯追求 benchmark 分数。对于开发者和企业用户来说,这意味着更低成本、更高效率的 AI 能力;而对于普通用户而言,或许还需要等待 Gemini 3.5 Pro 和 Gemini 4 的到来,才能真正感受到"质的飞跃"。