谷歌发布三款Flash模型,Gemini 3.5 Pro延期
今天(2025年),谷歌搞了个大动作——一口气发布了三款 Flash 轻量级模型。但有趣的是,原定于今日推出的 Gemini 3.5 Pro 并未如期亮相。这一"反常"操作迅速引发网友吐槽,尤其是当大家发现 Gemini 3.6 Flash 的智能水平似乎并没有超过 Gemini 3.5 Flash 时,舆论更是炸开了锅。
不过,谷歌官方博客很快出来"解释"了一番:Flash 系列的定位从来不是拼绝对智商,而是平衡效率与质量,满足生产环境中 AI 智能体对高 Token 效率、低延迟以及稳定性能的需求。
那么,这次发布的三款新模型到底什么来头?我们逐一拆解。
1. Gemini 3.6 Flash:主力生产任务的新标杆
作为此次发布的旗舰 Flash 模型,Gemini 3.6 Flash 面向的是通用主力生产任务,尤其在编程、知识工作和多模态任务上表现有所提升。
关键数据一览
| 指标 | Gemini 3.5 Flash | Gemini 3.6 Flash | 提升幅度 |
|---|---|---|---|
| Artificial Analysis Index(输出 Token 消耗) | 基准 | 减少 17% | ⬇️ 17% |
| DeepSWE 测试得分 | 37% | 49% | ⬆️ +12pp |
| MLE Bench 成绩 | 49.7% | 63.9% | ⬆️ +14.2pp |
| OSWorld-Verified 成绩 | 78.4% | 83.0% | ⬆️ +4.6pp |
| GDPval-AA v2 得分 | 1349 | 1421 | ⬆️ +72 |
价格
- 输入价格:每 100 万 Token $1.50
- 输出价格:每 100 万 Token $7.50
可以看出,Gemini 3.6 Flash 在多个权威基准测试中都取得了显著进步,尤其是在代码生成和软件工程师相关任务中表现突出。
2. Gemini 3.5 Flash-Lite:速度最快、成本最低
如果说 3.6 Flash 是"全能型选手",那 Gemini 3.5 Flash-Lite 就是"性价比之王"。它是 Gemini 3.5 系列中速度最快、成本最低的模型。
关键数据
- 输出速度:高达每秒 350 个 Token(根据 Artificial Analysis 测试)
- Terminal-Bench 2.1:从 31% 提升至 54%
- GDM-MRCR v2:从 60.1% 提升至 72.2%
- GDPval-AA v2:从 642 飙升至 1140
- SWE-Bench Pro:54.2%,高于 Gemini 3 Flash 的 49.6%
- OSWorld-Verified:74.0%,也超过后者的 65.1%
价格
- 输入价格:每 100 万 Token 仅 $0.30
- 输出价格:每 100 万 Token 仅 $2.50
这个定价策略非常激进,几乎把成本压到了极致,非常适合大规模部署和对延迟敏感的场景。
3. Gemini 3.5 Flash Cyber:网络安全专项微调
第三款模型 Gemini 3.5 Flash Cyber 则走的是垂直领域路线——它针对网络安全漏洞发现和修复进行了专项微调。
- 在 CyberGym 基准测试上取得接近前沿水平的竞争力表现
- 每个 Token 使用成本低于更大规模模型
- 近期将通过 CodeMender 面向政府机构和受信任合作伙伴限量试点推出
这款模型的发布,说明谷歌正在将 Flash 系列的能力延伸到专业安全领域,这是一个非常有前景的方向。
为什么网友在吐槽?
问题的核心在于:Gemini 3.6 Flash 在多项基准上的提升,看起来并没有超越人们对其"下一代"的期待。尤其是当有人对比发现其"智能水平"与 Gemini 3.5 Flash 差距不大时,质疑声便随之而来。
但谷歌的回应也很明确:Flash 系列的核心价值不在于"谁更聪明",而在于在真实生产环境中能否高效、稳定、低成本地运行。对于 AI 智能体(Agent)而言,Token 效率、响应速度和稳定性往往比极限 benchmark 分数更重要。
未来展望
谷歌也透露了一些令人期待的消息:
- Gemini 3.5 Pro 正在与合作伙伴开展测试,待准备充分后将尽快面向更多用户开放
- 下一代模型 Gemini 4 已启动预训练任务,这是迄今规模最大、目标最具挑战性的预训练项目
换句话说,Flash 系列只是谷歌 AI 战略的一部分,更强大的 Pro 和未来的 Gemini 4 还在路上。
如何获取?
- Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 即日起开放使用
- 开发者可通过 Google AI Studio 和 Android Studio 调用 Gemini API
- Gemini 3.6 Flash 已登陆 Google Antigravity,企业用户可通过 Gemini Enterprise Agent Platform 使用
- 普通用户可通过 Gemini 应用 体验
- Gemini 3.5 Flash-Lite 正在逐步接入 Google 搜索
总的来说,谷歌这次的发布策略更像是"稳扎稳打"而非"激进跃进"。Flash 系列瞄准的是实际生产需求,而非单纯追求 benchmark 分数。对于开发者和企业用户来说,这意味着更低成本、更高效率的 AI 能力;而对于普通用户而言,或许还需要等待 Gemini 3.5 Pro 和 Gemini 4 的到来,才能真正感受到"质的飞跃"。