谷歌静默上架 Gemini 3.6 Flash 与 3.5 Flash Lite:定价倒挂与场景细分

谷歌静默上架 Gemini 3.6 Flash 与 3.5 Flash Lite:定价倒挂与场景细分

Google 近日在 AI Studio 和 Vertex API 上悄然上线了两款新模型:Gemini 3.6 FlashGemini 3.5 Flash Lite。此次发布未伴随官方发布会、博客文章或推文,仅在模型选择器中增加了标注为 "New" 的选项。

两款模型的发布日期均显示为 2026 年 7 月 21 日,知识截止日期统一为 2026 年 3 月。值得注意的是,此次更新中 Pro 系列并未同步推出。

核心模型解析

1. Gemini 3.6 Flash:性能与价格的"反向操作"

  • 模型 IDgemini-3.6-flash
  • 官方定位:被称为"我们迄今最智能的模型",旨在 agentic(智能体)和 coding 任务中提供持续的前沿性能。
    • 注:不同页面描述存在差异,AI Studio 模型卡描述其为"平衡速度与智能,在 agentic 和多模态任务中提供强劲表现"。
  • 定价策略
    • 输入:$1.50 / 百万 token
    • 输出:$7.50 / 百万 token
  • 价格对比:目前在售的上一代 Gemini 3.5 Flash 输出价格为 $9.00 / 百万 token。新版 3.6 Flash 不仅性能更强,输出价格反而降低了 $1.50,延续了谷歌 Flash 系列"更强且更便宜"的传统。

2. Gemini 3.5 Flash Lite:专为高频 Agentic 工作流设计

  • 模型 IDgemini-3.5-flash-lite
  • 官方定位:面向大规模高频 agentic 任务和 subagent(子智能体)工作流,强调高吞吐和低延迟执行。
  • 应用场景:该模型专门针对由主 Agent 拆解任务后,大量子 Agent 并行处理粗活的场景。类比 Anthropic 的产品线,其角色类似于 Claude Code 中的 Haiku 模型。
  • 定价策略
    • 输入:$0.30 / 百万 token
    • 输出:$2.50 / 百万 token
  • 性价比:其价格约为 Gemini 3.6 Flash 的五分之一到三分之一,被形容为"白菜价",适合大规模低成本调用。

命名体系与现状观察

此次发布暴露出谷歌模型命名体系的混乱现象:
1. 版本跳跃不一致:Flash 系列升级至 3.6,而 Flash Lite 仍停留在 3.5。
2. 文案冲突:同一模型在不同官方页面上的介绍文案不完全一致。
3. 旗舰缺席:Gemini 3.5 Pro 尚未出现,此前曾鸽过一次,此次继续保持"Flash 先行、旗舰随后"的节奏。

开发者入口

目前两款模型已在 Google AI Studio 开放试用,开发者可通过以下地址直接选用:
* Google AI Studio:https://aistudio.google.com


信息来源:基于原始材料事实整理,发布时间与价格数据以材料披露为准。