Gemini 4已开练!谷歌三连上新,主打又便宜又快

谷歌“Flash”三连发背后:极致性价比狂欢下的旗舰焦虑

AI圈的竞争,早就过了单纯比拼“谁参数大”的阶段。现在的战场,是算成本的账本和抢场景的跑马圈地。

最近,谷歌搞了个大动作,一口气甩出三款新模型:Gemini 3.6 FlashGemini 3.5 Flash-Lite以及网络安全特供版Cyber。这一波操作,主打一个“快、准、省”。但在这阵热闹的锣鼓声背后,有个尴尬的事实被刻意淡化了:大家心心念念的旗舰级Gemini 3.5 Pro,又鸽了。

更有趣的是,在Pro迟迟不来的当口,谷歌转头宣布:Gemini 4已经开练,而且这次是“史上最激进”的预训练。

这出戏,有点意思。

一、 Flash系列:把“便宜”刻进DNA

这次发布的三款模型,虽然都挂着“Flash”的名号,但谷歌的分寸拿捏得很细——既要全能,又要极速,还要垂直。

先说主角 Gemini 3.6 Flash。

这玩意儿像是给旗舰模型做了个“瘦身手术”。官方数据很性感:代码生成能力在DeepSWE基准测试中从37%提到了49%,多模态理解也上了一个台阶。最关键的是省钱——输出Token消耗比上一代少了17%,某些编码场景下甚至能省65%。

定价更是直接打到了地板:输入$1.5/M,输出$7.5/M。对于要大规模跑Agent(智能体)的公司来说,这每一分钱都是净利润啊。

接着是 Gemini 3.5 Flash-Lite,纯纯的速度机器。

这模型定位很明确:我不一定最强,但我最快、最便宜。每秒350个Token的输出速度,读万字长文不到半分钟。价格更是低到令人发指:输入$0.3/M,输出$2.5/M。这就是所谓的“白菜价”,专门用来抢占那些对延迟敏感、对成本极度敏感的场景。

最后是 Cyber,安全圈的“内部专享”。

基于Flash微调,专攻网络安全漏洞查找。不对外公开,只给政府和可信合作伙伴试点。这套路你不陌生吧?跟Anthropic玩的一模一样,先圈住核心用户,再慢慢放风。

二、 旗舰缺席:3.5 Pro去哪儿了?

Flash系列发得越热闹,开发者心里越没底。因为真正能扛大旗的Gemini 3.5 Pro,至今还是个谜。

还记得今年5月Google I/O大会上,CEO皮查伊信誓旦旦地说:“再给我们一个月。”结果两个月过去了,连个影子都没有。

坊间传闻挺多,但核心就一个:硬实力没达标。

据彭博社爆料,3.5 Pro因为编码能力拉胯被内部叫停。团队试过用新数据补救,结果“令人失望”。甚至有说法称,谷歌打算推翻重来,目标定在7月中旬上线,但现在看,估计又要延期了。

官方的回应也很高冷:“Ready了就发。”

翻译一下就是:我们也在等,但你们别催了。

三、 Gemini 4:命名混乱下的豪赌

就在3.5 Pro还在娘胎里挣扎的时候,谷歌突然抛出一个重磅消息:Gemini 4启动预训练。

这话里的信息量很大。“史上最激进”是个什么概念?是新架构?还是超大规模的数据飞轮?外界都在猜。但这同时也暴露了谷歌产品线的一个老毛病:命名体系乱成一锅粥。

你看现在,Nano、Flash、Flash-Lite、Pro、Ultra、Cyber……六条线并行。Flash都迭代到3.6了,Pro还卡在3.5没影儿。这种版本号各自为政的局面,让用户很难直观感受到技术的代际跃迁。

四、 竞争对手:在你犹豫时狂奔

谷歌内部调整产品线的这两个月,外面世界可没闲着。

Anthropic发了Fable 5,xAI出了Grok 4.5,OpenAI更是像拧螺丝一样迭代了GPT-5.6的三个小版本。

相比之下,谷歌现役能打的旗舰,还得靠今年2月发布的3.1 Pro来撑场面。这意味着,在高端旗舰赛道上,谷歌已经断档大半年了。

而且,数据不说谎。

虽然官方吹得天花乱坠,但不少开发者实测后发现,3.6 Flash在某些场景下的实际智力表现,甚至不如竞品GPT-5.6 Sol medium,成本反而更高。这说明什么?说明基准测试(Benchmark)和真实应用场景之间,还隔着一道鸿沟。

结语:性价比不是万能药

谷歌这波“Flash三连发”,战略意图很明显:用极致性价比和速度,在Agent和规模化应用市场抢地盘。 同时提前预热Gemini 4,展示野心。

但这招能赢吗?

旗舰模型的延期,暴露的是谷歌在产品节奏把控上的焦虑。如果3.5 Pro继续拖下去,会不会出现“发布即过时”的尴尬?而混乱的产品线,又能不能帮用户理清技术实力?

对于AI从业者来说,接下来就看两点:3.5 Pro到底啥时候能落地?Gemini 4又能拿出什么颠覆性的技术?

毕竟,在AI圈,慢一步,可能就是差一个时代。