Gemini 4已开练!谷歌三连上新,主打又便宜又快
AI圈的竞争,早就过了单纯比拼“谁参数大”的阶段。现在的战场,是算成本的账本和抢场景的跑马圈地。
最近,谷歌搞了个大动作,一口气甩出三款新模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及网络安全特供版Cyber。这一波操作,主打一个“快、准、省”。但在这阵热闹的锣鼓声背后,有个尴尬的事实被刻意淡化了:大家心心念念的旗舰级Gemini 3.5 Pro,又鸽了。
更有趣的是,在Pro迟迟不来的当口,谷歌转头宣布:Gemini 4已经开练,而且这次是“史上最激进”的预训练。
这出戏,有点意思。
一、 Flash系列:把“便宜”刻进DNA
这次发布的三款模型,虽然都挂着“Flash”的名号,但谷歌的分寸拿捏得很细——既要全能,又要极速,还要垂直。
先说主角 Gemini 3.6 Flash。
这玩意儿像是给旗舰模型做了个“瘦身手术”。官方数据很性感:代码生成能力在DeepSWE基准测试中从37%提到了49%,多模态理解也上了一个台阶。最关键的是省钱——输出Token消耗比上一代少了17%,某些编码场景下甚至能省65%。
定价更是直接打到了地板:输入$1.5/M,输出$7.5/M。对于要大规模跑Agent(智能体)的公司来说,这每一分钱都是净利润啊。
接着是 Gemini 3.5 Flash-Lite,纯纯的速度机器。
这模型定位很明确:我不一定最强,但我最快、最便宜。每秒350个Token的输出速度,读万字长文不到半分钟。价格更是低到令人发指:输入$0.3/M,输出$2.5/M。这就是所谓的“白菜价”,专门用来抢占那些对延迟敏感、对成本极度敏感的场景。
最后是 Cyber,安全圈的“内部专享”。
基于Flash微调,专攻网络安全漏洞查找。不对外公开,只给政府和可信合作伙伴试点。这套路你不陌生吧?跟Anthropic玩的一模一样,先圈住核心用户,再慢慢放风。
二、 旗舰缺席:3.5 Pro去哪儿了?
Flash系列发得越热闹,开发者心里越没底。因为真正能扛大旗的Gemini 3.5 Pro,至今还是个谜。
还记得今年5月Google I/O大会上,CEO皮查伊信誓旦旦地说:“再给我们一个月。”结果两个月过去了,连个影子都没有。
坊间传闻挺多,但核心就一个:硬实力没达标。
据彭博社爆料,3.5 Pro因为编码能力拉胯被内部叫停。团队试过用新数据补救,结果“令人失望”。甚至有说法称,谷歌打算推翻重来,目标定在7月中旬上线,但现在看,估计又要延期了。
官方的回应也很高冷:“Ready了就发。”
翻译一下就是:我们也在等,但你们别催了。
三、 Gemini 4:命名混乱下的豪赌
就在3.5 Pro还在娘胎里挣扎的时候,谷歌突然抛出一个重磅消息:Gemini 4启动预训练。
这话里的信息量很大。“史上最激进”是个什么概念?是新架构?还是超大规模的数据飞轮?外界都在猜。但这同时也暴露了谷歌产品线的一个老毛病:命名体系乱成一锅粥。
你看现在,Nano、Flash、Flash-Lite、Pro、Ultra、Cyber……六条线并行。Flash都迭代到3.6了,Pro还卡在3.5没影儿。这种版本号各自为政的局面,让用户很难直观感受到技术的代际跃迁。
四、 竞争对手:在你犹豫时狂奔
谷歌内部调整产品线的这两个月,外面世界可没闲着。
Anthropic发了Fable 5,xAI出了Grok 4.5,OpenAI更是像拧螺丝一样迭代了GPT-5.6的三个小版本。
相比之下,谷歌现役能打的旗舰,还得靠今年2月发布的3.1 Pro来撑场面。这意味着,在高端旗舰赛道上,谷歌已经断档大半年了。
而且,数据不说谎。
虽然官方吹得天花乱坠,但不少开发者实测后发现,3.6 Flash在某些场景下的实际智力表现,甚至不如竞品GPT-5.6 Sol medium,成本反而更高。这说明什么?说明基准测试(Benchmark)和真实应用场景之间,还隔着一道鸿沟。
结语:性价比不是万能药
谷歌这波“Flash三连发”,战略意图很明显:用极致性价比和速度,在Agent和规模化应用市场抢地盘。 同时提前预热Gemini 4,展示野心。
但这招能赢吗?
旗舰模型的延期,暴露的是谷歌在产品节奏把控上的焦虑。如果3.5 Pro继续拖下去,会不会出现“发布即过时”的尴尬?而混乱的产品线,又能不能帮用户理清技术实力?
对于AI从业者来说,接下来就看两点:3.5 Pro到底啥时候能落地?Gemini 4又能拿出什么颠覆性的技术?
毕竟,在AI圈,慢一步,可能就是差一个时代。