谷歌这次不再遮遮掩掩,一口气连发三款Gemini新模型。今天,谷歌DeepMind接连放出三张王牌:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及Gemini 3.5 Flash Cyber。一款是更强的主力军,一款是更快的轻量级选手,还有一款是专攻漏洞的安全特种兵。这三款产品的核心目标非常明确:让生产环境中的AI智能体跑得更快、更聪明、成本更低。
就在发布新模型的同时,谷歌还抛出了一枚重磅炸弹——DeepMind正式启动了“史上最激进”的预训练计划,目标直指下一代旗舰模型Gemini 4。
**Gemini 3.6 Flash:Token消耗暴降65%**
此次发布的真正“C位”是Gemini 3.6 Flash。它的最大亮点在于大幅降低Token消耗。根据Artificial Analysis Index的测算,相比上一代3.5 Flash,其输出Token减少了17%,而在DeepSWE编码基准测试中,最高可节省65%的Token。这不仅意味着“少吐字”,更意味着完成多步任务所需的推理步骤和工具调用更少,绕的弯路更短,真正实现了“又快又省”。此外,它的价格也更低廉:每百万Token输入1.5美元,输出7.5美元。
在性能方面,3.6 Flash在多个关键测试中均超越了前代产品:DeepSWE编程测试从37%提升至49%;MLE Bench机器学习测试从49.7%提升至63.9%;OSWorld-Verified电脑操作测试从78.4%提升至83%;GDPVal-AA v2知识型任务更是拿下了1421分,比上一代高出70多分。
演示视频中,3.6 Flash展示了强大的多智能体编排能力,轻松完成复杂的代码迁移任务,并在响应速度和代码质量上实现了对3.5 Flash的降维打击。此外,它还能通过Gemini Canvas打通3D工作流,快速生成专业摄影级纹理,或化身AI交互设计师打造沉浸式主题工作室。
**Gemini 3.5 Flash-Lite:击败自家老大哥**
第二款产品Gemini 3.5 Flash-Lite则走了一条不同的路线:极致的速度与极致的低价。其输出速度达到每秒350个Token,是3.5系列中最快的。价格也低得惊人:每百万Token输入仅需0.3美元,输出2.5美元。这种特性使其天生适合处理海量文档和Agent搜索等高频、大规模场景。
最令人惊讶的是,这款轻量级模型在多项编程和Agent测试中竟然击败了体量更大的Gemini 3 Flash:在SWE-Bench Pro测试中达到54.2%,高于3 Flash的49.6%;在OSWorld-Verified测试中达到74.0%,高于65.1%。3.6 Flash作为“主脑”负责拆解任务,Flash-Lite作为“分身”批量执行,两者结合轻松应对高并发压力。官方演示中,这种组合能在极短时间内输出25套高可用网页设计方案,速度之快堪称“想一下就出一批”。
目前,Flash-Lite已上线Gemini App,并将逐步接入谷歌搜索。
**Gemini 3.5 Flash Cyber:专攻安全的特种兵**
第三款是Gemini 3.5 Flash Cyber,一款专注于网络安全的硬核模型。其核心任务只有一个:找漏洞、补漏洞。目前,AI发现漏洞的速度已经快于现有系统修复漏洞的速度。谷歌将其嵌入代码安全智能体CodeMender中,通过多个Cyber智能体协同作战,在安全基准CyberGym上刷新了最高纪录,且成本低于更庞大的模型。不过,这款模型目前仅供特定专业场景使用,普通用户暂时无法直接接触。
**Gemini 4开跑:史上最激进预训练**
尽管Gemini 3.5 Pro尚未全面铺开,Gemini 4的训练已经悄然启动。这次的三连发只是“前菜”,而那句重磅官宣才是真正的重头戏。谷歌已确认,内部正在执行史上最激进的预训练计划,目标直指Gemini 4。业内大佬预测,按照谷歌常规的六个月训练节奏,年底可能就能看到Gemini 4的身影。
谷歌传递的信号再清晰不过:AI这场终极牌局,好戏才刚刚开始。对于广大用户和开发者而言,今天这场发布其实只有一个字最实在——降。价格降了,Token消耗降了,运行Agent的成本也降了。至于那个迟迟未到的旗舰模型,和刚刚起步的Gemini 4,目前还属于“期货”。能用上、且价格亲民,才是今天就能装进你口袋里的真金白银。旗舰再强大,也得先落地应用。
