谷歌 DeepMind 今日毫无保留,一口气祭出三张王牌:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 以及 Gemini 3.5 Flash Cyber。这三款产品分别代表了更强的主力、更快的轻量级版本以及专攻漏洞的安全特种兵。它们的共同指向非常明确:让运行在生产环境中的 AI Agent 变得更快、更聪明且更廉价。与此同时,谷歌还宣布启动了“史上最激进”的预训练计划,目标直指下一代模型 Gemini 4。谷歌释放出的信号非常清晰:AI 这一终极牌局的好戏才刚刚开始。
**Gemini 3.6 Flash:真正的核心主力**
首先来看这次真正的“C位”担当——Gemini 3.6 Flash。它此次的核心亮点在于极致的 Token 节省。据 Artificial Analysis Index 测算,相比上一代 3.5 Flash,其输出 Token 减少了 17%。在 DeepSWE 编码基准测试中,最高能节省 65% 的 Token。这不仅仅是少吐字,它完成多步任务所需的推理步骤和工具调用也更少,绕的弯路更短,真正做到了又快又省。
价格方面,3.6 Flash 也更具诚意:输入 1.5 美元、输出 7.5 美元每百万 Token,比 3.5 Flash 更便宜。更省、更便宜,还得更能打。在几项关键测试上,3.6 Flash 均实现了对前代的超越:DeepSWE 编程测试从 37% 提升至 49%,MLE Bench 机器学习研究测试从 49.7% 提升至 63.9%,OSWorld-Verified 电脑操作测试从 78.4% 提升至 83%,GDPVal-AA v2 知识型工作任务拿下 1421 分,比上一代高出 70 多分。
Demo 展示中,3.6 Flash 展现了强大的多智能体编排能力,不仅轻松拿下复杂的代码迁移任务,更在响应速度和代码质量上对 3.5 Flash 实现了降维打击。此外,它还能结合 Gemini Canvas 打通 3D 工作流,快速制作摄影级纹理提取工具,甚至化身 AI 交互设计师,轻松打造沉浸式主题工作室。
**Gemini 3.5 Flash-Lite:击败老大哥的轻量小将**
第二款 Gemini 3.5 Flash-Lite 走的是另一条路:主打极致速度和极致便宜。3.5 Flash-Lite 的输出速度达到每秒 350 个 Token,是整个 3.5 系列中最快的。价格也低至每百万 Token 输入 0.3 美元、输出 2.5 美元,天生适合“海量处理文档”和“Agent 搜索”这种高频、走量的场景。
最令人惊讶的是,这款轻量级模型在多项编程和 Agent 测试中,居然反手击败了体量更大的 Gemini 3 Flash。在 SWE-Bench Pro 测试中,3.5 Flash-Lite 以 54.2% 的成绩击败了 3 Flash 的 49.6%;在 OSWorld-Verified 测试中,则以 74.0% 的成绩战胜了 65.1%。其工作原理是 3.6 Flash 作为主脑拆解任务,Flash-Lite 作为分身批量执行,轻松抹平高并发压力。官方演示显示,两者结合下,Flash-Lite 可以一口气生成 25 套高可用网页设计方案,速度快到几乎是“想一下就出一批”。目前该模型已在 Gemini App 上线,并陆续进入谷歌搜索。
**Gemini 3.5 Flash Cyber:专修漏洞的安全特种兵**
第三款 Gemini 3.5 Flash Cyber,是一款专攻网络安全的硬核模型。它的任务只有一个:找漏洞、补漏洞。眼下一个尴尬的现实是,AI 检测漏洞的速度已经快过了现有系统修复漏洞的速度。谷歌将这款模型塞进代码安全智能体 CodeMender 中,依靠多个 Cyber 智能体协同作战,在安全基准 CyberGym 上刷新了 SOTA,且成本低于更大的模型——用一个更轻的模型,干最需要精度的活。
不过,这款模型目前普通人暂时无法接触。
**Gemini 4:史上最激进的预训练已启动**
虽然 Gemini 3.5 Pro 尚未发布,但 Gemini 4 的训练已经悄然开启。这次三连发只是前菜,但压轴的这句官宣才是真正的重头戏。谷歌已确认,内部已启动史上最激进的一次预训练,目标直指 Gemini 4。有专家表示,按照谷歌常规的六个月训练节奏,年底或许就能看到 Gemini 4 的身影。
对于真金白银掏钱买 Token、搭 Agent 的用户来说,今天的这场发布其实只有一个字最实在——降。价格降了,Token 耗量降了,跑一次 Agent 的成本也降了。至于那个迟迟未到的旗舰版和刚刚开跑的 Gemini 4,目前还是“期货”。能用上、还便宜的,才是今天就能装进你钱包的东西。旗舰再强,也得先落地。
