刚刚,Google DeepMind 发布了 Gemini 3.7 Flash!核心推理能力全面升级,同时祭出限时半价策略:输入 0.75 美元、输出 3.75 美元/百万 Token,年底恢复原价。别家都在卷性能,谷歌独树一帜开始打价格战。
01、谷歌无大将,Gemini 3.7 Flash 称大王
先看谷歌力推的主要买点:它在关键编码任务(如调试和问题解决)上相比 3.6 Flash 表现出强劲提升。它能够以更少的提示词设计出功能性更强的网页布局和应用。在完成真实业务工作流时,它提供了更优的推理能力和准确性。
FrontierCode 生产代码质量从 3.6 的 34.4% 跳到 43.6%,涨了近 27%。DeepSWE 长时程软件工程从 49% 飙到 65.3%,涨幅超 34%。Code Arena Elo 打到 1588,Terminal-bench 2.1 拿下 85.8%。编码和智能体两个赛道,3.7 Flash 几乎把 3.6 Flash 按在地上摩擦,可谓是加量不加价。
功能层面,3.7 Flash 支持可定制思考配置,此后开发者可以自己调节“想多久”,在质量、成本和延迟之间找平衡点。多模态输入覆盖文本、图像、音频、视频,上下文窗口 1M Token,输出上限 64K。已经上线 Gemini App、AI Studio、Gemini API 和 Antigravity,知识截止到 2026 年 3 月。
半价策略值得细看。输入 0.75 美元/百万 Token、输出 3.75 美元/百万 Token 的价格维持到 2026 年 12 月 31 日,之后恢复到 1.50/7.50 美元——和 3.6 Flash 标准价持平。谷歌的算盘很清楚:趁年底前用低价把开发者的项目绑进 Gemini 生态,等迁移成本够高了再恢复原价。
但也别急着喊“谷歌赢了”。3.7 Flash 的知识截止在 3 月,意味着它对过去五个月发生的事一无所知。幻觉问题官方自己也承认“仍可能出现”。已有网友反馈,Gemini-3.7-flash 在软件工程相关基准测试中表现普通,甚至性价比不如 Sonnet-5。更关键的是,Flash 是谷歌的轻量级产品线。真正的较量在 Pro 和 Ultra 级别,那里 Claude 和 GPT 才是对手。
02、3.5 Pro 无了,谷歌慌了
据传,Gemini 3.5 Pro 已被谷歌 Gemini 放弃,多数团队正忙于 Gemini 4。这也被视为谷歌 DeepMind 的最后一次打造顶尖 AI 的机会。
据报道,52 岁 Google 联合创始人 Sergey Brin 狠话:要么加速,要么等死!据 Reuters 独家报道,谷歌联合创始人 Sergey Brin 近月多次敦促核心 AI 团队全力投入 Gemini,以追赶 Anthropic 和 OpenAI。他在 4 月的 DeepMind 全员大会上明确要求团队加快速度,随后公司对 DeepMind 进行重大领导层调整,Gemini 旗舰版也因性能落后被推迟两个月。
谷歌重组之际,Sergey Brin 正拼命给员工打气——这一幕,像极了 2022 年 ChatGPT 横空出世时,他仓促推动谷歌应战的旧日重演。如今,Sergey Brin 虽无正式头衔,52 岁的他却以“联合创始人”的余威,在暗处左右模型航向。
知情人士称,过去数月,他向核心团队反复灌输:必须追,必须赶上 AI 前沿。他尤其力推“递归式自我改进”——让技术学会自己进化,无需人类插手。去年 11 月,谷歌 Gemini 模型曾短暂超越竞争对手,但 Anthropic 和 OpenAI 随后的新版本发布,再次让谷歌陷入追赶状态。截至今年 8 月,由于内部测试显示 Gemini 在编程等领域的表现仍落后于竞争对手,谷歌已经将下一代旗舰 Gemini 版本推迟了两个月。
8 月 5 日,Demis Hassabis 退居幕后,由其副手 Koray Kavukcuoglu 接任更多管理职责。与此同时,Gemini 最初的两位技术联合负责人离职,共同创办一家创业公司。两名消息人士称,Hassabis 和 Kavukcuoglu 告诉员工,一些非技术团队将从 DeepMind 转移至谷歌企业汇报体系。对于一个过去鼓励员工探索附属研究项目的组织而言,如今要求重新夺回模型领先地位的信息非常明确。
