7月21日,谷歌毫无征兆地推出了两款新模型:Gemini 3.6 Flash和Gemini 3.5 Flash-Lite,正式登陆Google AI Studio和模型选择器。与此同时,备受瞩目的旗舰模型Gemini 3.5 Pro却依然不见踪影。原计划6月上线的3.5 Pro至今仍未发布,这让市场不禁疑惑:谷歌为何先交出两张“草稿纸”?

**Gemini 3.6 Flash:成本更低,效率更高**

谷歌表示,相比上一代,3.6 Flash在编码、推理和工具调用方面有所提升,同时通过减少输出token降低了运行成本。这款模型的定位是面向真实生产环境的高效模型,特别是为Agent服务。在Agent时代,任务往往需要数十轮模型调用,因此模型必须足够快且便宜。

根据官方API文档,3.6 Flash延续了3.5 Flash的长上下文优势(支持100万token),并支持代码执行、外部工具调用等能力。定价方面,输入1.50美元/百万token,输出7.50美元/百万token。相比3.5 Flash(输出9美元),输出成本有所下降。谷歌内部测试显示,3.6 Flash相比3.5 Flash减少了55.8%的token消耗,同时评分从85分提升至100分。

在公开基准测试中,3.6 Flash在DeepSWE(代码评测)中得分49%,高于上一代的37%;在OSWorld-Verified(电脑操作)中得83%,超过3.5 Flash的78.4%;在MLE Bench(机器学习)中得63.9%,高于49.7%。虽然这些数据表明有进步,但在与GPT-5.6 Luna、Claude Sonnet 5等前沿模型的横向对比中,3.6 Flash在复杂软件工程和知识工作上仍不占优势。

Artificial Analysis的评测显示,3.6 Flash的综合智力指数仍为50分,与3.5 Flash持平。但其速度优势明显,每项任务平均耗时约1.3分钟,相比上一代的2.7分钟缩短了一半。这意味着3.6 Flash的升级核心在于效率:用更少的计算完成更多任务。

**Gemini 3.5 Flash-Lite:速度最快,但单价微涨**

作为Flash系列的轻量版,3.5 Flash-Lite牺牲了部分上限,换取了更低的成本和更快的速度。测试数据显示,其任务完成时间从上一代的1.6分钟缩短至0.6分钟,生成速度达到约350 token/秒,处于当前主流高速水平。

定价上,输入0.30美元/百万token,输出2.50美元/百万token。相比3.6 Flash,价格约为1/5和1/3。但相比上一代3.1 Flash-Lite,新模型并未降价,甚至因能力提升导致综合成本可能上升。

尽管如此,3.5 Flash-Lite在各项测试中表现亮眼。它支持不同的思考深度,并内置了Computer Use能力。在Terminal-Bench 2.1、GDM-MRCR v2等测试中均有显著提升。值得注意的是,在一些Agent和代码测试中,3.5 Flash-Lite甚至超过了上一代更高定位的Gemini 3 Flash。这表明,随着技术进步,更便宜、更快的模型正在承接过去需要大模型才能完成的部分任务。

此外,谷歌还推出了专门针对网络安全场景的Gemini 3.5 Flash Cyber。该模型未公开提供,仅通过CodeMender平台向政府和可信合作伙伴开放。在CodeMender系统中,多个Flash Cyber Agent可协同工作完成分析任务,并在CyberGym基准测试中达到了接近前沿模型的表现。

**Gemini 3.5 Pro:迟迟未交的旗舰答卷**

相比Flash系列展现出的务实路线,Gemini 3.5 Pro代表了谷歌的模型上限。然而,这份“答卷”至今仍未交出。原定于6月上线的3.5 Pro,目前已延期数月。

据彭博社和路透社报道,谷歌仍在优化模型能力,尤其是编码表现,以期达到内部目标。华尔街正密切关注3.5 Pro的发布,将其视为判断Google DeepMind能否跟上OpenAI和Anthropic的重要指标。随着Agent进入企业工作流,代码能力的重要性日益凸显,一个模型能否理解复杂项目、修改真实代码,直接决定了其实际生产价值。

谷歌CEO皮查伊近期多次强调成本优势,表示迁移至Gemini模型可为企业节省超过10亿美元。然而,市场期待的硬实力证明尚未出现。在国产模型如GLM-5.2、Kimi K3迅速追赶的背景下,如果Gemini 3.5 Pro持续滞后,Flash系列充其量只能作为填补空档的“草稿纸”。反之,若3.5 Pro能强势回归,Flash路线将成为完整体系的一部分:Pro负责突破上限,Flash负责规模化应用。在即将到来的财报电话会议中,市场势必会继续追问这款旗舰模型的最终表现。

最新快讯

2026年07月22日

10:41
月之暗面发布的 Kimi K3 再次引发了市场对于算力需求的担忧,导致美股半导体板块应声下跌。然而,多家华尔街机构认为,这并非算力需求见顶的信号,反而是需求加速的催化剂。这款拥有 2.8 万亿参数、百万上下文长窗口的开源模型,将显著推高 KV 缓存、HBM、存储及云基建需求。Kimi K3 更像是 AI 使用量扩散的催化剂,而非硬件需求见顶的信号。 市场将 ...
10:41
7月22日,据《科创板日报》报道,英伟达正式发布了新一代Spectrum-6以太网交换芯片,旨在支持基于Vera Rubin平台的超大规模AI基础设施。 作为下一代Spectrum-X以太网交换机平台的核心组件,Spectrum-6凭借高带宽、智能流量管理及故障恢复能力,致力于提升AI工厂的整体计算效率。目前,CoreWeave、微软、Nebius、Spac...
10:36
鼓狮财经7月22日电,美国总统特朗普于7月21日在社交媒体上宣布,已指示美国政府解除针对黎巴嫩长达40多年的直飞航班禁令。这一表态是在当天于白宫与到访的黎巴嫩总统奥恩举行会晤后作出的。此次会晤具有特殊的历史意义,这是奥恩自2025年1月就任黎总统以来,首次与美国总统进行正式会晤,也是自2009年以来首位访问白宫的黎巴嫩国家元首。不过,据美国媒体报道,目前尚不...
10:36
据鼓狮财经7月22日报道,韩国产业通商部21日指出,尽管中东局势再度升级引发全球能源市场动荡,但韩国的原油供应依然保持稳定,预计直至9月底均无虞。根据该部当天发布的新闻稿,韩国7月和8月已确定的原油现货接收量已达到去年同期水平的110%,9月确定的到货量则为去年的90%。
10:36
7月17日,世界人工智能大会的展馆里,模型在生成代码,机器人在人群中穿行。然而,受外围市场科技股调整的影响,A股市场呈现出截然不同的景象。当日,上证指数下跌3.05%,科创50指数跌幅超过7%。全市场超过5000只个股下跌,其中半导体、算力硬件产业链大幅下挫,存储器、光刻机及AI应用等题材领跌。这两个画面发生在同一座城市、同一时间段。就在大会开幕前夕,月之暗...
10:10
许多年以后,当市场回望2026年7月,它很可能成为全球大模型产业竞争的一道重要分水岭。因为更多人或许从这个月开始意识到,没有哪次模型的性能座次是绝对安全的。这个月的短短几周内,中国的5家头部独立大模型公司分别在忙着不同的事。智谱用4.2%的新增股份换取314亿港元,提出了2年不追求变现的摸高计划;MiniMax同一周拿出160亿港元的配股加可转债组合,创始人...
10:10
本届世界杯中,西班牙以1比0战胜阿根廷。虽然赛场上的角逐已经落幕,但网上的“谣言大战”却愈演愈烈。从挪威球星哈兰德的伪造视频,到指控阿根廷“操纵比赛”的假图,真真假假混杂在一起广泛传播。大量由人工智能生成的视频、合成图片以及断章取义的片段随着世界杯的热度四处扩散。这些虚假内容往往在官方辟谣之前,就已经获得了数百万的播放量。其形式五花八门,有的为了搞笑,有的为...
10:10
谷歌 DeepMind 今日毫无保留,一口气祭出三张王牌:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 以及 Gemini 3.5 Flash Cyber。这三款产品分别代表了更强的主力、更快的轻量级版本以及专攻漏洞的安全特种兵。它们的共同指向非常明确:让运行在生产环境中的 AI Agent 变得更快、更聪明且更廉价。与此同时...
10:09
鼓狮财经7月22日消息,被誉为“华尔街一哥”的美国最大商业银行摩根大通首席执行官杰米·戴蒙,对于当前人工智能(AI)领域的投资热潮持谨慎态度。不过,他对SpaceX公司计划在太空建立数据中心的宏伟构想却给予了高度评价。 在接受最新一期播客采访时,戴蒙直言,人工智能领域的资金投入规模空前巨大。虽然他认为AI最终可能像互联网一样产生回报,但绝不会按照投资者预期的...
10:09
鼓狮财经7月22日讯,受存储芯片巨头股价飙升的带动,韩国综合股价指数(KOSPI)周三延续前一日强势,大幅收涨并再次触发熔断机制。开盘后不久,KOSPI指数便飙升4.5%,截至发稿时涨幅已扩大至5.53%,报收7,121.17点,盘中最高涨幅一度超过6%。 北京时间上午8时07分左右,韩国交易所启动了“侧车机制”,即暂停KOSPI的程序化买盘。该机制通常在K...
09:56
WAIC2026刚刚结束,厂商们的大模型战略似乎变了味儿。往年大家比拼的是参数规模和榜单分数,今年关注的焦点变成了“模型能干什么”以及“能不能赚钱”。细究之下,一个显著的趋势浮出水面:厂商们都在搞轻量化部署,推出各种迷你版本。这究竟是为何? 回想一下,你有多久没在信号不佳的电梯里,对着那个怎么叫都不应的语音助手干瞪眼了?或者就在昨天,开车进隧道时导航突然失声...
09:55
回望2026年7月,这很可能会成为全球大模型产业竞争的一道重要分水岭。人们开始意识到,没有哪次模型的性能排名是绝对安全的。在这个月的短短几周内,中国的5家头部独立大模型公司分别在忙着不同的事。智谱用4.2%的新增股份换取314亿港元,提出了2年不追求变现的摸高计划;MiniMax同一周拿出160亿港元的配股加可转债组合,创始人宣布零薪酬直到实现AGI;月之暗...