Anthropic 突然亮出了两张新牌,却被提前曝光了。今天,第三方开发者应用和 Discord 社区接连出现了两个陌生的模型 ID——claude-marshmallow-eap 和 claude-melon-eap。早期实测显示,Marshmallow 表现更强,对话自然度甚至反超 Opus 5,而 Melon 则稍逊一筹。不过,它们目前的综合能力并未达到“Fable 级别”,最快下周就会上线。就在全网关注这两款新模型时,Anthropic 内部却先爆出一个“雷”——Fable 5 上线两个多月,却遭遇了近乎集体的冷落。
01、紧急补牌,Claude 新模型曝光
这轮更新似乎比以往来得更急。业内人士推测,Marshmallow 大概率对应 Opus 级别的迭代,也就是 Opus 5.1,而 Melon 则更接近 Sonnet 级别。一位网友分享的 SVG 测试结果进一步拉开了两者差距。虽然 Anthropic 官方尚未回应,但种种迹象表明,如果只是常规升级,倒也说得通。真正微妙的是时间点——就在两个多月前,Anthropic 刚刚推出了最强、最贵的旗舰模型 Fable 5。
02、最强 Fable 5,意外爆冷
两个月前,Fable 5 满载着“最强旗舰”的光环登场。它能力最强,定价也最贵,是 Claude 产品线金字塔的顶端。按行业惯例,新旗舰发布后,企业通常会迅速迁移预算,向最新最强的模型倾斜。然而,这一次规律在 Fable 5 身上失效了!支付平台 Ramp 追踪了美国超过 7 万家企业的 Token 消费数据,结果显示:Fable 5 上线一个月后,仅占 Anthropic 平台 Token 调用量的 6%,支出占比 11.4%。两个月过去了,这一份额仍徘徊在 11% 左右。这意味着,愿意将模型切换到 Fable 5 的开发者和大厂寥寥无几。对比同期 OpenAI 的旗舰 GPT-5.6 Sol,它拿走了 25% 的 Token 和 23% 的支出份额。在同一赛道,Anthropic 顶配模型的份额仅为竞品的四分之一。更尴尬的是,尽管单价是竞品的两倍,Fable 5 的总营收贡献却只有竞品的 75%。Fable 5 的单价高达 Anthropic 自家 Opus 4.8 的 2 倍,是 Haiku 4.5 的 10 倍。虽然强大,但大多数企业的日常场景根本用不到那个级别。
自家 Opus 5 反杀大哥
Anthropic 另一款模型 Opus 5,反而成了对 Fable 5 的“正面暴击”。7 月底,Opus 5 登场,定价仅为 Fable 5 的一半,但在编程和知识工作评测中,成绩反而更好。CursorBench 3.2 的测试结果更加直观——在最大算力下,Opus 5 得分 70%,每任务成本 8.23 美元;Fable 5 得分 70.5%,仅高出 0.5 个百分点,但成本高达 17.32 美元。相当于多花一倍的钱,只多跑出 0.5% 的成绩。企业用脚投票的结果毫不意外,Ramp 数据显示,Opus 5 上线后,其支出迅速反超了 Fable 5。
开源份额从 11% 暴涨至 62%
不仅如此,开源 AI 的疯狂扩张同样给 Anthropic 带来巨大压力。Vercel AI Gateway 统计显示:4 月,开源模型的 Token 份额仅为 11%。到 6 月,这一数字暴涨至 29%。8 月的最新数据更是直接冲到了 62%。短短两个月,从不到三成飙升至超过六成。而它们花费的成本,不到企业总支出的 4%。换句话说,干着大部分活的模型,几乎不花钱。这让 Fable 5 的处境愈发尴尬。往里看,Opus 5 只要一半的价格,就已经能追到它身后;往外看,开源模型还在一轮轮压低价格。Fable 5 固然可以继续负责冲击能力上限,但 Anthropic 眼下更缺的,是企业真正愿意长期使用、大量使用的模型。这么看,Marshmallow 和 Melon 突然冒出来,也就没那么意外了。它们要补的,正是 Claude “全家桶”里最关键的一环——既要够强,也得够便宜;既能秀肌肉,更得有人买单。
