整个周四,除了关注菲奖,全网都在守候传说中即将降临的 Opus 5。知情人士疯狂暗示,泄露截图满天飞,种种迹象都表明今夜必有大事发生。然而,全网守了一整天,最终等来的却是“暂缓发布”的通知。据消息灵通人士透露,原因并非技术瓶颈,而是出于安全考量——这款模型可能威胁到人类对高级 AI 的控制。更有内部人士直言,这是首个促使实验室开始质疑“Scaling Law”是否该继续的模型。
这一消息一经发布,舆论瞬间炸锅。
网友怒批炒作:狼来了不管用了
“威胁人类”、“质疑 Scaling Law”,这些言论在两年前或许还能唬住大众,但在经历无数次“狼来了”之后,网友们显然不再买账。许多人认为,这不过是产品发布不及预期时的一场饥饿营销。有人讽刺 Anthropic“得了一种撒谎成性症”,认为这种持续制造恐慌的行为只会加速用户转向竞争对手。
尽管官方解释冠冕堂皇,但部分手快且有特殊权限的开发者,还是通过 Cursor IDE 提前拿到了 Opus 5 的“真容”。
提前实测:3D细节封神,但代价昂贵
知名大 V Chetaslua 的实测视频引爆了社区。他激动地称 Opus 5 为“一头 3D 野兽”,展示了其惊人的 UI 卡片生成能力和游戏构建细节,精细程度令人咋舌,甚至让他激动得手抖,直呼这就是 AGI 的水平。这种在空间理解、三维构建和代码生成上的突破,证明了 Anthropic 在底层逻辑推理上的确取得了重大进展。
然而,强大的背后是高昂的代价。Chetaslua 披露,Opus 5 的 Token 消耗速度极快,仅仅三次对话就耗光了所有额度,比 Fable 5 还要“费钱”。此外,在基础视觉测试中,它也遭遇了翻车——未能识别出图片中松饼上的小虫子,而谷歌的模型早已轻松解决。看来,Opus 5 确实存在严重的偏科问题。
代号“蜂巢”:全副武装的反击
早在 7 月 9 日,Cursor IDE 中出现的“Claude Honeycomb EAP”选项就引起了注意。这便是 Opus 5 的代号为“Honeycomb(蜂巢)”。据爆料,它具备多项跨越式提升:支持高达 100 万 Token 的超长上下文,允许塞入大部头小说或庞大代码库进行分析;具备可配置的推理努力值,用户可在速度与质量间自由切换;同时拥有全能的代码、智能体及多步推理能力,并配备了更聪明的安全与回退机制。
更令人称道的是其“蜂巢”架构的反向安全回落机制:当模型遇到复杂问题、置信度不足时,它不会强行胡说八道,而是自动降级调用 Opus 4.8 兜底。这种设计既平衡了算力成本,又保证了输出稳定性,定位为比 Opus 4.8 更强、比 Fable 5 更便宜的“超级平替”。
Anthropic 急于亮出这张底牌,是因为市场竞争已经白热化。面对 OpenAI 的步步紧逼、Tibo 的免费额度轰炸,以及 Kimi、Qwen、GLM 等对手的稳扎稳打,留给 Anthropic 挤牙膏的时间真的不多了。
