今天是 Tibo 大神「连续 28 天发布或重置」挑战的第四天,重磅消息终于来了!昨天,OpenAI 宣布向所有用户(无论免费还是付费)开放 GPT-6,而今天更是直接推出了全新的 GPT-6.1 Sol Ultrafast 版本。配合更新的模型控制系统,这一新版本能够实现对用户指令的即时响应。
GPT-6.1 Sol 本身在 9 月 29 日的开发者大会上刚刚发布,定位是“接近 Astra 的能力,且价格仅为五分之一”。其标准版 API 定价为每百万输入 Token 2 美元、输出 10 美元,已经是目前市面上性价比极高的前沿模型。而 Ultrafast 模式在此基础上,将速度直接提升了 8 倍。OpenAI 官方将其描述为“Near-Astra intelligence at up to 8x faster speeds than Sol Standard”,简单来说,就是智能水平与标准版一致,依然逼近旗舰 Astra,但速度翻倍。
这也是 OpenAI 在“Ultrafast”概念上的第二次迭代。今年早些时候,他们曾与 Cerebras 合作推出过 GPT-5.6 Sol 的 Ultrafast 预览版,当时宣称输出速度高达 750 tokens/s,是标准速度的 14 倍。相比之下,GPT-6.1 Sol Ultrafast 的 8 倍提速幅度看似保守,但考虑到 6.1 Sol 本身的智能水平已大幅超越 5.6 Sol,能在更高的能力基线上实现 8 倍加速,其实含金量更高。
这种速度对于开发场景的意义不言而喻。OpenAI 给出的典型用例包括:线上故障排查、智能体实时导航应用,以及任何“每一秒都在烧钱”的实时交互场景。
在 API 定价方面,Ultrafast 模式为每百万输入 Token 12 美元、输出 60 美元,恰好是标准版的 6 倍。OpenAI 开发者关系工程师 Dominik Kundel 给出了一个更直观的定位:“接近 Astra 级别的智能,8 倍于 Sol 的速度,成本仅为 Astra 的 1.2 倍。”如果拿 Astra 的标准 API 价格(每百万输入 10 美元、输出 50 美元)做对比,Ultrafast 确实只贵了一点点,但换来了远超 Astra 的响应速度。如果你的业务场景里 Astra 的速度不够用,Ultrafast 提供了一个“加一点钱买一堆速度”的选项。
尽管 Ultrafast 的能力参数非常诱人,但有一个关键信息几乎被淹没在了公告里:在 Codex 和 ChatGPT Work 端,Ultrafast 仅对 Pro 500 订阅用户、符合条件的按量付费 Enterprise 用户和 Edu 用户开放。Pro 500 是 OpenAI 今年推出的月费 500 美元的高端订阅计划。这意味着对于普通 ChatGPT Plus(20 美元/月)甚至 Pro(200 美元/月)用户来说,想在 ChatGPT 或 Codex 里用上 Ultrafast,还得额外付费。
这引发了用户的不满情绪。有开发者试用后表示,Ultrafast 在 XHigh effort 模式下确实快得惊人,但 token 消耗速度也同样惊人。500 美元月费对应的 25 倍用量额度在这种模式下“几分钟就能烧掉 1%”。也有人质疑限制逻辑本身:“如果 Ultrafast 会更快地消耗我的用量额度,那为什么不让所有付费用户自己选择?我愿意承受更快用完额度的代价。”
当然,API 端并不受订阅等级限制,开发者可以直接调用 gpt-6.1-sol 模型并启用 Ultrafast 模式,按量付费即可。这对搭建智能体、做实时应用的团队来说门槛并不高。GPT-6.1 Sol Ultrafast 的即时价值在于:它在 API 层面提供了一个“接近旗舰智能 + 极速”的组合,且不需要等待 Astra 降价。对于普通用户来说,即时响应带来的体验提升或许更直接,毕竟没有人喜欢眼睁睁看着模型往错误方向一路狂奔。Day 5 会带来什么?我们明天见。
