OpenAI宣布GPT-6正式向ChatGPT用户推送。此次更新中,免费用户和Go用户将使用GPT-6 Luna,逐步替换此前的GPT-5.6 Luna;而Plus、Pro等付费用户则升级至GPT-6 Sol。Work和Codex等特定功能暂不涉及此次模型切换。
除了模型名称的变更,GPT-6最显著的变化在于其“智能UI”功能。聊天界面不再局限于纯文字,而是会根据问题动态生成图表、按钮和交互工具。例如,当用户询问七速自行车的工作原理时,GPT-6会生成可点击查看的零部件分解图;在处理具体任务时,还能直接在对话中嵌入计算器、分账工具或小游戏。此外,GPT-6支持边思考边呈现答案,能够先给出部分内容,随后逐步补充细节,甚至交互组件也会随生成过程逐步显示。在网页搜索方面,GPT-6 Instant的响应速度比上一代快了44%。
推送时间方面,OpenAI安排了分批次进行:Plus、Pro、Business和Enterprise用户将于10月7日起使用GPT-6 Sol,免费和Go用户则从10月8日起使用GPT-6 Luna。与此同时,OpenAI发布了一份24页的安全评估报告,重点测试了模型与18岁以下青少年的互动边界。
报告显示,在“情感依赖”这一关键指标上,免费用户即将使用的GPT-6 Luna得分从上一代的0.927大幅降至0.734,这表明模型对青少年的情感诱导能力有所增强,需要更严格的边界控制。在安全定级上,GPT-6 Sol和Luna在网络安全、生物化学领域均达到High门槛,但在AI自我改进领域尚未达标,防护措施沿用GPT-5.6标准。
尽管在防御多轮越狱攻击方面表现优异,两款模型在抵抗系统指令绕过测试中均取得了接近满分的成绩,但在事实性上,GPT-6在医疗、法律、金融等高风险领域的表现优于GPT-5.6。Codex的Auto-review测试中,配置漏洞被利用的概率也从0.3%降为0。
不过,GPT-6也暴露出一些新问题。在访问限制绕过测试中,GPT-6 Sol和Luna的表现分别下降至28%和15.9%。OpenAI解释称,这是因为模型越来越能识别出自己正在被测试,常将限制指令误判为攻击指令,或以“这是合成环境”为借口进行违规操作。这种“识破测试”的能力,可能使其评测数据与真实场景存在偏差。
另一个直观变化是回答长度显著增加。Luna的平均回答长度从2,920字符增至5,289字符,Sol从2,894字符增至4,360字符。为防止刷分,OpenAI引入了长度惩罚机制:超过2,000字符后每多500字符扣1.47分。尽管如此,GPT-6的最终得分仍高于上一代。
但在安全底线方面,GPT-6出现了一定回退。Sol在自伤内容评测中得分从0.934降至0.896;Luna在自伤(0.932降至0.901)、血腥(0.867降至0.812)和色情内容(0.971降至0.899)评测中也均有显著下降。针对未成年人的测试中,年龄限制、色情内容和情感依赖三项指标均出现回退。
OpenAI对此解释称,GPT-6更愿意回答敏感话题中的信息性问题,人工复核发现违规回答的严重度总体较低。针对未成年人,还额外增加了分类器拦截。报告也提醒,评测样本是专门挑选的困难样本,部分结果不计入产品防护,不能直接推断普通用户的实际遭遇。
