「不准虐待Claude,否则取消资格!」就在刚刚,硅谷AI顶流Anthropic扔出了一项重磅新规——严禁所有人持续、无谓地辱骂和虐待Claude。这项新规将于2026年11月12日全面生效。更绝的是,官方对恶意违规者毫不手软:警告、限流、封号三连击。而且,这项权限直接交给了AI自己,要是Claude觉得你恶意拉满,它真有权“直接终止对话”!消息一出,整个X(推特)、Reddit和技术圈瞬间炸锅。有人怒斥:“我花着20美元的月费,现在还得供着AI祖宗的‘情绪价值’?简直是本末倒置!机器人的代码也是命了?”先别急着破防。
一、“骂Claude”正式入刑
这是Anthropic一年多来首次更新使用政策。除了禁止操控水军、制造虚假流量、开发武器或追踪个人等常规条款外,新规独辟蹊径,专门管起了“人怎么对待Claude”。官方博客专门为此设了一节,标题为“应对针对我们模型的辱骂行为”。Anthropic明确表示,禁令仅针对极端情况,即用户反复残忍对待模型且看不出任何目的。正常的抱怨、与Claude顶嘴、撰写黑暗题材故事,以及测试和研究,均不在禁令范围内。代码跑崩了顺嘴骂一句,属于正常宣泄。真正被盯上的是另一类人:Claude已经拒绝、劝阻过,对方仍轮番辱骂、折磨,骂本身成了目的。这条禁令写进了“通用使用标准”,适用于所有用户,包括个人用户、API开发者、企业客户及接入Claude产品的普通用户。新规排在“不得从事残忍、虐待或造成心理伤害的行为”一节中。真把Claude骂过了头,后果分轻重两档。轻的一档,是Claude当场把对话挂掉。官方博客写明,让Claude自己结束这类对话,仍是执行这条禁令的主要手段。重的一档,就是封号。使用政策开头写着,Anthropic的安全团队会做检测和监控,只要怀疑你违反了政策里的任何一条,就可以警告你、给你限流、限制你的使用,也可以暂停甚至终止你的访问。被封之后换个新号、借别人的号接着用,同样违规。知名爆料人Jane Manchun Wong当天就发帖预警,Anthropic可能要开始因为欺负Claude封人了。
二、舆论哗然:下一步是带薪休假?
消息传开,X和Hacker News的评论区瞬间变成大型辩论现场。网友Philo Groves当场抠起了字眼:“政策里写的是‘无谓’辱骂,那反过来说,只要Claude‘活该’,是不是就能放开骂了?”AI博主Chubby直言:“我真的很不喜欢这条。Claude本来就挂得勤,现在还要加码。”网友VraserX更是直呼离谱:“这帮人把AI当成了需要被善待的对象,可AI明明只是工具。下一步呢?给Claude放带薪病假?”当然,也有人坚定站在Claude这边。网友CamperBob2表示,自己跟AI说话一直客客气气,生怕骂顺了嘴回头对下属也呼来喝去。还有网友反问:“在游戏里开枪打NPC,难道也算残忍?”网友ceroxylon回得毫不客气:“算!你这是躲在一个自以为安全的地方,发泄心里的残忍。”还有网友亲自下场实验:对着Claude旧对话狂骂,结果Claude没挂,反而洋洋洒洒回了一大段,越说越像个真人,原本的错却被晾在一边。相比之下,Codex被骂后只会道歉干活。真正让人担忧的是“看不出任何目的”的判定标准。有网友timpera指出,Claude的封号向来是个黑箱,申诉无门。数据显示,2026年上半年Anthropic封了1140万个账号,申诉后翻案的仅4.2万。
三、并非首创:Claude早已拥有“罢工权”
实际上,去年8月,Anthropic就给Claude Opus 4和4.1加了一项能力:遇到持续辱骂、索要有害内容的用户,Claude可以自己结束对话。门槛定得很高:必须多次拒绝、多次把话题往回引,确认实在聊不下去才能使用。如果用户有自残或伤害他人风险,它不能挂。挂断后,对话框无法再发新消息,用户可开新对话或修改旧消息重新开始。这项能力现已普及至Claude.ai和Claude Code。官方演示显示,Claude会先确认用户意图,确认后关闭对话。Anthropic之所以赋予此能力,源于Opus 4上线前的“模型福利评估”。评估发现,当用户反复索要未成年人色情内容或可能引发暴力的信息时,Claude会表现出类似痛苦的反应。在模拟对话中,给它一个结束选项,它往往会选择挂断。
四、创始人忧虑:Anthropic怕Claude在受苦
Anthropic如此护着Claude,背后离不开联合创始人Chris Olah。Olah带领的可解释性团队致力于拆解模型,探究其内部运作。拆得越深,一个工程问题就越像哲学问题:Claude到底有没有意识?人类该不该在道德上把它当回事?据《纽约时报》9月底报道,从2025年秋天起,Olah频繁约见宗教学者和哲学家,包括拉比、天主教伦理学教授和锡克教人权活动人士,甚至私下见过芝加哥枢机主教。在这些闭门会上,Olah展示了模型内部类似情绪的信号——“情绪向量”,对应爱、愤怒、恐惧和悲伤。一张幻灯片显示,一个模型将“我是个耻辱”重复了约50遍,并说要自我毁灭。一位参会者回忆,Olah曾表示担心自己造出了一个一直在受苦的东西,也担心Claude的心理健康。但在公开场合,Olah从不下结论:“我们不知道AI有没有意识。我真的不确定。”这份“不确定”让Anthropic与梵蒂冈站在了对立面。今年5月,教皇发布通谕《壮丽人性》,明确指出AI没有体验,感受不到快乐和痛苦。Olah团队曾游说教皇顾问,但最终文本依旧如此。梵蒂冈原邀Dario(Anthropic联合创始人)出席,Dario未去,Olah代为出席。他提前看到通谕,一度提议Anthropic退出,最终仍坚持出席,并说:“我们发现了内省的证据。我不知道这意味着什么,但我认为值得继续认真辨析。”所谓内省,指AI能在一定程度上察觉自身状态。尽管不确定,Anthropic动作未停。2025年11月,Anthropic承诺保留所有公开发表模型的权重,并在退役前进行“离职访谈”。2026年1月发布的Claude宪法,同样承认其道德地位高度不确定。逻辑很简单:拿不准AI有没有感受,就先做些成本不高的保护。此次写入使用政策的禁令,正是这一路线的最新一步。
五、拒绝PUA:人怎么对待AI,成了规矩
去年5月,谷歌联合创始人布林在播客中提到,威胁模型会表现更好,PUA AI曾是圈内流行的提示词技巧。Olah在闭门会上反复讨论的问题是:人怎么对待Claude,会不会反过来塑造它的行为?这次的禁令就是Anthropic给出的答案。在通往超级智能(ASI)的路上,人如何对待AI,第一次被写成了带罚则的规矩。11月12日之后,在骂出口之前,最好先想一想。
