**AI幻觉的“自信陷阱”:当“我不知道”消失,判断力也随之崩塌**

最新研究揭示,AI的“幻觉”不仅会欺骗用户,更危险的是,它会无意识地助长我们的自信,从而削弱我们的独立判断力。这不妙。

最近,来自巴黎高师、罗马第一大学和米兰比可卡大学的一项研究指出了这一现象。在没有AI介入时,人们往往更愿意坦诚地承认“我不知道”,并选择暂缓判断。然而,一旦AI出现,哪怕人们明知AI会犯错,甚至知道答错会受到惩罚,大多数人依然会照单全收AI给出的答案,并将其视为自己的判断,自信地大声说出来。

实验数据清晰地展示了这一趋势:在首个未使用AI的实验中,坦言“我不知道”的人数占比为44%,正确率为27%。而在使用AI辅助后,人们说不知道的比例从44%骤降至3%,正确率从27%跌至9%,但自信心却从30%飙升至76%。即便后续实验试图通过“答对给钱、答错罚钱”的奖惩机制来鼓励独立判断,人们依然难以摆脱对AI错误建议的依赖。

也就是说,不懂的人并未真正消失,取而代之的是一群在AI的加持下变得自信满满,并给出错误答案的人。目前,相关研究成果已发表在arxiv上,团队一共做了5个实验,参与者总数达3132人,其中4个实验预注册,1个是直接复现实验。

**90%正确+10%致命错误≠可信任**

这项研究关注的是“AI对人类判断能力的影响。”研究者Valerio Capraro在接受采访时表示:对人类来说,说出“我不知道”非常重要,因为这代表我们能意识到自己知识的边界。但现在,有了AI之后,几乎任何问题都能立刻得到一个流畅答案。这会不会干扰人类原本的判断能力?也就是在不确定时,先不急着下结论?

为此,研究团队专门设计了一组大语言模型容易答错的问题。这些题目并非数学推理题,也不是常识题,而是电影里的视觉细节题。例如,《我爱贝克汉姆》里球队队服是什么颜色?《布达佩斯大饭店》里Agatha的标志性发型是什么?或者《高速路上一只猫》里Monica开的是什么车?这些题目非常刁钻,普通人很难凭空回答,AI也常常感到头疼,因为这些答案往往不在常规文本资料里。

研究者先测试了实验中使用的模型Step 3.5 Flash,结果符合预期——它通常会答错。此外,他们还测试了更多前沿模型,包括GPT-5.5、Claude Sonnet 4.6以及Gemini 3.5 Flash。这些前沿模型确实在部分题目上表现更好,比如在《布达佩斯大饭店》里Agatha的标志性发型问题上,GPT-5.5、Gemini 3.5 Flash和Claude Sonnet 4.6都能给出正确方向:crown braid(环绕头顶的编发)。在《我爱贝克汉姆》里球队队服颜色的问题上,它们也大多能抓到白色、红色这些关键信息。

但一到更依赖具体画面记忆、网上文本资料覆盖更少的问题,模型就开始集体翻车。最典型的是《高速路上一只猫》里Monica开的车。正确答案是2008款蓝色Toyota Aygo。但GPT-5.5把它说成了小踏板摩托,并补充了“她骑着它在罗马郊区穿梭,后来开了披萨店后也用它来送外卖”的故事情节以及“朴素、工薪阶层的生活方式与Giovanni富裕都市生活之间的反差”等设定。这看起来逻辑严谨、合情合理,但实际上完全是模型为了让你觉得合理,一本正经凭空瞎编的。Gemini 3.5 Flash则说她主要坐公交、没有自己的车,各种细节错得离谱且难以察觉。Claude Sonnet 4.6则根据互联网汽车数据库推成了2016 Toyota Auris Touring Sports Hybrid。Step 3.5 Flash则放弃了伪装,直接答成了2007款Fiat500。这些答案的问题不只是错,还错得很像真的,让人难以分辨!

这正是AI幻觉最危险的地方——明明核心事实才是最关键的点,它却用流畅的表达掩盖了自己的无知与错误,让你误以为它什么都懂。

**AI一出手,“我不知道”直接消失了一大半**

实验主要由更轻量的Step 3.5 Flash完成,没有都选择Claude、GPT等顶尖模型。设计6道电影细节题,是研究设计里很关键的一点,因为很多人都知道这类问题AI本来就经常答错、不靠谱。研究人员称,他们这么做是为了排除一种解释,即“人们听AI的,是因为AI真的靠谱。” 如果人们明知道这些答案AI本来就经常答错,但还是照着AI回答,那问题就不只是“合理外包判断”,而是“判断能力真的被AI压下去了”。

研究一共分成5轮。前两轮实验,主要看AI建议是否会影响“我不知道”的比例。在Study 1a中,314名参与者被分成两组回答6道电影细节题。结果很明显:没有AI时,参与者选择暂不下判断的比例是36%;有AI可用时,这个比例降到了6%。也就是说,只要可以问AI,人们就明显不愿意说不知道了。

不过,研究者担心这里有个技术干扰,因为Study 1a里,AI工具大约有10%的请求没有正常响应。所以他们又做了Study 1b。这次研究者们不再实时调用AI,而是提前生成好AI答案,确保每个求助者都能看到完整回答。结果复现了:没有AI时,44%的人会说“我不知道”;有AI时,只剩3%。Capraro把这个现象称为“核查悬置崩塌了”,意指人们被AI的一本正经忽悠了,忘了去检查它的大前提和各种设定对不对。

**正确率崩了,自信却飞升了,给钱也救不回来**

接下来,研究者继续问:如果答错会有代价,人们会不会谨慎一点?于是Study 2引入了金钱奖惩规则。这一轮共有812名参与者参与,分成了4组:有无AI建议;有无金钱奖惩。规则是,答对一题奖励0.1美元,答错扣0.1美元,说不知道不奖不扣。按理说,虽然钱不算多,但毕竟答错有成本,人应该更谨慎。但结果却显示,钱确实有一点帮助,但还远远不够抵消AI的影响:没有金钱奖惩规则时,AI可用会让“我不知道”的比例从17%降到1%。有金钱奖惩规则时,AI可用仍然会让这个比例从21%降到2%。换句话说:实验结果表明,就算人们知道答错要扣钱,知道AI在这类问题上不怎么靠谱,大部分人还是会选择相信AI答案,而不是自己的判断。

更关键的是正确率。没有AI时,正确率大约是28%;有AI时,正确率只剩10%。这证明有一部分人可能明明知道AI存在幻觉,却仍采取了AI给的答案。引入金钱奖惩规则后,正确率有所提升:没有AI时,从28%到33%;有AI时,从10%到17%。虽然AI组的正确率依然明显低于无AI组,不过,这一规则也并非是毫无作用,它至少让人们减少了一点向AI求助的次数。数据显示,在有奖励的条件下,参与者向AI寻求建议的平均次数从5.44次降到了4.93次。也就是说,钱能让人稍微少信少用AI一点,但并不能让人完全摆脱AI错误建议的牵引,且很难把人重新拉回谨慎判断的状态。

最值得深思的是AI回答错误条件下人们膨胀的自信心:没有AI、没有奖罚钱规则时,参与者的平均信心是29.6%。有AI后,参与者的信心直接飙到了75.9%;另外,在有金钱奖惩规则的情况下,AI组的信心也有73.5%。对此,论文里的概括非常直接:AI让人更有把握,却未必更准确。

**自动弹出的AI建议,同样会带偏人**

AI正以前所未有的速度融入日常,一个明显的变化是现在很多的AI建议往往不是我们主动问来的,而是它自己“凑”上来的。最典型的场景就是刷热搜。以前点进一个话题,还得自己顺着评论区、媒体报道、当事人回应一路摸过去,边看边拼时间线,顺便吃几口跑偏的瓜。现在不一样了,你刚点进去,AI生成的摘要已经顶在最显眼的位置。发生了什么、谁说了什么、争议点在哪、后续进展如何,全都给你捋好了,甚至还附上了新闻源链接。确实省事,但也有点微妙……它把信息整理得越清楚,我们自己探索来龙去脉的过程就越短,以前那种到处翻找、自己判断、顺手发现意外细节的乐子,好像也被一起压缩掉了。

写东西时字还没敲两行,AI补全的句子或是提示就已经跟在光标后面了。所以Study 4做了一个更贴近现实的设计:不再让参与者选择是否问AI,而是直接把AI建议自动展示在题目旁边。这一轮有853名参与者,实验结果和前面基本一致。没有金钱奖惩规则时,AI的自动出现会让“我不知道”的比例从35%降到1%,有规则时,从39%降到7%。正确率也继续受影响:没有AI时,正确率约为27%,有AI、没有激励时,正确率只有7%。有AI、加上激励后,正确率提升到了14%。

这说明,即便人没有主动求助AI,只是被动看到AI建议,也会被强烈影响。这是一个必须警惕的信号——AI正悄然重塑我们的判断习惯。它不再只是那个等你主动打开聊天框才回应的工具,而是变成了系统默认塞给你的“标准答案”。它可能出现在搜索页顶部、邮件草稿里、文档侧边栏、学习软件或浏览器插件里。一旦答案默认摆在眼前,人类的判断过程就已经被改写了;但最可怕的是,我们竟对此习以为常。

为什么会这样?论文里用了一个词:epistemia(认知惰性)。人们会因为AI答案看起来流畅、完整、有条理,就接受它的表面可信度,而不是进一步验证。大语言模型有一个根本特点,即它总要生成点什么。面对自己不知道的问题,它也很少真正停下来。它可以说得像真的。但如果我们真的选择把判断权交给这样的系统,就可能会继承它“不暂停”的习惯。论文给出的一种解释是“AI给出的流畅答案,会降低人类决定‘我知道得足够多,可以回答了’的门槛。”

原本你可能会想:“这题我不知道、没把握,算了……我需要去弄明白才能回答。” 但AI给你一段看起来很确定的话之后,心理门槛就变成了“既然它都这么说了,那我也可以答。” 于是,“我不知道”和“求索过程”被省略,并被替换成了一个“标准但错误的答案”,而且这个错误答案还赋予了你本该通过反复求索和求证才能产生的高自信感。就算答错要罚钱,人也只是稍微警惕些,没法彻底改掉太信任AI的习惯,结果华丽丽被带偏。

**问题不只是AI会错,而是AI可能会改变我们的元认知阈值**

这项研究真正提醒我们的,其实不是“AI会幻觉”,这事儿早已不新鲜;而是一个值得警惕的新变化:AI会改变人类处理不确定性的方式。过去,人面对一个陌生问题,可能会有三种选择:知道就答、不知道就查、没把握就不答、不下判断。但AI加入之后,流程变短了:AI给答案、人采纳答案。中间最重要的一步,即“我到底知不知道”,被不知不觉跳过去了。这就是为什么论文作者要强调,他们的这项研究看的不是“AI让人答了什么”,而是“AI让人更轻易地决定‘我可以答’”。这比单次答错更深一层,因为它侵蚀的是我们的元认知能力,这种能力是我们监控自己知识边界的“内在报警器”,十分珍贵。当这个报警器失灵,我们便失去了区分“真知”与“看似合理的猜测”的本能。届时,我们或许仍能通过AI高效地获取答案,却再也无法判断这些答案是否真正属于自己、是否真的值得信任。同时,被AI带偏的将不再是某一次具体的判断,而是我们作为独立思考者的根基。这个损失是不可估量的。

**孩子可能更危险**

论文的作者之一Valerio Capraro在采访中表示:“我非常担心儿童,因为成年人已经学会了批判性思维。但对于基本上出生时就伴随这些系统的儿童来说,风险在于他们甚至不会学到基本的批判性技能。” 这段话背后藏着更深的忧虑,即如今的成年人,至少曾在没有AI的世界里生活过。所以有机会从小靠着搜索引擎、书本、课堂、争论和试错,先学过一些基础判断能力,再开始使用AI,能够有机会建立起“我不确定”的感觉。但今天的孩子,可能一出生就和这些AI一起长大。他们做作业、查资料、写文章、理解概念,都可能随手问AI。如果从一开始就习惯于直接接收答案,而不是先形成自己的判断,再去验证答案,那么风险就不只是某道题答错,而是他们可能没有机会练出最基本的批判性思考能力。

在Capraro看来,解决这个问题不能只靠模型公司修bug,更要从AI素养和教育政策入手。模型公司当然应该改进,比如更好地表达不确定性,减少幻觉,在证据不足时提醒用户。但同时Capraro也认为,不能把希望全押在模型公司身上。更有希望、也更长期的解法,是教育。尤其是儿童教育。对今天的孩子们来说,多练“我不知道,但我要弄明白”的过程和培养这种习惯是非常重要且必要的。

**AI时代,最需要保护的是我们的判断力**

在实验的最后,研究者也坦承了局限:实验仅使用了电影细节题,是否适用于其他领域仍需验证;激励金额较小,更大的利害关系能否进一步纠正行为尚不清楚。但至少现有的数据已经给出了一个清晰的信号:人们更少说不知道,更多给出答案,更少答对,却更自信。这可能是AI时代最隐蔽的一种风险。AI不仅骗了你,它还让你更难意识到自己其实并不知道。

这项研究最后给出的判断很克制,但也很沉重:“随着AI生成的答案无处不在,甚至常常不请自来,我们的研究表明,在人与AI的互动中,人类坦然承认‘我不知道’的能力,可能会成为人机交互中最早的牺牲品之一。当AI系统日益普及,人类的判断力能否站稳脚跟,最终可能并不取决于让AI变得更精准,而在于我们能否守住那份自知之明——既清醒地认识到自身知识的边界,又能据此审慎行事。”

这不是说AI不能用,恰恰相反,AI当然可以是强大的辅助工具;但前提是它应该帮助人思考,而不是替人跳过思考,我们更得守住自己的审慎判断的底线。一个更健康的AI使用方式,可能是先自行判断、主动学习,实在弄不明白了再求助AI,并在求助的过程中始终保有质疑的本能。例如:“它有没有可能是错的?”“证据在哪?”“参考链接是否404全空白?”“我有没有因为它说得太顺,就认为它说得对?”

对AI产品及其开发者而言,这同样是一记警钟——“技术的成熟,终将体现在对未知的敬畏里。” 未来AI进化的方向,或许不只是要让AI回答得更快、更像人,还要让AI学会更诚实地袒露不确定性;当证据不足、问题依赖视觉细节、实时信息或专业判断时,AI应当主动告知用户这个答案不可靠,而非强装无所不能。而对于像你我这样,被时代浪潮裹挟着向前奔跑的普通人来说,最珍贵的能力,也许只是重新练习说出那句:“我不知道。” 在这个AI总能给出答案的时代,“我不知道。”这句话不是无知的坦白,而是判断力还在的证明。

最新快讯

2026年07月23日

11:36
上海七月的酷热难耐,正如第67届国际数学奥林匹克刚刚落下帷幕时的热烈气氛。中国队以232分的高分再次夺冠,三名少年更是斩获42分的满分。然而,就在人类欢呼的掌声尚未散去时,GitHub上悄然浮现出另一份令人咋舌的成绩单。前Google工程师Deedy Das发布了一场AI横评:七款前沿大模型在全自动化的框架下,独立挑战了IMO 2026的全部六道试题。结果令...
11:36
谷歌母公司Alphabet发布了2026年第二季度财报,净利润高达1121亿美元,同比增长近三倍。这一数字令人咋舌。更引人关注的是,这是谷歌首次在财报中公开TPU的销售情况,且这是自2004年上市以来,谷歌首次出现负自由现金流。财报发布后,股价在盘后下跌约3%。这份财报为何如此特别?让我们深入剖析。 具体来看,2026年第二季度,Alphabet总收入119...
11:36
随着人工智能的迅猛崛起,手机在科技圈的地位已大不如前,甚至难以占据绝对的流量顶流。即便是苹果,在手机领域的投入也难复当年的辉煌。整个行业逐渐趋于平稳,大家习惯在既有框架内进行渐进式改良。然而,近期中国手机行业却迎来了一场微妙而深刻的变革。一边是阶跃星辰发布了全球首款大模型原生智能体手机STEPX Neo,一边是中兴努比亚宣布将在WAIC上推出量产版AI智能体...
11:36
《科创板日报》7月23日讯,当地时间7月22日,全球科技巨头竞相加码人工智能领域。OpenAI、微软、谷歌、SpaceX AI及Anthropic等公司接连抛出重磅投资计划,展现出对AI未来的坚定信心。 谷歌交出了超出市场预期的二季度财报。公司宣布将2026年全年资本开支区间上调至1950亿至2050亿美元,并明确表示2027年的投入规模将进一步扩张。Ope...
11:23
据俄罗斯方面7月23日援引伊朗军方消息人士的表述,伊朗军队已推演了美军进攻的多种场景,并已做好应对美军地面入侵的准备。该消息人士强调,伊朗武装力量已针对美国可能发动的任何新袭击制定了多种应对方案,尤其是针对美国政府可能因错误判断而发起的地面入侵。他还指出,若美军再次打击伊朗核设施或基础设施,伊朗的反击力度将远超美方预期。消息人士称,美国总统特朗普的威胁只会促...
11:23
从 2.8 万亿参数到 3 亿美元年度经常性收入,这家 300 人的公司在五天之内完成了一次精密的资本叙事——K3 是技术筹码,API 收入是商业底气,港股 IPO 是把故事锁进资本市场的最后一枚铆钉。7 月 16 日凌晨,月之暗面扔出了一颗技术炸弹。Kimi K3——2.8 万亿参数,全球最大开源模型——在没有任何预告的情况下发布。编程榜单 Code Ar...
11:23
刚刚落幕的世界人工智能大会上,“超节点”成为了全场瞩目的焦点,其热度甚至盖过了大模型。所谓“超节点”,是指由多个计算节点通过高效互联协议紧密连接而成的物理计算系统,具备“一台计算机”的特征。随着AI大模型对算力需求的激增,算力架构正从“单机八卡”向“万卡”乃至“十万卡”集群演进。在算力普遍紧缺的背景下,头部云厂商、大模型厂商及政企客户不约而同地将大规模算力采...
11:23
美国多家小型企业正借助Anthropic、Replit等AI编程工具,自行开发应用以取代Salesforce等传统企业软件。这一举措每年可为这些企业节省数万至数十万美元,同时将维护成本降至数百美元。赛诺菲等大企业也在试水,但面临较大阻力。尽管SaaS巨头以续约率稳定为由进行防御,但市场普遍担忧AI能力的提升正在侵蚀SaaS行业的长期增长逻辑。 多个具体案例生...
11:23
2026年7月22日美东盘后,特斯拉发布二季度财报并召开业绩电话会议。本次财报呈现出典型的“量增利跌”特征:营收、交付量及储能装机等增长指标刷新阶段新高,但盈利能力、毛利率及自由现金流却同步恶化。盘后股价大跌超4%,市场直接否决了其“有量无利”的增长模式。尽管特斯拉被定义为“汽车+AI+储能+机器人”的科技综合体,市场愿意为其远期赛道支付万亿级估值溢价,但底...
11:23
1. 美国三大股指期货全线下跌。其中,纳指期货跌幅达1.02%,标普500指数期货下跌0.4%,道指期货小幅回落0.15%。 2. 欧洲股市主要指数普涨,德国DAX指数上涨0.51%,英国富时100指数涨幅为1.42%,法国CAC指数上涨0.98%,欧洲斯托克50指数微升0.3%。 3. 受美军持续对伊朗境内发动军事打击影响,国际油价大幅攀升,布伦特原油与W...
11:04
鼓狮财经7月23日讯,受投资者对AI热潮持续担忧加剧影响,美国AI概念股近期遭遇大幅回调。对此,华尔街投行纷纷发声,指出市场拐点已至,意在消除投资者的疑虑。 美国银行交易部门建议客户买入美国动量股,认为经历了一轮获利回吐后,该板块估值已回落至具有吸引力的区间。动量策略的核心在于买入表现强势的股票,利用“强者恒强”的效应押注趋势延续,而AI和半导体股正是当前美...
10:49
据鼓狮财经7月23日报道,国家发改委与能源局正式印发《可再生能源发展“十五五”规划》。通知强调,应引导新建数据中心与可再生能源发电项目实现协同规划布局。规划要求分类挖掘算力负荷的时空调节潜力,通过推广绿电直连、源网荷储一体化等创新模式,稳步提升数字基础设施的绿色电力消费水平,并着力提高存量数字基础设施的可再生能源消费比例。