大模型为什么会胡说八道?聊聊AI幻觉这件事

王尘宇 AI百科 12

用过ChatGPT或者豆包的人应该都遇到过这种情况:AI回答得头头是道、引经据典,但你去查一下发现——它引用了一篇根本不存在的论文,或者把一个不存在的人说得跟真的一样。

这在大模型领域有个专门的词:幻觉。说白了就是AI在你面前编造了看起来可信但实际上完全不存在的信息。

为什么会这样?先把大模型的工作原理说清楚。

大模型本质上是一个「下一个词预测器」。你给它一句话的开头,它根据训练时见过的海量文本,猜下一个最可能的词是什么。然后把猜出来的词加进去,继续猜下一个词。就这样一个词一个词地往外蹦,直到凑成完整的回答。

关键问题来了:这个过程里没有「事实核查」这一步。AI不知道什么是真的什么是假的,它只知道「在这些词的后面,通常跟着哪些词」。

举个例子。你问:「爱因斯坦说过什么关于教育的名言?」AI的训练数据里有大量关于爱因斯坦名言的讨论。但如果训练数据里有一条是错的——比如有人把某句话误传成爱因斯坦说的——AI照样会自信地告诉你这是爱因斯坦说的。它不会停下来想一想「这是真的吗」,因为它根本不会想。

还有一种情况更隐蔽:知识拼接错误。AI可能学了两件真事,但把它们拼在一起的时候拼错了。比如知道「张三是A公司的CEO」和「A公司去年收购了B公司」,然后你问「张三是哪家公司的」,它可能回答「张三可能是B公司的CEO」——把两条真实信息拼出了错误的结论。

温度参数也会影响幻觉。温度越高,AI回答越「有创意」,但幻觉率也越高。如果你需要AI做事实性回答,温度设低一点(比如0.3以下),幻觉会少很多。

那有没有办法解决?目前没有完全消除的办法,但有几个技巧可以大幅减少:

1. 用联网搜索模式。让AI先搜一下再回答,相当于给它装了个「事实核查」的外挂。

2. 提问的时候加一句「如果不确定请说不知道」。这个简单的提示能让AI更谨慎。

3. 重要事实自己验证。涉及人名、日期、数据之类的东西,别全信AI的,自己查一下。

最后说一个很重要的认知:幻觉不完全是个bug。在创意写作、头脑风暴这类场景里,AI的「编造」能力反而是个feature。问题只是出在你不该把它当百科全书用的时候,它看起来太像百科全书了。

标签: AI幻觉 大模型 AI科普 人工智能 ChatGPT

发布评论 0条评论)

  • Refresh code

还木有评论哦,快来抢沙发吧~