← 文章 / AI技术
和润科普 7小时前 · 2026-09-15 10:36:17 · 2 阅读

AI为什么会胡说?大模型「幻觉」的 3 个底层原因

上个月我让 AI 帮我查一个冷门法规的生效日期,它张口就来:「自 2023 年 5 月 1 日起施行。」语气笃定得像背过法条。我多问一句「依据哪一条」,它给我编了一串看起来极其正规的条款编号——可惜全是假的。

这就是大家说的「AI 幻觉」。今天不聊玄的,我把底层原因拆成 3 个,你听完就明白:为什么它越聪明越爱编,以及普通人该怎么防。

第一个坑:它根本不是在「查」,是在「猜」

大模型干活的本质,是「预测下一个词」。你输入一句话,它根据训练时见过的海量文本,算出「下一个最可能出现的词」是什么,一个一个接下去。

它不是数据库,没有「事实表」可查。你问「珠峰多高」,它不会去翻测量报告,而是从记忆里拼出「8848」这种高频表述。拼对了是撞上的,拼错了你也不一定看得出来。

第二个坑:它吃进去的「教材」本来就有错

训练数据来自整个互联网——论坛、营销稿、过时的百科、互相抄的公众号。同一件事网上能有一百种矛盾说法。模型全吃,却没有「真值裁判」帮它分辨哪个对。

所以你问它「XX 品牌是哪年成立的」,它把网上各种版本揉一块,给你一个「听起来最合理」的年份。记住:合理 ≠ 正确。

第三个坑:它被训练成「永远要接话」,不会说不知道

模型的目标是从头到尾流畅地生成。一旦学会说「我不知道」,对话就断了,评分就低。于是它宁可硬编,也不肯承认盲区。

这就是为什么它编起来源、文献、法条来面不改色——不是恶意,是「出厂设定」就是「必须往下说」。

普通人防幻觉,3 招够用

① 让它给出处:加一句「请附上信息来源链接」,真有依据才会露出来,编的当场露馅。
 ② 关键事实自己复核:日期、价格、法规、医疗建议,别直接信,去官网或权威渠道核对一遍。
 ③ 逼它诚实:加一句「请列出你不确定或可能出错的地方」,它会主动给自己打补丁。

最后说句反直觉的:幻觉不是 bug,是 feature。正因为它能「无中生有」,才会写诗、编故事、想创意。我们要的不是消灭幻觉,而是知道它什么时候在编、什么时候能信。

觉得有用?微信搜一搜「和润科普」关注我,更多硬核科普每周上新 👇

原始来源: 和润科普

评论 (0)