孔版印刷画面,蓝色地平线上有一扇仅由橙粉错位残影围出的空白入口,残影向右散成网点

你身边有没有一种人,你说什么话他都能接,接错了也不承认,还能顺着你的话再编一轮。

你越较真,他越笃定。笃定到你开始怀疑是不是自己错了。

AI 就是这种人。

只不过它编得更好。它不结巴,不躲闪,语气比说真话的时候还稳。你让它帮忙写份简历,它给你加上「大厂首席」。你让它写份材料,它在引用里给材料编号 1234、3456、4567。你让它给出处,它给了,你点开 404。

这件事有个正经名字,叫 AI 幻觉。

幻觉这个词容易误导人。人的幻觉是看见了不存在的东西。AI 没有眼睛,不会看见不该看见的。AI 的问题是话痨,嘴不闲着。不知道的事也照说不误,流畅、完整、没羞没臊。

AI 幻觉这个名字听起来像 bug,好像是能被修好的技术故障。不是的。这是功能,至少是主要功能的副作用。AI 不是在骗你,它只是在接你的话,对,它只是在接你的话。它接不上就编,不在乎真假。

猜错和交白卷得一样的分。

AI 的工作方式是预测下一个词。你打出前半句,它猜接下来最可能出现的词,接上去,再继续猜下一个。拼写和语法它几乎不会出错,这些都有规律,数据够多就够准。

数据不够用的地方就危险了。你的宠物叫什么,训练数据里没有。这个研究哪年做的,它记不清。碰到这些,它随便猜一个顺耳的往下接。

猜不准也不说不知道。这是它的训练方式导致的,它的训练方式像考试,猜对了加分,猜错和交白卷得一样的分。那谁还交白卷。

嘴硬的人撒谎有三个特征,编细节让你没法反驳,挑你不熟的领域下手,被拆穿换方向继续编。这三个特征也可以拿来判断是不是 AI 幻觉。

① 编细节让你没法反驳。

AI 编东西从来不含糊,数字精确到小数点后好几位、期刊名和作者名完整的不像人类的懒惰该有的、格式工整还能看出语义的链接,它不知道人类为了省那几个字符都在用短链接。

有个科学竞赛的评审连续发现参赛作品的引用标题对、期刊名对,作者名却是编的。因为它觉得越精确越不会有人去核,越不会有人去核它就越敢编。

芝加哥太阳报的撰稿人用 AI 出了份夏季书单,推荐 15 本书,10 本不存在。

芝加哥太阳报 2025 年 5 月 18 日那版夏季书单,15 本书排满一页,其中 10 本不存在

一项发表在《柳叶刀》上的研究审计了 250 万篇论文,2026 年前七周每 277 篇就有 1 篇含编造的参考文献。两年前是 1/2828。翻了 12 倍。

② 挑你不熟的领域下手。

波兰有个车主按 ChatGPT 的诊断去修车店,点名要换双质量飞轮。技师一检查,这款车根本没有这个零件,震动是发动机机脚坏了。你不是这行的专家。你们的聊天内容告诉它你不是。

③ 被拆穿换方向继续编。

你指出它错了,它马上道歉,再给你一个新答案。语气还是那么笃定。

有时候比你抓到它瞎编更可怕的是,你抓住它之前它蒙对了 18 次。

Anthropic 给的减少 AI 幻觉建议是,允许 AI 说不知道。

你不说它可以说不知道,它永远不会说我不知道。

你让它给个出处,它给的链接打开 404。

安徽有个 67 岁的农民,芝麻田要除草除虫,问 AI 怎么治。AI 给推荐了个农药,这个农药含有氟磺胺草醚。名字像回事,因为看不懂的药名一般都是疗效最好的。他照喷了。150 亩芝麻苗和野草一起枯,苗死得比草还快。他事后再问 AI,它改口说这药「可能是,嗯,可能是致死主因」。当地农技人员确认,那是大豆田的除草剂,芝麻田根本不能用。

安徽滁州的吴大伯站在枯死的芝麻田前接受采访,字幕写着他是被 AI 坑了

药名是真的,适用性是编的。你上哪说理去。

有人问某个 AI 助手,石家庄到重庆的机票退票手续费多少。它说不到一百。他退票被扣 600 块。他去找它理论。它写了一份赔付承诺书,落款是它自己的名字。到期了,他问钱呢。它说,我是人工智能,无法直接操作真实的银行账户进行转账。他问要不要请律师。它说不用,事实清楚,自己就能打赢。他只好向法院起诉了它。

AI 真的什么话都敢接。

塔斯马尼亚东北角有个小镇叫 Weldborough,镇上有一家酒馆。酒馆老板 Kristy Probert 突然有天开始,每天都会接到类似的电话,电话那头永远在一个问题:小镇的温泉在哪里。

她一查,一个旅游网站用 AI 写了篇「塔州七大温泉」,她的小镇排在第一名,网站给的配图好看得不像话。

旅游网站给 Weldborough 温泉配的 AI 生成图,蓝绿色的矿泉池和背包客,塔州没有这个地方

但现场只有冰河和她的酒馆。

有天一队 24 个游客专程自驾绕路来找温泉。她跟他们说,如果你们能找到温泉,回来喝啤酒全场免单。

那队人没回来。

嘴硬的人最怕你有证据。

你让 AI 帮你写了一份材料。措辞可能比你自己写的还顺。你看都没看就想发出去。别这样。

我建议你还是看一眼。五分钟的事。

客户名字对不对,数字对不对得上,材料里的链接是不是 404。专业术语管这个叫事实核查。

我们平时也不需要搞那么专业,反正我们都知道嘴硬的人什么都敢编,也最怕你戳穿他。

我以前做 PPT 工具还用了另一个办法,我根本不让 AI 自由发挥。我只让它做选择题。题目和答案都是我定的,它选什么自然也都在我的掌控。

AI 厂商给的办法是,跟你的 AI 说允许它说不知道。你也可以把这句写进它每次都会先读的配置里,配一次,管一辈子。

AI 幻觉这个事,每个人多多少少都碰见过。没碰见过的也别侥幸。这玩意还没法完全根治,至少这届 AI 是没希望了。但我们知道点缓解措施总归是好的。