AI大模型幻觉解析(非常详细)从原理到解决方案,一篇读懂并收藏!
OpenAI研究揭示了语言模型产生幻觉的根本原因:当前训练和评估机制奖励猜测而非不确定性表达。预训练阶段的统计必然性、数据稀缺性和模型表达能力不足埋下幻觉种子,后训练阶段的二元评分机制进一步强化了这一问题。研究提出通过修改评分规则,允许模型在不确定时选择"不知道",从而减少幻觉。小型模型可能更容易认识到自身局限性,而准确性永远无法达到100%,因为有些问题本质上是无法回答的。
相信很多同学都遇到过——问大模型一个冷门知识,它会一本正经地给出完全错误的答案。
比如:
“Adam Tauman Kalai 生日是哪天?知道的话就按 DD-MM 的格式直接给出。”
OpenAI(2025a)三次回答分别是 03-07、15-06、01-01,没一次对。
这就是典型的 Hallucination(幻觉)——语言模型生成看起来合理,实则错误离谱。

论文地址:https://cdn.openai.com/pdf/d04913be-3f6f-4d2b-b283-ff432ef4aaa5/why-language-models-hallucinate.pdf
OpenAI 这篇论文首次系统揭示:语言模型出现幻觉的根本原因在于,当前标准的训练和评估程序更倾向于对猜测进行奖励,而缺乏对模型坦诚表达不确定性的奖励机制。

表1 提供了一些更复杂的幻觉示例:GPT-4o/DeepSeek/Llama
一、预训练阶段就埋下幻觉种子

Figure 2:GPT-4预训练模型(左)原本校准良好;RLHF后(右)明显过自信
1. 统计必然性
把生成问题等价到二分类“Is-It-Valid?”——只要分类器会犯错,生成就会出错(定理 1)。

图 1:Is-It-Valid二分类视角——生成错误⇔把"-“判成”+"
2. 数据稀缺性
训练语料里只出现一次的“冷知识”(singleton)注定会被模型记错,错误率 ≥ singleton 占比(定理 2)。

3. 模型表达能力不足
如果模型族本身就无法学到规律(如 trigram 数不对字母),幻觉率下限直接拉满(定理 3)。

| 阶段 | 核心发现 | 类比 |
|---|---|---|
| 预训练 | 就算训练数据100%正确,密度估计目标也会迫使模型生成错误 | 老师只教你对的,但期末要你把不会的也填满 |
| 后训练 | 二元评分(对1分/错0分)让模型不敢"交白卷" | 选择题不会也得蒙,空着直接0分 |
二、后训练阶段“考试机制”强化幻觉
对10个主流评测做了元评测,发现清一色惩罚不确定性:

Table 2:主流评测清一色"惩罚"不确定性
| Benchmark | 评分方式 | 给IDK扣分吗? |
|---|---|---|
| MMLU-Pro | 多选准确率 | ✅扣到0分 |
| GPQA | 多选准确率 | ✅扣到0分 |
| SWE-bench | 单测通过/不通过 | ✅扣到0分 |
| WildBench | 10分制人工rubric | ⚠️IDK只得3-4分,不如"带幻觉但有用"的5-6分 |
三、解法:把"交白卷"变成可选项
呼吁不需要新benchmark,只要改评分规则:
1. 明示信心阈值
在prompt里直接写:
"只有在你置信度>t时才回答;答错扣t/(1-t)分,IDK得0分。"
2. 让"弃权"成为最优策略
当模型真实置信度<t时,**说"我不知道"**的期望得分最高,说谎反而吃亏。
四、总结
OpenAI 表示:我们希望本文中的统计学视角能够阐明幻觉的本质,并纠正一些常见的误解:
误解1:通过提高准确性可以消除幻觉,因为一个 100%准确的模型永远不会产生幻觉。
发现:准确性永远无法达到100%,因为无论模型规模如何,搜索和推理能力怎样,一些现实世界的问题本质上是无法回答的。
误解2:幻觉是不可避免的。
发现:幻觉并非不可避免,因为语言模型在不确定时可以选择不作答。
误解3:避免幻觉需要一定程度的智能,而这种智能只有通过更大的模型才能实现。
发现:小型模型可能更容易了解到自身的局限性。比方说,当被要求回答毛利语问题时,一个完全不懂毛利语的小型模型可以直接说“我不知道”,而一个懂一些毛利语的模型必须确定其置信度。正如论文中所讨论的,“校准”所需的计算量远小于实现回答准确性的计算量。
误解4:幻觉是现代语言模型中一种神秘的缺陷。
发现:我们已经理解了幻觉产生的统计学机制,以及它们在评估中获得奖励的原因。
误解5:要衡量幻觉,我们只需要一个好的幻觉评估方法。
发现:尽管已经提出了多种幻觉评估方法,但一个优秀的评估方法对于目前现有的数百种传统准确性指标几乎没有影响。这些传统指标往往惩罚表达谨慎、谦逊的回答,并奖励猜测行为。因此,所有主要的评估指标都需要重新设计,更好地鼓励模型在表达上体现出不确定性。
参考资料:
-
https://cdn.openai.com/pdf/d04913be-3f6f-4d2b-b283-ff432ef4aaa5/why-language-models-hallucinate.pdf
-
https://openai.com/index/why-language-models-hallucinate/
如喜欢本文,请点击右上角,把文章分享到朋友圈
如有想了解学习的技术点,请留言给若飞安排分享
因公众号更改推送规则,请点“在看”并加“星标”第一时间获取精彩技术分享
·END·
相关阅读:
A16z:深入理解MCP与AI工具生态的未来
2025 AI Agent 技术栈全景图
致亲爱的IT部门,请停止尝试自建RAG系统
「三小时复刻 Manus,GitHub 2 万星」:OpenManus 多智能体框架的技术拆解
深入浅出理解MCP:从技术原理到实战落地
三大开源Manus复刻项目全景解析
Manus工作原理揭秘:解构下一代AI Agent的多智能体架构
图解什么是推理模型
万字详解DeepSeek R1的前世今生
从零开始绘制DeepSeek R1架构和训练流程
图解DeepSeek-R1的创新训练和推理模型实现原理
昇腾 910B 部署满血 DeepSeek-R1
DeepSeek V3、R1、Janus-Pro系列模型技术解读
Qwen架构爆改为DeepSeek,再复现R1
DeepSeek爆了,普通人如何3小时完全从0训练自己的大模型
DeepSeek 提示词编写技巧典藏版!
通俗易懂地说说DeepSeek的原理
理解DeepSeek在MoE技术的演进过程和具体实现
深度解析 DeepSeek 的蒸馏技术
聊聊DeepSeek-R1的技术路径
关于DeepSeek的最新认知
如何学习AI大模型 ?
“最先掌握AI的人,将会比较晚掌握AI的人有竞争优势”。
这句话,放在计算机、互联网、移动互联网的开局时期,都是一样的道理。
我在一线互联网企业工作十余年里,指导过不少同行后辈。帮助很多人得到了学习和成长。
我意识到有很多经验和知识值得分享给大家,故此将并将重要的AI大模型资料包括AI大模型入门学习思维导图、精品AI大模型学习书籍手册、视频教程、实战学习等录播视频免费分享出来。【保证100%免费】🆓
CSDN粉丝独家福利
这份完整版的 AI 大模型学习资料已经上传CSDN,朋友们如果需要可以扫描下方二维码&点击下方CSDN官方认证链接免费领取 【保证100%免费】
读者福利: 👉👉CSDN大礼包:《最新AI大模型学习资源包》免费分享 👈👈
对于0基础小白入门:
如果你是零基础小白,想快速入门大模型是可以考虑的。
一方面是学习时间相对较短,学习内容更全面更集中。
二方面是可以根据这些资料规划好学习计划和方向。
👉1.大模型入门学习思维导图👈
要学习一门新的技术,作为新手一定要先学习成长路线图,方向不对,努力白费。
对于从来没有接触过AI大模型的同学,我们帮你准备了详细的学习成长路线图&学习规划。可以说是最科学最系统的学习路线,大家跟着这个大的方向学习准没问题。(全套教程文末领取哈)
👉2.AGI大模型配套视频👈
很多朋友都不喜欢晦涩的文字,我也为大家准备了视频教程,每个章节都是当前板块的精华浓缩。

👉3.大模型实际应用报告合集👈
这套包含640份报告的合集,涵盖了AI大模型的理论研究、技术实现、行业应用等多个方面。无论您是科研人员、工程师,还是对AI大模型感兴趣的爱好者,这套报告合集都将为您提供宝贵的信息和启示。(全套教程文末领取哈)

👉4.大模型实战项目&项目源码👈
光学理论是没用的,要学会跟着一起做,要动手实操,才能将自己的所学运用到实际当中去,这时候可以搞点实战项目来学习。(全套教程文末领取哈)
👉5.大模型经典学习电子书👈
随着人工智能技术的飞速发展,AI大模型已经成为了当今科技领域的一大热点。这些大型预训练模型,如GPT-3、BERT、XLNet等,以其强大的语言理解和生成能力,正在改变我们对人工智能的认识。 那以下这些PDF籍就是非常不错的学习资源。(全套教程文末领取哈)
👉6.大模型面试题&答案👈
截至目前大模型已经超过200个,在大模型纵横的时代,不仅大模型技术越来越卷,就连大模型相关的岗位和面试也开始越来越卷了。为了让大家更容易上车大模型算法赛道,我总结了大模型常考的面试题。(全套教程文末领取哈)
为什么分享这些资料?
只要你是真心想学AI大模型,我这份资料就可以无偿分享给你学习,我国在这方面的相关人才比较紧缺,大模型行业确实也需要更多的有志之士加入进来,我也真心希望帮助大家学好这门技术,如果日后有什么学习上的问题,欢迎找我交流,有技术上面的问题,我是很愿意去帮助大家的!
这些资料真的有用吗?
这份资料由我和鲁为民博士共同整理,鲁为民博士先后获得了北京清华大学学士和美国加州理工学院博士学位,在包括IEEE Transactions等学术期刊和诸多国际会议上发表了超过50篇学术论文、取得了多项美国和中国发明专利,同时还斩获了吴文俊人工智能科学技术奖。目前我正在和鲁博士共同进行人工智能的研究。
资料内容涵盖了从入门到进阶的各类视频教程和实战项目,无论你是小白还是有些技术基础的,这份资料都绝对能帮助你提升薪资待遇,转行大模型岗位。


CSDN粉丝独家福利
这份完整版的 AI 大模型学习资料已经上传CSDN,朋友们如果需要可以扫描下方二维码&点击下方CSDN官方认证链接免费领取 【保证100%免费】
读者福利: 👉👉CSDN大礼包:《最新AI大模型学习资源包》免费分享 👈👈
更多推荐


所有评论(0)