什么是RAG?

检索阶段:痛点和解决方案

痛点一:检索质量低

痛点二:覆盖范围不足

痛点三:情境调节困难

痛点四:有效内容划分

痛点五:高质量文本排名

痛点一:幻觉问题

痛点二:缺乏可解释性

痛点三:推理速度慢

痛点四:个性化落地难

痛点五:质量评估难

RAG 的评价指标

总结

References:

曾经参与过公司内部的RAG应用,写过一篇关于RAG的技术详情以及有哪些好用的技巧,这次专注于总结一下RAG的提升方法。

还是老样子,深入浅出希望给更多的人进行科普。

什么是RAG?

RAG简单来说就是给予LLM的一些增强

  • 引入新的信息,这些信息可能不在LLM中。
  • 使用RAG控制内容来减少幻觉(模型生成与现实不符的输出),这是RAG的一个常见用途。通常的用例是提供内容给模型,并指示它仅使用该内容来回答问题,不使用LLM自有的知识,以此限制回答来自特定的知识库,减少幻觉。

简单来说,RAG主要是由检索和生成两个阶段组成:

  • 检索阶段:在检索阶段,算法搜索并检索与用户提示或问题相关的信息片段。向量数据库中查找与Query相关的数据。
  • 生成阶段:大模型从增强提示及其训练数据的内部表示中提取信息,以在那一刻为用户量身定制引人入胜的答案。
    那么,基于RAG的提升方法也是从这两个极端来实现,接下来会用更简单通俗的方法讲解一下RAG存在的痛点和解决方法。
    检索阶段:痛点和解决方案

检索阶段:痛点和解决方案

痛点一:检索质量低

RAG 模型严重依赖于检索到的上下文文档的质量。如果检索器无法找到相关的事实段落,就会严重妨碍模型根据有用信息并产生准确、深入的响应的能力。
特别是现在,稀疏向量检索在语义匹配和检索高质量文档存在困难

解决方案

  • 增强目标域的相关性:通过监督训练信号或模型反馈来微调检索器。
  • 采用 DPR 或 ANCE 等模型的密集检索器模型,以获得更高的召回率和相关性。
  • 尝试使用多向量表示、近似最近邻搜索和最大内积搜索来不影响准确性的情况下提高检索速度。
  • 为了真实性,使用可信度指标检索权威、值得信赖的来源。

痛点二:覆盖范围不足

虽然外部知识对于高质量的 RAG 输出是必不可少的,但即使是最大的语料库也无法完全覆盖用户可能查询的实体和概念。如果无法访问全面的知识源,该模型就会返回对利基或新兴主题的无知、通用的响应。

解决方案

  • 通过集合不同来源的文档来扩展语料库,以增加覆盖的可能性。
  • 设计模块化架构以添加/更新知识源,而无需完全重新培训。
  • 增加实时检索来覆盖运行时候文档覆盖度

痛点三:情境调节困难

即使具有良好的检索能力,RAG 模型也常常难以正确地调节上下文文档并将外部知识合并到生成的文本中。如果没有有效的情境调节,就无法产生具体的、真实的反应。
解决方案

  • 通过专用的交叉注意力转换器层加强情境化
  • 具有自我监督目标的预训练语言模型,用于训练外部文本。
  • 使用更好的情感实体分析方法

痛点四:有效内容划分

对于新增加的文档而言,RAG模型确定所需要检索的内容并用于生成是十分困难的,特别是针对长内容的处理。这就需要针对新增加的信息进行清洗和划分。
解决方案

  • 更好的数据清洗方法,清理文档无效内容和隐私内容
  • 调整上下文数据分块大小,较小的块通常可以改善检索,但可能会导致生成过程缺乏周围的上下文

![外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传](https://img-home.csdnimg.cn/images/20230724024159.png?origin_url=.%2F(29%20%E5%B0%81%E7%A7%81%E4%BF%A1%20_%2087%20%E6%9D%A1%E6%B6%88%E6%81%AF&pos_id=img-0LWFE9DP-1758705273890) 在大模型应用中,如何提升RAG(检索增强生成)的能力? - 知乎_files/v2-56ea1796ae39679fcf68f9a06c1908c7_720w.webp)

痛点五:高质量文本排名

在检索源数据时候,需要有效的方法给检索的数据进行排名,找到最想相关的数据才能更好的得到内容。
解决方案

  • 将元数据添加到块中,使用他们来帮助处理结果,包括日期、标记等
  • 增加多样性和相关性来进行排序器
  • 重新排名是解决相似性和相关性之间差异问题的一种解决方案

![外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传](https://img-home.csdnimg.cn/images/20230724024159.png?origin_url=.%2F(29%20%E5%B0%81%E7%A7%81%E4%BF%A1%20_%2087%20%E6%9D%A1%E6%B6%88%E6%81%AF&pos_id=img-k9JHawH0-1758705273891) 在大模型应用中,如何提升RAG(检索增强生成)的能力? - 知乎_files/v2-573d69ba676c9f2ff5a24933acaef035_720w.webp)

RAG技术落地是目前行业内最普遍且容易推广的一种大模型技术落地案例了,在电商、法律、金融、教育甚至HR等行业都在逐步落地和推广。

如果想要了解大模型技术如何落地的话,想在未来快人一步的宝子们,不论前端、后端、算法还是产品经理,都别错过知乎知课堂的AI大模型进阶课✨。

课程由业内大佬亲授,高效提升学习效率;配套超全资料福利,覆盖大模型技术原理+应用落地实战,助你快速掌握前沿技术!

🔥技术岗高薪必学:AI大模型技术原理+应用开发+模型训练

¥0.00就业无忧

当然这是一门免费的公开课,让你与大模型开发的大佬亲自接触,了解真实的AI大模型应用开发,以及真实的业务落地思路以及解决方案。

如果你还没有赶上大模型的风口,还不过来与行业大牛进行交流一下么?

另外,如果还是0元,建议你赶紧冲,跟AI大牛手把手教学的机会太难得了!

最不可少的就是,添加助教小姐姐的微信,领取更详细的课程资源及案例剖析资料,让你随时随地都能回顾知识点。

![外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传](https://img-home.csdnimg.cn/images/20230724024159.png?origin_url=.%2F(29%20%E5%B0%81%E7%A7%81%E4%BF%A1%20_%2087%20%E6%9D%A1%E6%B6%88%E6%81%AF&pos_id=img-JrCXITsm-1758705273891) 在大模型应用中,如何提升RAG(检索增强生成)的能力? - 知乎_files/v2-1ddaa2a36d44e6b5bce33e6ff52a4886_720w.webp)

生成阶段: 痛点和解决方案

痛点一:幻觉问题

由于过度依赖语言模型先验,RAG 模型经常生成看似合理但完全错误或不忠实的语句,而没有在检索到的上下文中进行验证。
解决方案

  • 通过训练信号直接最小化产生幻觉文本的可能性。
  • 根据与上下文的不匹配自动检测制造。
  • 对检索到的文档使用可信度指标,以防止对不可靠来源的限制。
  • 通过将优化重点放在上下文基础上来削弱语言模型先验。

痛点二:缺乏可解释性

与传统的 QA 系统不同,RAG 模型无法了解生成文本背后的推理。模型的可解释性仍然是含蓄和不透明的,而不是明确的。
解决方案

  • 设计模型架构,以结构化链/图的形式明确跟踪证据和解释。
  • 实施辅助头来预测解释性证据,例如显着数据生成源的内容片段。
  • 在每个生成步骤附加有意义的上下文标签以跟踪来源。
  • 通过引用内容来源来生成描述推理的自然语言解释。
  • 总结查询和上下文之间证明响应合理性的关键语义联系。

痛点三:推理速度慢

检索与生成的耦合阻碍了 RAG 模型与标准语言模型的延迟匹配。推理管道缺乏对需要毫秒响应的实时应用程序的优化。
解决方案

  • 优化标记化、编码和检索推理,以最大程度地减少生成之前的开销。
  • 使用 NMSLIB、FAISSScaNN 等库采用高效的近似最近邻索引。
  • 利用模型并行性和批量检索+生成来提高管道效率。
  • 设计模型蒸馏方法,以最小的质量损失压缩检索器-生成器组合。
  • 尽可能将检索转移到离线状态,以避免运行时瓶颈。

痛点四:个性化落地难

在通用语料库上训练的 RAG 模型缺乏针对特定用户需求、上下文和查询生成响应的能力。如果没有个人理解,他们无法解决模棱两可的信息请求。
解决方案

  • 设计角色上下文记忆来跟踪对话中的用户配置文件和上下文。
  • 在匹配目标用户的标记查询->响应对上微调 RAG 模型。
  • 先前对话和用户反馈进行多任务训练。
  • 利用元学习开发少量的个性化技术。
  • 构建用户特定的扩展模块来补充检索语料库。

痛点五:质量评估难

可能的接地响应的多样性使得使用自动化指标可靠地评估 RAG 模型输出的正确性和质量变得具有挑战性。人类评估也缺乏可扩展性。这阻碍了迭代改进。
解决方案

  • 生成带有专家原理的带注释的测试集,以实现标准化评估。
  • 根据语义而不是 n 元语法重叠开发专门的指标。
  • 通过有针对性的自动评估,分别量化相关性、连贯性、一致性等关键轴。
  • 利用用户反馈信号作为个性化质量判断来设计在线学习方案。
  • 构建以注释而不是数字分数为中心的交互式评估界面。

RAG 的评价指标

在RAG架构中会存在一下评价指标

  1. **真实性:**判断生成内容是否与事实一致
  2. **答案相关性:**答案与提示的相关性
  3. **上下文精度:**检查相关块的排名是否较高。
  4. **上下文回忆:**比较真实情况与上下文,检查是否检索到所有相关信息
  5. **上下文实体召回:**评估检索到的上下文中存在的实体数量与真实值
  6. **上下文相关性:**检索到的上下文与提示的相关性
  7. **答案语义相似度:**生成的答案与实际答案在语义上的相似程度
  8. **答案正确性:**评估生成答案与实际答案的准确性和一致性

总结

RAG 是一种很有前途的提高 LLM 准确性和可靠性的方法,具有事实依据、减少偏见和降低维护成本等优点。虽然未知识别和检索优化等领域仍然存在挑战,但正在进行的研究正在突破 RAG 功能的界限,并为更值得信赖和信息丰富的LLM应用铺平道路。

零基础如何高效学习大模型?

为了帮助大家打破壁垒,快速了解大模型核心技术原理,学习相关大模型技术。从原理出发真正入局大模型。在这里我和MoPaaS魔泊云联合梳理打造了系统大模型学习脉络,这份 LLM大模型资料 分享出来:包括LLM大模型书籍、640套大模型行业报告、LLM大模型学习视频、LLM大模型学习路线、开源大模型学习教程等, 😝有需要的小伙伴,可以 扫描下方二维码免费领取🆓**⬇️⬇️⬇️

在这里插入图片描述

【大模型全套视频教程】

教程从当下的市场现状和趋势出发,分析各个岗位人才需求,带你充分了解自身情况,get 到适合自己的 AI 大模型入门学习路线。

从基础的 prompt 工程入手,逐步深入到 Agents,其中更是详细介绍了 LLM 最重要的编程框架 LangChain。最后把微调与预训练进行了对比介绍与分析。

同时课程详细介绍了AI大模型技能图谱知识树,规划属于你自己的大模型学习路线,并且专门提前收集了大家对大模型常见的疑问,集中解答所有疑惑!

在这里插入图片描述

深耕 AI 领域技术专家带你快速入门大模型

跟着行业技术专家免费学习的机会非常难得,相信跟着学习下来能够对大模型有更加深刻的认知和理解,也能真正利用起大模型,从而“弯道超车”,实现职业跃迁!

在这里插入图片描述

【精选AI大模型权威PDF书籍/教程】

精心筛选的经典与前沿并重的电子书和教程合集,包含《深度学习》等一百多本书籍和讲义精要等材料。绝对是深入理解理论、夯实基础的不二之选。

在这里插入图片描述

【AI 大模型面试题 】

除了 AI 入门课程,我还给大家准备了非常全面的**「AI 大模型面试题」,**包括字节、腾讯等一线大厂的 AI 岗面经分享、LLMs、Transformer、RAG 面试真题等,帮你在面试大模型工作中更快一步。

【大厂 AI 岗位面经分享(92份)】

图片

【AI 大模型面试真题(102 道)】

图片

【LLMs 面试真题(97 道)】

图片

【640套 AI 大模型行业研究报告】

在这里插入图片描述

【AI大模型完整版学习路线图(2025版)】

明确学习方向,2025年 AI 要学什么,这一张图就够了!

img

👇👇点击下方卡片链接免费领取全部内容👇👇

在这里插入图片描述

抓住AI浪潮,重塑职业未来!

科技行业正处于深刻变革之中。英特尔等巨头近期进行结构性调整,缩减部分传统岗位,同时AI相关技术岗位(尤其是大模型方向)需求激增,已成为不争的事实。具备相关技能的人才在就业市场上正变得炙手可热。

行业趋势洞察:

  • 转型加速: 传统IT岗位面临转型压力,拥抱AI技术成为关键。
  • 人才争夺战: 拥有3-5年经验、扎实AI技术功底真实项目经验的工程师,在头部大厂及明星AI企业中的薪资竞争力显著提升(部分核心岗位可达较高水平)。
  • 门槛提高: “具备AI项目实操经验”正迅速成为简历筛选的重要标准,预计未来1-2年将成为普遍门槛。

与其观望,不如行动!

面对变革,主动学习、提升技能才是应对之道。掌握AI大模型核心原理、主流应用技术与项目实战经验,是抓住时代机遇、实现职业跃迁的关键一步。

在这里插入图片描述

01 为什么分享这份学习资料?

当前,我国在AI大模型领域的高质量人才供给仍显不足,行业亟需更多有志于此的专业力量加入。

因此,我们决定将这份精心整理的AI大模型学习资料,无偿分享给每一位真心渴望进入这个领域、愿意投入学习的伙伴!

我们希望能为你的学习之路提供一份助力。如果在学习过程中遇到技术问题,也欢迎交流探讨,我们乐于分享所知。

*02 这份资料的价值在哪里?*

专业背书,系统构建:

  • 本资料由我与鲁为民博士共同整理。鲁博士拥有清华大学学士美国加州理工学院博士学位,在人工智能领域造诣深厚:

    • 在IEEE Transactions等顶级学术期刊及国际会议发表论文超过50篇
    • 拥有多项中美发明专利。
    • 荣获吴文俊人工智能科学技术奖(中国人工智能领域重要奖项)。
  • 目前,我有幸与鲁博士共同进行人工智能相关研究。

在这里插入图片描述

内容实用,循序渐进:

  • 资料体系化覆盖了从基础概念入门核心技术进阶的知识点。

  • 包含丰富的视频教程实战项目案例,强调动手实践能力。

  • 无论你是初探AI领域的新手,还是已有一定技术基础希望深入大模型的学习者,这份资料都能为你提供系统性的学习路径和宝贵的实践参考助力你提升技术能力,向大模型相关岗位转型发展

    在这里插入图片描述在这里插入图片描述在这里插入图片描述

抓住机遇,开启你的AI学习之旅!

在这里插入图片描述

Logo

码道开发者社区,聚焦华为云码道 CodeArts 代码智能体,沉淀 Agent、Skill、鸿蒙开发实战内容,供开发者查阅资料、交流技术、分享工程实践

更多推荐