返回报告库

AI / Technology

RAG让语言模型先查资料,再组织答案

关于这篇论文的三个关键问题

RAG:让语言模型先查资料,再组织答案 解决了什么问题?

纯参数语言模型像一个“闭卷答题者”:知识压在权重里,更新世界知识通常要继续训练,也很难指出某个答案来自哪段资料。2020 年已有 REALM、ORQA 等“先检索再处理”的系统,但主要探索开放域抽取式 问答——答案通常必须是检索文档中的原文片段。论文的问题是:能否保留预训练生成模型自由组织语言的能力,同时给它一个可检索的外部记忆,并把同一架构用于问答、生成和分类?[来源:§1;§5]

RAG:让语言模型先查资料,再组织答案 的核心结论有哪些证据?

生成质量的证据也不只来自自动指标。Jeopardy 问题生成的人评覆盖 452 对 输出:评价者认为 RAG 更事实正确的比例为 42.7%,BART 更好的比例为 7.1%;在具体性上,RAG 更好为 37.4%,BART 更好为 16.8%。不过“无多数意见”分别占 20.8% 和 20.1%,说明比较并非毫无歧义。[来源:§4.3;表 4]

阅读 RAG:让语言模型先查资料,再组织答案 时最需要注意什么局限?

最大的未解风险 是检索与生成之间没有事实保证:找错段落、资料缺失或资料过时,都会限制答案。论文使用单一 Wikipedia 快照,MS-MARCO 中一些问题本来就无法仅靠 Wikipedia 回答;而“更少幻觉”的结论主要来自特定任务与相对 BART 的实验,不能外推成 RAG 会消除幻觉。[来源:§3.2;§4.2;§6]

今天还可免费读 2 篇新报告订阅 Pro 后无限阅读,并获得每月 10 篇新论文生成额度。升级 Pro