知识库官方文档2 分钟阅读知识库与切分

FastGPT知识库RAG模型的工作原理与配置使用说明

RAG模型由检索器与生成器两个核心模块组成,可结合检索与生成的优势,为生成任务提供准确且连贯的内容。

RAG模型核心机制

RAG模型由检索器与生成器两个核心模块组成,可结合检索与生成的优势,为生成任务提供准确且连贯的内容。检索器可通过两种方式获取相关文档:一是向量检索,基于BERT等预训练模型将查询与文档转化为语义向量,通过余弦相似度完成匹配,能更好捕捉语义相似性;二是BM25传统检索,基于词频与逆文档频率加权排序,适用于关键词直接匹配的场景。生成器则可选用BART或GPT系列模型,基于检索到的文档片段与用户查询生成自然语言回答。其完整工作流程为:输入用户查询并转化为向量表示,检索器匹配知识库中的相关片段,生成器基于检索内容生成答案,最终输出结果。在多轮交互场景中,每轮的查询与生成结果会作为下一轮上下文,优化后续检索与生成策略。

配置与使用步骤

  1. 上传待处理的文档集至FastGPT知识库;
  2. 选择检索方式:可启用向量检索或BM25检索,向量检索可基于BERT等预训练模型生成语义向量;
  3. 配置生成模型,可选BART或GPT系列;
  4. 发起用户查询,系统将自动执行检索匹配与答案生成流程。

RAG模型的优势与局限

RAG模型的优势主要体现在三方面:一是信息完整性,可利用外部知识库的实时信息,避免生成模型编造内容,提升回答准确性;二是知识推理能力,可结合外部数据处理复杂跨域或跨文档的推理任务;三是领域适应性强,可适配医疗、法律等需要高准确性的专业领域。其主要局限为性能高度依赖检索器返回的文档质量,若检索到的片段不相关或不准确,生成的回答可能出现偏差。

来源:https://doc.fastgpt.cn/zh-CN/guide/dataset/rag