常见问题分类与说明
本文梳理FastGPT知识库的各类常见问题及基础说明:文件解析失败时,若未开启【PDF增强解析】,需在Admin后台正确配置OCR模块以启用增强解析;文件出现中文乱码,可将文件另存为UTF-8编码格式。Excel文件导入支持xlsx格式,不止支持CSV。Tokens计算统一按照gpt3.5标准执行。恢复重排模型需在config.json文件中配置后,才可在界面勾选使用。文件处理模型用于数据处理的【增强处理】和【问答拆分】,增强处理可生成相关问题和摘要,问答拆分可执行问答对生成;索引模型用于向量化,构建快速查询的数据结构。套餐到期后的数据保留规则为:免费版账号30天未登录将清空知识库,应用配置不受影响;付费套餐到期后自动切换为免费版。若出现知识库页面闪烁,需检查并补齐索引模型的配置。
回复长度限制调整方法
当出现知识库结果过多导致回答中断,或聊天记录触发上下文限制时,可参考统一的回复长度计算公式:最大回复=min(配置的最大回复(内置的限制),最大上下文(输入和输出的总和)- 历史记录)。以18K模型为例,其输入与输出的总长度存在上限,输出增多则可使用的输入空间会减小。调整方式包括:检查并调整配置的最大回复上限;减小历史记录(即对话聊天记录)以释放输入空间;私有化部署场景下,可在后台配置模型参数时预留上下文空间,例如将128000的模型上下文配置为120000,剩余空间可分配给输出内容。
可直接执行的配置步骤
- 解决PDF文件解析失败:若上传时未开启【PDF增强解析】,登录Admin后台完成OCR模块的正确配置,即可启用增强解析功能。
- 修复知识库页面闪烁:确认并补齐索引模型的配置项,即可恢复页面正常显示。
- 调整上下文预留空间(私有化部署):在后台模型参数配置页面,将128000的模型上下文配置值设为120000,预留剩余空间用于输出内容。
- 解决文件中文乱码:将出现乱码的文件另存为UTF-8编码格式后重新上传。
来源:https://doc.fastgpt.cn/zh-CN/guide/dataset/faq