现象
使用fastgpt-Milvus v4.8.20-fix2 docker compose部署版本的场景中,添加本地嵌入模型时,配置模型官方参数维度768、最大tokens 512。在知识库数据处理环节,选择自动设置分割和预处理规则时无法正常执行处理流程;选择自定义长度512时则可正常处理。当添加模型时最大上下文填入512时,自动处理无法触发,且自动处理流程似乎默认使用768作为长度基准,仅当导入模型的配置参数大于该数值时才可正常运行。填入官方指定参数时无报错信息,仅显示状态已就绪。
可能原因
自动分割预处理逻辑默认调用模型维度参数作为分割基准,未正确识别配置的最大上下文参数。当配置的最大上下文参数不大于模型维度时,自动处理流程无法正常执行,且未返回明确的错误提示。
排查步骤
- 确认当前FastGPT部署版本为fastgpt-Milvus v4.8.20-fix2,且使用docker compose方式部署。
- 记录本地嵌入模型的官方参数,包括模型维度与最大tokens数值。
- 进入目标知识库的数据处理配置页面,分别测试自动设置分割和预处理、自定义长度两种处理模式。
- 记录不同配置组合下的处理结果与系统状态提示。
解决与验证
- 调整本地嵌入模型的最大上下文配置参数,使其数值大于模型维度(需按实际模型参数确认调整后的数值)。
- 重新进入目标知识库的数据处理配置页面,选择自动设置分割和预处理规则,验证处理流程是否正常执行。
- 若需严格使用官方指定的最大tokens参数,可切换至自定义长度模式手动配置参数,确保数据处理正常完成。
来源: FastGPT 官方来源
适用性与版本范围
本页适用于官方来源记录的 故障排查 场景。执行变更前,需核对 FastGPT、依赖、API 与部署版本。
安全护栏
凭证与私密数据使用 [REDACTED_CREDENTIAL] 占位符。执行操作前需核对文档的环境与版本。
回滚指引
恢复变更前的技术内容权威快照、已保存配置与数据快照,再执行最小验证场景。