现象
FastGPT 4.9.6私有部署版本中,知识库的混合检索与语义检索返回时间均超过30秒。向量模型使用阿里text-embedding-v2,单独响应时间约100ms。
可能原因
当前已知向量模型单独响应正常,但整体搜索耗时远超模型响应时长,且检索现象与配置关联度较低,具体原因需按实际环境确认。
排查步骤
- 确认当前FastGPT版本为4.9.6私有部署版本。
- 单独测试向量模型的响应时间,确认是否符合100ms左右的正常范围。
- 分别执行混合检索、语义检索测试,记录每次检索的返回耗时。
- 检查知识库相关配置参数,确认是否存在异常配置项。
- 查看系统运行日志,定位搜索流程中的耗时环节。
解决与验证
需结合排查步骤定位的具体耗时环节进行针对性调整。验证方式为重新执行知识库搜索操作,确认返回时间是否恢复至合理范围。
来源: FastGPT 官方来源
适用性与版本范围
本页适用于官方来源记录的 故障排查 场景。执行变更前,需核对 FastGPT、依赖、API 与部署版本。
安全护栏
凭证与私密数据使用 [REDACTED_CREDENTIAL] 占位符。执行操作前需核对文档的环境与版本。
回滚指引
恢复变更前的技术内容权威快照、已保存配置与数据快照,再执行最小验证场景。