现象
当前FastGPT未内置视频输入相关功能,用户无法上传视频文件至系统,也无法通过系统调用多模态视频分析模型完成视频内容理解与问答交互,无法满足上传视频后让AI总结内容、用于教育或内容审核等场景的需求。
可能原因
- FastGPT原生未集成视频输入处理的功能模块;
- 未完成支持视频分析的多模态模型的对接配置;
- 系统未开启视频文件上传的相关权限或存在格式、大小限制规则。
排查步骤
- 确认当前FastGPT版本是否具备视频输入功能的原生支持,需按实际环境确认;
- 检查是否已完成支持视频分析的多模态模型的对接配置;
- 查看系统是否配置了允许上传视频文件的相关规则,包括格式、大小等限制;
- 核对模型调用参数是否符合视频输入的相关要求,需按实际环境确认。
解决与验证
首先,若FastGPT原生未集成视频输入功能,需按实际环境确认是否存在官方提供的视频处理扩展模块或插件;其次,完成支持视频分析的多模态模型的对接配置,确保参数符合视频输入的调用要求;然后,开启系统对视频文件上传的权限,设置合理的视频格式与大小限制,具体参数需按实际环境确认。验证时,上传测试视频文件并发起针对视频内容的提问,例如"总结该视频的主要内容""视频中出现了哪些场景",确认系统可正常调用模型返回基于视频内容的分析结果。
来源:https://github.com/labring/FastGPT/issues/6521