现象
使用FastGPT v4.12.1私有部署版本,配置vllm部署Qwen3模型后,工具模型调用直接返回400错误,对话模型约70%的请求返回400错误,且模型服务本身运行正常。
可能原因
该问题暂无明确关联的已知原因,需结合实际部署环境的交互日志、参数配置等信息进行排查确认。
排查步骤
- 确认FastGPT中配置的vllm模型接口地址、密钥等参数是否正确无误。
- 查看FastGPT的后端日志,提取返回400错误的具体请求内容与响应信息。
- 直接调用vllm模型服务的接口,使用FastGPT生成的同款请求参数,验证是否会返回400错误。
- 核对Qwen3模型的官方接口要求,确认FastGPT发送的请求参数格式、字段是否符合规范。
解决与验证
根据排查得到的具体问题,调整FastGPT的模型请求参数,使其符合vllm部署的Qwen3模型的接口要求。调整完成后,重新发起工具模型调用与对话模型请求,验证400错误是否不再出现,且模型能正常返回响应结果。