技术速查官方文档3 分钟阅读技术速查

使用Docker部署适配FastGPT所需的BGE重排序模型服务

可通过Docker快速部署适配FastGPT的BGE重排序模型服务,官方提供多个规格的镜像与标准部署配置。部署后可通过指定端口与安全凭证调用该服务。 1.

结论

可通过Docker快速部署适配FastGPT的BGE重排序模型服务,官方提供多个规格的镜像与标准部署配置。部署后可通过指定端口与安全凭证调用该服务。

具体怎么做

  1. 选择对应镜像:
    • base版:registry.cn-hangzhou.aliyuncs.com/fastgpt/bge-rerank-base:v0.1(4GB+)
    • large版:registry.cn-hangzhou.aliyuncs.com/fastgpt/bge-rerank-large:v0.1(5GB+)
    • v2-m3版:registry.cn-hangzhou.aliyuncs.com/fastgpt/bge-rerank-v2-m3:v0.1(5GB+)
  2. 配置端口映射为6006:6006,设置环境变量ACCESS_TOKEN为自定义访问凭证,请求时需携带Authorization: Bearer ${ACCESS_TOKEN}头信息。
  3. 执行Docker运行命令(以base版、token为mytoken为例): ``bash docker run -d --name reranker -p 6006:6006 -e ACCESS_TOKEN=mytoken --gpus all registry.cn-hangzhou.aliyuncs.com/fastgpt/bge-rerank-base:v0.1 ``
  4. 或使用docker-compose部署,示例配置: ``yaml version: "3" services: reranker: image: registry.cn-hangzhou.aliyuncs.com/fastgpt/bge-rerank-base:v0.1 container_name: reranker deploy: resources: reservations: devices: ports: environment: ``
    • driver: nvidia count: all capabilities: [gpu]
    • 6006:6006
    • ACCESS_TOKEN=mytoken

注意事项

  1. 宿主机未安装NVIDIA GPU驱动时,需移除docker run命令的--gpus all参数,或隐藏docker-compose配置中的deploy块。
  2. 端口6006需未被其他进程占用,避免启动冲突。
  3. 根据服务器存储空间选择对应规格的镜像,防止磁盘空间不足。
  4. 妥善保管ACCESS_TOKEN,防止未授权访问服务。

来源:FastGPT 官方文档