跳至主要内容
FASTGPT / 技术中心

从部署到 API,
直接找到可执行答案。

面向开发与部署人员,按任务搜索 4869 篇技术内容,覆盖部署升级、知识库、工作流、集成与 API。

4869 篇内容11 个主题官方文档与公开 Issue

按任务找到答案

共 4869 篇

模型指南官方文档

Qwen 128K 上下文 这一档模型配 OceanBase 的配置口径

Qwen 128K 上下文 这一档模型配 OceanBase 的配置口径 这一档模型的参数意味着什么 Qwen 128K 上下文模型档位,其 128000 的上下文长度,意味着单次输入模型可承载的文本总量非常庞大,为召回大量相关知识片段提供了空间。引用上限 100000 决定了知识库在生成回答时,模型可引用…

5 分钟阅读
模型指南官方文档

Qwen 128K 上下文 这一档模型配 openGauss 的配置口径

Qwen 128K 上下文 这一档模型配 openGauss 的配置口径 这一档模型的参数意味着什么 Qwen 这一档模型,上下文长度 128000 意味着模型单次处理的文本总量上限。这直接限制了 RAG 应用中可以召回并输入给模型的知识内容总量。引用上限 100000 设定了知识库检索结果可以被模型引用的…

6 分钟阅读
模型指南官方文档

Qwen 128K 上下文 这一档模型配 PostgreSQL(pgvector) 的配置口径

Qwen 128K 上下文 这一档模型配 PostgreSQL(pgvector) 的配置口径 这一档模型的参数意味着什么 这一档模型具有 128000 的上下文长度,这意味着单次对话中模型能够处理的输入信息量庞大。引用上限为 100000,这限定了从知识库召回并作为上下文输入给模型的引用内容的总 toke…

4 分钟阅读
模型指南官方文档

Qwen 32K 上下文 这一档模型配 Milvus 的配置口径

Qwen 32K 上下文 这一档模型配 Milvus 的配置口径 这一档模型的参数意味着什么 Qwen 32K 上下文模型系列,其上下文长度为 32000 token,决定了每次交互中模型能处理的输入内容总量,包含指令、历史对话和召回内容。单次最大输出长度未明确标注,通常由平台侧或实际模型能力决定,影响模型…

4 分钟阅读
模型指南官方文档

Qwen 32K 上下文 这一档模型配 OceanBase 的配置口径

Qwen 32K 上下文 这一档模型配 OceanBase 的配置口径 这一档模型的参数意味着什么 Qwen 32K 这一档模型,其 maxContext 值为 32000 token,这决定了单次请求中模型可以处理的最大输入长度,包括用户查询、历史对话以及召回内容。模型单次最大输出长度未明确标注,通常这意…

4 分钟阅读
模型指南官方文档

Qwen 32K 上下文 这一档模型配 openGauss 的配置口径

Qwen 32K 上下文 这一档模型配 openGauss 的配置口径 这一档模型的参数意味着什么 Qwen 32K 上下文模型档位,其上下文长度 32000 token 决定了单次交互中模型能处理的输入与输出总和。引用上限 30000 token 则限定了知识库召回内容被模型引用的最大长度,直接影响了知识…

4 分钟阅读
模型指南官方文档

Qwen 32K 上下文 这一档模型配 PostgreSQL(pgvector) 的配置口径

Qwen 32K 上下文 这一档模型配 PostgreSQL(pgvector) 的配置口径 这一档模型的参数意味着什么 Qwen 32K 上下文模型系列,其 maxContext 达 32000 token,允许在单次交互中处理大量输入信息。单次最大输出 (maxTokens) 字段未标注,通常意味着模型…

4 分钟阅读
模型指南官方文档

Qwen 128K 上下文 这一档模型配 Milvus 的配置口径

Qwen 128K 上下文 这一档模型配 Milvus 的配置口径 这一档模型的参数意味着什么 qwen-coder-turbo 模型具备 128000 的上下文长度,这决定了单次请求中可输入的用户提问与检索内容的合集上限。引用上限为 50000 token,用于限定从知识库中召回并注入模型进行回答的内容总…

4 分钟阅读
模型指南官方文档

Qwen 128K 上下文 这一档模型配 OceanBase 的配置口径

Qwen 128K 上下文 这一档模型配 OceanBase 的配置口径 这一档模型的参数意味着什么 qwen-coder-turbo 模型具备 128000 的上下文长度,决定了单次请求中模型能处理的输入文本总量。引用上限为 50000,这是模型在生成回答时,用于引用知识库内容的 token 预算。段落条…

3 分钟阅读
模型指南官方文档

Qwen 128K 上下文 这一档模型配 openGauss 的配置口径

Qwen 128K 上下文 这一档模型配 openGauss 的配置口径 这一档模型的参数意味着什么 qwen-coder-turbo 模型所处的这一档,其上下文长度为 128000 token,表示模型一次处理的输入信息总量上限。单次最大输出未标注,通常意味着模型会根据其内部设定和当前会话长度动态调整输出…

4 分钟阅读
模型指南官方文档

Qwen 128K 上下文 这一档模型配 PostgreSQL(pgvector) 的配置口径

Qwen 128K 上下文 这一档模型配 PostgreSQL(pgvector) 的配置口径 这一档模型的参数意味着什么 这一档模型(qwen-coder-turbo)具备 128000 的上下文长度,决定了在单次交互中能处理的总文本量上限。引用上限为 50000 token,这意味着用于 RAG 检索回…

4 分钟阅读
模型指南官方文档

Qwen 1024K 上下文 这一档模型配 Milvus 的配置口径

Qwen 1024K 上下文 这一档模型配 Milvus 的配置口径 这一档模型的参数意味着什么 这一档模型具备 1024000 token 的上下文长度(maxContext),这意味着单次对话中模型可以处理的海量信息输入。引用上限(quoteMaxToken)为 1000000 token,这是模型用于…

4 分钟阅读