跳至主要内容
FASTGPT / 技术中心

从部署到 API,
直接找到可执行答案。

面向开发与部署人员,按任务搜索 4869 篇技术内容,覆盖部署升级、知识库、工作流、集成与 API。

4869 篇内容11 个主题官方文档与公开 Issue

按任务找到答案

共 4869 篇

模型指南官方文档

ChatGLM 128K 上下文 这一档模型配 OceanBase 的配置口径

ChatGLM 128K 上下文 这一档模型配 OceanBase 的配置口径 这一档模型的参数意味着什么 这一档模型(glm-4.6v、glm-4.6v-flashx、glm-4.6v-flash)的上下文长度为 128000 Token,决定了单次模型调用能够处理的输入信息总量,包括系统指令、用户查询和…

4 分钟阅读
模型指南官方文档

ChatGLM 128K 上下文 这一档模型配 openGauss 的配置口径

ChatGLM 128K 上下文 这一档模型配 openGauss 的配置口径 这一档模型的参数意味着什么 上下文长度 128000 表示模型在单次交互中能处理的总文本量上限。maxContext 参数将以此为基准进行配置,确保输入内容不会超出模型的能力。单次最大输出未标注,意味着模型可以根据需求生成较长的…

4 分钟阅读
模型指南官方文档

ChatGLM 128K 上下文 这一档模型配 Milvus 的配置口径

ChatGLM 128K 上下文 这一档模型配 Milvus 的配置口径 这一档模型的参数意味着什么 ChatGLM 家族这一档模型提供 128000 的上下文长度,意味着单次请求中可携带的指令、历史对话和知识库召回内容总量上限。引用上限 120000 明确了知识库召回内容在整个上下文中的最大占比,为 RA…

5 分钟阅读
模型指南官方文档

ChatGLM 128K 上下文 这一档模型配 OceanBase 的配置口径

ChatGLM 128K 上下文 这一档模型配 OceanBase 的配置口径 这一档模型的参数意味着什么 ChatGLM 128K 上下文模型系列,如 glm-4.5 和 glm-4-air,其上下文长度高达 128000 token,这决定了单次请求中模型能处理的输入信息总量。引用上限 quoteMax…

4 分钟阅读
模型指南官方文档

ChatGLM 128K 上下文 这一档模型配 openGauss 的配置口径

ChatGLM 128K 上下文 这一档模型配 openGauss 的配置口径 这一档模型的参数意味着什么 本档模型以 128000 的上下文长度为特点,这意味着在单次对话中,模型可以处理更长的用户输入、系统指令以及从知识库检索到的信息。引用上限 120000 规定了知识库内容在送入模型前可占据的最大 to…

4 分钟阅读
模型指南官方文档

ChatGLM 64K 上下文 这一档模型配 Milvus 的配置口径

ChatGLM 64K 上下文 这一档模型配 Milvus 的配置口径 这一档模型的参数意味着什么 glm-4.1v-thinking-flashx 和 glm-4.1v-thinking-flash 模型档位提供了高达 64000 token 的上下文长度,这意味着在单次对话中可以承载大量的历史信息或召回…

4 分钟阅读
模型指南官方文档

ChatGLM 64K 上下文 这一档模型配 OceanBase 的配置口径

ChatGLM 64K 上下文 这一档模型配 OceanBase 的配置口径 这一档模型的参数意味着什么 glm-4.1v-thinking-flashx 和 glm-4.1v-thinking-flash 模型拥有 64000 的上下文长度,这意味着单次请求中模型可以处理的总输入文本量。引用上限 6000…

3 分钟阅读
模型指南官方文档

ChatGLM 64K 上下文 这一档模型配 openGauss 的配置口径

ChatGLM 64K 上下文 这一档模型配 openGauss 的配置口径 这一档模型的参数意味着什么 glm-4.1v-thinking-flashx 和 glm-4.1v-thinking-flash 模型提供高达 64000 token 的上下文长度,这意味着在单次交互中可以处理大量输入信息。模型支…

4 分钟阅读
模型指南官方文档

ChatGLM 1000K 上下文 这一档模型配 Milvus 的配置口径

ChatGLM 1000K 上下文 这一档模型配 Milvus 的配置口径 这一档模型的参数意味着什么 glm-4-long 模型,其上下文长度高达 1,000,000 token,赋予了处理超长文本和多轮复杂对话的能力。这意味着在知识库检索场景下,可以一次性注入大量召回内容,减少分批请求的必要性。引用上限…

4 分钟阅读