模型指南官方文档4 分钟阅读模型组合页

Yi 16K 上下文 这一档模型配 openGauss 的配置口径

此档模型具备 16000 token 的上下文处理能力,这决定了单次请求中可供模型参考的全部信息总量。模型对引用内容的 token 预算为 12000 token。引用内容合计占用的 token 数量受此上限限制。向量检索返回的段落条数与引用内容的 token 预算是两个独立的衡量维度。模型支持图片

这一档模型的参数意味着什么

此档模型具备 16000 token 的上下文处理能力,这决定了单次请求中可供模型参考的全部信息总量。模型对引用内容的 token 预算为 12000 token。引用内容合计占用的 token 数量受此上限限制。向量检索返回的段落条数与引用内容的 token 预算是两个独立的衡量维度。模型支持图片输入,允许在对话中融入视觉信息。此档模型不具备工具调用能力,这意味着无法通过模型直接触发外部功能或 API。

配 openGauss 要定哪些

配置项建议取法这样取的依据
OPENGAUSS_URLpostgresql://user:password@host:port/database连接数据库实例的必要信息,确保可达性
ef_construction100影响 HNSW 图构建的质量与召回准确率,过低影响召回,过高增加构建时间
ef_search80影响 HNSW 搜索时的召回率,根据实际召回效果进行调整
m32HNSW 算法中每个节点的最大连接数,影响索引大小和查询性能
检索条数5-8结合模型引用上限和段落平均长度,控制召回条数以优化引用效率
段落字符长度500-1000确保每段信息完整且不过长,避免单段内容过多导致总引用超限

这两者互相约束的地方

向量库返回的文档段落条数与每段内容的长度,共同决定了召回内容的总 token 数量,这一总量必须控制在模型 16000 token 的上下文预算之内。引用上限是按 token 计量的,而向量库的返回结果是按条数计量的。引用内容总 token 量是否触及 12000 token 的上限,取决于每条召回段落的平均长度。当 openGauss 的索引参数,如 ef_construction 或 ef_search,被调大时,通常会提高检索的召回准确率和召回率。这意味着模型在处理更相关、更全面的召回内容时,其推理质量可能得到提升,但同时也会增加查询时的计算资源消耗。

容易做错的三处

  • 日志显示 ERROR: database "your_db" does not exist:OPENGAUSS_URL 中指定的数据库名称不正确或未创建。
  • 检索结果的 documents 字段为空:向量库中没有与查询匹配的有效数据,或者检索参数设置过于严格。
  • 模型返回的回答内容过短或不完整:召回的段落总 token 量超过了模型的引用上限 12000 token,导致部分内容被截断。

怎么确认配好了

  • 执行一次查询,检查 openGauss 返回的文档条数是否在预设范围内。
  • 计算一次查询召回内容的总 token 数,确认其是否在模型的上下文长度 16000 token 和引用上限 12000 token 之内。
  • 观察模型针对复杂问题的回复质量,判断召回内容的有效性和相关性是否达到预期。
  • 监控 openGauss 数据库的连接状态和查询延迟,确保系统运行稳定。

参考资料