这个品类的数据长什么样
热力品类的数据主要来自热力站实时监测终端、管网SCADA系统、气象站、用户用热台账。更新节奏覆盖分钟级实时运行参数、日度能耗统计、月度经营报表三类。单份文档多为结构化表格或时序CSV,包含点位编号、采集时间、供回水温度、管网压力、瞬时流量、累计用热量等字段,单位涵盖℃、MPa、m³/h、GJ等多类计量标准。
这些特征在「多轮对话与提示词」这一环带来什么约束
热力数据的多时序分层特征要求多轮对话必须保留上下文的时间戳关联,避免跨时段数据混淆。多字段多单位的结构要求提示词需明确指定字段优先级与计量规则,防止模型混用不同单位的参数。实时采集的高频数据要求对话环节优先召回最新时段的监测数据,避免使用过时的历史数据。结构化文档的固定字段格式要求提示词需限定召回内容的输出结构,确保返回参数与业务字段一一对应。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
maxContext | 前12–18轮对话上下文 | 热力投研问题多聚焦单点位或片区的时序变化,过多上下文会干扰核心参数的关联逻辑 |
召回条数 | 前6–10条 | 热力数据字段密集,有限的召回量可避免模型混淆不同点位的监测参数 |
相似度阈值 | 0.78–0.82 | 结构化热力数据的匹配特征明确,该区间可过滤无关数据同时保留有效匹配结果 |
引用内容模板 | [{点位ID}] {采集时间}: 供温{供温}℃, 回温{回温}℃, 压力{压力}MPa | 明确结构化字段的展示格式,便于模型关联对话中的点位与时间信息 |
引用模板提示词 | 请基于提供的热力监测数据作答,优先使用最新采集的参数 | 强化模型对实时数据的优先级判断,适配热力投研的时效性需求 |
stream | 按场景选择,API调用时需匹配业务逻辑 | 适配不同对话场景的输出格式要求,符合实际调用的参数组合规范 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:配置
引用模板提示词后,召回内容未按预期格式展示。原因:误将引用模板提示词与全局系统提示词混用,未明确其仅用于格式化知识库召回的片段内容。 - 现象:API调用时设置
stream: false且detail: true,返回结果缺少热力数据的点位编号字段。原因:未在API请求的knowledgeBaseIds参数中绑定目标热力知识库,导致未触发知识库召回。 - 现象:开源版本v4.9.14下,并发调用时出现
503 Service Unavailable状态码。原因:v4.9.14版本默认并发限制适配通用场景,热力知识库的结构化数据召回占用更多计算资源,超出默认阈值。
怎么确认配好了
- 发起单轮对话测试,输入包含特定点位编号与时间的问题,核对返回结果中是否包含对应点位的热力参数。
- 查看对话日志,确认
maxContext参数保留的上下文轮次符合预设范围,未出现无关历史对话干扰。 - 调用API接口并传入
detail: true参数,核对返回的sourceDocuments字段是否包含匹配的热力知识库文档。 - 逐步递增并发调用次数,观察是否出现
503报错,据此标定适配当前热力知识库的并发上限。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。