这个品类的数据长什么样
煤化工尽调报告的数据来源包括煤炭行业协会公开统计、煤化工项目环评公示、上市企业年报及供应链公开报价。数据更新节奏存在差异,产能、能耗等核心指标按月度更新,行业政策、项目进展按季度更新,年度行业白皮书按自然年发布。文档结构通常包含项目基本信息、产能参数、原料消耗、排污指标、财务摘要等模块,字段单位多采用万吨/年、立方米/吨产品、吨CO₂/万吨产能等专业计量标准。
这些特征在「多轮对话与提示词」这一环带来什么约束
煤化工尽调数据来源分散且专业度高,多轮对话需跨数据源验证信息一致性,提示词需明确指定不同数据源的优先级。单份报告文本较长,多轮对话的上下文窗口需保留足够内容,避免截断关键专业参数。字段单位具有强专业性,提示词需强制要求输出对应单位,防止混淆计量标准。数据更新周期差异大,多轮对话的历史上下文需自动过滤过期数据,确保引用信息时效性。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
maxContext | 8000–12000 字符 | 煤化工尽调报告单份文本较长,需保留足够上下文支撑多轮信息验证,避免截断关键专业参数 |
recallTopK | 前6–8条 | 煤化工尽调数据字段多且专业,需召回足够相关片段覆盖产能、能耗、财务等核心维度 |
similarityThreshold | 0.72–0.78 | 煤化工专业术语辨识度高,阈值过低会引入无关行业数据,过高会遗漏部分关联信息 |
historyMaxLength | 10–15 轮 | 多轮尽调对话需保留关键数据对比的上下文,过多轮次会增加模型推理负载 |
promptTemplate | 「请基于提供的煤化工尽调数据,按[字段名](单位:[对应单位])格式输出,优先使用最新更新的数据源」 | 需明确专业字段的单位要求,统一输出格式,指定数据源优先级 |
historyAutoSave | 启用 | 确保多轮对话的回复内容被完整留存,避免重新加载时出现空回复 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:多轮对话历史中未留存指定回复内容,重新加载对话时自动回复为空。原因:未启用
historyAutoSave参数,或配置的historyExcludeList包含了回复内容的核心关键词。 - 现象:工作流内提示词的落款时间未正确输出系统当前日期,出现固定值或空值。原因:未正确绑定平台内置的时间变量,或未在提示词模板中声明变量生效范围。
- 现象:工作流中前一个AI对话的回复内容被包含在第二个对话的最终输出结果中。原因:未在第二个对话的输入配置中排除前序节点的输出,或未开启
inputFilterPreviousNode参数。
怎么确认配好了
- 上传一份标准煤化工尽调报告,发起多轮对话,验证历史记录中会留存每一轮的回复内容。
- 在工作流提示词中插入内置时间变量,触发运行后核对落款时间与系统当前日期一致。
- 配置两个串联的AI对话节点,触发运行后查看最终输出,确认仅包含第二个对话的回复内容。
- 调整
similarityThreshold至0.7,发起查询后核对召回的片段均为煤化工专业相关数据。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。