焦煤研报检索的多轮对话与提示词

焦煤研报数据主要来自中国煤炭工业协会、各煤炭主产区行业协会、大连商品交易所、第三方煤炭咨询机构。更新节奏覆盖每日现货价格、每周港口库存与运输数据、每月供需平

这个品类的数据长什么样

焦煤研报数据主要来自中国煤炭工业协会、各煤炭主产区行业协会、大连商品交易所、第三方煤炭咨询机构。更新节奏覆盖每日现货价格、每周港口库存与运输数据、每月供需平衡报告,以及季度、年度深度行业分析。文档结构包含发布机构、发布时间、焦煤牌号(主焦煤、1/3焦煤等)、核心指标(灰分、硫分、粘结指数G值、胶质层厚度Y值)、价格区间、库存与成交量数据,价格单位为元/吨,库存、成交量单位为万吨。

这些特征在「多轮对话与提示词」这一环带来什么约束

焦煤研报包含大量专业指标与特定单位,多轮对话需保留历史交互中的指标口径与单位约定,避免出现混淆。高频更新的数据要求对话系统限制召回文档的时间范围,确保返回内容的时效性。单篇深度研报篇幅较长,需合理配置召回片段的长度,同时提示词需明确指定提取焦煤专属指标,避免混入泛煤炭品类的无关内容。不同发布机构的数据口径存在差异,提示词需要求标注数据来源与统计口径,保障对话结果的一致性。

配置怎么定

配置项建议取法这样取的依据
maxContext前 3000 字符焦煤单篇深度研报常超2000字符,保留足够上下文避免专业指标断档
召回条数前 4 条焦煤研报数据维度多,过多召回会稀释核心供需与价格信息
相似度阈值0.75–0.85焦煤专业指标匹配精度要求高,避免低相关的泛行业研报混入
PARSE_FILE_TIMEOUT_SECONDS120 秒焦煤研报常包含大量表格数据,解析耗时较通用文档更长
重排返回条数前 2 条聚焦核心价格与供需数据,减少非必要的行业背景信息干扰
single_turn_prompt按对话历史拼接保留之前提及的焦煤指标口径,避免重复修正单位与统计规则

本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。

容易做错的三处

  • 配置single_turn_prompt时仅设置单次触发规则,导致后续对话无法保留之前约定的焦煤指标口径,出现单位混淆的报错文案。
  • 调用对话记录接口时未携带conversationId参数,导致返回的对话记录字段为空,无法查看历史交互内容。
  • 召回条数设置为前8条且相似度阈值设为0.6,导致引入泛煤炭品类的非焦煤研报,出现结果匹配度不足的问题。

怎么确认配好了

  • 发起包含焦煤专业指标(如粘结指数G值、胶质层厚度Y值)的首轮对话,后续追问时验证系统能自动关联历史指标口径。
  • 调用获取对话记录接口,确认携带conversationId后能返回完整的历史交互内容。
  • 查看知识库召回日志,确认返回的研报均标注焦煤相关关键词,且数量符合配置的召回条数。
  • 上传单篇焦煤深度研报,验证解析耗时未超过配置的PARSE_FILE_TIMEOUT_SECONDS阈值。

问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。