煤化工研报检索的多轮对话与提示词

煤化工研报的来源包括行业协会公开资料、上市公司公开披露文件、专业咨询机构的公开研报。更新节奏为按季度发布专项报告,政策或项目变动时补充更新。文档一般分为行业

这个品类的数据长什么样

煤化工研报的来源包括行业协会公开资料、上市公司公开披露文件、专业咨询机构的公开研报。更新节奏为按季度发布专项报告,政策或项目变动时补充更新。文档一般分为行业概况、核心项目参数、上下游供需数据、政策解读四个章节,核心参数集中在项目参数章节,包含原料煤品质参数、项目产能规模、产品定价区间、产业链配套情况等内容,参数单位多为吨、万元、吉焦、mg/kg等。

这些特征在「多轮对话与提示词」这一环带来什么约束

煤化工研报包含大量专业工艺参数与产业链数据,多轮对话需保留上下文内的专业术语与项目指代,避免对话断裂。研报更新无固定周期,提示词需支持动态匹配最新公开的项目数据。核心参数分散在不同章节,多轮对话需引导用户明确参数类型,避免召回无关内容。部分参数涉及跨章节关联,提示词需指定召回范围,确保返回内容的关联性。长文档的解析与召回需合理控制上下文窗口,避免超出模型处理能力。

配置怎么定

配置项建议取法这样取的依据
maxContext8000–12000 字符煤化工研报单篇长度较长,需保留足够上下文处理多轮对话中的项目指代
recall_top_k前 8–12 条煤化工研报参数分散,需足够召回量覆盖跨章节关联内容
prompt_template固定前缀为“该助手为煤化工行业研报检索助手,仅基于提供的研报内容回答问题,需明确标注引用的研报章节”,后缀为用户问题需限定回答范围,避免生成无关内容,明确助手身份
PARSE_FILE_TIMEOUT_SECONDS300 秒煤化工研报文档结构复杂,需足够时间完成分块与字段提取
similarity_threshold0.75–0.85需过滤无关的研报内容,同时保留专业参数的匹配度
rerank_top_n前 3–5 条需聚焦核心参数内容,避免过多冗余信息

本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。

容易做错的三处

  • 现象:调用API时,响应记录预览中human字段为空。原因:未在请求体中正确传递human参数,或参数格式不符合接口要求。
  • 现象:自定义对话界面交互体验不佳,召回结果展示无逻辑。原因:未配置rerank_top_n参数,或未对召回结果按相关性进行排序。
  • 现象:使用第三方部署的大模型时,回答内容未遵循预设的检索规则。原因:提示词未在prompt_template中正确配置,或未将研报上下文传入模型上下文窗口。

怎么确认配好了

  • 发起单轮测试请求,检查响应记录中是否包含正确的human参数内容,确认参数传递正常。
  • 发起多轮对话测试,验证上下文是否被正确保留,项目指代是否被准确识别。
  • 查看召回结果列表,确认结果数量与排序符合预设配置,无明显无关内容。
  • 触发文件解析任务,检查解析耗时是否在配置的PARSE_FILE_TIMEOUT_SECONDS范围内,无超时报错。

问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。