动力煤研报检索的工作流编排

动力煤研报数据主要来自行业协会公开数据、期货交易所挂牌信息、券商行业分析报告及专业煤炭资讯平台。更新节奏不固定,券商研报随行业事件触发更新,行业供需数据按周

这个品类的数据长什么样

动力煤研报数据主要来自行业协会公开数据、期货交易所挂牌信息、券商行业分析报告及专业煤炭资讯平台。更新节奏不固定,券商研报随行业事件触发更新,行业供需数据按周或月度更新。文档结构多包含核心指标表格、供需平衡分析、价格走势图表,字段包含动力煤平仓价(单位元/吨)、发热量(单位大卡/千克)、港口库存(单位万吨)、铁路运输量等,部分研报会附带区域价差对比明细。

这些特征在「工作流编排」这一环带来什么约束

动力煤研报的分散数据源与非固定更新节奏,要求工作流支持多数据源并行拉取与事件触发、定时轮询两种更新模式。文档内的结构化表格与图表占比高,需要工作流配置专用的结构化数据解析节点,避免纯文本解析破坏指标间的关联逻辑。跨来源的单位差异(如平仓价的计价基准不同、发热量的单位表述差异),需要工作流内置标准化转换环节。部分深度研报篇幅超万字,需配置分段召回与上下文拼接规则,确保大模型可完整获取核心分析数据。

配置怎么定

配置项建议取法这样取的依据
ragRecallTopN前10-15条动力煤研报核心指标集中在前10条召回结果中,适配FastGPT 4.10.0版本的上下文加载逻辑,避免冗余信息干扰
maxContext20-30条匹配动力煤研报的长文本分析需求,平衡上下文长度与大模型token消耗,符合行业分析的常规窗口要求
CODE_RUNNER_MAX_COUNT3个支持多数据源并行校验与格式转换,适配多来源研报数据的处理需求,避免组件冲突
fileParseModeraw跳过默认文本解析,直接将上传的研报PDF/Excel文件传入大模型,保留原始表格的单元格关联关系
MODEL_ENV_VAR_ENABLED开启允许问题优化节点调用预设的动力煤行业参数环境变量,统一指标口径
PARSE_FILE_MAX_SIZE50 MB适配单份深度动力煤研报的文件体积上限,避免解析超时

本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。

容易做错的三处

  • 现象:将maxContext设为30条后,对话明细仅展示2条上下文,大模型回复未关联研报核心数据。原因:未同步调整ragRecallTopN的取值,默认召回条数过低,导致有效关联的研报片段未被加载,该问题在FastGPT 4.10.0版本中较为常见。
  • 现象:上传动力煤研报的Excel文件后,大模型无法识别表格内的平仓价、发热量等结构化字段。原因:未将fileParseMode配置为raw,默认文本解析流程拆分了表格单元格的关联关系,丢失了指标对应关系。
  • 现象:工作流中添加第4个代码运行组件后,界面弹出配置超限报错,错误码为400。原因:未修改CODE_RUNNER_MAX_COUNT的默认取值,系统默认限制工作流仅支持3个代码组件并行运行。

怎么确认配好了

  • 进入工作流的RAG配置模块,核对上下文保留条数与召回条数的配置,调整至适配动力煤研报的内容体量。
  • 上传单份动力煤研报文件,触发解析流程后,查看解析结果预览,确认结构化表格的关联关系未被破坏。
  • 向工作流发起测试调用,查看组件运行日志,确认所有配置的代码运行组件均可正常执行。
  • 触发问题优化节点的测试运行,确认节点可正常调用预设的行业参数配置。

问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。