特钢研报检索的工作流编排

特钢研报的数据来源包括中国特钢企业协会发布的行业统计报告、重点特钢生产企业的产销快报、第三方大宗商品资讯平台的现货报价数据。更新节奏以月度核心产销数据更新为

这个品类的数据长什么样

特钢研报的数据来源包括中国特钢企业协会发布的行业统计报告、重点特钢生产企业的产销快报、第三方大宗商品资讯平台的现货报价数据。更新节奏以月度核心产销数据更新为主,周度现货价格数据同步更新。文档多为带结构化表格的PDF或Word格式,包含牌号分类、产量、吨价、下游应用品类、进出口量等字段,其中价格字段单位为元/吨,产量字段单位为吨或万吨,无统一的固定排版格式。

这些特征在「工作流编排」这一环带来什么约束

特钢研报的多源多格式特征要求工作流需支持多数据源接入与格式校验,避免因文档排版差异导致的解析错误。不同数据源的更新周期差异,要求工作流需配置差异化的定时触发规则,分别适配周度现货数据与月度产销数据的同步节奏。特钢细分品类多、字段单位明确的特征,要求工作流需添加牌号、应用场景等精准过滤参数,同时需配置单位校验逻辑,防止跨单位计算产生偏差。结构化表格占比高的特征,要求工作流的RAG环节优先提取表格内的结构化数据,提升检索精度。

配置怎么定

配置项建议取法这样取的依据
rag_recall_top_k前10条特钢研报细分品类多,过多召回会增加上下文长度,过少会遗漏关键细分数据
rag_chunk_size800–1200 字符特钢研报包含大量结构化表格段落,该长度可完整保留单张表格的核心数据
workflow_trigger_cron0 0 2 * * 1,5(周度)、0 0 4 * * 1(月度)适配特钢现货数据周更、产销数据月更的更新节奏
mcp_param_auto_fill开启特钢研报检索需补充牌号、应用场景等多参数,自动填充可减少手动输入误差
parse_table_enable开启特钢研报包含大量结构化产销、价格表格,开启后可精准提取字段数据
rag_similarity_threshold0.75–0.85特钢数据细分度高,需较高相似度过滤无关的通用钢铁研报内容

本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。

容易做错的三处

  • 现象:调用MCP节点时触发参数缺失报错,无法通过工作流内的交互环节自动收集补充参数。原因:未开启mcp_param_auto_fill配置,或未在工作流中添加参数收集分支。
  • 现象:同一输入在本地工作流调试中返回正确结果,但线上发布后的实际调用结果偏差较大。原因:线上环境的rag_recall_top_k、rag_similarity_threshold等配置与本地调试参数不一致,或知识库未完成全量同步。
  • 现象:从知识库的特钢研报中无法精准提取指定牌号的吨价数据,返回结果包含大量无关文本。原因:未开启parse_table_enable配置,或未在检索提示中明确指定提取字段与单位。

怎么确认配好了

  • 触发工作流的定时任务,查看任务日志中是否按预设周期调用了对应数据源的节点。
  • 输入特钢牌号与应用场景关键词,核对检索结果中是否仅包含匹配的特钢研报内容。
  • 调用MCP节点,验证是否自动弹出参数收集界面并正确传递补充后的参数。
  • 查看知识库解析记录,确认特钢研报中的结构化表格已被正确提取为可检索字段。

问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。