普钢财报分析的工作流编排

普钢财报数据主要来自交易所公开公告、行业资讯平台及第三方数据终端。更新节奏以季度报告、年度报告为核心,季度报告每季度末后45天内发布,年度报告需在次年4月底

这个品类的数据长什么样

普钢财报数据主要来自交易所公开公告、行业资讯平台及第三方数据终端。更新节奏以季度报告、年度报告为核心,季度报告每季度末后45天内发布,年度报告需在次年4月底前披露,临时产量、成本调整公告按需发布。文档结构包含核心财务指标、生产经营数据两大部分,核心字段包括粗钢产量、吨钢综合成本、营业收入、归母净利润,单位分别为万吨、元/吨、亿元、亿元。

这些特征在「工作流编排」这一环带来什么约束

多源数据的格式差异要求工作流配置多类型文档解析节点,适配PDF公告的纯文本提取与第三方结构化数据的字段映射。季度性批量数据触发需要设置定时调度节点,限定仅处理当季最新数据,避免重复加载历史报表。行业专属字段的单位一致性要求工作流添加字段校验步骤,拦截吨钢成本以元为单位的异常数据,需统一转换为行业通用的千元单位。临时公告的非结构化内容需要配置行业术语词典,提升关键词提取的准确率。

配置怎么定

配置项建议取法这样取的依据
multi_knowledge_base_enabletrue普钢财报数据分散在公告、行业资讯、财务数据库三个独立知识库,需同时召回关联内容
document_parse_timeout600 秒单份年度PDF公告页数超150页,默认解析时长不足以完成完整提取
keyword_extract_threshold0.75普钢行业专属术语如“吨钢综合成本”“粗钢产能利用率”的提取置信度需高于通用阈值
global_variable_pass_modeall_module需将工作流中提取的粗钢产量、吨钢毛利等变量传递给后续MCP工具节点
rag_recall_top_k前8条普钢财报核心指标分散在3-5个段落,需召回足够上下文片段保证分析完整性
workflow_trigger_cron0 0 10 5,20 * *匹配季度报告披露后5天、20天的常规窗口,定时触发工作流执行

本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。

容易做错的三处

  • 现象:工作流执行后返回“全局变量未定义”报错,后续节点无法读取提取的粗钢产量字段。原因:未将global_variable_pass_mode配置为all_module,仅允许部分节点访问全局变量。
  • 现象:MCP工具调用时传入的token字段为空,无法完成接口请求。原因:未配置global_variable_pass_mode为允许跨模块传递,或未将token变量绑定到对应工具参数位。
  • 现象:提取的关键词包含“钢材价格”,未包含“普钢价格”,关键词匹配准确率不足。原因:未加载普钢行业专属术语词典,关键词提取阈值设置过低,导致通用词汇优先匹配。

怎么确认配好了

  • 进入工作流配置页面,检查multi_knowledge_base_enable开关是否开启,确认已关联公告、行业资讯、财务数据库三个知识库。
  • 测试单份年度PDF公告的解析任务,查看解析日志确认耗时未超过配置的document_parse_timeout值,无解析失败报错。
  • 触发一次测试工作流,查看全局变量面板,确认提取的粗钢产量、吨钢毛利等字段已生成,且可在后续MCP工具节点中选择引用。
  • 查看定时触发配置,确认workflow_trigger_cron表达式匹配季度报告披露的常规时间窗口,无重复触发的冲突设置。

问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。