这个品类的数据长什么样
焦煤财报数据主要来自国内煤炭行业协会公开报告、交易所上市焦煤企业季度年报及临时公告。数据更新节奏分为季度与月度两类:季度财报数据于季后15个工作日内发布,月度行业供需数据于次月5日前更新。文档结构包含核心经营指标字段,如原煤产量、精煤回收率、港口平仓价、进口量,单位分别为万吨、百分比、元/吨、万吨,部分年报还会附带产能规划与成本构成明细。
这些特征在「工作流编排」这一环带来什么约束
焦煤财报的多来源、分周期更新特性,要求工作流需配置多源数据拉取节点,按季度、月度及临时公告三类触发规则分别绑定对应数据源,避免遗漏非固定发布的临时公告数据。字段单位的差异化要求工作流中加入单位校验节点,对提取的价格、产量字段自动匹配预设单位规则,避免跨数据源的单位混淆,比如将协会报告的“平仓价”与企业财报的“销售均价”统一映射为同一指标。长文档的年报内容较多,需配置分段提取与合并节点,确保核心指标不会被截断。临时公告的触发无固定周期,需额外配置公告订阅触发节点,补充常规定时任务未覆盖的更新场景。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
workflow_loop_max | 100 次 | 焦煤财报批量处理的单次循环数据量通常在百级以内,该取值可避免无限循环导致的资源占用异常 |
PARSE_DOC_CHUNK_SIZE | 800–1200 字符 | 焦煤财报的长文本段落多为数百到千字符,该区间可保留完整的指标上下文,避免关键信息被截断 |
trigger_type | 定时触发 + 订阅触发 | 焦煤财报既有固定周期的季度/月度数据,也有临时公告的非固定更新需求,双触发模式可覆盖全量更新场景 |
data_unit_validate | 开启 | 焦煤财报数据包含多种单位,开启该参数可自动校验提取字段的单位一致性,避免跨数据源的单位混淆 |
subapp_log_enable | 开启 | 需留存子应用调用的日志用于问题排查,开启该参数可将子应用的调用记录持久化存储 |
legacy_text_processing | 按版本适配启用 | 升级后旧版工作流的文本加工节点可通过该开关恢复原有逻辑,适配不同版本的配置需求 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:工作流执行时循环触发超过设定次数后无报错但停止运行。原因:未配置
workflow_loop_max参数,使用了平台默认的循环上限,未适配焦煤财报批量处理的需求。 - 现象:调用已配置的子应用或插件后,对话日志未生成对应记录。原因:未开启
subapp_log_enable参数,子应用调用的日志未被持久化存储。 - 现象:升级后旧版工作流中的文本加工节点无法正常运行,提取的焦煤财报指标缺失单位信息。原因:未启用
legacy_text_processing兼容开关,新版解析逻辑未适配旧版文本加工的单位提取规则。
怎么确认配好了
- 手动触发对应触发规则的测试任务,核对日志面板中是否拉取到预期的焦煤财报数据源,确认
trigger_type配置的触发规则生效。 - 运行包含循环节点的测试工作流,观察循环执行的次数是否符合预设规则,确认
workflow_loop_max参数配置正确。 - 调用配置好的子应用执行指标提取,查看日志面板是否生成对应调用记录,确认
subapp_log_enable参数配置正确。 - 导入升级前的工作流配置文件,测试文本加工节点的运行效果,确认
legacy_text_processing开关配置正确。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。