这个品类的数据长什么样
铁矿石相关财报数据主要来自境内外上市钢铁企业的定期公告、行业协会月度监测报告及港口通关数据。更新节奏分为季度、年度的企业财报强制披露,以及周度、月度的行业行情数据更新。文档结构多为结构化表格搭配文字分析,包含原生矿产量、进口量、港口库存、现货价格、加工成本等字段,单位多采用吨、千吨、元/吨、美元/干吨等,部分海外报告会额外标注汇率折算后的人民币计价数据。
这些特征在「工作流编排」这一环带来什么约束
铁矿石品类的数据来源分散且格式差异大,要求工作流需配置多源数据适配节点,分别处理企业公告的PDF结构化解析与行业报告的CSV、JSON格式转换。不同数据的更新节奏差异,要求拆分定时触发节点的执行周期,企业财报触发周期设为季度,行业行情数据设为月度。字段单位不统一的问题,需要在工作流中加入统一计量单位的转换环节,避免后续分析出现计算偏差。财报披露存在固定窗口期,需配置触发时间避开披露高峰时段,防止接口调用触发限流规则。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
PARSE_FILE_TIMEOUT_SECONDS | 300 秒 | 铁矿石财报PDF包含多页结构化表格,解析时长较长,300秒可覆盖多数完整解析需求 |
external_function_call_timeout | 120 秒 | 铁矿石数据清洗涉及多维度单位转换与格式校验,需预留足够执行时长 |
form_node_display_mode | embedded | 当工作流作为嵌套子流程时,隐藏弹窗可避免打断主流程执行链路 |
rag_retrieve_top_k | 前8条 | 铁矿石财报关联字段较多,需召回足够上下文支撑分析,同时避免冗余信息干扰 |
file_upload_max_size | 500 MB | 大型行业监测报告PDF体积较大,放宽上传限制可完整获取数据源 |
workflow_parallel_limit | 5 个 | 铁矿石数据多源采集时需控制并发量,防止触发第三方数据源限流策略 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 嵌套作为子流程的工作流中,表单输入节点仍弹出独立对话框。未将
form_node_display_mode配置为embedded,默认弹窗模式在嵌套场景下仍会触发弹窗展示。 - 调用自定义Python函数时出现
504 Gateway Timeout报错。未调整external_function_call_timeout的取值,默认超时时长不足以覆盖铁矿石数据清洗的复杂计算流程。 - 批量处理铁矿石财报数据时,工作流执行耗时超出预期。未设置合理的
workflow_parallel_limit,并发量过高触发第三方数据源限流,导致部分请求排队等待。
怎么确认配好了
- 上传单份铁矿石财报测试文件,核对解析输出的字段与原始文档的对应关系,确认单位转换环节生效。
- 触发工作流执行,查看自定义函数的运行日志,确认执行时长未超过配置的超时阈值。
- 将当前工作流嵌套进测试主流程,触发主流程执行,确认表单节点未弹出独立对话框。
- 提交多组并行的数据源采集请求,检查是否出现限流相关的报错信息,确认并发配置合理。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。