这个品类的数据长什么样
焦炭相关财报数据主要来源于上市煤焦企业的定期报告、行业自律组织发布的月度运行简报、国内期货交易所焦炭交割品质量标准文档。数据更新节奏分为三类:定期报告按季度、年度更新,行业简报按月度更新,交割标准文档按年度修订。文档结构包含结构化生产经营数据表格、业务板块分析文本、质量指标说明章节,涉及的字段包括产能规模、日均产量、平均出库价格、粒度组成、抗碎强度,对应单位分别为万吨、吨、元/吨、毫米、兆帕。
这些特征在「工作流编排」这一环带来什么约束
由于数据来源分散,工作流需配置多数据源拉取节点,分别对接企业财报、行业简报与标准文档。不同数据源的更新节奏差异,要求设置分层定时触发规则,匹配季度、月度的更新周期。文档中同时包含结构化表格与非结构化文本,需区分配置解析规则,对表格内容做结构化提取,对文本内容做分段处理。特定的字段与单位要求,需添加数据校验环节,过滤不符合单位规范的提取结果,避免后续分析出现数据偏差。此外,焦炭行业的跨生产、销售、期货板块的数据关联需求,要求工作流设置分支编排逻辑,根据财报类型触发不同的处理分支。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
PARSE_TABLE_ENABLE | 开启 | 焦炭财报包含大量结构化生产、销售数据表格,开启后可精准提取核心业务字段 |
SCHEDULE_CRON | 0 0 1 1,4,7,10 *(季度触发)与0 0 1 * * *(月度触发) | 匹配企业财报按季度披露、行业简报按月度更新的节奏 |
分段长度 | 1200-1500 字符 | 覆盖焦炭财报行业分析章节的核心信息,同时避免超出模型上下文上限 |
VAR_ALLOWED_TYPES | ["file", "number", "string"] | 支持上传焦炭检测报告、调用数值型产能数据、传入文本型分析指令 |
PARSE_FILE_TIMEOUT_SECONDS | 900 秒 | 适配大型焦炭企业年报的文件体积,避免解析中途超时中断 |
相似度阈值 | 0.75 | 过滤低相关的非财报类文档,保留高匹配度的行业数据与企业公告 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:AI对话节点返回上下文超限报错,状态码为413。原因:未配置
maxContext参数限制输入长度,未添加输入长度校验节点。 - 现象:自定义知识库选择的全局变量无法正常关联数据,输出字段为空。原因:未正确设置
VAR_ALLOWED_TYPES参数,未指定知识库关联的变量类型。 - 现象:文件上传节点无法触发文档解析,界面提示文件格式不支持。原因:未开启
PARSE_TABLE_ENABLE参数,或UPLOAD_FILE_MAX_SIZE设置过小,超出焦炭财报文件的常规体积。
怎么确认配好了
- 手动触发一次工作流,检查解析后的表格字段是否包含焦炭相关的产能、产量指标,无无关冗余字段。
- 查看定时任务运行日志,确认按设定的
SCHEDULE_CRON周期自动触发工作流运行。 - 上传一份焦炭企业财报测试文件,检查解析耗时未超过
PARSE_FILE_TIMEOUT_SECONDS设置的阈值。 - 测试输入超长文本,确认触发输入长度限制拦截,不返回无响应或异常报错。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。