这个品类的数据长什么样
炼化品类的财报数据主要来自交易所公开披露的定期报告、企业投资者关系板块公告及第三方结构化财报数据库。更新节奏遵循监管要求,年报每年更新一次,半年报、季报分别每半年、每季度更新一次。文档结构包含炼化板块营收、原油加工量、成品油与化工品产量、单位加工成本等核心字段,原油加工量、产量类字段单位多为万吨,营收类单位为亿元,单位加工成本单位为元/吨,部分企业会附带月度生产运营的补充数据。
这些特征在「部署与升级」这一环带来什么约束
炼化品类财报的固定更新周期与批量文档特性,要求部署阶段配置适配批量解析的超时与并发参数,避免大文档解析超时。特定的行业字段与单位要求,需在知识库配置中预设字段抽取规则,升级过程中需保留旧版的字段映射逻辑,避免历史配置失效。临时补充的月度运营数据需支持灵活上传,升级时不能覆盖已配置的自定义解析模板。长文本年报的分段处理,需匹配行业文档的平均长度调整分段参数,避免内容截断影响分析结果。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
PARSE_FILE_TIMEOUT_SECONDS | 600–900 秒 | 炼化财报文档多为长文本,单文件解析耗时较长,该参数可避免大文件解析中断 |
UPLOAD_FILE_MAX_SIZE | 1000 MB | 单份年度财报文档体积较大,需适配大文件上传需求 |
RECALL_CHUNK_NUM | 前 8–12 条 | 炼化财报的核心字段集中在前几个匹配的文档片段,过多召回会增加上下文冗余 |
PARSE_SEGMENT_LENGTH | 1200–1500 字符 | 财报文档包含专业术语与长句,该分段长度可保留语义完整性,避免专业术语拆分断裂 |
INDEXING_BATCH_SIZE | 50–80 份/批 | 批量导入财报文档时,该参数可平衡索引效率与服务器负载,避免docker部署时出现索引停滞 |
HTTP_TOOL_OUTPUT_SHOW | 开启 | 炼化财报分析的工作流常通过HTTP工具调用行业数据接口,开启后可在对话中展示接口返回的中间结果 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:使用HTTP请求做编排时,对话输出结果中不显示工具返回的output内容。原因:未开启
HTTP_TOOL_OUTPUT_SHOW配置项,工具返回的中间结果未被纳入对话上下文。 - 现象:docker部署环境下,知识库索引任务持续处于运行状态,无进度更新。原因:
INDEXING_BATCH_SIZE配置过大,超出服务器内存与CPU负载阈值,导致索引进程阻塞。 - 现象:升级至v4.8.17版本后,财报分析生成的图表无法正常显示,界面返回报错提示。原因:升级后未保留旧版的字段映射配置,炼化财报的专用字段未被正确识别,导致图表渲染所需的数据源缺失。
怎么确认配好了
- 上传一份测试用的炼化财报文档,检查解析后的字段是否包含行业专属核心字段,确认解析规则生效。
- 发起一次财报分析对话,查看HTTP工具调用的中间结果是否正常展示,确认配置项生效。
- 批量上传多份财报文档,观察索引任务的进度更新情况,确认索引参数未超出服务器负载阈值。
- 尝试导入旧版工作流文件,检查工作流节点是否完整加载,确认工作流兼容配置生效。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。