这个品类的数据长什么样
煤化工财报数据主要来自境内外交易所披露的上市公司定期报告、行业协会发布的月度运行数据及企业公开的临时公告。更新节奏以季度、年度为核心周期,临时公告随项目进展或重大变动发布。文档结构包含合并财务报表、经营情况讨论与分析、产能与产量明细等模块,字段涵盖总营收、各细分产品(如甲醇、烯烃、焦油)的产量与单位成本,单位多采用万吨/年、千克标煤/吨产品、万元等专业计量标准,无通用行业的统一简化字段。
这些特征在「多轮对话与提示词」这一环带来什么约束
煤化工财报的细分产品字段多、专业单位复杂,要求多轮对话需跟踪用户指定的报告周期与产品类型,避免跨周期、跨品类的信息混淆。较长的文档内容会导致单轮召回的冗余信息较多,需合理限制上下文窗口的总长度,同时确保召回的内容精准匹配用户的专业查询。此外,临时公告的不定期更新要求对话系统可灵活切换不同报告期的数据源,提示词需明确约束模型仅使用关联的煤化工专属数据作答,避免引入通用煤炭行业的无关信息。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
maxContext | 8000-12000 字符 | 煤化工财报单份分段内容较长,需保留多轮对话中的报告周期、细分产品字段等上下文 |
recall_top_k | 前 6-8 条 | 覆盖煤化工财报中总营收、各产品产量、单位成本等多类细分数据 |
similarity_threshold | 0.72-0.78 | 过滤通用煤炭行业数据,精准召回煤化工专属财报字段 |
PARSE_FILE_TIMEOUT_SECONDS | 300-420 秒 | 单份煤化工年报PDF页数较多,解析耗时高于通用文档 |
system_prompt_template | 仅基于关联的煤化工财报数据作答,明确标注报告周期与计量单位,数据不足时说明无法回答 | 约束模型聚焦专业场景,避免混淆通用术语与煤化工专属参数 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:正式对话中触发知识库关联报错,预览模式无异常。原因:正式对话启用了知识库权限校验,而预览模式未校验,煤化工财报关联的知识库文件权限未正确配置。
- 现象:多轮对话中模型混淆不同报告期的煤化工产品数据。原因:未在系统提示中强制要求明确标注报告周期,上下文未跟踪用户指定的报告期参数。
- 现象:复制对话内容到外部工具后,Markdown格式丢失。原因:未配置对话输出的格式转换规则,默认输出为纯文本,不是结构化格式。
怎么确认配好了
- 上传单份煤化工年度财报PDF,触发解析任务,核对解析完成状态与提取的字段是否包含煤化工专属参数。
- 发起多轮对话,依次询问总营收、甲醇产量、单位煤耗,核对模型是否保留前一轮的报告周期信息。
- 调整相似度阈值后,发起测试查询,核对召回结果是否仅包含煤化工专属财报数据,无通用煤炭行业无关内容。
- 复制对话输出内容到外部工具,核对格式是否符合预设的结构化要求。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。