这个品类的数据长什么样
炼化品类的财报数据主要来自境内外上市公司公开披露的年度、季度定期报告,以及行业自律组织发布的月度运行监测数据。数据更新节奏以季度、年度为核心周期,月度补充性数据按需更新。文档结构包含原油加工量、成品油产出占比、化工品营收占比、单位加工成本、产能利用率等字段,单位多涉及吨、元/吨、亿元等工业与财务通用单位,单份完整财报文档包含多维度的业务与财务交叉数据内容。
这些特征在「多轮对话与提示词」这一环带来什么约束
炼化财报的多源数据结构与长文档特征,要求多轮对话需保留跨轮次的字段口径一致性,避免因上下文丢失导致的口径偏差。多维度的工业与财务字段组合,要求提示词需明确指定数据的统计范围,例如合并报表或母公司口径。长文档篇幅会带来上下文冗余,需限制有效召回的文档片段长度,仅保留与当前对话主题相关的炼化板块数据。不同更新周期的数据源,要求对话流程支持按季度、月度筛选数据的参数配置,确保返回数据的时间范围匹配用户实际查询需求。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
maxContext | 8000–12000 字符 | 炼化财报单份文档片段较长,需保留足够上下文支持多轮口径延续 |
recallTopK | 前 6–8 条 | 炼化数据字段多,需召回足够相关片段覆盖业务与财务交叉维度 |
similarityThreshold | 0.75–0.85 | 平衡召回精度与覆盖度,避免无关的非炼化板块数据混入 |
PARSE_FILE_TIMEOUT_SECONDS | 300 秒 | 长财报文档解析需较长时间,防止因超时中断对话流程 |
promptTemplate | 按炼化财报口径整理数据,保留单位与统计范围 | 明确指定字段的工业与财务单位,对齐用户的行业查询需求 |
sessionHistoryMaxLength | 前 10 轮对话 | 控制多轮对话的上下文冗余,仅保留关键口径与问题关联 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:调用对话接口时返回
408 Request Timeout错误码,工作流执行至知识库搜索环节后中断。原因:未将PARSE_FILE_TIMEOUT_SECONDS配置为适配长财报解析的时长,导致文档解析未完成即触发超时。 - 现象:对话返回的炼化数据单位混乱,同时出现吨与千克、元与万元。原因:提示词模板未明确指定字段的标准单位与统计范围,导致AI混用不同口径的单位数据。
- 现象:对话界面无内置点赞交互组件,无法触发官方点赞反馈。原因:v4.8.10及更早版本的官方对话接口未内置点赞功能,需自行基于对话事件回调实现该交互。
怎么确认配好了
- 上传一份完整的炼化财报文档,触发知识库解析,核对解析任务的超时时间是否符合配置的
PARSE_FILE_TIMEOUT_SECONDS取值。 - 发起多轮对话,先询问某季度的炼化总营收,再追问对应板块的成品油毛利,核对AI是否保留了之前的季度口径。
- 测试对话交互,确认可基于接口事件实现点赞功能,或核对界面是否已加载对应组件。
- 查看对话日志的存储配置,确认会话历史的保留规则符合业务需求,无自动删除的异常设置。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。