这个品类的数据长什么样
焦炭相关财报数据主要来源于炼焦企业公开披露的年度、季度报告,以及行业协会发布的月度供需监测数据、期货交易所挂牌交易的焦炭品种交割数据。更新节奏分为定期与不定期:年度财报每自然年度末更新,季度财报每季度末更新,行业监测数据每旬或月度更新。文档结构中,焦炭相关模块通常包含产能规模、产销总量、单吨生产成本、产品售价、毛利占比等字段,单位多为吨、元/吨、万元。
这些特征在「多轮对话与提示词」这一环带来什么约束
焦炭财报数据的多源、分周期更新特征,对多轮对话与提示词配置带来明确约束。首先,不同周期的财报数据口径存在差异,多轮对话需支持用户指定数据的时间范围,提示词需预设时间范围校验逻辑,避免跨期数据混淆。其次,焦炭业务字段包含专业术语,多轮对话需支持用户逐步追问术语定义,提示词需内置行业术语的标准解释模板。另外,产销与成本数据存在绑定关系,多轮对话需联动上下文关联数据,提示词需配置上下文召回的关联规则。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
maxContext | 8000–12000 字符 | 焦炭财报单份文档通常超过5000字符,多轮对话需保留至少2份完整财报上下文,避免上下文截断导致数据丢失 |
systemPrompt | 仅基于焦炭相关财报数据回答,需明确标注数据来源与时间范围,无法确认的数据需说明无法获取 | 焦炭财报数据存在多源口径差异,明确来源与时间范围可避免回答偏差 |
chatCompletionModel | gpt-4o-mini 或同级别长上下文模型 | 焦炭财报包含多字段关联数据,长上下文模型可更好处理多轮追问的上下文关联 |
similarityThreshold | 0.75–0.85 | 焦炭财报字段多且专业,阈值过低会引入无关数据,过高会遗漏相关字段信息 |
recallTopK | 前 6–8 条 | 焦炭财报的业务模块包含多个关联字段,召回过多会增加上下文冗余,过少会遗漏关键数据 |
PARSE_FILE_TIMEOUT_SECONDS | 300 秒 | 焦炭财报文档通常包含多张表格与详细数据,解析耗时较长,需延长超时时间避免解析失败 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:调用
/api/v1/chat/completions接口时,回答未遵循焦炭财报分析的专属提示词规则,出现通用AI回答内容。原因:未通过messages数组的system角色传入专属提示词,默认使用全局配置导致提示词不匹配。 - 现象:在同一工作流中配置的对话开场白未实现中英文切换,仅返回单一语言内容。原因:未在提示词配置中加入语言识别逻辑,未针对不同输入语言预设对应的开场白模板。
- 现象:上传焦炭财报的markdown格式文件后,图片链接未携带域名,对话中无法正常加载图片。原因:未在文件解析配置中开启markdown格式的图片域名自动补全功能,仅对word格式文件生效。
怎么确认配好了
- 发起测试对话,询问焦炭某一周期的财报数据,核对回答是否明确标注数据来源与时间范围。
- 调整
similarityThreshold的取值,测试不同阈值下的召回结果数量,确定符合业务需求的取值区间。 - 上传单份焦炭财报文档,发起多轮追问,核对对话可联动上下文关联的多个业务字段。
- 调用
/api/v1/chat/completions接口,传入专属系统提示词,核对接口返回的回答是否遵循预设规则。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。