这个品类的数据长什么样
动力煤数据的来源涵盖国内煤炭行业协会公开报告、沿海港口现货交易平台、期货交易所交割仓单数据及重点电厂采购记录。更新节奏分为多个层级:现货价格每日更新,周度发布区域供需数据,月度更新进口量统计,季度发布产能调整报告。文档以结构化Excel、CSV表格为主,部分行业分析为带图表的PDF格式,核心字段包含产地名称、挂牌价格、热值、干基硫含量、港口库存、运输时效,对应单位分别为元/吨、千卡/千克、毫克/千克、万吨、元/吨·公里。
这些特征在「多轮对话与提示词」这一环带来什么约束
数据源分散且更新频率分层,要求多轮对话按周期维度逐步引导用户补充数据,避免一次性请求过多跨周期信息。结构化与非结构化文档并存,提示词需明确区分结构化表格提取与非结构化图表解析的规则,防止混淆字段归属。多维度字段搭配多样单位,提示词需强制要求输出时标注对应单位,减少人工校对成本。不同维度数据存在强关联逻辑,比如价格随热值、运输成本波动,多轮对话需逐步拆解关联条件,确保提取逻辑清晰。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
maxContext | 8000–12000 字符 | 动力煤尽调数据包含多维度历史记录,较长上下文可保留完整分析脉络 |
chunkSize | 1000–1500 字符 | 适配动力煤数据的结构化表格长度,避免拆分破坏字段关联 |
similarityThreshold | 0.75–0.85 | 过滤低相关的非动力煤品类数据,提升提取精度 |
enableMarkdownRender | 开启 | 确保提示词中定义的markdown格式被正确渲染为展示效果 |
showTokenCount | 开启 | 分别显示输入输出tokens数量,便于监控调用成本 |
maxTokenOutput | 3000 字符 | 匹配尽调报告的标准输出长度,避免截断关键数据 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:输出结果为markdown源码,格式未经过渲染。原因:未开启
enableMarkdownRender配置项,仅将提示词格式作为纯文本输出。 - 现象:对话过程中无法查看输入、输出的tokens数量。原因:未开启
showTokenCount配置项,平台默认不展示token统计数据。 - 现象:发起多轮对话后仍无法获取指定周期或维度的有效动力煤数据。原因:提示词未明确提取规则,未引导用户补充必要参数,或未调整召回参数适配动力煤数据量。
怎么确认配好了
- 上传一份结构化动力煤数据文档,触发预设提示词的问答流程,查看输出结果,确认markdown元素被正确渲染为可视化效果。
- 进入对话界面的设置面板,确认
showTokenCount开关处于开启状态,发起一次查询后查看界面是否显示输入、输出的tokens统计数据。 - 发起多轮追问,分别查询不同时间周期、不同维度的动力煤数据,确认系统能准确识别查询条件并返回对应结果。
- 调整
chunkSize和topK参数后,测试召回数据的完整性,确认无关键信息遗漏或结果截断。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。