焦煤投研知识库建设的对话日志与审计

焦煤数据来源包括国内煤炭行业协会公开监测数据、焦煤期货交易所行情数据、上游矿山与下游钢厂的公开贸易台账。更新节奏分为三类:期货行情每日更新,行业供需周报每周

这个品类的数据长什么样

焦煤数据来源包括国内煤炭行业协会公开监测数据、焦煤期货交易所行情数据、上游矿山与下游钢厂的公开贸易台账。更新节奏分为三类:期货行情每日更新,行业供需周报每周更新,年度产能政策报告按季度发布。文档结构分为行情快照、供需台账、政策解读三类,每个文档包含品类核心参数、交易数据、关联产业动态。核心参数字段包括灰分指标、粘结指数、交割品级,单位为吨、元/吨、千焦/千克。

这些特征在「对话日志与审计」这一环带来什么约束

焦煤数据的多更新节奏、多来源属性与多核心参数特征,对对话日志与审计带来三重约束。第一,不同类型数据的生命周期差异明显,期货行情需留存至对应交割周期结束,行业周报需留存至下一期报告发布,日志需按数据分类设置自动归档规则。第二,焦煤核心参数涉及灰分、粘结指数等多维度指标,审计时需追踪每个参数引用的原始文档标识,避免跨文档的参数混淆。第三,数据来源包含公开监测数据与内部贸易台账,日志需区分公开访问与内部调用的权限标识,确保审计可追溯访问主体与数据权限范围。

配置怎么定

配置项建议取法这样取的依据
log_retention_days按数据分类设置:期货数据7天,行业报告30天匹配焦煤不同数据的生命周期,避免无效存储占用
audit_log_include_source开启需追踪焦煤数据的原始来源,确保审计可验证引用真实性
max_context_length8000–12000 字符焦煤文档包含多维度参数与交易数据,需足够上下文长度支撑完整对话逻辑
api_custom_context_enable开启支持自定义传入上下文,适配焦煤投研中需直接引用特定报告片段的场景
batch_process_timeout600 秒焦煤批量解析多份行业报告时,需足够时间处理长文档内容
log_tag_enable开启,按数据类型打标便于后续按焦煤的行情、报告分类检索审计日志

本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。

容易做错的三处

  • 现象:未开启log_tag_enable,无法按焦煤数据类型检索审计日志。原因:未针对焦煤多分类数据配置标签规则,导致日志无有效分类标识。
  • 现象:开源版4.8.11中,批量上传焦煤长文档时出现try reducing the size of the batch报错,进程卡住。原因:未调整batch_process_timeout与UPLOAD_FILE_MAX_SIZE参数,批量处理的文档总长度超出系统默认阈值。
  • 现象:通过API传入自定义焦煤报告片段时,系统仍拼接历史对话内容,无法获取指定片段。原因:未开启api_custom_context_enable参数,导致自定义上下文功能未生效。

怎么确认配好了

  • 发起一次焦煤期货行情相关的对话,检查日志中是否包含该会话的来源标识与数据引用标签。
  • 上传一份焦煤行业报告,查看批量处理任务的超时时间是否符合预设配置,无报错完成解析。
  • 生成免登录分享链接,发起对话后在审计面板中检索该会话记录,确认可正常查看。
  • 调用API传入自定义焦煤报告片段,检查对话上下文是否包含传入的指定内容,不涉及系统拼接的历史记录。

问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。