这个品类的数据长什么样
热力投研的数据主要来自热力管网实时监测传感器、热力生产调度系统、行业政策文件、供热负荷预测模型输出及公开研报。实时监测数据以分钟级更新,政策与研报文档不定期更新。单条数据包含结构化字段:监测点编号、采集时间戳、供水温度(℃)、回水压力(kPa)、热流量(m³/h),半结构化的区域监测报表,以及非结构化的行业分析文档,字段需关联对应供热区域与管网节点标识。
这些特征在「对话日志与审计」这一环带来什么约束
热力投研数据的实时性要求对话日志需完整保留原始采集时间戳与监测点关联标识,避免仅存储加工后结果。数据同时包含结构化运行参数与非结构化研报,日志需区分不同类型的输入输出内容,支持按监测区域、采集时段筛选审计记录。热力数据关联公共服务合规要求,审计链路需覆盖API调用、用户提问、知识库召回的具体文档ID与参数,同时需限制日志存储周期,避免因数据量过大超出常规存储阈值。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
LOG_RETENTION_DAYS | 90 天 | 符合热力行业公共服务数据审计的常规留存要求,平衡存储成本与溯源需求 |
INCLUDE_SOURCE_DOC_IN_LOG | 开启 | 热力投研需追溯召回的监测报表、政策文件等源数据,完整审计链路需包含文档标识 |
DAILY_API_LOG_STORAGE_QUOTA | 50 GB | 适配单热力项目的监测节点规模,避免单日日志量超出常规存储阈值 |
MAX_HISTORY_TOKENS | 8000–12000 | 覆盖热力投研中多组参数对比、跨时段分析的对话上下文需求 |
LOG_EXPORT_ALLOWED_FIELDS | 采集时间,监测点ID,用户提问,召回文档ID | 简化审计筛选流程,仅保留热力投研场景下核心的溯源与核查字段 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:API调用生成的对话记录无法在管理后台的日志列表中查看。原因:未开启
API_CALL_LOG_ENABLE配置项,导致API交互的对话日志未被写入存储。 - 现象:不同用户的对话历史无法按身份隔离,任意用户可查看全部对话记录。原因:未配置
USER_CONVERSATION_ISOLATION为开启状态,日志未关联用户唯一标识。 - 现象:日志预览中Human字段为空。原因:未正确传递用户提问的原始文本参数,或参数未按
human字段名传入接口,导致日志无法捕获用户输入内容。
怎么确认配好了
- 调用测试API生成一条对话记录,检查日志列表中是否包含该记录的预设核心字段。
- 使用两个不同的测试用户身份发起对话,验证各自仅能查看自身的对话历史记录。
- 手动导出一份日志样本,确认导出字段包含预设的审计所需信息,无缺失。
- 触发一次知识库召回操作,检查日志中是否关联了对应召回文档的唯一标识。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。