这个品类的数据长什么样
化妆品投研数据来源包括国家药监局化妆品备案平台、品牌官方成分披露页面、第三方成分检测数据库、电商平台用户评价、行业消费研报。更新节奏随数据源类型调整,备案数据按监管要求同步更新,成分数据库随行业成分迭代调整,电商评价实时同步。单篇数据文档包含成分名称、浓度标注、备案编号、发布时间、用户评价星级、来源渠道等字段,单位涉及mg/g、%、ppm等。
这些特征在「对话日志与审计」这一环带来什么约束
化妆品投研数据多源异构且字段格式特殊,要求对话日志必须完整标记每条数据的来源类型,确保审计时可追溯合规与非合规数据源。成分浓度、单位等字段的特殊性,要求日志需校验字段格式一致性,避免审计时出现单位混淆。实时更新的电商评价数据,要求日志支持按精确时间戳索引,匹配投研场景的即时查询需求。此外,化妆品数据的合规性要求较高,日志需单独区分官方备案数据与第三方公开数据的记录标记。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
log_enable | 全量开启 | 覆盖投研全链路的对话与操作记录 |
log_retention_days | 180 天 | 符合金融投研审计的合规留存周期 |
hide_chain_log | 开启 | 避免对话历史展示AI思考过程,匹配投研场景使用习惯 |
workflow_log_sync | 开启 | 确保工作流内调用的插件、子应用同步记录日志 |
api_log_include_sources | api,web,plugin | 覆盖所有投研工具的调用入口 |
log_field_check | 开启浓度、单位字段校验 | 匹配化妆品数据的特殊字段格式要求 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:对话历史中包含未配置的AI思考过程片段。原因:未开启
hide_chain_log配置,导致链执行日志被写入对话记录。 - 现象:工作流内调用子应用或插件后,对应操作未出现在对话日志中。原因:未开启
workflow_log_sync配置,工作流内部调用未同步日志。 - 现象:通过API拉取历史记录时,
source字段仅返回api值,无法获取其他场景的调用记录。原因:未配置api_log_include_sources为全量场景,过滤了非API来源的日志。
怎么确认配好了
- 发起一次网页端的化妆品成分查询对话,查看对话日志面板是否完整记录调用时间、用户输入、AI返回内容。
- 配置
workflow_log_sync后,运行包含插件调用的投研工作流,核对日志面板是否包含插件执行的详细记录。 - 通过API调用拉取历史对话,检查
source字段是否包含配置的场景类型。 - 查看系统日志面板,确认无日志丢失或过滤的异常提示。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。