这个品类的数据长什么样
化妆品智能尽调报告的数据主要来自国家药品监督管理局官方备案数据库、品牌方公开的产品检测报告及成分公示文档。数据随新备案产品提交、已备案产品配方或注册信息变更时更新。结构化备案文件包含产品名称、备案编号、生产企业信息、成分列表、备案日期、产品类别,非结构化文件包含产品检测报告PDF、成分说明文档。成分列表仅列明成分通用名称,无固定单位标注,字段类型涵盖字符串、日期、列表等。
这些特征在「工作流编排」这一环带来什么约束
这些特征在工作流编排环节带来明确约束。官方备案数据库的结构化数据需通过API拉取,工作流需配置API调用节点处理接口鉴权与分页逻辑。非结构化检测报告PDF需解析,需适配长文本分段配置。成分列表无统一格式与单位,需在工作流中加入标准化处理环节,统一成分通用名称。备案信息更新无固定周期,工作流需设置灵活的触发规则,避免使用过期数据。产品类别区分普通与特殊化妆品,需配置分支判断节点,按类别调用不同的尽调规则。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
分段长度 | 800–1200 字符 | 化妆品检测报告文本较长,适配大模型上下文窗口限制 |
API 请求超时 | 300 秒 | 官方备案数据库接口响应存在波动,预留足够拉取时间 |
工作流触发方式 | 定时触发 + 手动触发 | 适配备案数据按需更新与实时同步的需求 |
变量映射规则 | 按字段名精准匹配 | 避免成分列表等无统一格式字段的映射错误 |
分支条件匹配模式 | 全匹配 | 准确区分普通与特殊化妆品的尽调分支 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 工作流运行后,AI对话节点无法获取代码运行输出的成分列表内容,界面显示变量为空。未在代码节点配置输出变量的映射规则,导致变量未被正确写入工作流上下文。
- 工作流拉取备案数据时返回404状态码,流程直接中断。未配置API请求的自动重试机制,官方备案数据库接口临时不可用时未自动恢复请求。
- 工作流解析检测报告后,返回的有效内容条数远少于实际文档。分段长度设置不合理,导致长文本被过度截断,丢失部分检测数据。
怎么确认配好了
- 手动触发一次工作流,核对拉取的备案数据字段与预设字段是否匹配,确认变量映射规则生效。
- 查看工作流运行日志,确认API请求无连续超时,验证超时时间配置适配接口响应波动情况。
- 对比解析后的检测报告文本与原文档,确认文本分段无过度截断,适配后续大模型处理需求。
- 触发产品类别分支节点,验证普通与特殊化妆品的流程分支是否按预设规则跳转。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。