这个品类的数据长什么样
中药尽调报告的数据来源涵盖中国药典、地方炮制规范、批次检验报告、种植溯源档案等。数据更新节奏差异显著:中国药典每5年正式修订一次,地方炮制规范随区域监管要求调整,批次检验报告与溯源档案随生产批次实时更新。文档结构包含结构化字段(如品名、批次号、含量测定值)与非结构化文本(如性状描述、炮制方法),字段单位涉及mg/g、g/kg、mm等专业计量标准,单份文档长度跨度较大。
这些特征在「工作流编排」这一环带来什么约束
中药数据源的多源性与格式差异要求工作流需配置多源数据接入节点,实现结构化检验数据与非结构化药典文本的统一解析。字段单位的专业性要求工作流内置单位校验与归一化节点,避免因单位不匹配导致的数据分析偏差。更新节奏的差异要求工作流支持定时全量同步与手动增量触发的组合模式,适配不同数据源的更新频率。文档长度跨度大的特征要求工作流配置灵活的分段规则,兼顾长文本解析完整性与上下文token限制。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
分段长度 | 800–1200 字符 | 中药尽调报告包含长文本的性状描述与含量测定数据,分段过长会破坏语义连贯性,过短会导致上下文碎片化 |
知识库召回条数 | 前 8–12 条 | 中药数据源包含药典、检验报告、溯源数据多类,过多召回会触发token超限,过少会遗漏关键鉴别信息 |
相似度阈值 | 0.75–0.85 | 中药专业术语语义相似度较高,阈值过低会引入无关数据,过高会遗漏同品类不同批次的有效信息 |
PARSE_FILE_TIMEOUT_SECONDS | 300 秒 | 单份批量中药检验报告或溯源档案解析耗时较长,超时会导致工作流节点中断 |
引用上限 | 1000–1500 字符 | 中药尽调报告需整合多源字段,引用上限过低会丢失完整的含量测定或炮制规范数据 |
工作流触发方式 | 定时触发+手动触发 | 药典数据更新周期固定,批次报告随生产节奏更新,需兼顾自动增量同步与临时手动尽调需求 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:在单个Bot内配置工作流时,仅能调用单个顶层工作流,无法直接添加多个独立工作流。原因:未使用“子工作流调用”节点,未开启工作流嵌套权限,导致无法实现多工作流组合。
- 现象:导入他人分享的工作流JSON后,本地画布中无法找到文本加工模块。原因:本地FastGPT版本低于v1.12.0,该版本后文本加工模块才被纳入官方默认工作流节点库。
- 现象:设置
引用上限为2000后,生成的尽调报告仍触发token超限提示。原因:未结合中药数据源的平均文本长度调整分段长度参数,单段文本过长导致累计token超出模型限制。
怎么确认配好了
- 执行单次测试工作流,核对返回的尽调报告中是否包含所有配置的数据源字段,确认字段映射无缺失。
- 调整
相似度阈值与知识库召回条数参数,执行多批次测试,确认召回结果覆盖药典、检验报告、溯源数据三类核心数据源。 - 上传单份最长的中药尽调文档,核对工作流执行时长是否在
PARSE_FILE_TIMEOUT_SECONDS设置范围内,无超时报错。 - 导出工作流JSON文件,核对文本加工节点、子工作流调用节点是否已正确配置,无缺失节点配置。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。