罕见病制度的工作流编排

罕见病领域的制度与SOP文档数据主要来源于国家卫生健康委员会、药品监督管理局、各省市医保局发布的政策文件、临床诊疗指南、药物可及性方案以及医院内部制定的操作

这个品类的数据长什么样

罕见病领域的制度与SOP文档数据主要来源于国家卫生健康委员会、药品监督管理局、各省市医保局发布的政策文件、临床诊疗指南、药物可及性方案以及医院内部制定的操作规程。这些数据更新频率相对较低,通常以季度或年度为单位进行修订。文档多以PDF、Word格式呈现,结构化程度不一,部分为条文式法规,部分为包含图表和流程图的临床路径。关键字段包括疾病名称、诊断标准、治疗方案、用药目录、医保支付范围、审批流程、随访要求等,其中涉及的剂量单位(如 mg/kg)、时间单位(如 周、月)和诊断指标(如 酶活性单位)具有高度特异性。

这些特征在「工作流编排」这一环带来什么约束

罕见病制度文档的低更新频率意味着知识库的索引重建无需过于频繁,可以降低资源消耗。其复杂且多样的文档结构,特别是包含图表和流程图的SOP,要求工作流中的文档解析组件(PARSE_FILE_TYPE)具备强大的多模态处理能力,以确保信息完整提取。特有的字段和单位对信息提取的准确性构成挑战,需要更精细的文本分段策略(分段长度)和实体识别(实体抽取)步骤。此外,由于罕见病诊疗往往涉及多学科协作,工作流需要能灵活编排多轮问答与决策分支,以应对复杂情况下的制度解读需求,例如根据患者具体情况判断是否符合特定治疗的医保报销条件。

配置怎么定

配置项建议取法这样取的依据
分段长度800–1200 字符罕见病文档内容密度高,长分段有助保留上下文,避免信息割裂。
重叠长度100–200 字符确保分段边界上下文不丢失,提升召回准确率。
召回条数8–12 条制度解读可能涉及多个相关条款,增加召回量可提升覆盖率。
相似度阈值0.75–0.85罕见病制度问答对精准度要求高,需较高阈值过滤不相关内容。
实体抽取启用,配置疾病、药物、剂量等特定词表精准识别罕见病领域特有实体,提高问答的专业性。
最大处理Token4000应对复杂制度条款,确保模型能够完整处理输入上下文。

容易做错的三处

  • 在工作流中 知识库搜索 组件的 检索内容为空 分支未正确配置,导致当罕见病相关政策在知识库中未被命中时,系统无法给出有效引导或备选方案,仅返回空结果。
  • 变量 在 表单输入 组件中未正确传递,例如 patient_diagnosis 变量值为空,导致下游的 条件判断 无法基于患者诊断信息进行逻辑分支。
  • 在处理含有流程图的PDF文档时,文件解析 组件未能正确识别图中的文本内容或箭头指向,导致关键步骤信息缺失,影响后续 工作流 对审批流程的解读。

怎么确认配好了

  • 针对典型罕见病诊疗场景,输入多组复杂问题,检查工作流输出的制度解读是否完整引用了相关条款,并能正确识别其中的疾病名称、药物剂量等关键信息。
  • 模拟知识库中缺少特定罕见病政策的情况,验证工作流是否能触发预设的 无结果处理 分支,并给出合理的提示或引导用户进一步操作。
  • 检查工作流中 条件判断 组件的日志,确认其根据输入的患者数据(如诊断、年龄、体重等)正确选择了不同的逻辑路径,例如判断是否满足特定药物的医保支付条件。

问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-21,当时的最新发布版本为 FastGPT v4.17.0。