高值耗材制度的工作流编排

高值耗材制度文档主要来源于医疗机构内部管理规定、国家及地方卫健委发布的相关政策法规。数据更新频率相对较低,通常为季度或年度更新,涉及政策变动时可能临时更新。

这个品类的数据长什么样

高值耗材制度文档主要来源于医疗机构内部管理规定、国家及地方卫健委发布的相关政策法规。数据更新频率相对较低,通常为季度或年度更新,涉及政策变动时可能临时更新。文档结构以非结构化文本为主,常包含 Word 文档、PDF 文件和少量 Excel 表格。核心字段包括耗材编码、品名、规格型号、生产厂家、注册证号、采购价格、使用科室、审批流程、报废标准等。单位涉及金额(元)、数量(个/套)、时间(天/月/年)等,部分耗材会涉及特殊的计量单位如毫升、克等。文档中还会包含大量的流程描述、责任主体、例外情况说明等。

这些特征在「工作流编排」这一环带来什么约束

高值耗材制度数据更新频率低,意味着知识库的索引重建无需过于频繁,可以降低系统资源消耗。文档以非结构化文本为主,对文本解析和分段策略提出了较高要求,需要确保制度条款的完整性不被破坏。制度文档中包含大量流程描述和责任主体,要求工作流能够准确识别并关联这些实体,从而在问答中提供精确的流程指引。字段和单位的多样性,尤其是采购价格、使用科室等敏感信息,在问答时需要工作流能够进行恰当的上下文理解和信息抽取,避免误读或遗漏关键数据。此外,制度中常包含例外情况说明,要求工作流具备一定的逻辑判断能力以处理复杂查询。

配置怎么定

配置项建议取法这样取的依据
分段长度800–1200 字符确保制度条款的完整性,避免关键信息被截断。
分段重叠长度100 字符保证上下文连续性,提升召回质量,尤其适用于流程描述。
召回条数前 5–8 条考虑到制度文档的严谨性,增加召回条数以覆盖更多相关条款。
相似度阈值0.75提高召回结果的相关性,过滤掉不相关的制度条文。
重排返回条数3 条在高召回量基础上,通过重排精选最核心的几条制度依据。
PARSE_FILE_TIMEOUT_SECONDS600 秒制度文档通常较长,延长解析超时时间以避免解析失败。

容易做错的三处

  • AI 回答中未能准确引用制度条款,而是自行总结或生成内容。原因是分段策略不当,导致制度原文被切分得过于零碎,LLM 难以重建完整语境。
  • 用户提问关于特定耗材的审批流程时,AI 无法给出明确的步骤或责任人。原因是工作流中的实体识别与关系抽取模块配置不足,未能有效识别出流程中的关键节点和参与方。
  • 上传的长篇制度文档解析失败或耗时过长。原因是 PARSE_FILE_TIMEOUT_SECONDS 参数设置过小,或文件解析服务处理大文件的并发能力不足。

怎么确认配好了

  • 选择 5 份典型的制度文档进行上传和解析,检查解析日志是否无报错,并随机抽查 3-5 处文档分段是否符合预期。
  • 针对高值耗材的采购、使用、报废等核心流程,提出 10 个以上覆盖不同角色的问题,检查 AI 回答是否能准确引用制度原文,并提供正确的流程指引。
  • 模拟用户提问中包含特定耗材名称和价格信息,验证 AI 回答中能否准确抽取并呈现这些数值,同时核对单位是否正确。

问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-21,当时的最新发布版本为 FastGPT v4.17.0。