这个品类的数据长什么样
既往症判定所需的数据主要来自投保时的健康告知存档、理赔阶段提交的门诊/住院病历、医保经办机构的结算明细,以及既往投保的核保档案。数据随单个理赔案件触发更新,单次案件仅加载当前申请对应的专属记录,无全局批量更新。文档结构包含结构化医保结算字段与非结构化病历文本,结构化字段包含ICD-10诊断编码、就诊机构等级、费用金额(单位为元),非结构化文本长度跨度从数百到数万字符不等。
这些特征在「工作流编排」这一环带来什么约束
混合结构化与非结构化的数据特征,要求工作流同时配置结构化字段解析节点与非结构化文本抽取节点,避免单一解析逻辑遗漏关键信息。单次案件触发的数据更新模式,要求工作流不依赖全局缓存的历史数据,每次执行时需重新导入当前理赔申请对应的专属文档,防止跨案件数据混淆。非结构化文本长度跨度大的特点,要求工作流配置动态文本分段规则,适配不同长度的病历文本,避免超出模型上下文限制。标准化的医保字段格式要求,工作流需内置字段校验逻辑,验证ICD编码、费用金额单位等格式合法性,减少后续判定环节的无效输入。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
PARSE_FILE_TIMEOUT_SECONDS | 300-600 秒 | 既往症相关的病历文本通常较长,需要足够时间完成结构化与非结构化解析,避免中途中断 |
UPLOAD_FILE_MAX_SIZE | 20-50 MB | 理赔相关的病历、结算清单单文件通常不超过50MB,该区间可覆盖绝大多数案件的文件上传需求 |
TEXT_SPLIT_CHUNK_SIZE | 800-1200 字符 | 非结构化病历文本跨度大,该区间可平衡上下文完整性与模型处理效率,适配多数视觉与文本模型的输入限制 |
STRUCTURED_FIELD_VALIDATION | 启用并校验ICD-10编码、费用单位 | 医保相关字段需符合行业标准格式,确保后续判定环节的输入数据合法有效 |
BASE64_CONVERSION_ENABLE | 启用 | 理赔材料常包含影像类病历,需先转换为base64格式才能被视觉模型识别与解析 |
WORKFLOW_TRIGGER_MODE | 按单次理赔案件触发 | 数据随单个理赔案件更新,无需全局定时触发,避免跨案件数据混淆 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 工作流执行时提示“文件格式不支持”,未配置
BASE64_CONVERSION_ENABLE参数,无法将上传的影像类病历转换为模型可识别的base64格式。 - 通过API调用工作流上传文件后,系统提示“知识库未关联数据”,未将导入的医疗文件关联至预设的全局知识库变量,或未在工作流中配置知识库召回节点。
- 工作流执行超过预设时间后中断,未调整
PARSE_FILE_TIMEOUT_SECONDS参数,长文本病历的解析时间超出默认阈值。
怎么确认配好了
- 上传一份标准的医保结算清单与门诊病历,查看工作流各节点是否成功解析出ICD-10编码、就诊金额等结构化字段,以及既往病史描述的非结构化文本。
- 调用测试API,传入模拟的理赔案件参数与文件路径,检查返回结果是否包含完整的既往症判定相关数据,无参数缺失报错。
- 配置测试用的超时阈值,上传一份超长病历文本,验证工作流是否在预设时间内完成解析,未出现超时中断。
- 开启字段校验开关,传入格式错误的ICD编码,检查工作流是否触发格式校验提示。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。