这个品类的数据长什么样
远程医疗药物警戒的数据主要来源于患者远程问诊记录、电子处方、可穿戴设备监测数据以及患者居家填报的症状日志。这些数据更新频率高,问诊记录和处方通常是实时生成,监测数据可能按分钟级上传,症状日志则由患者按天或周更新。文档结构多样,问诊记录多为非结构化文本,包含医生诊断、患者描述;电子处方是结构化数据,包含药品名称、剂量、用法;可穿戴设备数据是时间序列型,字段如心率、血压、血氧;症状日志是半结构化文本或结构化表格,描述不良事件发生时间、症状、严重程度。字段单位常见有 mg、ml、bpm、mmHg 等。
这些特征在「引用来源与溯源」这一环带来什么约束
远程医疗数据的高更新频率要求知识库能快速同步最新信息,避免引用过时数据导致误判。非结构化问诊记录和半结构化症状日志,需要强大的文本解析能力来准确识别关键信息和不良事件描述。多样化的数据结构意味着在引用时可能需要聚合不同来源的数据片段,例如结合处方信息和症状日志来溯源某个不良反应。时间序列数据在引用时需要考虑时间窗口和趋势分析,确保引用的数据点具有代表性。此外,由于数据敏感性高,对引用来源的精确性和可追溯性要求极高,系统必须能清晰指出信息来自哪个患者、哪个时间点的哪个记录。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
分段长度 | 300–500 字符 | 平衡上下文完整性与检索效率,适应问诊记录中的短句和关键信息 |
召回条数 | 前 8 条 | 考虑到远程医疗场景下不良反应可能涉及多个并发因素,需要更多上下文 |
相似度阈值 | 0.75–0.85 | 确保召回内容的关联性,过滤掉不相关的问诊记录或监测数据 |
重排返回条数 | 前 3 条 | 聚焦最相关的证据,减少无关信息干扰,提升溯源效率 |
引用变量格式 | {{doc.title}} - {{doc.content}} | 明确展示来源文档标题和相关内容片段,方便快速定位 |
引用展示模式 | 仅展示引用链接 | 优先在回复中直接给出结论,按需提供详细引用链接,避免冗余 |
容易做错的三处
- 引用变量
{{doc.title}}或{{doc.content}}为空,原因可能是原始文档解析失败,导致元数据缺失。 - 系统报错
quote type error,通常是因为尝试引用一个不支持的变量类型,例如引用了非文本格式的数据。 - 回复中未能包含完整的引用文件地址,这可能是因为知识库配置中未启用或未正确配置
引用展示模式。
怎么确认配好了
- 提交一个包含典型不良反应描述的问诊记录,检查回复中是否准确引用了相关的处方信息和症状日志片段。
- 测试引用变量是否能正常解析并显示,例如
{{doc.source}}是否能显示原始数据来源的标识。 - 模拟一个药品不良反应事件,检查系统在溯源时是否能提供清晰的时间线和相关数据点,例如从电子处方到患者症状日志的链路。
- 验证在回复中点击引用链接后,是否能正确跳转到对应的原始数据记录或知识库文档。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-21,当时的最新发布版本为 FastGPT v4.17.0。