这个品类的数据长什么样
调味品的溯源数据主要来自三类渠道:一是全国调味品标准化技术委员会发布的行业监测文档,二是生产企业公开的原料采购与生产检测报告,三是商超系统的动销与溯源条码数据。数据更新节奏存在差异:行业监测文档按月更新,企业检测报告随生产批次实时更新,动销数据按周更新。单份文档结构包含产品条码、生产批次号、原料溯源编码、检测项目及对应数值、经销商备案信息等字段,字段单位多为mg/kg(检测值)、箱/吨(销量)、字符串型(条码与批次号)。
这些特征在「引用来源与溯源」这一环带来什么约束
由于调味品溯源数据包含条码、批次号等精准标识字段,引用环节需优先匹配这些字段,若使用泛文本检索,易召回无关的行业通用数据。不同渠道数据更新频率差异较大,需针对不同数据源设置对应召回的时间范围,避免引入过期的生产批次信息。单份文档内字段关联紧密,如批次号对应特定检测报告,分段解析时需保证分段长度覆盖完整的字段组,否则会割裂溯源信息的关联性。此外,调味品溯源数据的检测项与数值需严格对应,引用时需保留字段与单位,否则会影响尽调报告的准确性。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 | |||
|---|---|---|---|---|---|
召回条数 | 前8条 | 调味品溯源数据单条长度适中,过多召回会导致引用冗余,过少则无法覆盖完整尽调所需的溯源信息 | |||
相似度阈值 | 0.75–0.82 | 调味品的条码、批次号等字段辨识度较高,阈值过低会引入无关的行业通用文档,过高则无法召回匹配的溯源数据 | |||
分段长度 | 1000–1200 字符 | 调味品溯源文档常包含多组关联字段,分段长度覆盖完整字段组可避免割裂溯源信息的关联性 | |||
PARSE_FILE_TIMEOUT_SECONDS | 90 秒 | 批量溯源文档包含多页检测报告,解析耗时较长,设置90秒可避免因超时导致的解析失败 | |||
引用模板 | `{{source.title}} | 批次号:{{source.metadata.batch_no}} | 检测项:{{source.metadata.test_item}} | 单位:{{source.metadata.unit}}` | 调味品尽调需明确溯源的批次、检测项与对应单位,模板需包含核心溯源字段 |
重排返回条数 | 前3条 | 调味品溯源信息需精准匹配,重排后保留最相关的3条即可满足尽调需求 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象为工作流中AI回答未引用查询结果,原因是未开启
启用引用配置项,或未将知识库召回结果传入提示词的上下文变量中。 - 现象为代码运行节点中无法选择知识库引用变量,原因是未将知识库输出节点连接至代码节点的输入端口,或未开启知识库节点的
输出元数据配置。 - 现象为回复仅展示引用内容无正文信息,原因是提示词中仅配置了引用展示规则,未设置正文生成的逻辑,或知识库召回结果为空但触发了强制引用输出。
怎么确认配好了
- 上传一份包含明确批次号与检测项的调味品溯源文档,运行工作流后检查回复内容,确认是否包含文档中的核心溯源字段。
- 查看知识库的召回日志,确认返回的结果条数与
召回条数配置的取值一致。 - 检查工作流的输出节点元数据,确认是否包含
batch_no、test_item等配置的溯源字段。 - 调整
相似度阈值至0.70与0.85,测试召回结果的相关性,确认阈值调整后召回结果符合预期。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。