这个品类的数据长什么样
身份证件KYC的数据来源分为两类,一类是对接国家公安身份核验接口的官方数据,另一类是用户上传的实体证件扫描件或实拍照片。更新节奏上,公安接口数据每季度同步官方库,用户上传的文档无固定更新周期。文档结构为固定版式,包含姓名、公民身份号码、住址、签发机关、有效期限5个核心字段,所有字段均采用标准中文表述,无特殊单位或自定义格式。
这些特征在「多轮对话与提示词」这一环带来什么约束
身份证件的字段固定且格式标准,多轮对话需严格围绕预设字段展开,不能引入无关核验项。公安接口数据的同步周期限制了实时核验的时间范围,提示词需限定调用接口的时间区间,避免使用过期数据。用户上传的图片需先经过OCR解析,多轮对话需衔接OCR提取结果与用户补充信息,确保字段匹配的准确性。同时,单份证件数据量较小,过多的上下文会干扰后续的字段校验逻辑。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
maxContext | 10–15 轮对话上下文 | 身份证件KYC需连贯核对OCR结果、用户补充信息与核验规则,过多上下文会干扰核心字段匹配 |
PROMPT_TEMPLATE | 固定字段核验模板,仅保留姓名、公民身份号码、住址、签发机关、有效期限 | 身份证件字段固定,避免提示词引入无关核验项,确保核验范围精准 |
OCR_REQUIRE_FIELDS | ["姓名","公民身份号码","有效期限"] | 核心字段缺失时触发自动追问,减少用户手动输入成本,提升核验效率 |
UPLOAD_FILE_MAX_SIZE | 5 MB | 身份证件扫描件或照片单文件体积较小,限制后避免无效大文件占用平台资源 |
CHAT_REPLY_FORMAT | 纯文本格式 | 匹配无Markdown格式的输出需求,直接展示核验结果与追问内容 |
maxRetryCount | 2 次 | 身份证件核验需严格匹配官方数据,重试次数过多会延长核验周期,影响用户体验 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:对话结果仅在侧边面板展示,主对话框无内容。原因:未开启
CHAT_DIRECT_REPLY配置,默认将结果定向至文档解析侧边栏。 - 现象:每次发起KYC核验都需新建会话,无法延续多轮对话。原因:未设置
persistChatSession为true,会话默认在单次交互结束后自动销毁。 - 现象:AI回复自动使用Markdown格式,无法调整为纯文本展示。原因:未将
CHAT_REPLY_FORMAT配置为纯文本,默认启用Markdown渲染逻辑。
怎么确认配好了
- 上传一张身份证件扫描件,观察主对话框是否直接展示OCR提取的字段结果,无侧边弹窗跳转。
- 连续输入补充的证件信息,确认对话会话未自动关闭,可连贯完成多轮核验流程。
- 查看AI回复内容,确认未出现Markdown格式的标题、列表等元素,仅展示纯文本格式的核验结果与提示。
- 测试上传仅包含部分核心字段的证件照片,确认系统自动触发缺失字段的追问,未直接返回错误提示。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。