资金来源KYC 的多轮对话与提示词

资金来源KYC的核验数据主要来自客户提交的三类材料:银行对公或个人账户流水、年度纳税申报表、固定资产或金融资产的评估证明。数据更新节奏为单次核验时的一次性提

这个品类的数据长什么样

资金来源KYC的核验数据主要来自客户提交的三类材料:银行对公或个人账户流水、年度纳税申报表、固定资产或金融资产的评估证明。数据更新节奏为单次核验时的一次性提交,或按合规审计要求定期更新。文档结构多为多页PDF或结构化CSV文件,银行流水包含交易日期、交易金额、交易对手方、资金流向等字段,纳税申报表包含申报周期、应缴税额、实缴税额等字段,资产证明包含评估值、出具机构、有效期等字段。其中交易金额单位统一为人民币元,交易日期格式为YYYY-MM-DD。

这些特征在「多轮对话与提示词」这一环带来什么约束

资金来源的核验数据多为多页结构化文件,且字段规则随数据源类型变化,因此多轮对话需要按材料类型分批次处理信息,避免上下文过载。同时,资金来源核验需溯源每一笔交易的合规性,对话必须保留完整的历史交互上下文,确保模型能关联前后交易信息。此外,不同材料的字段差异较大,提示词需要明确区分不同数据源的提取逻辑,避免模型混淆字段。另外,资金来源核验存在合规性要求,对话必须主动追问缺失的关键字段,无法通过单次提问覆盖所有核验信息。

配置怎么定

配置项建议取法这样取的依据
maxContext8000–12000 字符资金来源核验需保留多轮交易核对的上下文,该长度可覆盖10轮左右的对话交互,避免上下文溢出
dialogue_round_limit10–15 轮常规资金来源核验需逐笔核对交易、补充缺失的交易对手信息,10-15轮可覆盖绝大多数核验场景
prompt_template针对资金来源KYC场景,先识别提交材料类型,再按银行流水/纳税证明/资产证明分别提取对应合规字段,追问缺失的关键信息,最后生成标准化核验结果资金来源的核验数据字段随材料类型变化,明确模板可避免模型混淆不同数据源的提取规则
recall_top_k前6–8 条资金来源核验需关联交易上下文,召回过多会导致上下文过载,过少会遗漏关键交易细节
similarity_threshold0.75–0.85需准确匹配交易对手方与核验材料的信息,该阈值可平衡匹配准确率与召回率
file_parse_chunk_size1000–1500 字符资金来源的流水文件多为长文本,分块后可保留完整的交易上下文,提升提取准确率

本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。

容易做错的三处

  • 现象:调用对话接口返回400 Bad Request,提示“上下文长度超限”。原因:未配置maxContext参数,未限制对话历史的保留长度,导致多轮交易核对的上下文超出模型支持的最大长度。
  • 现象:对话返回的资金流向、出具机构等字段为空,且未触发追问。原因:提示词未明确要求模型在提取字段时检查完整性,未针对资金来源场景定义追问规则,导致模型遗漏关键合规字段。
  • 现象:无法通过接口获取完整对话记录,仅返回部分交互内容。原因:未开启dialogue_history_export配置项,或调用接口时未携带正确的会话ID参数,导致接口无法定位对应会话的完整历史。

怎么确认配好了

  • 发起一轮测试对话,输入单页银行流水的片段,核对模型是否能正确提取交易金额、交易对手方字段,根据提取准确率调整similarity_threshold。
  • 调用对话接口,检查返回结果中是否包含完整的会话历史,确认dialogue_history_export配置项已开启。
  • 模拟多轮追问交易细节,比如先询问某笔交易的对手方,再询问该对手方的关联交易,检查模型是否能保留之前的交易上下文,根据上下文保留情况调整maxContext。
  • 上传多份不同类型的资金来源材料,比如银行流水和纳税证明,检查模型是否能分别按材料类型提取对应字段,根据字段匹配度调整prompt_template。

问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。