这个品类的数据长什么样
投资平台的智能尽调报告数据主要来自公开上市公司财报、行业监管披露文件、合作机构提供的项目尽调底稿及第三方投研数据库。数据更新节奏依来源不同区分,财报类按季度、年度更新,监管文件实时推送,项目底稿随项目推进动态更新。单份尽调报告文档结构通常包含主体基本信息、核心财务指标、风控合规条款、关联交易明细、投研评级结论等模块。字段包含总资产、营业收入、关联交易金额等,对应单位分别为元、元、万元。
这些特征在「多轮对话与提示词」这一环带来什么约束
投资平台尽调报告的数据分散来源与格式差异,要求多轮对话需支持跨源字段对齐,提示词需明确指定不同数据源的字段映射规则,避免数据混淆。不同来源的更新节奏差异,要求对话上下文需动态过滤过期数据,仅保留近30天内的有效信息。单份尽调报告篇幅较长,多轮对话需限制上下文窗口内的有效内容占比,避免冗余信息干扰核心查询。字段单位存在差异,提示词需强制要求对话输出统一单位的计算结果,适配投资分析的标准化需求。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
maxContext | 8000–12000 字符 | 适配单份尽调报告的核心内容长度,结合多轮对话历史上下文,避免超出模型窗口限制 |
recallTopK | 前3–5 条 | 尽调报告的核心分析字段集中在TOP3-5的检索结果中,过多召回会引入冗余信息 |
promptTemplate | 固定指定以万元为单位输出财务指标,仅保留近30天的数据源,对齐不同来源的字段映射规则 | 适配投资平台的标准化分析需求,避免单位混淆与数据过期 |
PARSE_FILE_TIMEOUT_SECONDS | 300 秒 | 单份尽调报告篇幅较长,解析需足够时间完成文本拆分与字段提取 |
maxConversationRounds | 5–8 轮 | 尽调分析的多轮追问通常不超过8轮,过多轮次会导致上下文冗余 |
similarityThreshold | 0.75–0.85 | 过滤低相关的尽调文档片段,保留核心关联内容 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:4.6.9版本及以上高级编排中配置判断器后,AI对话无法获取初始用户问题。原因:未在判断器的输出变量中绑定
userQuery字段,导致后续AI节点无法读取原始提问内容。 - 现象:对话日志中显示的用户标识字段为空。原因:未配置对话上下文的用户信息同步规则,未将平台用户的唯一标识传入对话节点。
- 现象:多轮对话返回的尽调数据单位不统一。原因:提示词模板未明确指定统一单位的输出要求,导致模型随机使用不同单位生成结果。
怎么确认配好了
- 上传一份测试用的尽调报告,发起包含财务指标追问的初始提问,核对对话上下文是否包含该提问内容。
- 发起多轮追问,核对每次回复的上下文是否过滤了超过30天的旧数据源信息。
- 调整相似度阈值后,核对召回的文档片段数量是否符合预期,无过多低相关内容。
- 配置提示词模板后,发起包含单位转换需求的提问,核对回复是否统一使用万元为单位输出。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。