这个品类的数据长什么样
综合服务研报检索的数据来源包含券商研究所公开研报、公募基金投研文档、行业协会发布的行业分析报告。更新节奏为每日更新券商晨会、行业周报,每周更新深度研报,每月更新行业全景报告。单篇文档结构包含标题、发布机构、发布时间、核心观点、行业跟踪数据、标的评级等字段,其中「报告页数」单位为页,「覆盖标的数量」单位为家,「发布时间」为标准日期格式字段。
这些特征在「多轮对话与提示词」这一环带来什么约束
研报数据单篇篇幅较长且字段丰富,要求多轮对话需精准关联单篇报告内的特定字段信息,避免跨报告混淆。高频更新的数据源要求提示词需明确指定优先使用最新发布的报告内容,防止引用过时信息。多轮追问场景下,需保留当前会话内的报告标识与核心字段上下文,确保后续提问能直接关联到已提及的研报内容。同时,研报的结构化字段与非结构化文本混合的特征,要求提示词需明确区分数据字段与分析观点,避免生成错误关联。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
maxContext | 前 8–12 条会话上下文 | 研报内容篇幅较长,过多上下文会挤占模型窗口,8-12条可覆盖多轮追问的关联需求且不超出常规模型上下文限制 |
promptTemplate | 「请基于以下研报内容回答用户问题:{context}。用户问题:{question}。需严格匹配研报中的字段名称与数值单位。」 | 研报存在结构化字段,明确提示词要求匹配字段可避免生成错误关联 |
relevanceThreshold | 0.75–0.85 | 研报内容专业且字段分散,阈值过低会召回无关报告,过高会遗漏相关内容,0.75-0.85可平衡召回精度与覆盖范围 |
rerankTopN | 前 5–7 条召回结果 | 研报来源多样且数量较多,重排后取前5-7条可确保核心相关报告被纳入上下文,同时控制单轮输入的字符量 |
contextWindowSize | 6000–8000 字符 | 单篇研报文本可达数万字符,设置该参数可将召回的上下文截断至模型可处理的合理范围 |
completionReason | 开启字段透传 | 用于多轮会话中传递当前会话的检索范围,确保后续提问能直接关联到已指定的研报报告 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:FastGPT 4.10.0版本中,配置
maxContext为30条后,对话明细仅显示2条上下文,回复无法关联上下文。原因:未同步配置contextWindowSize参数,会话上下文被模型输入窗口强制截断,仅保留最近2条内容。 - 现象:工作流中无法引用AI对话节点的
completionReason字段值。原因:未开启AI对话节点的「透传完成原因」配置项,该字段默认未写入会话存储上下文。 - 现象:提示词中包含空格时,无法正确识别研报中的带空格的字段名。原因:提示词未使用半角引号包裹带空格的字段标识,导致模型无法精准匹配结构化字段。
怎么确认配好了
- 发起单篇指定研报的定向提问,核对回复内容是否严格匹配报告内的字段与数值,确认提示词配置生效。
- 发起两轮及以上的关联追问,核对对话明细中是否保留了前序提问的上下文信息,确认
maxContext配置符合预期。 - 触发循环验证逻辑,核对工作流是否能根据分类判断结果触发二次检索或结束会话,确认
enableLoop配置正确。 - 查看向量召回日志,核对召回结果的数量与
rerankTopN、relevanceThreshold的配置是否匹配,确认检索配置生效。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。