这个品类的数据长什么样
住宅开发的营销相关数据主要来自四个渠道:项目案场的客户咨询录音转写、户型与配套的官方公示文档、线上留资表单的用户提问记录,以及营销物料的版本迭代存档。数据更新节奏随场景变化:案场咨询记录实时生成,户型参数仅在项目规划调整时更新,营销物料则随推广节点每月更新1-2次。文档结构包含两类:结构化字段如楼栋编号、户型建筑面积(单位㎡)、备案单价(单位元/㎡)、周边公共配套名称;非结构化内容如客户对话原文、营销推广文案草稿。
这些特征在「多轮对话与提示词」这一环带来什么约束
结构化字段的明确性要求多轮对话需精准匹配预设字段,避免模糊提取导致的参数错误。实时生成的案场咨询数据要求对话上下文保留最近3轮以上的用户提问,确保后续回复能承接之前的需求细节。营销物料的版本迭代特性要求提示词中需加入版本校验逻辑,确保调用最新的推广内容。非结构化的客户对话原文需要系统能识别不同阶段的用户诉求,从初期的户型咨询到后期的价格谈判,逐步调整回复方向。同时,备案价格等受监管的字段需在提示词中明确禁止随意修改,确保回复合规。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
maxContext | 前6轮对话 | 住宅开发营销对话多为5轮以内的需求递进,保留前6轮可覆盖完整咨询链路,避免上下文丢失 |
similarityThreshold | 0.75–0.85 | 需匹配户型参数、备案价等结构化字段,阈值过低会引入无关内容,过高则无法召回相关配套信息 |
contextSplitSize | 800–1200 字符 | 营销物料文档多为长文本,分段长度适配大模型的上下文窗口,避免截断关键的户型与价格信息 |
maxToken | 8000–12000 | 适配长文本的营销物料与多轮对话的上下文长度,确保完整传递用户需求与项目信息 |
logRetentionDays | 30 天 | 营销咨询需保留历史对话用于复盘,30天的保留周期可覆盖常规的推广复盘周期,同时控制存储成本 |
promptTemplate | 明确指定提取「楼栋号、户型面积、备案单价」字段,禁止修改监管类价格信息,适配接入的大模型上下文理解能力调整表述方式 | 住宅开发营销内容需精准匹配项目参数,提示词需约束回复范围,避免生成不符合规要求的内容 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:提示词中包含带空格的字段名(如「备案单价」)时,系统无法准确匹配对应的结构化数据。原因:未在提示词模板中明确要求保留空格,或未使用引号包裹字段名以避免被拆分。
- 现象:通过API渠道发布的应用,后续请求无法承接历史对话内容,回复未关联之前的用户提问。原因:未在API请求的请求体中携带有效的会话ID参数,导致每次请求都被视为新对话。
- 现象:部署后重启容器,7天前的对话日志无法找回。原因:未在docker配置文件中配置持久化日志目录,或未设置
logRetentionDays的合理取值,导致日志被自动清理或未持久化存储。
怎么确认配好了
- 上传一份住宅项目的户型参数文档,输入包含空格的字段名提问,核对回复是否准确提取对应字段。
- 发起3轮以上的连续对话,查看回复是否承接前一轮的提问细节,确认上下文链路完整。
- 登录FastGPT工作台,查看对话日志列表,确认超过7天的日志仍可正常查看。
- 调用API渠道发起多轮请求,携带会话ID参数,核对第二次请求的回复是否关联第一次的提问内容。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。