这个品类的数据长什么样
数据来源为境内外证券交易所公开披露的定期报告、公司官方投资者关系平台发布的财报文件。更新节奏为季度报告于季度结束后45日内披露,年度报告于年度结束后120日内披露。文档结构通常包含合并财务报表、经营情况讨论与分析、研发投入明细、核心业务板块营收占比等模块。字段涵盖单季度营收、累计营收、毛利率、研发费用率、合同负债金额等,单位以人民币元、万元或亿元标注。
这些特征在「多轮对话与提示词」这一环带来什么约束
单份财报文件篇幅较长且包含多业务板块数据,多轮对话需支持上下文关联的板块定向查询,提示词需明确限定业务范围,避免跨板块数据混淆。财报字段存在单位差异,提示词需提前统一单位转换规则,确保多轮对话中输出数据的单位一致性。财报披露存在固定滞后周期,多轮对话的提示词需增加披露状态校验逻辑,避免生成未公开的财务数据。不同公司的财报模块命名存在差异,提示词需兼容常见业务板块命名变体,提升查询适配性。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
maxContext | 8000–16000 字符 | 通信设备单季度财报文本量约3000-7000字符,预留多轮交互的上下文余量,避免关键信息被截断 |
召回条数 | 前6–8 条 | 通信设备财报核心指标分散在多个模块,召回6-8条可覆盖所需数据,同时避免无关内容干扰 |
相似度阈值 | 0.75–0.85 | 过滤低匹配度的非财报文本,保留与用户查询强相关的财报片段 |
PARSE_FILE_TIMEOUT_SECONDS | 300 秒 | 大型年度财报文件解析需较长时间,300秒可覆盖多数常规文件的解析流程 |
分段长度 | 1000–1500 字符 | 适配财报多业务板块的文本结构,避免单段包含跨板块数据导致混淆 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:多轮对话界面出现卡顿或响应延迟,原因:未合理设置
maxContext参数,导致上下文窗口过大引发模型加载超时。 - 现象:模型输出内容不符合预设指令,未按要求围绕通信设备财报展开回答,原因:提示词未配置在对话启动的前置系统提示位,仅附加在用户提问后,未被模型优先识别。
- 现象:解析后的财报数据字段单位混乱,原因:未在提示词中明确单位转换规则,导致模型混用万元与亿元数值。
怎么确认配好了
- 上传单份通信设备季度财报文件,发起首次查询,核对模型返回的文本是否包含财报核心指标,且单位统一。
- 发起两轮以上关联查询,比如先查询运营商业务营收,再查询对应季度的研发费用,核对模型是否能关联上下文保留之前的业务限定。
- 检查对话历史导出功能,确认可获取完整的交互记录与解析后的财报片段。
- 调整
maxContext参数后,发起长文本查询,核对模型未出现上下文截断导致的信息缺失。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。