这个品类的数据长什么样
其他综合财报分析的数据主要来源于上市公司公开披露的年度、半年度或季度财报附注中的其他综合收益相关内容,包含结构化明细数据与非结构化附注文字。数据更新节奏严格匹配企业财报披露周期,无临时增量更新。文档结构以结构化表格为核心,附带对应业务说明文字,包含其他综合收益的明细类别、税前金额、税后净额、归属母公司份额、少数股东份额等字段,单位统一为货币计量单位,无额外混合单位。
这些特征在「引用来源与溯源」这一环带来什么约束
由于数据同时包含结构化明细字段与非结构化附注文字,需要精准关联每个数据项的原始文档位置与字段标识,避免溯源信息模糊。财报披露周期固定但更新集中,需定期同步知识库以保证溯源数据的时效性。字段数量较多且专业性强,需避免召回无关的财报条目,同时需保留字段元数据以明确溯源对应关系。非结构化附注文字较长,需保证分段解析时不破坏字段与上下文的绑定关系。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
召回条数 | 前8-12条 | 其他综合财报数据包含多类明细与附注,需覆盖核心关联内容,避免遗漏关键溯源信息 |
相似度阈值 | 0.72-0.85 | 财报术语专业性较强,阈值过低会引入无关财报条目,过高会无法召回关联的附注内容 |
PARSE_SEGMENT_LENGTH | 1200-1500字符 | 财报附注段落长度较长,分段过长会丢失字段与上下文的绑定关系,过短会破坏结构化数据的完整性 |
REFERENCE_MAX_COUNT | 6-10条 | 其他综合财报的溯源条目较多,设置过多会干扰主回答的可读性,设置过少会无法覆盖所有关联数据 |
REFERENCE_SHOW_SOURCE | 开启 | 需明确标注溯源的文档名称、段落位置与对应字段,满足财报分析的合规溯源要求 |
EXPORT_REFERENCE_FORMAT | 带字段映射格式 | 需保留原始数据的字段标识,方便后续核对分析结果与原始财报的对应关系 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象为4.8.22版本中调用时知识库选项为空,原因是未将其他综合财报的结构化JSON文件正确导入指定知识库分组,或配置中未绑定对应知识库ID。
- 现象为返回的溯源引用条数不足或无法下载溯源文件,原因是
REFERENCE_MAX_COUNT设置过低,或未开启溯源文件的下载权限,导致无法获取完整的溯源数据。 - 现象为溯源结果未关联对应财报字段,原因是解析时未保留字段元数据,导致召回的内容无法匹配原始数据的字段标识,无法实现精准溯源。
怎么确认配好了
- 上传一份其他综合财报的结构化JSON文件,在知识库管理界面查看是否成功解析并显示对应字段与文档信息。
- 发起财报分析请求,查看返回结果中是否附带标注了文档名称、段落位置和对应字段的溯源信息。
- 调整
REFERENCE_MAX_COUNT参数后,验证返回的溯源条目数量是否符合设置值。 - 导出分析结果,确认溯源文件的格式与字段映射是否符合配置要求。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。