这个品类的数据长什么样
航空装备企业的财报数据主要来自上海证券交易所、深圳证券交易所的公开披露平台,以及对应军工集团的官方公告渠道。披露节奏固定为季度报告、半年度报告与年度报告,对应披露节点为季后10日内、季后30日内与年度结束后4个月内。单份财报文档包含结构化财务报表与专项附注,字段涵盖通用财务指标与航空装备专属项,如军品营收占比、军机交付架数、发动机产能数据,单位包含人民币万元、交付架数、生产台数等。
这些特征在「引用来源与溯源」这一环带来什么约束
航空装备财报的多来源固定披露、专属字段多、文档结构分层的特征,对引用溯源带来三项核心约束。其一,需匹配固定披露节点配置数据源同步规则,确保引用的是当期最新披露文件,避免使用过期数据。其二,需限定召回范围至财报的结构化报表与对应专项附注章节,避免召回无关内容,同时针对军品营收、交付量等专属字段,配置字段映射规则,确保召回内容与原文表述完全对应。其三,需为每份披露文件配置唯一标识,避免不同来源的同类型财报出现引用混淆。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
recall_chunk_range | ["financial_statements", "notes_military"] | 航空装备财报核心信息集中在结构化报表与军品专项附注,限定范围可过滤无关内容,提升溯源准确性 |
datasource_sync_cron | "0 0 2 10,30,120 * * *" | 匹配季度报告季后10日、半年度报告季后30日、年度报告季后120日的披露节点,确保同步当期最新文件 |
reference_id_strategy | ["exchange_code", "disclose_date", "page_number"] | 基于交易所公告代码、披露日期、页码生成唯一引用ID,避免不同财报的引用标记混淆 |
remove_reference_mark | false | 需保留原始引用标记用于合规溯源,仅在输出展示环节可配置临时隐藏 |
max_recall_count | 前6条 | 航空装备财报专项字段分布分散,召回6条可覆盖核心数据,避免召回冗余内容 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:生成的回答中出现无对应财报原文的伪造引用ID。原因:未配置
reference_id_strategy的唯一标识规则,直接依赖大模型生成的随机标记,导致溯源无法匹配真实文件。 - 现象:输出内容中残留
引用标记:[1]等原始格式字样。原因:未正确配置remove_reference_mark参数,或未在输出流程中执行标记清理逻辑,导致原始解析标记被直接输出。 - 现象:召回的内容包含非财报的企业动态公告。原因:未设置
recall_chunk_range的限定范围,召回了与财报无关的集团日常公告,导致引用溯源偏离核心分析数据。
怎么确认配好了
- 上传单份航空装备季度财报至知识库,触发解析流程,查看解析后的文档分块列表,确认仅包含结构化报表与军品专项附注的分块内容。
- 调用大模型生成单份财报的分析内容,检查引用标记的格式,确认包含交易所代码、披露日期与页码信息,无随机生成的伪造ID。
- 临时调整
datasource_sync_cron参数为手动触发模式,手动同步数据源,确认最新披露的财报文件被优先加载至召回池。 - 查看最终输出内容,确认原始引用标记按配置保留或已被清理,无格式错乱的残留字样。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。