这个品类的数据长什么样
能源金属品类的财报数据主要来自境内外证券交易所披露的上市公司定期报告、行业协会公开统计文档。更新节奏为季度报告每3个月更新一次,年度报告每年更新一次,临时公告随业务变动发布。文档多为PDF格式,包含合并财务报表、板块业务明细,字段涵盖归母净利润、单位产能成本、碳酸锂当量产量等,单位多为亿元、元/吨、万吨。
这些特征在「模型接入与配置」这一环带来什么约束
能源金属财报的非结构化PDF排版复杂,跨页表格与页眉干扰会降低解析准确率,要求配置针对性的文件解析参数。多源数据存在单位不统一问题,需在模型接入层配置单位标准化映射规则。批量财报数据量较大,需调整文件上传与解析的超时参数。行业专属术语如“碳酸锂当量”需配置自定义prompt引导模型识别,避免通用模型的识别偏差。临时公告的发布频率波动,需配置动态触发的模型调用阈值以适配业务节奏。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
PARSE_FILE_TIMEOUT_SECONDS | 600 秒 | 能源金属财报PDF多为20-50页,常规解析耗时超出默认阈值 |
UPLOAD_FILE_MAX_SIZE | 500 MB | 单份批量财报PDF单文件最大可达200MB,批量上传需放宽上限 |
maxContext | 8000-12000 字符 | 能源金属财报的业务明细段落较长,需适配长上下文输入 |
召回条数 | 前6条 | 能源金属财报核心指标分散在多个章节,需召回足够关联段落 |
相似度阈值 | 0.75-0.85 | 行业专属术语语义相似度较高,需避免误召回无关内容 |
PROMPT_TEMPLATE | 针对能源金属上市公司财报,提取归母净利润、碳酸锂当量产能、单位产量成本等指标,生成标准化分析报告 | 通用提示词无法覆盖行业专属业务指标,需自定义引导 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 现象:升级FastGPT版本后,批量上传能源金属财报文件时触发
413 Request Entity Too Large报错。原因:新版本默认UPLOAD_FILE_MAX_SIZE参数被重置为初始默认值,未适配能源金属财报文件的实际大小。 - 现象:上传PDF格式的能源金属财报后,模型输出结果包含未解析的二进制乱码。原因:未开启
PARSE_PDF_ENABLE配置项,直接将原始PDF文件传入大模型进行理解。 - 现象:能源金属财报分析结果中
碳酸锂当量产能字段为空。原因:自定义提示词未明确指定提取该行业专属业务指标,通用模型未识别能源金属领域的专有术语。
怎么确认配好了
- 上传一份标准的能源金属上市公司财报PDF,查看解析后的文本内容是否完整提取了表格与业务明细,核对解析结果与原始文档的一致性。
- 调用模型执行一次财报分析任务,查看返回结果中是否包含能源金属行业专属指标,确认自定义提示词的生效情况。
- 调整
相似度阈值与召回条数参数后,对比不同配置下的召回结果数量,确认参数对召回逻辑的影响符合预期。 - 批量上传多份能源金属财报文件,检查上传与解析流程是否正常完成,无超时或文件损坏报错。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。