这个品类的数据长什么样
玻璃智能尽调报告的数据主要来自建筑玻璃批次出厂检测报告、进场现场检测记录、供应链溯源台账。数据更新节奏随批次交付时更新,进场检测数据随现场检测完成后更新。文档结构包含批次编号、厚度(mm)、透光率(%)、抗冲击强度(kJ/m²)、生产厂商信息、进场日期等字段。
这些特征在「多轮对话与提示词这一环带来什么约束
玻璃尽调数据包含多个带明确单位的字段,且不同批次参数差异显著。多轮对话中需明确跟踪当前批次编号,避免混淆不同批次的参数。文档长度较长,需适配长文本处理。字段单位需明确指定提取对应单位,避免模型混淆不同批次的参数。
配置怎么定
| 配置项 | 建议取法 | 这样取的依据 |
|---|---|---|
maxContext | 8000–12000 字符 | 玻璃尽调报告单份文档长度通常在5000字符左右,设置该区间可覆盖多轮对话上下文不溢出 |
UPLOAD_FILE_MAX_SIZE | 200 MB | 玻璃检测报告单份大小通常不超过150 MB,预留合理余量 |
PARSE_FILE_TIMEOUT_SECONDS | 300 秒 | 长文档解析需足够时间,避免超时中断 |
召回条数 | 前 8 条 | 玻璃尽调数据字段较多,召回足够条目覆盖核心参数 |
相似度阈值 | 0.75 | 过滤低匹配度的无关文档,确保提取数据的准确性 |
重排返回条数 | 前 5 条 | 优先返回最相关的检测报告 |
本页给出的参数取值均为常规建议,用于确定配置的起点。实际取值受材料形态、数据量与业务规则影响,具体问题需具体分析,建议在自有样本上实测后再定。
容易做错的三处
- 调用openapi发起对话时未携带
app_id参数,返回401 Unauthorized错误。原因是未通过对应api创建应用并获取有效app_id。 - 上传玻璃检测报告时选择了
.zip压缩包格式,未被系统识别。原因是系统仅支持.pdf、.xlsx、.docx格式。 - 配置ollama模型后,对话返回无流式输出,返回结果为空。原因是未开启
stream参数开关,或本地ollama服务未正确暴露端口。
怎么确认配好了
- 发起openapi调用时携带
app_id和session_id参数,检查返回状态码为200 OK。 - 上传玻璃检测报告文件,检查系统返回解析成功的提示,确认文件格式被支持。
- 开启
stream参数为true,发起对话,检查返回结果是否有流式输出。 - 为每个用户分配独立的
session_id,检查不同用户的对话历史未共享。
问题素材取自公开社区提问(2026-09-11 去重 4,834 条)。文中的配置项名称与取值区间需以所用版本的实际界面与文档为准;本页核验日 2026-09-14,当时的最新发布版本为 FastGPT v4.17.0。