目录
一、系统概述..................................................... 2
href="https://zhuanlan.zhihu.com/p/2072655140587298839/edit#_Toc3340" data-draft-type="text-link">二、 技术路线................................................... 3
(一)多类文档上传.......................................... 4
(二)文档切分.............................................. 4
href="https://zhuanlan.zhihu.com/p/2072655140587298839/edit#_Toc32127" data-draft-type="text-link">(三) 文档向量化........................................... 6
href="https://zhuanlan.zhihu.com/p/2072655140587298839/edit#_Toc26446" data-draft-type="text-link">(四) 构建RAPTOR树........................................ 6
href="https://zhuanlan.zhihu.com/p/2072655140587298839/edit#_Toc21677" data-draft-type="text-link">(五) 混合检索............................................. 7
1. 向量检索............................................ 7
2.关键词搜索........................................... 9
href="https://zhuanlan.zhihu.com/p/2072655140587298839/edit#_Toc19245" data-draft-type="text-link">(六) 文档融合与重排....................................... 9
1.文档融合............................................ 9
2.文档重排........................................... 11
href="https://zhuanlan.zhihu.com/p/2072655140587298839/edit#_Toc31535" data-draft-type="text-link">(七) 提示词工程.......................................... 13
(八)引文溯源............................................. 15
href="https://zhuanlan.zhihu.com/p/2072655140587298839/edit#_Toc25874" data-draft-type="text-link">三、 软硬件环境................................................ 15
href="https://zhuanlan.zhihu.com/p/2072655140587298839/edit#_Toc7076" data-draft-type="text-link">(一) 软件环境............................................ 16
href="https://zhuanlan.zhihu.com/p/2072655140587298839/edit#_Toc24637" data-draft-type="text-link">(二) 硬件环境............................................ 17
href="https://zhuanlan.zhihu.com/p/2072655140587298839/edit#_Toc12534" data-draft-type="text-link">四、 应用场景.................................................. 17
一、系统概述
本装备维修保障升级技术方案是面向装备维修业务打造的一套全离线、本地化、可溯源、3D可视化作业平台,主要服务一线维修人员与资料管理员,用于统一管理各类装备维修资料、辅助工作人员快速处置装备故障。
系统具备三大核心功能:
(1)维修资料统一数字化管理
支持批量导入装备维修手册、故障案例、设备规范、扫描图纸等各类文件,自动完成资料规整、分类存储与离线知识库归档,替代纸质手册、零散电子文档杂乱存放的管理模式,实现所有维修资料集中、规范管理,方便人员随时查阅调取。
(2)故障智能查询与维修方案自动生成
维修人员输入装备故障现象、故障编号,系统会自动匹配对应的官方维修依据,优先展示权威原厂手册内容,自动补齐手册中跨页面、跨章节的关联参考内容,整合完整资料后自动生成条理清晰、流程规范的标准化维修处置方案。
(3)本地模型自主优化升级
系统可长期沉淀日常维修问答、标准处置案例作为训练样档,在本地环境下完成模型优化迭代,持续提升故障判断、方案输出的贴合度,让系统输出内容更贴合本单位装备维修实际场景,无需依赖外部网络与线上大模型服务。
整体而言,该系统围绕装备维修全流程提供本地化智能辅助能力,解决以往人工翻找资料耗时久、故障处置参考依据零散、维修方案撰写不标准等问题,缩短故障研判处置时间,统一维修作业标准,为装备日常维修保障工作提供完整的离线智能支撑。
二、技术路线
本系统的技术路线,如下所示。

技术路线:
把所需要的文档格式进行上传。
对上传的文档进行清洗数据和自动修改文档中的空格等等,对文档进行切分,切分成若干个符合要求的独立的小文档。
对所切分成的独立小文档进行向量化,将文档转化成向量。
进行构建RAPTOR树。
进行混合检索(向量检索和关键字检索)提高召回率。
以及再进行构建提示词,将问题与检索到的向量整合一起构建提示词。
最后大模型生成方案、3D可视化影像、源文追溯。
(一)多类文档上传
(1)批量上传
基于前端技术开发上传面板,通过前后端数据交互(Axios)向后端Java网关发送文件流;支持Word、Excel、PDF、图片、扫描图纸等格式批量拖拽上传。
(2)内容提取
网关做请求转发,校验文件大小、格式、权限后分流:图片/扫描件—转发至Python PaddleOCR服务,完成图文识别,提取图片内文字;电子文档—直接读取文档源生文档。
(3)文档存储
再进行提取的纯文档、文档名称、页码、文件路径存入SQLite结构化数据库;原始文件、OCR结果本地SSD持久化存储。以及支持断点续传、批量删除、资料分类管理,所有操作日志写入SQLite。
(二)文档切分
通过Embedding技术,实现文档切分功能,将维修手册、技术手册等大块文档,分解成更小段落切分,确保搜索结果与用户查询相匹配极为关键。软件的文档集合

其中n表示文档的总数。将输入文档序列的最大切分长度chunk_size
设为K,并定义相邻两个切片片段之间重叠Token长度为L。每篇文档
被切分成一系列段落,记为

,其中
表示第i篇文档切分后chunk数量,
表示第i篇文档第j个chunk,因此第i篇文档的chunk数量
如下式所示。

其中,

表示计算文档
的token总长度。
本软件文档切分使用重叠滑窗分句算法对预处理的文档段落进行切分,进而形成连续的文档块,在每个文档块前,附加相应的章节标题,以此构成独立的信息单元,如下图所示。该模块接收清洗的文档作为输入,并输出结构化的文档分块。

(三)文档向量化
文档向量化将文档块进行向量化编码,用于后续的向量检索,步骤如下图所示。

具体而言,将切分后文档块作为输入,对其中的每个文档块应用向量化模型,生成相应的向量,并汇总这些向量以形成集合作为输出。
本方案采用通用向量化模型BGE对文档分块进行向量化处理,将每段文档映射为高维的密集向量,以便于后续的检索操作。BGE模型对于短查询到长文档的检索任务,每个短查询需要查询指令前缀开头,以提高检索效果,如下式所示。

其中,

指和本文块嵌入使用同一模型,

表示将查询指令前缀和原始的查询拼接。
(四)构建RAPTOR树
构建RAPTOR(RAPTOR:RECURSIVE ABSTRACTIVE PROCESSING FOR TREE-ORGANIZED RETRIEVAL递归抽象处理树状检索)树,按照语义对文档块做聚类,形成多个cluster。按照语义对chunk(文档块)做聚类,形成多个cluster(簇),利用LLM给每个cluster内的文档生成摘要总结,并为对总结也生成embedding,作为树的非Leaf叶节点;越接近Root(根)节点,语义越精简。

(五)混合检索
混合搜索集成了向量搜索和关键词搜索两种不同的搜索策略,优化了信息检索的效率和准确性。混合搜索通过并行执行向量搜索和关键词搜索,各自独立召回文档块集合,以提高领域文档召回率,模块的输入是用户的问题,输出则是召回的文档集合。
1. 向量检索
向量搜索通过计算查询向量与数据库内每个存储向量之间的相似性得分,以此确定并返回相关性最高的记录。向量搜索旨在从知识库中检索出与用户查询语义最相关的文档,本模块将用户查询的向量化表示

作为输入,并返回相关性最高的TopK文文档作为输出,如下图所示。
表 1 向量检索参数表
| 序号 | 参数 | 参数类型 | 说明 |
| 1 | data | list | 待检索的查询向量集合,由 BGE Embedding 模型生成。 |
| 2 | anns_field | str | Milvus 索引中存储文档向量的字段名,固定为 vec。 |
| 3 | metric_type | str | 向量距离计算方式,BGE 模型固定使用 COSINE 余弦相似度。 |
| 4 | limit | int | 向量粗召回返回候选片段数量,配置为 30,预留数据供 Rerank 精排。 |
| 5 | nprobe | int | 检索遍历的聚类分片数量,单机离线环境推荐取值 10~16,平衡检索速度与准确率。 |
查询阶段,将输入向量与预定向量的最近邻聚类中的向量进行比较,以此确定最相似的文档。通过限制搜索范围,在保持精度损失最小的前提下,显著提高了查询效率。
本项目采取Collapsed Tree Retrieval(展开树检索)方式,即将RAPTOR树展开单层,然后直接对所有文档节点进行向量相似性检索,检索出所有的相关节点文档。

2.关键词搜索
关键词搜索通过全文搜索技术,检索并返回包含特定关键词的文档。关键词搜索旨在从索引中搜索出与用户查询文档最匹配的文档,本模块将用户查询作为输出,并返回文档匹配度最高的TopK文档作为输出。首先分析用户输入的查询语句中的关键词,进而生成对应每个关键词的文档列表。当查询涉及多个关键词时,对各关键词的列表执行交集运算,以获得含有全部关键词的文档列表,随后,根据特定算法对文档列表进行排序,确保与查询最相关的文档优先展示,最终,系统返回排名靠前的文档作为搜索结果,通过引入基于长度的惩罚机制来避免模型得分偏好长度较短文档的问题。
(六)文档融合与重排
文档融合与重排对混合搜索召回的结果集进行合并与优化,以筛选出具有最高综合评分的文档。首先,引入基于熵权法的策略,采用相对分数融合机制,调整召回结果的评分,实现两种评分体系的有效整合。然后从融合后的文档集中选择评分最高的TopK文档,基于原始问题进行进一步的精排,得到最终输出的TopN文档。本方案采用文档融合与重排模型分为两个主要阶段。第一阶段是文档融合,采用相对分数融合的策略。流程的第二阶段旨在对文档融合后的结果集进行进一步的重排。
1.文档融合
文档融合算法接收向量搜索和关键词搜索产生的结果集作为输入,即分别召回的排名前K位的记录。其中每个结果以JSON的格式返回,包含三个字段,即文档分块的唯一ID、文档内容及相应分数。为了有效处理这些结果,构建哈希表存储评分信息,其中键对应于文档的唯一ID。算法分别遍历向量搜索结果和关键词搜索结果,将分数记录到哈希表中

以及

字段中,通过熵权法计算两种评分的权重比例,进而得出文档的最终得分,并选择综合得分最高的前N个文档作为输出。
最终的分的策略首先对向量搜索和关键词搜索的得分进行归一化处理,得分计算方法如下式所示,然后通过加权融合标准化得分以计算出综合得分,旨在更精确地量化文档的相关性。

其中,score
代表指定文档的原始得分,

和

分别代表在当前检索策略下召回的文档集合中最高得分和最低得分。对于Sem
和Lex
检索结果集,本方法分别对其得分进行标准化,从而获得归一化得分列表

与

。为了在最终结果中灵活调整两种得分的相对重要性,本课题采用熵权法引入权重参数
a,如下式所示,以协调两种搜索策略的综合贡献。

其中,

表示R流程第一阶段的最终得分,参数a默认取值为0.5,表示两种算法对最终结果产生相等的贡献。文档融合示意如下图所示。

2.文档重排
文档重排利用交叉编码器计算用户问题与给定候选文档之间的相关性分数,并结合文档融合得分,从而对文档列表进行重新排序,算法考虑问题与文档之间的语义匹配度,改进语义排序的结果。
本方案选用离线交叉编码器(Rerank)模型来执行此任务。交叉编码器同时处理两个文档输入,产生一个包含两者特征及其相互关系的综合嵌入向量,具体表达如下式所示。该模型通过在编码阶段考虑句子文档之间的依赖性,从而为后续的分类提供了一种更细致的评分机制。

其中,query和content通过[CLS]连接后通过类BERT模型进行打分,得到重排阶段的分数

。
在流程中,两个独立的阶段分别产生两组得分,即

和

,为了有效融合这两阶段的评估结果,课题引入了权重因子γ,该因子每个阶段的得分赋予相对重要性权重,综合得分的计算如下式所示。

流程的设计特点决定了其第二阶段能够作为一个模块化组件,独立地集成到现有系统中,根据特定应用的需求进行定制化微调。在实际应用过程中,为了捕捉数据特性并优化排序效果,关键参数γ需要调整。通过对离线交叉编码器模型的微调及参数调优,DFAR流程得以有效识别文档和关键词的细微差异,进而计算出最优的综合得分,完成文档融合与重排任务。文档重排具体步骤如下图所示。

(七)提示词工程
系统将定制化装备维修提示词模板持久存储在SQLite数据库中,管理员可通过Electron桌面端在线新增、修改、删除模板内容。模板内置三层强制约束规则,如图所示。

1.角色约束:固定定义大模型身份为专业装备维修工程师;
2.输出规范约束:强制维修方案统一分为故障现象、排查步骤、维修操作、安全注意事项四段固定结构;
3.内容约束:严格限制模型仅依据检索召回的参考资料作答,不允许编造不存在的维修流程、参数。
程序接收混合检索返回的Top20候选原文片段、用户输入的故障描述,自动填充至空白模板中,拼接生成完整结构化Prompt(提示词),转发至Qwen2-7B大模型推理接口执行方案生成。
(八)引文溯源
三者集成在同一顶层模块并行运算,接收上游组装完成的提示词与检索元数据,最终全部输出至桌面客户端,如下图所示。

系统记录生成维修方案时全部用到的文本块唯一 ID,关联查询 SQLite 中存储的原始文档、对应页码、本地文件存储路径;前端将维修方案内所有引用参考资料的文字渲染为可点击超链接形式,用户点击链接即可触发溯源逻辑,自动打开本地存储的原始维修手册、扫描图纸,并快速定位至对应参考页码,完整展示原文依据,实现全部维修内容可溯源、可查证。
三、软硬件环境
本系统的软硬件环境包括:软件环境和硬件环境。
(一)软件环境
本系统软件环境如下表所示。
表 2 软件环境表
| 序号 | 类型 | 名称 | 版本号 |
| 1 | 操作系统 | Windows Server 2019 Standard |
2019 |
| 2 | AI运行环境 | Python | 3.10 |
| 3 | 高性能开发环境 | C++17编译标准 | C++17 |
| 4 | 服务网关组件 | Nginx(统一接口入口) | 1.24 |
| 5 | 数据库连接工具 | HikariCP(数据库高速管理器) | 内置配套 |
| 6 | 数据库组件 | SQLite(业务数据库) | 3.45 |
| 7 | Redis(缓存库) | 7.2 | |
| 8 | Milvus向量数据库 | 2.3.3 | |
| 9 | AI加速工具 | ONNX Runtime(AI 推理加速器) |
1.17 |
| 10 | TensorRT(GPU 推理加速引擎) | 10.0 | |
| 11 | AI图像处理工具 | OpenCV(图像处理库) | 4.9 |
| 12 | AI模型 | PaddleOCR(图片识别) | 2.7 |
| 13 | Qwen2-7B-Instruct (量化大模型) |
INT4量化版 | |
| 14 | BGE-large-zh-v1.5(Embedding 向量) | v1.5 | |
| 15 | BGE-reranker-base(Rerank 重排) | base版 | |
| 16 | MacBERT-base(关键字抽取) | base版 | |
| 17 | AI计算工具 | PyTorch | 2.2 |
| 18 | 桌面前端工具 | Electron 桌面打包 |
28.0+ |
| 19 | 前端界面工具 | Vue3(开发界面) | 3.4+ |
| 20 | Element Plus UI组件库 |
2.6+ | |
| 21 | 网络请求工具 | Axios(前后端异步通信) | 1.6+ |
| 22 | 3D可视化组件 | Three.js(3D可视化引擎) | r128+ |
| 23 | Cesium(3D可视化引擎) | 1.111 | |
| 24 | 部署运维工具 | Docker(可选部署工具) | 27.0.3 |
(二)硬件环境
本系统硬件环境如下表所示。
表 3 硬件环境
| 序号 | 名称 | 规格/版档号 |
| 1 | CPU | ≥8核16线程(i7-12700同等及以上) |
| 2 | 内存 | ≥32GB DDR4,推荐64GB及以上 |
| 3 | 存储硬盘 | SSD固态硬盘,可用空间≥100GB |
| 4 | GPU | RTX3060 12GB及以上 |
| 5 | 网卡 | 千兆有线网卡 |
| 6 | 显示器 | 1080P及以上分辨率 |
四、应用场景
本系统应用的场景有六个,分别是:一线装备现场维修作业场景、库房/保障站维修资料管理场景、装备故障复盘与维修培训场景、离线无外网密闭作业环境场景、装备定期维保计划执行场景、系统本地模型迭代优化场景。
(1)一线装备现场维修作业场景
装备发生异响、报错、功能故障时,维修人员身处设备作业现场,无大量纸质手册查阅条件,可直接输入故障现象、设备故障代码,系统快速调取原厂维修资料,自动生成标准化维修步骤,无需人工翻阅零散图纸、分册手册,快速完成故障研判与处置。
(2)库房/保障站维修资料管理场景
装备保障管理员批量收纳、归档新版维修手册、历史故障处置案例、设备技术规范,系统统一完成数字化存储、分类管理,替代纸质文件存放混乱、查阅困难、易破损丢失的管理模式,实现所有装备技术资料本地化集中保管,随时可检索调取。
(3)装备故障复盘与维修培训场景
日常维修完成后,工作人员将完整故障处置流程、解决方案录入系统沉淀为标准样档;后期可调取历史故障案例用于新人维修培训、故障复盘分析,统一维修作业标准,减少维修人员经验水平参差不齐带来的处置偏差。
(4)离线无外网密闭作业环境场景
适用于内网隔离、禁止连接互联网的装备保障单位,整套系统全部本地离线运行,资料、模型、交互流程均部署在本地设备,不向外传输装备涉密技术资料,满足保密管控要求,在无网络环境下完整实现资料查询、故障智能辅助功能。
(5)装备定期维保计划执行场景
开展设备季度、年度预防性维保工作时,操作人员可通过文字查询对应设备维保规范、检查项目、拆装流程,系统自动整合完整维保操作要求,输出规范维保作业方案,保障定期维保流程完整无遗漏。
(6)系统本地模型迭代优化场景
保障单位积累足量专属装备故障案例后,管理人员可在本地环境完成模型优化训练,针对本单位特有装备、高频故障持续优化方案输出效果,适配专属装备保障业务,无需依赖外部线上AI服务。
浙公网安备 33010602011771号