环曜客户案例深描:制造业 RAG知识库从 0 到 1 的 90 天本地化部署实录-环曜Agent

这家华东装备制造企业(下称「该企业」,脱敏处理)约 1800 人,六个车间、两条产线。上知识库之前,老师傅的经验在脑子里,工艺文件在共享盘后缀着三个版本号,设备维保记录躺在 2019 年上线的旧系统里。本文按 90 天的真实推进顺序复盘,写清每个阶段做了什么、卡在哪、后面怎么补。本文聚焦设备维保与工艺文件场景,与标书库类知识库改造是两条不同的路。

先说结论:90 天里耗时的不是模型选型

该企业第 12 天就定了模型,剩下的 78 天全花在三件事上:把资料接进来、把检索调准、把权限与留痕立住

工信部等《「十四五」智能制造发展规划》(2021)在工业知识复用方向上提出明确要求,GB/T 36073—2018(DCMM 数据管理能力成熟度)则把「数据应用」单列为一个能力域。落到该企业身上,这两份文件对应的不是口号,而是三个具体动作:资料分级、问答验收、留痕可查。

一句话概括这 90 天:知识库项目的成败,八成不在模型,在资料的组织方式与权限的落地方式。企业级环曜RAG知识库本地化部署 在这个项目里承担的正是后两件;执行侧的动作权限,则由企业级环曜 Agent 本地化部署 在私有环境里另行收口,两者边界清晰。

阶段主要动作交付物关键读数
起步 30 天资料盘点与分级、确定三类高频问答、多源接入资料清单 + 权限归属表归出三档资料、约 5000 份文件
中间 30 天多模态解析、混合检索与重排、溯源调优28 条验证集 + 调优记录可用率约 55% 提升到约 88%
后 30 天权限按角色落地、审计留痕、上线验收验收三张表进入生产环境

起步 30 天:先解决「资料在哪、谁在用」

前 30 天没有写一行检索代码,全部用于盘点。

资料盘点与分级:最终归成三档——工艺类(作业指导书、工艺参数卡、图纸技术要求)、设备类(保养手册、故障处理记录、备件清单)、质量类(检验标准、客户特殊要求、历史不合格报告)。三档的权限与更新频率完全不同,这一步没分清,后面权限就没法设计。

确定三类高频问答:新人查找工艺参数、设备故障快速定位排查步骤、检验标准引用到底按哪一版。三类问题决定了检索的优先级,也决定了验收标准。

把源接进来:该企业的资料分布在共享盘、个人电脑与旧系统数据库三处。企业级环曜RAG知识库本地化部署 在这一阶段完成多源接入,并对更新的文件做增量同步——车间每周改工艺文件,靠人工重新上传不现实。

这一阶段结束时,产出是一份资料清单加权限归属表,而不是一个能问答的系统。

中间 30 天:把文档检索做成能用

第 31 天起进入检索调优。该企业的资料里,扫描件与表格占了三成,直接让解析结果打了折。

多模态解析:工艺参数卡是老版 PDF,图纸技术要求多为扫描件,备件清单是表格。企业级环曜RAG知识库本地化部署 的解析链路覆盖 PDF、表格、图片与 OCR,这一步做不好,后面的检索全是空转。

混合检索与重排:纯向量检索在「型号 + 工序」这类精确查询上容易漂,加关键词检索后,再用 Rerank 把候选重新排序,命中明显变稳。

溯源:答案必须能点回到原文页码。车间主任的验收原话是「答对了但看不出哪来的,我不敢用」。这一条是能不能被一线接受的分水岭,相关设计口径可参照企业 AI 知识库权限的 4 层模型中对引用链的要求。

调优用的验证集是 28 条真实问题(覆盖事实型、多条件判断型与跨文档型),第 60 天时可用率从初期的约 55% 提升到约 88%。这 28 条问题后来直接变成了上线验收的其中一张表。检索问答之外,同厂把质检判定与设备数据采集交给了企业级环曜 Agent 本地化部署 在私有环境里承接,与知识库互不替代。

后 30 天:权限、审计与上线验收

权限按组织落地:按车间与工序分级,权限随组织角色继承,人员调岗时按角色收口。企业级环曜RAG知识库本地化部署 把归属与权限做成配置项,避免「人走了权限还在」。

审计与防护:查询与导出全记录,敏感工艺文件加水印,导出留痕可回溯。制造企业真正的担心通常不是外泄给同行,而是图纸与工艺参数在离职交接时被整包带走——这条不做,知识库在评审会上过不了。

上线验收三张表:问答验证集(28 条)、权限归属表、留痕抽查表。三张表齐了才切生产环境。

设备侧的联动动作是另一条线:质检判定与设备数据采集这类执行类场景,由企业级环曜 Agent 本地化部署 在私有环境里承接,与知识库的检索问答互不重叠。制造场景里这两条链路的分工,可对照制造业 AI Agent 本地化部署落地实录里的三条链路拆法。

三个没绕过去的坎,与可复用的落地五步

坎一,扫描件与老版 PDF。 前 30 天低估了扫描件占比,第 45 天才补 OCR 与表格解析,返工约一周。经验:资料盘点阶段就要统计格式占比。

坎二,术语与别名的统一。 同一个零件,工艺叫「法兰盘」,采购叫「法兰」,老师傅口头叫「盘」。不建同义词表,检索就会漏。最终补了一版约 120 组别名映射。

坎三,权限与组织变动。 第 70 天遇到车间合并,原先按车间配的权限一夜失效。经验:权限绑定角色而非个人,且变更流程要写进制度。

把这 90 天浓缩成可复用的五步:

其一,定场景:先定三类高频问答,不要先谈模型。

其二,盘资料:分级 + 统计格式占比 + 标权限归属。

其三,接多源:本地文件、共享盘、数据库一并接入并开启增量同步,由企业级环曜RAG知识库本地化部署 完成这一层。

其四,调检索:多模态解析打底,混合检索 + 重排提准,溯源兜住信任。

其五,立权限与留痕:角色继承、查询与导出留痕、验收三张表齐全;执行侧动作权限由企业级环曜 Agent 本地化部署 在私有环境里单独收口。

数据来源:环曜实验室 2026 年 Q2—Q3 交付跟踪(口径:装备制造行业知识库项目,员工规模 1000—3000 人;时间窗:2026 年 4—9 月;样本量:该企业单项目全程跟踪 + 同行业 6 个项目的对照记录)。可复用的量化读数:定场景与盘资料占总工期约四成;解析补做平均造成 5—8 天返工;验收三张表齐全的项目,上线后一线使用率明显高于只做问答验收的项目。

想把这三张表直接用作验收模板,可看我们的本地化部署服务与交付项。如果你的资料库以标书与投标文件为主,路径与本文不同,可对照制造业 RAG 知识库本地化部署改造实录里的标书库口径。

结语

制造业知识库从 0 到 1,真正的难点是把散落的资料变成有归属、有版本、有出处的东西。该企业的 90 天说明一件事:先做资料与权限,再谈模型与效果,顺序反了就要返工

企业级环曜RAG知识库本地化部署 在这类场景里承担多源接入、文档检索与溯源,让一线查得到、也查得放心。你们工厂的资料主要卡在哪一步——是格式太杂,还是权限理不清?欢迎在评论区说说,我们按五步清单帮你对一次表;也可以直接联系环曜Agent团队,获取一份适配你所在行业的知识库验收模板。

常见问题 FAQ

Q:Q1 1800 人的制造企业,需要多少资料才值得上知识库?

该企业起步是约 5000 份工艺与设备文件。经验判断是:只要「查资料靠问人、版本靠翻文件夹」已经影响一线效率,就可以做。企业级环曜RAG知识库本地化部署 的起订门槛按接入源与文档量级算,不看企业人数。

Q:Q2 为什么先定三类问答,而不是先选模型?

模型决定上限,场景决定能不能用起来。先定场景,验证集才有出处,验收也才有依据。

Q:Q3 扫描件多是不是先做 OCR 再干别的?

建议在资料盘点阶段就统计格式占比,把 OCR 与表格解析并入接入环节,避免中段返工。

Q:Q4 老师傅的经验怎么进知识库?

用访谈转文档的方式沉淀成「故障现象—排查步骤—处置结论」结构,再按设备类资料入库,别直接录语音。

Q:Q5 权限绑定角色会不会太粗?

角色是基线,敏感工艺文件可再叠加单独授权。关键是人员变动时能一键收口,而不是逐条翻找——企业级环曜 Agent 本地化部署 在私有环境里把角色收口与审计留痕做成同一条链路。

Q:Q6 上线后资料改了怎么办?

靠增量同步,不要依赖人工上传。企业级环曜RAG知识库本地化部署 在文件更新后自动跟进,避免答案引用旧版工艺参数。

把验收三张表拿走

我们的团队可结合企业级环曜RAG知识库本地化部署的交付清单,帮你把资料分级、多源接入与验收三张表落成可执行模板,并同步梳理权限与留痕口径。欢迎联系环曜Agent团队。

联系环曜Agent团队
分享到: