引言:一个厂长的深夜电话
去年秋天,一位在浙江做汽配加工的朋友半夜给我打电话,说车间的加工中心主轴突然抱死,停机一天损失接近二十万。他问我:网上说的预测性维护,到底该怎么落地?是不是买套传感器装上就完事了?我说不是,这事儿得按步骤来,跳过哪一步都可能白花钱。今天这篇就把预测性维护实施步骤掰开揉碎讲一遍,从设备摸底到模型上线,一条路线图说清楚。

第一步:摸清家底,给设备分个三六九等
很多工厂一上来就想"全部设备都监测",预算立刻爆炸。正确的做法是先做设备资产盘点,按两个维度打分:故障停机的影响程度、故障发生的频率。影响大、频率高的关键设备优先上监测,比如生产线上的主机、单点故障的瓶颈工位。影响小、坏了随手换的泵阀,定期人工巡检就够了。一般经验是,20%的关键设备吃掉了80%的停机损失,先盯住这20%。
第二步:设计数据采集方案
确定了要监测哪些设备,接下来决定"测什么、怎么测"。不同设备故障模式不同,传感器选型差别很大。滚动轴承看振动,电机绕组看温度和电流,往复机械看压力波形。采集频率也有讲究:轴承早期故障的特征频率高,采样率至少要到位,不然信号都采不全。
常见的数据来源有三种:
| 数据来源 | 典型内容 | 实施难度 |
|---|---|---|
| 加装传感器 | 振动、温度、声发射 | 中,需要停机安装 |
| 接入现有PLC/SCADA | 电流、转速、工艺参数 | 低,走OPC协议即可 |
| 手持点检仪定期采集 | 低频巡检数据 | 最低,适合起步过渡 |
第三步:搭平台,把数据攒起来
这一步很多人会纠结自建还是用云平台。我的建议是中小工厂直接用成熟的SaaS方案,把精力留给数据治理。真正难的不是软件,是让数据"能用"——传感器点位命名要统一,数据要带时间戳和工况标签(空载还是满载、加工什么料),否则后期的模型会把不同工况的信号混在一起,误报率高得吓人。
第四步:模型训练与验证,别急着上AI
先说句实在话:起步阶段,基于阈值和趋势分析的"传统方法"就能解决60%的问题。轴承振动烈度超ISO 10816标准、温升速率异常,这些规则简单有效。等积累了半年到一年的故障样本,再上机器学习模型才有意义。验证环节要拿历史故障回测,宁可漏报也别误报太多——工人连续被误报警骚扰两周,就会把整个系统打入冷宫,这种项目失败案例我见过不止一次。
第五步:接进维修流程,形成闭环
预警发出来只是开始。工单系统要能接收预警、派单、记录处理结果,处理结果再回流给模型团队做标注。这个闭环转起来,系统才会越用越准。落地时建议先试点3个月,选一两条产线跑通全流程,再逐步推广到全厂。
几个容易踩的坑
- 只买硬件不配人:没有专人响应预警,系统三个月后自动"死亡"
- 跳过设备分级,全厂铺开,预算超支后烂尾
- 数据没有工况标签,模型混淆工况导致误报泛滥
- 考核指标定错:用"报警数量"考核而不是"避免的停机损失"
写在最后
回到开头那位朋友,他后来按这套步骤走了小一年:先盘设备、再上传感器、最后接工单,主轴故障预警提前了11天抓到。预测性维护实施步骤看着繁琐,本质就一句话——先想清楚要解决谁的什么问题,再动手。顺序对了,这事不难。
