损失与停机问题解决:让损失解决之后不再回来
这个支柱评估的是损失被看见之后工厂做什么:从选择处理哪些损失,到证明对策确实降低了损失。它还涵盖两个常常游离在正式问题解决之外的损失领域:设备保养,以及换型和短停机。

这个支柱涵盖什么,为什么损失真正是在这里缩小的
可视化告诉你发生了什么,日常例行机制确保有人作出反应。但两者都不会让下个月的损失变小。只有当工厂针对值得投入的损失下功夫,找到自己能够改变的原因,再确认这个改变站住了,损失才会变小。
这里也是精力容易被浪费的地方。对一个小损失做5个为什么分析,或者实施了却从不确认的对策,耗费的工时与有效的对策一样多。问题解决薄弱的工厂很少闲着:它们忙着一遍遍解决同样的问题,往往还是同一批人,而帕累托图每个季度看起来都一样。
五道题沿着一项损失的生命周期展开。第1题关于选择,第2题关于分析,第3题关于验证。后两道题关注由设备维修和生产共同承担的设备损失,以及换型和短停机;后两者常被排除在问题解决之外,因为每一次看起来都小得无关紧要。
答案中提到的具名方法(5个为什么、鱼骨图、A3、8D、SMED、TPM)只是举例。评估不会因为方法的名称而加分。它看重的是:无论你用哪种方法,围绕它有没有触发条件、审阅和数据确认。
在现场看到的五个等级
先在表中给你的工厂定位,再与你在评估中得到的支柱指数核对。完整的等级定义见等级页面。
| 等级 | 现场看到的情况 | 会议上数字的样子 |
|---|---|---|
| 1级 被动应对 | 谁的声音大、哪台设备上一次坏了,就先处理谁。不做分析就直接处理,也不确认效果。维修部门被动应对,两个部门互相指责。换型不计时。 | 同一个故障被当作新问题反复讨论。“那个上个月已经修好了”是常听到的话,却没有人能拿出这次修理改变了什么。 |
| 2级 初步认知 | 每月回顾停机总时长;凭经验做选择。原因靠非正式讨论。有计划性维护,但生产一有压力就推迟。大致知道换型时间。 | 按部门统计的月度总数。记录下来的原因都是表象,例如“传感器故障”或“操作失误”。行动记在会议纪要里,有人想起来才去查。 |
| 3级 规范化 | 每周回顾按原因分类的损失帕累托图,排在前面的项目已分派。重大事件使用5个为什么或鱼骨图。计划性维护得到遵守,故障数据共享。每次换型都计时;短停机靠估算。 | 墙上贴着每周帕累托图,行动清单跟踪到完成为止。行动在工作做完时关闭,而不是在损失下降时关闭,所以同样的原因会再次出现。 |
| 4级 主动预防 | 每条产线一张以工时和金额表示的帕累托图,排在前面的损失有具名负责人。使用有书面触发条件的标准方法,由经理审阅每一份分析。设备联合评审;操作工承担基础保养。关键产线已开展换型时间缩减;瓶颈产线的短停机被测量。 | 每一项已关闭的行动都有前后对比图。复发问题被公开讨论。设备维修和生产拿出的是同一套设备损失数字。 |
| 5级 卓越 | 工厂目标分解为各产线的损失预算。各层级都具备问题解决能力,分析质量有辅导。经验证有效的对策更新标准,并复制到同类设备上。操作工自主保养与计划性维护融为一体。换型按带目标时间的标准进行。 | 每周对照各产线的预算跟踪损失及其趋势。复发问题的占比被跟踪。各产线每一次超出目标的换型和每一种短停机原因都被复盘。 |
五道题,以及工厂常见的自我误判
问题解决容易被高估,因为相关的物件都在:模板、帕累托图、行动跟踪表。这些题问的是这些物件带来了什么。下面每项检查用的都是你手头已有的记录。
1. 你们如何决定先解决哪些损失? 我们要问的是:损失的大小是否决定了选择。常见的高估是:有每周帕累托图,但班组做的是排第五的那项,因为它更容易;或者排在首位的是“其他”,而且一直排在那里。按停机次数排序的帕累托图会掩盖长时间停机;只按时长排序的又会掩盖短停机。
列出上个月每个班组实际在处理的事项。把这份清单与同一批产线上个月的帕累托图并排放在一起。数一数排前三的损失中,有几项有人在处理。如果答案是一项或零项,这张帕累托图就只是摆设。
2. 如何分析根本原因? 我们要问的是:分析能否找到工厂可以改变的原因,以及有没有人检查推理的质量。常见的高估是清点填好的表格数量。停在“操作失误”或“轴承磨损”的5个为什么只是一张表格,不是分析。
取档案中近期的五份分析。逐份读它归结出的原因。它指向的是不是工厂可以在标准、设计、排产或培训计划中改变的东西?如果指向的是某个人,或者只是换个说法重复了表象,就不算数。然后查一查,启动分析的触发条件有没有在任何地方写下来。
3. 对策实施后,你们如何确认它有效? 我们要问的是:行动是否依据损失确实发生变化的证据才关闭。每一行都标着“已完成”的行动跟踪表是3级,不是4级:它证明工作做了,却证明不了工作有效。
挑选上季度关闭的五项行动。对每一项,找出行动前后各两到四周的损失数据。然后在本月同一台设备的帕累托图中查找同样的停机原因。数一数有多少项你能证明有效,又有多少项卷土重来。
4. 在设备损失上,设备维修和生产如何协作? 我们要问的是:设备损失是否被当作共同的问题、使用共同的数据来处理。常见的高估情形是:有联合会议,但维修讲、生产听;或者所谓操作工保养只是清扫,没有任何点检标准。
数一数上季度瓶颈产线安排了多少个计划性维护时段,其中多少个按计划日期完成。然后请这条产线上的一名操作工拿出清扫和点检标准,并说明点检时看什么。没有人能讲清楚的标准,就是没有在用的标准。
5. 换型和短停机是如何管理的? 我们要问的是:两者是否都被测量并着手解决,而不只是心里有数。这里常见的是低估:工厂以为短停机必须自动采集,其实在瓶颈产线上用一周的计数表就是正当的起步。高估也很常见:开过一次换型研讨会,之后时间又慢慢回到了原样。
取上个月发生频次高的那种换型的用时记录,看用时快的一次与慢的一次之间的差距,而不是平均值。差距大,说明没有在用的标准。至于短停机,请瓶颈产线的操作工在一个班次内,用笔为每一次短到来不及记录的停机画一道。把总数与你们记录中显示的数量对比。
4级工厂的不同做法
在这个支柱上处于4级的工厂,分析的问题并不比别人多。它们分析得更少,按价值挑选,而且拒绝在没有数据的情况下关闭任何一项。以下是往往让它们与众不同的做法。
- 每条产线每周一次损失评审,固定日期、固定时间。 不超过三十分钟。帕累托图以工时和金额显示停机时间,使用与财务一次性商定的每小时成本。排前三的损失各有一名具名负责人和一行状态说明。
- 正式分析有书面触发条件。 例如任何超过两小时的停机,或同一原因一周内出现三次。低于触发条件的,班组处理并记录;高于触发条件的,必须做结构化分析。
- 经理用15分钟审阅每一份分析。 用一份简短的检查表:问题是否用数据陈述,原因是否经过确认而不是假设,因果链是否落在工厂能掌控的事情上,对策是否针对这个原因。
- 关闭规则。 只有当损失数据在至少两到四周内显示出变化时,行动才能关闭。对于罕见故障,另行商定更长的观察期,或采用点检发现之类的先行指标。
- 设备维修和生产共用一套设备数字。 每周共同评审每台关键设备的故障频次和维修时间,瓶颈产线的操作工按照书面标准进行基础的清扫、润滑和点检。
- 换型有标准,有目标。 可以在产线运行时完成的任务与不能的任务分开,每个步骤都有时间,每一次超出目标时间的换型都在看板上写明原因。
- 瓶颈产线的短停机按原因计数。 手工计数也可以。一旦弄清了主要原因,就像其他损失一样纳入每周帕累托图。
确定在你们工厂什么算复发,例如行动关闭后90天内同一台设备出现同样的故障。把它写下来,每月统计复发次数。这是衡量问题解决是否有效的直接指标,而且维持它不花任何成本。
提升一个等级的90天计划
你的报告会为每道题给出具体的下一步行动。下面的计划把它们组合起来,针对这样一家工厂:每月回顾停机,非正式分析,行动跟踪松散。只在瓶颈产线上执行;一个范围窄但能坚持下来的计划,胜过一个铺满全厂却逐渐消退的计划。
- 第1–2周每周一列出瓶颈产线上周停机时长排在前面的停机,从中选一项着手解决。与财务商定每小时产出损失的成本,并写下来。在行动清单上加一列:“我们怎么知道它有效?”召开首次设备维修与生产负责人之间的30分钟周会,复盘本周的故障。
- 第3–6周建立每周按原因统计的停机时长帕累托图,以工时和金额表示,把排前三的项目分派给具名人员。选定一种分析方法,用产线上的真实案例培训主管,并写明使用该方法的触发条件。开始记录瓶颈产线每次换型的开始和结束时间,并用一个班次做一次短停机的手工计数。
- 第7–12周执行关闭规则:没有两到四周前后对比数据的行动,一律不关闭。开始由经理审阅每一份分析。拍摄发生频次高的那种换型,把可以在产线运行时完成的任务分离出来,并为每个步骤计时。在瓶颈产线启动操作工基础保养。第12周,重做各项自查,并重新评估。
90天内各自负责什么:
- 生产经理: 负责每周损失评审、帕累托图和关闭规则。
- 设备维修经理: 负责每周联合评审、计划性维护执行率和操作工保养标准。
- 财务或经营控制: 负责商定的每小时成本,一次定下,不在每次会议上重新讨论。
- 主管和班组长: 负责触发事件的分析和换型记录。
- 持续改善负责人: 培训分析方法,旁听头几次经理审阅,并与班组一起开展换型分析。
- 瓶颈产线的操作工: 按标准进行基础保养,并做短停机计数。
核验时评审团关注的证据
针对这个支柱,评审员在核验时要看的是一条完整的链条:依据数据选定的损失、一份分析、一项对策,以及前后对比的确认。一条附有记录的完整链条,比一整夹模板更有说服力。
- 连续几周的每周帕累托图,排在前面的损失旁写有具名负责人。
- 填写完成的分析(5个为什么、A3或8D),显示经理的审阅,以及启动这些分析的书面触发条件。
- 行动清单,已关闭的行动附有前后对比的损失数据。
- 瓶颈产线的计划性维护执行记录和填写完成的操作工保养检查表。
- 对照标准的换型时间记录,以及超出目标的换型清单及原因。
- 按原因统计的短停机次数,无论来自系统还是计数表。
- 如申报5级,还需提供经验证有效的对策已复制到的同类设备或产线清单。
不算数的包括:空白模板、单独的培训证书、仅有一份展示用的A3、标着“已完成”却没有数据的行动清单,或者之后没有任何换型记录的换型研讨会报告。访谈中,评审员可能会请你把一项损失从帕累托图一路讲到经验证的结果。
让工厂在这个支柱上停滞不前的陷阱
- 什么都要分析。 每次停机都要填表时,表格填了,却什么也没分析。触发条件的意义,就在于为重要的损失保住分析时间。
- 根本原因落在某个人身上。 “操作工没有按作业指导操作”,得到的只是重新培训,别无其他。要问的是:为什么这份作业指导那么容易不被遵守?
- 做完就关闭。 工作做完了,行动关闭了,三周后损失又回来了,换了一个新的行动编号。
- “其他”排在原因首位。 这意味着占比首位的损失既没有负责人,也没有分析。在做任何其他事之前,先把它拆开。
- 反复争论金额。 如果每次评审都在争论每小时成本,以金额表示的帕累托图就会被无视。商定一次,并注明日期。
- 把计划性维护当作缓冲。 为生产推迟维护,这周看起来不花代价,之后却以故障的形式找上门来。跟踪推迟次数,让这种取舍看得见。
- 只开一次换型研讨会。 时间降下来了,之后又慢慢回升,因为没有写下标准和目标时间,也没有人复盘超时。
- 复制对策却不检查是否适用。 推广到同类设备的对策,在每台设备上仍然需要单独做前后对比确认。
下一步
参加FEI评估,了解你的工厂在这个支柱以及其他五个支柱上所处的位置,并针对三个主要差距各获得一项90天行动。问题解决处理的是单项损失;下一个支柱持续改善机制,讲的是工厂如何针对众多损失规划、配置资源并保持改善。已核验的工厂可以参与 Factory Excellence Recognition 的评定。
常见问题
应该用哪种方法:5个为什么、A3还是8D?
哪一种都可以,只要它是一种有书面触发条件和经理审阅的标准方法。用5个为什么就足以达到3级。常见的分工是:产线层面的事件用5个为什么,较大的或涉及客户的问题用A3或8D;对得分而言,关键在于这一选择写了下来并得到执行。
怎样给停机定一个金额,又不必和财务长时间争论?
与财务商定瓶颈产线每小时产出损失的一个成本,写下计算方法并注明日期。它不需要很精确,但需要稳定,这样各项损失才能相互排序。每年复核一次,而不是每次会议都拿出来讨论。
关闭一项行动之前应该等多久?
模型采用改变之后两到四周的损失数据。对于一年只发生几次的故障,这个观察期太短:请另行商定更长的观察期,或采用点检结果之类的先行指标,并把规则写下来,避免逐案决定。
我们的换型次数由客户需求决定,换型那道题还适用吗?
适用。这道题问的不是你们换型多少次,而是每一次换型如何进行:是否计时,是否有标准和目标,超时是否被复盘。换型次数越多,这种规范就越有价值。
要在设备维修与生产协作上得高分,需要正式的TPM项目吗?
不需要。答案描述的是做法:受保护的计划性维护、共享的故障数据、联合评审、操作工基础保养和失效模式分析。推行TPM的工厂会觉得这些很眼熟,但无论项目叫什么名字,评估衡量的都是这些做法。