
很多工厂都装了安灯,也规定了“异常要及时上报”。但真正到现场看,最常见的问题不是灯不亮,而是灯亮了之后,大家不知道谁该来、什么时候来、来了先做什么。结果,安灯本来是用来缩小问题影响范围的,最后却变成了墙上的装饰,或者只是事后追责的证据。
这也是为什么安灯(Andon)的关键,从来不只是一个按钮、一盏灯或一套电子系统,而是一套清楚的异常响应机制。精益生产讲的是让问题尽早暴露,并在最小范围内被处理。若现场只有“报异常”,没有“接异常、判异常、解异常、复盘异常”的固定动作,问题只会换一种方式继续流动。
一、为什么很多企业装了安灯,现场还是照样救火?
不少企业导入安灯之后,最初几周看起来很热闹,异常被报出来的次数明显增加。但再过一段时间,现场又回到老样子:有些人不愿意按,有些灯亮了没人来,有些问题重复发生却没有后续动作。这通常不是员工不配合,而是机制没有设计完整。
1. 只定义“可以拉灯”,没有定义“谁必须响应”
如果操作员按下安灯后,只能被动等待,而班长、技术员、设备员、检验员之间又没有明确分工,那么每一次异常都只能靠临场猜测。有人先来,但未必能处理;真正能处理的人来了,却已经错过最佳时机。
2. 异常等级混在一起,现场很快麻木
缺料、质量异常、设备停机、参数偏差、首件未放行,这些问题的紧急程度并不相同。若所有异常都用同一种信号、同一种处理方式,久而久之,团队只会把安灯当成背景噪音,反而分不清什么才是真正需要立刻中断的情况。
3. 处理动作只停留在“先恢复生产”
很多现场一看到异常,第一反应就是尽快让设备重新动起来。这当然重要,但如果每次都只停留在临时复位、临时补料、临时换人,问题就会在下一班、下一批、下一周再回来。安灯的价值,不是把问题藏得更快,而是把问题解决得更早。
二、安灯真正要建立的,是一条“异常升级路径”
精益管理中的安灯,核心不是提醒大家“这里出事了”,而是让异常在固定时间内进入固定的人手里,并按固定步骤被判断和处置。因此,一个可用的安灯机制,至少要回答四个问题:
- 谁可以触发? 操作员、检验员、物料员、班长,哪些角色有权按灯或停线,必须先说清楚。
- 触发后谁先到场? 是班组长先来,还是设备员、工艺员直接来,不能模糊。
- 多长时间内必须响应? 不是为了追求漂亮数字,而是为了避免异常无限等待。
- 什么情况下现场处理,什么情况下升级? 若超过既定时间无法恢复,必须自动进入更高一级支持。
这四个问题如果没有标准答案,安灯就只是一个报警动作,不是一套管理机制。
三、一个常见场景:灯亮了,但真正的问题是“响应链断了”
例如在一条装配线上,操作员发现某工位连续出现扭矩异常,按下安灯后,邻线班长先过来看了一眼,判断可能是治具松动,于是让员工先继续做下一台;十几分钟后,质量人员抽检时又发现同类问题,才追溯到前面几件也可能受影响。这个过程中,安灯并不是没起作用,而是响应链没有闭合。
如果机制设计得更完整,现场应该更像这样运作:
- 操作员触发安灯并停止当前风险动作: 先防止异常继续扩大。
- 班组长在规定时间内到场做初判: 判断是缺料、设备、质量还是方法问题。
- 按异常类别拉动对应支持: 设备员处理设备类,工艺或质量人员处理参数与判定类。
- 若超过现场可恢复边界,立即升级: 不让一线在不确定状态下继续硬撑。
- 恢复后留下最小必要记录并做短复盘: 确保同类问题不会只被“关灯”而没有后续。
很多企业以为安灯系统的问题出在设备或软件上,其实更常见的是升级路径没有被写清楚、练清楚、守清楚。
四、怎样划分异常等级,现场才不会又乱又慢?
不是所有异常都要立即停整条线,但也不是所有异常都能边做边看。比较实用的做法,是先按影响边界区分异常等级,而不是按谁声音最大来判断。
1. 可在工位内快速恢复的异常
例如物料摆放错误、治具轻微偏位、简单复位即可解决的误报警。这类问题可以由班组长或指定支援在工位内快速关闭,但仍应保留触发记录,避免小问题高频重复。
2. 会影响质量或节拍,但短时间可判断的异常
例如扭矩偏差、首件确认卡住、设备状态不稳定、短时间缺料。这类问题通常需要在限定时间内完成判断:是停、是换、是隔离、还是升级。关键不在于马上给出完美答案,而在于不要让风险继续流向下工序。
3. 会造成批量风险或人机安全风险的异常
这类问题必须触发更高等级响应,必要时立即停线、隔离在制品、通知相关负责人。若企业把这种异常和普通补料、普通等待混在同一个队列里,真正的大问题往往反而被延迟处理。
五、管理者更该设计的,不是“灯”,而是“到场后的标准动作”
很多安灯项目在硬件上投入不少,但现场仍然无效,原因就在这里。真正决定效率的,不是报警方式有多先进,而是到场后的前 3 到 5 分钟有没有标准动作。现场至少要统一以下几件事:
- 先保什么: 先保安全、先保质量、先保不继续流出,而不是先保产量数字好看。
- 先问什么: 异常从哪一件开始、影响到哪一段、现在还在继续吗。
- 先看什么: 看设备状态、看工艺参数、看最近变更、看物料与治具,而不是只听口头解释。
- 先决定什么: 是继续、暂缓、隔离、换机、换料还是升级,必须有人当场拍板。
如果这些动作没有标准化,安灯响应再快,也可能只是更快地进入混乱。
六、为什么有些员工不愿意按安灯?问题往往不在意识,而在后果
现场常听到一句话:“大家都知道有异常要报,但就是不想按。”这通常不是培训没做,而是员工知道一旦按灯,可能会带来额外压力:被质问为什么停线、被认为动作慢、被要求自己先想办法撑过去。久而久之,安灯就会失真。
所以,管理者若希望安灯真实反映问题,必须建立一个明确立场:触发异常不是犯错,隐瞒异常才是风险。只要员工是在既定标准下触发安灯,就应该被视为保护流程,而不是制造麻烦。这个文化信号如果不被反复强化,再好的安灯制度都会慢慢失效。
七、一个更稳的推进顺序:先定义边界,再练响应,再追速度
不少企业一开始就想把安灯做成大屏、系统、看板联动,但如果基本边界还没理清,系统只会把混乱数字化。更稳妥的顺序通常是:
- 先定义异常分类与触发条件: 哪些必须按灯,哪些必须停线,先形成共同语言。
- 再定义响应角色与升级规则: 谁来、多久来、来后怎么判断、何时升级。
- 再做现场演练: 用真实场景模拟缺料、设备、质量和首件异常,检查响应链是否真的跑得起来。
- 最后才做系统固化: 当规则已稳定,再上电子化、数据化,效果才会更持久。
精益改善讲究先让流程可执行,再让流程可视化、可量化。顺序反了,安灯很容易只剩下形式。
总结
安灯不是一盏灯,而是一套异常升级与快速响应机制。它真正要解决的,不是“有没有人看到问题”,而是“问题暴露后,组织能不能在最短时间内让正确的人按正确的步骤把影响控制住”。
如果你的现场现在也有“灯亮了但没人来”“来了也不知道先做什么”“同类问题总在重复”的情况,不妨先别急着换系统,先把三个问题问清楚:谁能触发?谁来响应?什么情况下必须升级?很多安灯失效,不是因为工具不够先进,而是因为响应机制还没有真正建立起来。
可执行建议
- 先选一条线梳理异常类型: 把最近一个月最常见的异常按设备、质量、物料、方法分类,不要一开始就全厂铺开。
- 为每类异常指定第一响应角色: 明确谁必须到场,避免“大家都知道,结果谁都没来”。
- 设置简单的升级边界: 例如超过既定时间未恢复、涉及批量风险或安全风险时必须升级。
- 做 15 分钟现场演练: 用班前会或周会模拟一次安灯触发,看响应链在哪一步断掉。
- 每周只复盘前三大重复异常: 先把高频重复问题压下来,比统计很多数字更有用。





