Il est devenu totalement inacceptable pour les entreprises de permettre ou de tolérer la détérioration des équipements qui entraîne des pannes avec des conséquences graves sur la santé, la sécurité ou l'environnement. Bien que cela ait été publiquement adopté par de grandes entreprises dans la plupart des régions du monde, des événements continuent de se produire avec des résultats catastrophiques. Ceux-ci sont souvent le résultat d'une combinaison d'erreurs humaines et de pannes d'équipement. Cette combinaison, ainsi que les défaillances de systèmes de protection complexes (machines surveillant des machines), a été la cause profonde de certains des accidents les plus dévastateurs au monde. Une recherche rapide sur Google renverra instantanément des événements comme l'explosion de la raffinerie de Texas City, la marée noire de Deepwater Horizon, Tchernobyl, le vol Aloha 243, Three Mile Island et bien d'autres.
Cette présentation explorera les concepts de conséquences des pannes d'équipement et leur relation avec la probabilité de panne. Ce sont des éléments dans le développement d'une évaluation de criticité des équipements et d'un score de risque relatif, qui peuvent tous deux être utilisés pour prioriser le retard de travail correctif et les initiatives d'amélioration des programmes de fiabilité. En utilisant ces informations, nous examinerons ensuite des méthodes pour développer des stratégies de maintenance proactives conçues pour gérer efficacement ce risque à un « niveau tolérable ». Ces stratégies incluent généralement un mélange de tactiques de maintenance directe, de modifications, de formation et de procédures. L'objectif est d'améliorer la compréhension de la relation entre la sécurité et les programmes de fiabilité des équipements.