KPI opérationnels et efficacité des équipes

Les KPI opérationnels, du MTTD au Verification Success Rate, et le groupe distinct des Team KPI pour la charge de travail, la capacité et l'efficacité.

Indicateurs clés de performance opérationnelle

Operational Health Matrix s’appuie sur un système d’indicateurs d’exploitation conçu pour évaluer objectivement l’efficacité des processus de détection, d’analyse, de résolution et de vérification des problèmes d’exploitation.

À la différence d’un reporting classique, les KPI ne servent pas seulement à évaluer les services : ils alimentent aussi l’amélioration continue de la Plateforme IIoT elle-même.

Le système calcule tous les indicateurs automatiquement, à partir de l’historique réel du cycle de vie des Operational Issues.

Architecture des KPI

L’ensemble des indicateurs se répartit en quatre groupes indépendants.

flowchart TD
  ALL["Tous les indicateurs"] --> OPS["KPI opérationnels"]
  ALL --> ASSET["KPI des Assets"]
  ALL --> TEAM["KPI des équipes"]
  ALL --> PLAT["KPI de la plateforme"]

Cette séparation évite de mélanger l’état des équipements, l’efficacité des collaborateurs et la qualité des algorithmes d’analyse.

Temps moyen de détection (MTTD)

Le MTTD caractérise l’efficacité du sous-système d’analyse.

Définition :

Temps moyen entre la survenue effective d’un problème et sa détection automatique par la plateforme.

Il sert à évaluer :

  • la qualité des Detectors ;
  • la complétude de la télémétrie ;
  • les délais de traitement ;
  • l’efficacité de l’analyse.

Plus la valeur est faible, plus le système identifie rapidement le problème.

Temps moyen de prise en compte (MTTA)

Il traduit la rapidité de réaction du service d’exploitation.

Définition :

Temps moyen entre la création d’une Operational Issue et la confirmation de sa prise en charge par le service responsable.

Il permet d’évaluer :

  • la rapidité de réaction ;
  • la discipline organisationnelle ;
  • l’efficacité du service de conduite.

Temps moyen de résolution (MTTR)

L’indicateur d’exploitation principal.

Définition :

Temps moyen entre la création d’une Operational Issue et l’élimination confirmée de sa cause.

Seules les Issues terminées entrent dans le calcul.

Des objectifs distincts sont admis pour différentes classes de problèmes.

Temps moyen de vérification (MTTV)

Le MTTV évalue l’efficacité du processus de vérification.

L’indicateur caractérise :

le temps écoulé entre la fin des travaux et la confirmation du rétablissement de l’état normal de l’équipement.

Un MTTV élevé signale généralement :

  • une télémétrie insuffisante ;
  • une procédure de vérification complexe ;
  • un manque de ressources ;
  • des problèmes d’organisation de l’exploitation.

Respect des SLA (SLA Compliance)

Il indique la part des Operational Issues terminées sans manquement aux exigences SLA.

Il est calculé séparément pour :

  • la réponse (Response) ;
  • la prise en compte (Acknowledgement) ;
  • la résolution (Resolution) ;
  • la vérification (Verification) ;
  • la clôture (Closure).

Des statistiques distinctes sont tenues :

  • par région ;
  • par service ;
  • par Canon ;
  • par type d’équipement.

Ancienneté moyenne des Issues (Mean Issue Age)

Elle indique l’ancienneté moyenne des Operational Issues actives.

Elle sert à évaluer la dette d’exploitation accumulée.

La distribution est calculée en complément :

  • 0–1 jour ;
  • 1–3 jours ;
  • 3–7 jours ;
  • 7–30 jours ;
  • plus de 30 jours.

Taux de réouverture (Reopen Rate)

Il caractérise la qualité du traitement des problèmes.

Définition :

Part des Operational Issues rouvertes après leur clôture.

Une valeur élevée traduit :

  • une élimination incomplète de la cause ;
  • un diagnostic erroné ;
  • une vérification insuffisante ;
  • des défauts chroniques de l’équipement.

Taux de récurrence (Repeat Issue Rate)

Il indique la récurrence de Canons identiques sur un même Asset.

Il est utilisé pour analyser :

  • les défaillances chroniques ;
  • la nécessité de moderniser l’équipement ;
  • la qualité de la maintenance.

Taux de problèmes non détectés (Issue Escape Rate)

Il indique la part des problèmes qui n’ont pas été détectés automatiquement et qui ont été signalés par les utilisateurs.

Une hausse de cet indicateur impose d’analyser :

  • la couverture par les Detectors ;
  • la qualité de la télémétrie ;
  • la complétude de l’analyse.

Taux de vérification réussie (Verification Success Rate)

Il détermine la part des travaux confirmés avec succès par le système après leur exécution.

Une valeur élevée traduit :

  • un diagnostic correct ;
  • une exécution conforme des travaux ;
  • une grande fiabilité de l’Operational Workflow.

Backlog opérationnel

Le backlog indique le volume de travail non terminé.

Le système analyse en complément :

  • le volume total ;
  • le backlog critique ;
  • le backlog en retard ;
  • le backlog par service ;
  • le backlog par région.

Tableau de bord des KPI

Le tableau de bord analytique principal contient :

  • MTTD ;
  • MTTA ;
  • MTTR ;
  • MTTV ;
  • SLA Compliance ;
  • Reopen Rate ;
  • Repeat Rate ;
  • Detector Accuracy ;
  • False Positive Rate ;
  • Operational Backlog ;
  • Mean Issue Age ;
  • Health Trend.

Tous les indicateurs sont disponibles dans leur évolution temporelle et à tout niveau de la structure organisationnelle.

Tableau de bord KPI présentant les indicateurs des processus d'exploitation à côté d'un bloc People KPI distinct consacré au personnel et à la charge. Tableau de bord KPI présentant les indicateurs des processus d'exploitation à côté d'un bloc People KPI distinct consacré au personnel et à la charge.
KPI répartis en Operational KPI (processus) et People KPI (personnel et charge) — tous calculés à partir de l'historique des événements

Indicateurs d’efficacité des équipes

Les indicateurs d’exploitation des équipements ne servent pas à évaluer les collaborateurs.

Un groupe distinct de Team KPI est utilisé pour évaluer l’efficacité des services.

Cela évite qu’une détérioration de l’état des équipements ne dégrade automatiquement l’évaluation du travail du personnel.

Charge de travail (Workload)

Elle indique la charge réelle des ingénieurs.

Elle prend en compte :

  • le nombre d’Issues actives ;
  • leur criticité ;
  • leur complexité ;
  • le nombre d’Assets ;
  • le volume de la Verification Queue.

Utilisation de la capacité (Capacity Utilization)

Elle caractérise le degré d’utilisation des ressources disponibles du service.

Elle sert à :

  • équilibrer la charge ;
  • planifier les effectifs ;
  • évaluer la nécessité de redistribuer les travaux.
Écran Teams comparant les Issues ouvertes de chaque ingénieur à sa capacité, les ingénieurs surchargés étant mis en évidence. Écran Teams comparant les Issues ouvertes de chaque ingénieur à sa capacité, les ingénieurs surchargés étant mis en évidence.
Teams : Issues ouvertes rapportées à la capacité de chaque ingénieur, surcharge mise en évidence

Résolution dès la première intervention (First Time Resolution)

Elle indique la part des problèmes résolus sans réouverture.

Une valeur élevée traduit une grande qualité du diagnostic et de la réparation.

Équilibre des affectations (Assignment Balance)

Il évalue l’homogénéité de la répartition des Operational Issues entre les ingénieurs.

Il est utilisé lors de l’affectation automatique.

Durée moyenne de vérification

Il indique le temps moyen de confirmation des résultats des travaux réalisés.

Il permet de repérer les goulets d’étranglement du processus d’exploitation.

Tableau de bord de l’équipe

Le responsable du service dispose :

  • de la charge courante ;
  • d’une prévision de charge ;
  • des SLA ;
  • du backlog ;
  • de l’efficacité ;
  • des réouvertures ;
  • de la productivité de l’équipe ;
  • de la répartition des compétences.

Sujets connexes

Cette page vous a-t-elle été utile ?