Операционные KPI и эффективность команд
Операционные KPI от MTTD до Verification Success Rate и отдельная группа Team KPI для загрузки, capacity и эффективности команд.
Операционные KPI
Operational Health Matrix использует систему эксплуатационных показателей, предназначенную для объективной оценки эффективности процессов обнаружения, анализа, устранения и подтверждения эксплуатационных проблем.
В отличие от традиционной отчётности, KPI используются не только для оценки подразделений, но и для непрерывного улучшения самой IIoT Платформы.
Все показатели рассчитываются автоматически на основании фактической истории жизненного цикла Operational Issues.
Архитектура KPI
Все показатели разделяются на четыре независимые группы.
flowchart TD
ALL["Все показатели"] --> OPS["Операционные KPI"]
ALL --> ASSET["KPI активов"]
ALL --> TEAM["KPI команд"]
ALL --> PLAT["KPI платформы"]Подобное разделение исключает смешивание состояния оборудования, эффективности сотрудников и качества аналитических алгоритмов.
Среднее время обнаружения (MTTD)
MTTD характеризует эффективность аналитической подсистемы.
Определение:
Среднее время между фактическим возникновением проблемы и её автоматическим обнаружением платформой.
Используется для оценки:
- качества детекторов;
- полноты телеметрии;
- задержек обработки;
- эффективности аналитики.
Чем меньше значение, тем быстрее система выявляет проблему.
Среднее время реакции (MTTA)
Показывает скорость реакции эксплуатационной службы.
Определение:
Среднее время между созданием Operational Issue и подтверждением его принятия ответственным подразделением.
Позволяет оценивать:
- скорость реагирования;
- организационную дисциплину;
- эффективность диспетчерской службы.
Среднее время устранения (MTTR)
Основной эксплуатационный показатель.
Определение:
Среднее время между созданием Operational Issue и подтверждённым устранением причины.
При расчёте используются только завершённые Issues.
Для разных классов проблем допускаются отдельные нормативы.
Среднее время верификации (MTTV)
MTTV оценивает эффективность процесса проверки.
Показатель характеризует:
время между окончанием работ и подтверждением восстановления нормального состояния оборудования.
Высокий MTTV обычно свидетельствует:
- о недостатке телеметрии;
- о сложной процедуре проверки;
- о нехватке ресурсов;
- о проблемах организации эксплуатации.
Соблюдение SLA (SLA Compliance)
Показывает долю Operational Issues, завершённых без нарушения требований SLA.
Рассчитывается отдельно для:
- Response;
- Acknowledgement;
- Resolution;
- Verification;
- Closure.
Отдельная статистика ведётся:
- по регионам;
- подразделениям;
- канонам;
- типам оборудования.
Средний возраст Issues (Mean Issue Age)
Показывает средний возраст активных Operational Issues.
Используется для оценки накопленного эксплуатационного долга.
Дополнительно рассчитывается распределение:
- 0–1 день;
- 1–3 дня;
- 3–7 дней;
- 7–30 дней;
- более 30 дней.
Доля переоткрытий (Reopen Rate)
Характеризует качество устранения проблем.
Определение:
Доля Operational Issues, повторно открытых после закрытия.
Высокий показатель означает:
- неполное устранение причины;
- ошибочную диагностику;
- недостаточную верификацию;
- хронические дефекты оборудования.
Повторяемость проблем (Repeat Issue Rate)
Показывает повторяемость одинаковых канонов для одного актива.
Используется при анализе:
- хронических отказов;
- необходимости модернизации оборудования;
- качества обслуживания.
Доля пропущенных проблем (Issue Escape Rate)
Показывает долю проблем, которые не были обнаружены автоматически и были зарегистрированы пользователями.
Рост показателя требует анализа:
- покрытия детекторами;
- качества телеметрии;
- полноты аналитики.
Успешность верификации (Verification Success Rate)
Определяет долю работ, успешно подтверждённых системой после выполнения.
Высокий показатель свидетельствует:
- о правильной диагностике;
- о корректном выполнении работ;
- о высокой достоверности Operational Workflow.
Операционный backlog
Backlog показывает объём незавершённой работы.
Дополнительно анализируются:
- общий объём;
- критичный backlog;
- просроченный backlog;
- backlog по подразделениям;
- backlog по регионам.
Дашборд KPI
Главная аналитическая панель содержит:
- MTTD;
- MTTA;
- MTTR;
- MTTV;
- SLA Compliance;
- Reopen Rate;
- Repeat Rate;
- Detector Accuracy;
- False Positive Rate;
- Operational Backlog;
- Mean Issue Age;
- Health Trend.
Все показатели доступны в динамике и по любому уровню организационной структуры.
Показатели эффективности команд
Эксплуатационные показатели оборудования не используются для оценки сотрудников.
Для оценки эффективности подразделений применяется отдельная группа Team KPI.
Это позволяет исключить ситуацию, когда ухудшение состояния оборудования автоматически ухудшает оценку работы персонала.
Загрузка (Workload)
Показывает фактическую загрузку инженеров.
Учитываются:
- число активных Issues;
- их критичность;
- сложность;
- количество активов;
- объём Verification Queue.
Использование capacity
Характеризует степень использования доступных ресурсов подразделения.
Используется для:
- балансировки нагрузки;
- планирования штата;
- оценки необходимости перераспределения работ.
Устранение с первого раза (First Time Resolution)
Показывает долю проблем, устранённых без повторного открытия.
Высокое значение говорит о высоком качестве диагностики и ремонта.
Баланс назначений (Assignment Balance)
Оценивает равномерность распределения Operational Issues между инженерами.
Используется при автоматическом назначении.
Среднее время подтверждения
Показывает среднее время подтверждения результатов выполненных работ.
Позволяет выявлять узкие места процесса эксплуатации.
Дашборд команды
Руководитель подразделения получает:
- текущую загрузку;
- прогноз загрузки;
- SLA;
- backlog;
- эффективность;
- повторные открытия;
- производительность команды;
- распределение компетенций.
Связанные темы
Эта страница была полезной?
Спасибо за ваш отзыв!