مدیریت رخدادهای گسترده (Massive Incidents)
مدیریت رخدادهایی که Assetهای بسیاری را دربر میگیرند — همبستهسازی خودکار، چرخهٔ عمر رخداد، داشبورد عملیاتی و بازبینی پس از رخداد.
Massive Incident مجموعهای از Operational Issues بههمپیوسته است که علت مشترکی دارند.
بدین ترتیب میتوان رویدادهای بزرگ بهرهبرداری را بهعنوان یک شیء مدیریتی واحد تحلیل کرد.
همبستهسازی رخدادها
OHM هنگام همخوانی چند عامل، Operational Issues را بهصورت خودکار در قالب یک Massive Incident گرد میآورد:
- زمان وقوع؛
- منطقه؛
- Root Cause؛
- زیرساخت ارتباطی؛
- نسخهٔ نرمافزار؛
- رویداد بیرونی.
چرخهٔ عمر Massive Incident
flowchart TD
A["شناسایی"] --> B["همبستهسازی"]
B --> C["ایجاد Massive Incident"]
C --> D["بررسی"]
D --> E["کاهش اثر"]
E --> F["بازیابی"]
F --> G["راستیآزمایی"]
G --> H["بازبینی پس از رخداد"]
H --> I["بستن"]
داشبورد عملیاتی
سامانه برای هر Massive Incident این موارد را نشان میدهد:
- شمار Operational Issues مرتبط؛
- شمار Assetها؛
- مناطق متأثر؛
- Root Cause محتمل؛
- وضعیت بررسی؛
- SLA؛
- اثر بر کسبوکار (Business Impact)؛
- پیشرفت کنونی بازیابی.
بازبینی پس از رخداد (Post Incident Review)
پس از بستهشدن، رخداد تحلیل میشود.
گزارش شامل موارد زیر است:
- خط زمانی رویدادها؛
- Root Cause تأییدشده؛
- اثربخشی واکنش؛
- پایبندی به SLA؛
- درسهای آموخته (Lessons Learned)؛
- توصیههایی برای پیشگیری از تکرار.
همهٔ نتیجهگیریها را میتوان بهصورت خودکار به مقالههای Knowledge Base تبدیل کرد.
موضوعات مرتبط
آیا این صفحه مفید بود؟
از بازخورد شما سپاسگزاریم!