📍 المملكة العربية السعودية تحديث مستمر على مدار الساعة

وظيفة Major Incident Manager شاغرة لدى DXC Technology في الرياض

Major Incident Manager
🏢 DXC Technology
🕒 نُشرت: (اليوم) 📍 الرياض وظائف الهندسة والتقنية
التقديم على الوظيفة من المصدر الرسمي ↗

تفاصيل الوظيفة

شركة DXC Technology تعلن عن وظيفة مدير إدارة الحوادث الكبرى (Major Incident Manager) في الرياض، السعودية.

المهام والمسؤوليات

  • القيام بأنشطة إدارة الحوادث على مدار الساعة وطوال أيام الأسبوع لتقليل انقطاع الخدمة وتأثيرها على الأعمال.
  • تسجيل وإدارة الحوادث الناتجة عن تدهور الخدمة أو الانقطاعات أو التنبيهات التشغيلية.
  • إنشاء وإدارة قنوات الاتصال وجسور الحوادث للحوادث الحرجة.
  • تنسيق أنشطة استكشاف الأخطاء وإصلاحها واستعادة الخدمات ومشاركة أصحاب المصلحة.
  • ضمان اتخاذ القرارات السريعة وإزالة العوائق التشغيلية أثناء حل الحوادث.
  • القيادة في استعادة الخدمة مع الالتزام بعمليات إدارة الحوادث.
  • جدولة وتسهيل اجتماعات مراجعة الحوادث الكبرى بعد حل الحوادث.
  • توثيق الجداول الزمنية للحوادث وأنشطة الفرز وإجراءات الاسترداد والدروس المستفادة وفرص التحسين.
  • تنسيق مشاركة أصحاب المصلحة خلال جلسات المراجعة.
  • إنهاء ونشر تقارير مراجعة الحوادث الكبرى (MIR).
  • تنسيق أنشطة تحليل السبب الجذري (RCA) للحوادث الكبرى والمشكلات التشغيلية المتكررة عبر الفرق الفنية الداخلية والمصنعين الأصليين (OEMs) والبائعين الخارجيين وأصحاب المصلحة.
  • تحديد وتسجيل سجلات المشكلات بشكل استباقي بناءً على اتجاهات الحوادث والمخاطر المحتملة على الخدمة.
  • إجراء أنشطة تحديد المشكلات وتحليل الأثر بالتفصيل.
  • إنشاء وإدارة سجلات المشكلات لجميع الحوادث الكبرى والأحداث ذات التأثير الكبير على الخدمة.
  • ضمان أن جميع سجلات المشكلات تحتوي على أسباب جذرية موثقة وحلول بديلة وإجراءات تصحيحية وحلول دائمة.
  • تتبع المشكلات المفتوحة ومراقبة التقدم نحو الحل ضمن مستويات الخدمة المتفق عليها.
  • تسهيل أنشطة التحقيق لتحديد الأسباب الكامنة وراء الحوادث.
  • التنسيق مع الفرق الفنية والبائعين والمصنعين الأصليين (OEMs) وأصحاب المصلحة من ساما (SAMA) لتنفيذ الإصلاحات الدائمة.
  • قيادة مبادرات المعالجة الاستباقية للقضاء على المشكلات المتكررة قبل أن تصبح اتجاهات مؤثرة على الخدمة.
  • ضمان تنفيذ الإجراءات التصحيحية والوقائية والتحقق من صحتها.
  • تنسيق تنفيذ الإصلاحات المؤقتة لاستعادة استمرارية الخدمة أثناء تطوير الحلول الدائمة.
  • التحقق من فعالية الحلول البديلة والحلول الدائمة.
  • إعداد تقارير دورية وفقًا لمؤشرات الأداء الرئيسية المتفق عليها مثل اتجاهات المشكلات وحالة تحليل السبب الجذري (RCA) وجداول الحل والمشكلات المتكررة والحوادث والامتثال لاتفاقيات مستوى الخدمة (SLA) وغيرها.
  • ضمان الامتثال لسياسات إدارة الحوادث والمشكلات والإجراءات التشغيلية والمتطلبات التنظيمية.
  • تحديد فرص تحسين عملية إدارة الحوادث والمشكلات.
  • تقديم توصيات لفريق التحسين المستمر (CSI) بشأن تحسين العمليات وفرص الأتمتة.
  • قيادة المبادرات الهادفة إلى تقليل تكرار الحوادث وتحسين توفر الخدمة.
  • تحديث مستودعات المعرفة بالأسباب الجذرية المؤكدة والأخطاء المعروفة وإجراءات الحلول البديلة والحلول الدائمة.
  • ضمان توثيق الدروس المستفادة من الحوادث الكبرى وإبلاغها عبر فرق الدعم.

المهارات المطلوبة

  • إدارة الحوادث الكبرى (Major Incident Management).
  • منهجيات تحليل السبب الجذري (Root Cause Analysis - RCA) القوية.
  • ممارسات إدارة الحوادث والمشكلات (Incident and Problem Management).
  • معرفة إطار عمل إدارة خدمات تقنية المعلومات (ITIL Service Management).
  • تحليل الاتجاهات وإعداد التقارير والتحليلات التشغيلية.
  • معرفة البنية التحتية والتطبيقات والخدمات السحابية والشبكات وقواعد البيانات وعمليات الأمن.
  • إدارة اتفاقيات مستوى الخدمة (SLAs) ومؤشرات الأداء الرئيسية (KPIs) وأداء الخدمة.
عرض النص الأصلي للإعلان

Key Responsibilities


  • Perform 24x7 incident management activities to minimize service disruption and business impact.
  • Register and manage incidents resulting from service degradation, outages, or operational alerts.
  • Establish and manage communication, Incident Bridges for critical incidents.
  • Coordinate technical troubleshooting, restoration activities, and stakeholder engagement.
  • Ensure rapid decision-making and removal of operational roadblocks during incident resolution.
  • Drive service restoration efforts while maintaining adherence to Incident Management processes
  • Schedule and facilitate Major Incident Review meetings following incident resolution.
  • Document incident timelines, triage activities, recovery actions, lessons learned, and improvement opportunities.
  • Coordinate stakeholder participation during review sessions.
  • Finalize and publish MIR reports.
  • Coordinate Root Cause Analysis (RCA) activities for major incidents and recurring operational issues across internal technical teams, OEMs, third-party vendors, and stakeholders.
  • Proactively identify and register problem records based on incident trends and potential service risks.
  • Perform detailed problem determination and impact assessment activities.
  • Create and manage problem records for all major incidents and significant service-impacting events.
  • Ensure all problem records contain documented root causes, workarounds, corrective actions, and permanent resolutions.
  • Track open problems and monitor progress toward resolution within agreed service levels.
  • Facilitate investigation activities to determine underlying causes of incidents.
  • Coordinate with technical teams, vendors, OEMs, and SAMA stakeholders to implement permanent fixes.
  • Drive proactive remediation initiatives to eliminate recurring issues before they become service-affecting trends.
  • Ensure corrective and preventive actions are implemented and validated.
  • Coordinate implementation of temporary fixes to restore service continuity while permanent solutions are developed.
  • Validate effectiveness of workarounds and permanent resolutions.
  • Produce regular reports as agreed KPI like problem trends, RCA status, resolution timelines, reoccurring problems, incidents, SLA compliance etc.
  • Ensure compliance with Incident and Problem Management policies, operational procedures, and regulatory requirements.
  • Identify opportunities to enhance the Incident and Problem Management process.
  • Provide recommendations to the CSI team regarding process improvements and automation opportunities.
  • Drive initiatives aimed at reducing incident recurrence and improving service availability.
  • Update knowledge repositories with verified root causes, known errors, workaround procedures, and permanent resolutions.
  • Ensure lessons learned from major incidents are documented and communicated across support teams.


Technical Skills

  • Major Incident Management
  • Strong Root Cause Analysis (RCA) methodologies.
  • Incident and Problem Management practices.
  • Knowledge of ITIL Service Management framework.
  • Trend analysis, reporting, and operational analytics.
  • Knowledge of infrastructure, applications, cloud services, networks, databases, and security operations.
  • SLAs, KPIs, and service performance management.


KPIs

  • Reduction in recurring incidents.
  • Percentage of Major Incidents with complete RCA.
  • Problem and Major incident closure within SLA targets.
  • Mean Time to Identify Root Cause (MTTRCA).
  • Number of proactive problems identified and resolved.

Reduction in incident volume through permanent fixes


المصدر: LinkedIn - أُضيفت للموقع في 13 أغسطس 2026

وظائف أخرى لدى DXC Technology