Key Responsibilities
IT Service Continuity & Disaster Recovery
- Develop, maintain, and enhance Disaster Recovery and Business Continuity frameworks, procedures, and recovery runbooks.
- Plan, coordinate, and execute DR failover/failback exercises for mission-critical and business-critical applications.
- Ensure recovery readiness across data centers, cloud platforms, databases, network, and security infrastructure.
- Manage end-to-end DR testing lifecycle, including planning, execution, reporting, issue tracking, and closure.
- Coordinate annual DR exercise calendars and recovery validation activities.
Technical Recovery Management
- Support DR planning and recovery activities for:
- Cloud Platforms (AWS, Azure)
- Linux/Unix Servers
- Oracle and other enterprise databases
- Network & Security Infrastructure
- Enterprise Applications and Middleware
- Review and optimize technical recovery procedures and operational documentation.
- Validate recovery objectives (RTO/RPO) and ensure compliance with business requirements.
Automation & Process Improvement
- Drive DR automation initiatives using tools such as:
- Ansible
- Terraform
- Scripting and command-line automation
- Identify opportunities for process optimization and operational efficiency.
- Apply Lean Six Sigma or similar methodologies to improve DR execution and governance processes.
Governance, Risk & Compliance
- Coordinate with Risk Management, Internal Audit, Compliance, and Business Units for regulatory DR exercises.
- Ensure adherence to enterprise ITSCM policies, banking regulations, and audit requirements.
- Prepare management reports, audit evidence, risk assessments, and continuity metrics.
Stakeholder Management
- Collaborate with Infrastructure, Database, Network, Security, Application Support, and Business Teams.
- Facilitate technical and executive-level communications during DR planning and recovery exercises.
- Act as the primary coordinator during continuity and disaster recovery events.
Required Skills & Qualifications
Technical Skills
- Strong experience in Disaster Recovery and Business Continuity Management.
- Hands-on experience with:
- AWS and/or Azure Cloud
- Linux Administration
- Oracle Databases
- Server, Storage, Network, and Security technologies
- Knowledge of failover/failback architectures and recovery strategies.
- Experience with DR automation tools (Ansible, Terraform, scripting platforms).