High Availability & Disaster Recovery Planning
High Availability & Disaster Recovery Planning
Description
Pelatihan ini dirancang untuk membekali tim TI, manajemen risiko, dan business continuity officer bank dengan kemampuan menyusun strategi High Availability (HA) dan Disaster Recovery (DR) yang komprehensif. Fokus pelatihan adalah memastikan layanan kritikal perbankan, termasuk core banking, payment system, dan layanan digital, tetap tersedia secara terus-menerus dan dapat pulih cepat saat terjadi gangguan operasional atau bencana.
Peserta akan mempelajari perancangan arsitektur HA, replikasi data, strategi failover, serta integrasi DR dengan business continuity plan. Pelatihan menekankan best practice industri, pengujian simulasi, serta kepatuhan terhadap regulasi perbankan. Hasilnya adalah kemampuan untuk merancang infrastruktur yang resilien, mengurangi downtime, meminimalkan kerugian, dan menjaga kepercayaan nasabah serta stabilitas operasional bank
Objectives
- Memahami konsep dan prinsip High Availability dan Disaster Recovery di sektor perbankan
- Menguasai arsitektur HA dan strategi failover untuk sistem kritikal
- Mampu merancang rencana DR yang efektif dan sesuai regulasi
- Menilai risiko downtime dan dampaknya terhadap layanan dan portofolio
- Mengintegrasikan DR dengan business continuity plan (BCP)
- Melakukan simulasi, pengujian, dan continuous improvement DR
- Menyusun roadmap ketahanan operasional digital jangka pendek, menengah, dan panjang
Course outline
1. Konsep High Availability
- Definisi HA dan tujuan bisnis
- Availability metrics: uptime, MTBF, MTTR
- Single point of failure identification
- Redundancy design: active-active, active-passive
- Load balancing dan failover mekanisme
- Monitoring availability dan health check
2. Infrastruktur dan Arsitektur HA
- Server clustering dan virtualization
- Storage replication dan shared storage
- Network redundancy dan SDN failover
- Database high availability (mirroring, replication)
- Application-level HA design
- Disaster avoidance vs mitigation
3. Konsep Disaster Recovery
- Definisi DR dan hubungannya dengan BCP
- RTO (Recovery Time Objective) dan RPO (Recovery Point Objective)
- Disaster types: natural, technical, cyber, human error
- Recovery strategies: hot site, warm site, cold site
- Backup types: full, incremental, differential
- DR lifecycle dan continuous improvement
4. Data Protection dan Backup Management
- Backup scheduling dan retention policy
- Offsite backup dan cloud backup
- Data encryption in transit dan at rest
- Snapshot dan versioning
- Testing backup restore
- Data integrity verification
5. Risk Assessment dan Business Impact Analysis
- Critical system identification
- Dependency mapping antar aplikasi dan infrastruktur
- Impact analysis terhadap revenue, reputasi, dan regulasi
- Likelihood vs impact matrix
- Prioritization untuk recovery plan
- Key Risk Indicators (KRI) monitoring
6. DR Plan Design dan Implementation
- Step-by-step DR plan development
- Integration dengan HA infrastructure
- Failover procedures dan escalation paths
- Communication plan dan notification matrix
- Roles and responsibilities assignment
- Documentation dan approval workflow
7. Testing, Simulation, dan Continuous Improvement
- DR drills dan tabletop exercises
- Failover simulation dan performance measurement
- Gap analysis antara plan dan real scenario
- Lessons learned dan plan update
- Continuous monitoring dan reporting
- KPI/SLAs untuk DR readiness
8. Compliance dan Regulatory Requirements
- Regulasi OJK/BI terkait IT resilience
- Data retention dan protection compliance
- Audit trail dan evidences untuk regulator
- Reporting incident dan disaster event
- Alignment dengan internal policy dan IT governance
- Risk-based review dan approval process
9. Advanced HA & DR Strategies
- Multi-region data replication
- Cloud-based disaster recovery as a service (DRaaS)
- Continuous availability for core banking system
- Container orchestration untuk failover otomatis
- Integration dengan cybersecurity incident response
- Cost optimization vs resiliency trade-off
10. Studi Kasus dan Simulasi Implementasi
- Design HA untuk core banking system
- DR scenario simulation untuk payment system
- Multi-site failover exercise
- Evaluation of RTO/RPO compliance
- Identification of improvement points
- Development of comprehensive HA & DR roadmap
Method
- Pre-test
- Presentation
- Discussion
- Case study
- Post-test
Facilities
- Ruang Meeting Representatif
- Sertifikat Pelatihan Resmi
- Instruktur Profesional & Berpengalaman
- Training Kit Eksklusif
- Souvenir
- Pick Up Participant (Yogyakarta)