Data Center Operations & Monitoring
Data Center Operations & Monitoring
Description
Pelatihan ini dirancang untuk membekali tim TI, data center manager, dan infrastruktur operasional bank dengan kemampuan mengelola operasi data center secara efisien, aman, dan resilient. Fokus utama adalah memahami best practice dalam manajemen fasilitas, server, storage, jaringan, serta monitoring performa dan kesehatan infrastruktur agar layanan kritikal bank seperti core banking, payment system, dan digital banking tetap optimal dan bebas gangguan.
Peserta akan mempelajari arsitektur data center, standar operasional, monitoring real-time, manajemen kapasitas, serta mitigasi risiko operasional dan keamanan siber. Pelatihan ini menekankan integrasi monitoring dengan preventive maintenance, high availability, disaster recovery, dan kepatuhan regulasi perbankan, sehingga bank dapat meningkatkan efisiensi biaya, uptime layanan, dan ketahanan operasional secara berkelanjutan.
Objectives
- Memahami konsep dan prinsip operasi data center di sektor perbankan
- Menguasai arsitektur, manajemen, dan monitoring server, storage, dan jaringan
- Mampu merancang preventive maintenance dan high availability
- Mengidentifikasi dan memitigasi risiko operasional dan keamanan siber
- Memahami kepatuhan regulasi terkait data center bank
- Mengoptimalkan kapasitas dan efisiensi biaya operasional
- Menyusun laporan monitoring dan rekomendasi perbaikan untuk manajemen
Course outline
1. Konsep Dasar Data Center
- Definisi dan fungsi data center untuk bank
- Tier classification dan availability level
- Criticality assessment sistem perbankan
- Single point of failure identification
- Redundancy dan fault tolerance
- Best practice industry standards (Uptime Institute, TIA-942)
2. Infrastruktur Server dan Virtualisasi
- Server architecture dan hardware optimization
- Virtualisasi server dan hypervisor management
- Resource pooling: CPU, memory, storage
- Virtual machine monitoring
- Load balancing dan failover
- Capacity planning dan scaling strategy
3. Storage Management
- Storage architecture: SAN, NAS, DAS
- Data replication, snapshot, dan cloning
- Storage tiering dan deduplication
- Backup strategy dan retention policy
- Monitoring IOPS, latency, dan throughput
- Disaster recovery integration
4. Network Operations dan Monitoring
- Network topology dan redundancy
- Switch, router, firewall management
- Network monitoring tools dan alerting
- Bandwidth utilization dan traffic analysis
- SDN dan virtual network management
- Security monitoring dan intrusion detection
5. Monitoring Infrastruktur dan Layanan
- Monitoring server, storage, network, dan aplikasi
- Metrics dan KPI: uptime, response time, latency
- Log management dan correlation analysis
- Threshold setting dan automated alerting
- Dashboard dan reporting untuk manajemen
- Predictive maintenance berbasis data
6. High Availability dan Failover Mechanism
- Active-active vs active-passive setup
- Load balancing untuk critical service
- Redundant power supply dan cooling
- Failover procedure dan testing
- Monitoring failover performance
- Continuous availability planning
7. Preventive Maintenance dan Operasional Harian
- Hardware inspection dan replacement schedule
- Software patching dan update management
- Environmental monitoring: temperature, humidity, fire
- UPS, generator, dan cooling system check
- Documentation dan checklist operasi rutin
- Risk identification dan mitigation planning
8. Security dan Kepatuhan Data Center
- Physical security dan access control
- Cybersecurity measures di level data center
- Compliance dengan OJK/BI dan PCI DSS
- Audit trail dan log retention
- Incident response untuk server/network compromise
- Penilaian risiko keamanan data dan mitigasinya
9. Capacity Planning dan Optimization
- Resource utilization monitoring
- Forecasting growth dan scaling strategy
- Cost optimization vs performance trade-off
- Bottleneck identification
- Automation dan orchestration tools
- Lifecycle management server, storage, network
10. Studi Kasus dan Simulasi Monitoring
- Monitoring core banking system uptime
- Simulasi failure dan failover recovery
- Analisis log untuk root cause identification
- Reporting dashboard untuk manajemen
- Penentuan improvement action plan
- Penyusunan roadmap operasi data center berkelanjutan
Participants
- Information Technology
- Risk Management
- Compliance & APUPPT
- General Affair
- Audit Internal
Method
- Pre-test
- Presentation
- Discussion
- Case study
- Post-test
Facilities
- Ruang Meeting Representatif
- Sertifikat Pelatihan Resmi
- Instruktur Profesional & Berpengalaman
- Training Kit Eksklusif
- Souvenir
- Pick Up Participant (Yogyakarta)