Pengenalan DRM
Selamat datang di dokumentasi operator untuk DRM (Disaster Recovery Manager), orkestrator pemulihan bencana tingkat situs untuk lingkungan Awanio Cockpit.
DRM memungkinkan Anda melindungi mesin virtual dengan mereplikasikannya dari situs utama (primary site) ke situs pemulihan (recovery site), mengelompokkan beban kerja tersebut ke dalam rencana pemulihan (recovery plans) yang teratur, dan mengorkestrasi seluruh siklus pemulihan — uji failover (test failover), migrasi terencana (planned migration), failover darurat (emergency failover), perlindungan ulang (reprotect), dan failback — dari satu konsol terpadu.
Cara kerja integrasi komponen
- Vapor — mesin virtualisasi per-host. Vapor menangani replikasi disk aktual (Vapor sumber → Vapor target) dan mem-boot VM yang dipulihkan.
- Cockpit — pengontrol situs. Cockpit mengelola host Vapor, menyediakan tab Replikasi per-VM, dan melakukan penyandingan dengan situs peer.
- DRM — orkestrator pemulihan bencana. DRM mendaftarkan beban kerja, menyusun rencana pemulihan, dan menjalankan failover di seluruh situs yang disandingkan. DRM mendelegasikan tugas replikasi dan proses boot dasar ke Cockpit dan Vapor.
Dua cara mengoperasikan DR
Anda dapat menjalankan pemulihan bencana pada dua tingkatan:
| Tingkat | Lokasi | Paling cocok untuk |
|---|---|---|
| Per-VM | Cockpit → tab Replikasi pada VM | Mengonfigurasi dan mengoperasikan satu beban kerja secara langsung |
| Tingkat situs | Konsol DRM (Beban Kerja, Rencana Pemulihan, Failover) | Melindungi banyak beban kerja dan memulihkannya sebagai kelompok teratur |
Keduanya beroperasi pada replikasi dasar yang sama. Beban kerja yang Anda daftarkan di DRM akan muncul dengan tugas replikasi aktif di Cockpit, dan VM yang Anda konfigurasikan di tab Replikasi Cockpit dapat ditambahkan ke dalam rencana pemulihan DRM.
Siklus hidup pemulihan bencana
Penerapan umum dua situs mengikuti alur kerja berikut:
- Sandingkan situs — hubungkan Cockpit utama dan pemulihan, serta sandingkan instans DRM. Lihat Menyandingkan Dua Situs.
- Lindungi beban kerja — daftarkan VM untuk replikasi ke situs pemulihan. Lihat Melindungi Beban Kerja.
- Kelola replikasi — picu sinkronisasi, jeda/lanjutkan, dan sesuaikan RPO seiring waktu. Lihat Mengelola Replikasi.
- Susun rencana pemulihan — kelompokkan beban kerja ke dalam runbook terurut. Lihat Rencana Pemulihan.
- Latihan dan pemulihan — jalankan uji failover non-disruptif, dan jika diperlukan, jalankan failover terencana atau darurat. Lihat Failover & Pemulihan.
- Lindungi ulang dan failback — balikkan arah replikasi dan kembalikan beban kerja ke situs asalnya. Lihat Perlindungan Ulang & Failback.
- Pantau — awasi kesehatan replikasi dan usia titik pemulihan. Lihat Pemantauan & Pemecahan Masalah.
Konsep utama
- Situs utama / terlindungi (Primary site) — tempat beban kerja berjalan normal dan menjadi sumber replikasi.
- Situs pemulihan (Recovery / DR site) — tempat replika disimpan dan beban kerja dipulihkan ke sana.
- Titik pemulihan (Recovery point) — salinan disk beban kerja yang telah selesai dan tersimpan secara fisik di situs pemulihan yang siap di-boot saat failover.
- RPO (Recovery Point Objective) — seberapa sering beban kerja direplikasi. RPO yang lebih kecil berarti potensi kehilangan data lebih sedikit.
- Rencana pemulihan (Recovery plan) — runbook terurut yang melakukan failover sekelompok beban kerja berdasarkan urutan prioritas.
- Uji failover (Test failover) — mem-boot salinan beban kerja dalam jaringan terisolasi untuk latihan pemulihan tanpa mengganggu VM produksi yang sedang berjalan.
- Perlindungan ulang (Reprotect) — setelah failover, membalik arah replikasi sehingga situs pemulihan kini melindungi beban kerja.
Baru mengenal DRM?
Mulailah dengan Memulai untuk mengetahui prasyarat, lisensi, dan urutan pengaturan awal yang direkomendasikan.