Failover & Failback
Panduan ini membahas pemulihan VM di situs pemulihan dan pengembaliannya ke situs asal. Semua tindakan tersedia di tab Replication milik VM di bawah menu ACTIONS ▾.
Pilih operasi yang sesuai dengan situasi Anda:
| Operasi | Kapan digunakan | Kehilangan data |
|---|---|---|
| Test failover | Melatih pemulihan tanpa menyentuh produksi. | Tidak ada (produksi tetap berjalan). |
| Planned failover | Pemeliharaan terjadwal / relokasi bersih, sumber masih sehat. | Tidak ada. |
| Unplanned failover | Situs utama mati atau tidak dapat dijangkau. | Hingga sebesar RPO Anda. |
Test failover (DR drill)
Memverifikasi bahwa replika dapat di-boot — tanpa mengganggu produksi atau menjeda replikasi.
- ACTIONS ▾ → Test Failover → biarkan opsi power-on aktif → Start Drill.
- Cockpit mengkloning recovery point terbaru di situs pemulihan dan mem-boot-nya di jaringan terisolasi ("bubble"), sehingga tidak dapat berkonflik dengan VM produksi yang sedang berjalan.
- Buka konsol VM yang dipulihkan dan verifikasi OS serta layanannya.
- ACTIONS ▾ → Stop Test Failover — mematikan VM sandbox dan menghapus klon sementara.
TIP
Jalankan drill secara berkala untuk memastikan recovery point dapat di-boot dan pengaturan jaringan/pengalamatan ulang IP tamu Anda sudah benar.
Planned failover (switchover terencana)
Relokasi tanpa kehilangan data ketika sumber masih sehat.
- ACTIONS ▾ → Planned Migration / Failover → pilih apakah VM dinyalakan di target → Start.
- Cockpit: mematikan VM sumber secara perlahan → menjalankan sinkronisasi penyesuaian akhir → mem-boot VM di situs pemulihan (menerapkan pemetaan jaringan dan pengalamatan ulang IP tamu Anda).
- Registrasi sumber ditandai tidak aktif.
Unplanned failover (bencana)
Ketika situs utama sedang offline.
- Di situs pemulihan, buka tab Replication milik VM → ACTIONS ▾ → Emergency / Unplanned Failover → konfirmasi.
- Cockpit melewati pematian sumber dan sinkronisasi akhir, mem-boot VM di situs pemulihan dari recovery point terakhir yang berhasil, dan menerapkan pemetaan jaringan + pengalamatan ulang IP tamu.
VM besar dapat melaporkan timeout meskipun masih dalam proses pemulihan
Untuk disk berukuran besar, failover dapat memakan waktu beberapa menit dan permintaan dapat mengembalikan timeout meskipun VM pemulihan berhasil di-boot. Sebelum mencoba ulang, periksa situs pemulihan — jika VM yang dipulihkan sudah berjalan, failover telah selesai. (Sudah dilacak untuk perbaikan agar operasi langsung kembali dan diselesaikan di latar belakang.)
Reprotect & failback
Setelah unplanned failover, beban kerja berjalan di situs pemulihan tanpa perlindungan. Balik arah replikasi, lalu kembalikan ke situs asal ketika situs utama sudah sehat.
1. Reprotect (membalik replikasi)
- Di situs yang saat ini menjalankan VM, buka tab Replication milik VM → ACTIONS ▾ → Reprotect.
- Cockpit membalik endpoint dan mulai mereplikasi dari situs saat ini kembali ke arah situs asal. Tunggu hingga baseline terbalik selesai; kesehatan kembali ke OK.
Pemasangan arah balik
Reprotect/failback memerlukan site pair arah balik yang sudah ada (pemulihan → utama). Jika Anda hanya memasangkan utama → pemulihan, tambahkan pasangan arah balik terlebih dahulu (lihat Mengonfigurasi replikasi).
2. Failback (kembali ke situs asal)
- Setelah replikasi arah balik mengejar, jalankan Planned Failover dari situs pemulihan kembali ke situs asal (shutdown bersih → sinkronisasi akhir → boot di situs asal).
- Secara opsional jalankan Reprotect lagi dari situs asal untuk memulihkan arah normal utama → pemulihan.