التعافي من الكوارث
يحمي Cockpit أجهزتك الافتراضية عبر النسخ المتماثل على مستوى hypervisor بنمط النشط-الخامل (active-passive): يقوم الجهاز الافتراضي العامل في موقعك الرئيسي (Site A) بنسخ أقراصه باستمرار إلى موقع تعافٍ ثانوي (Site B). إذا تعطل الموقع الرئيسي — أو أثناء الصيانة المجدولة — يمكنك استعادة بيئة العمل على الموقع الثانوي مع حدٍّ محدود من فقدان البيانات.
يُنسَّق النسخ المتماثل بواسطة Cockpit، لكن البيانات تنتقل بين الأطراف مباشرة (peer-to-peer) بين خوادم Vapor، وبالتالي لا تمر حركة الاستعادة عبر مستوى الإدارة.
آلية العمل باختصار
- المزامنة الأساسية (Baseline sync) تنسخ القرص كاملًا مرة واحدة.
- المزامنات التراكمية (Incremental syncs) تنقل بعد ذلك الكتل التي تغيّرت فقط منذ آخر نقطة استعادة، وفق جدول RPO الخاص بك (تتبّع الكتل المتغيرة، وليس إعادة نسخ كاملة).
- كل مزامنة ناجحة تصبح نقطة استعادة يمكنك التبديل عند الفشل إليها.
ما يمكنك القيام به
| الدليل | المهمة |
|---|---|
| إعداد النسخ المتماثل | ربط المواقع، وتسجيل جهاز افتراضي، وتعيين سياسة النسخ المتماثل الخاصة به (RPO، والاحتفاظ، وإعادة تعيين الشبكة، وإعادة عنونة الضيف). |
| التشغيل والمراقبة | تشغيل مزامنة يدوية، وقراءة حالة صحة النسخ المتماثل، وفهم نقاط الاستعادة. |
| التبديل عند الفشل والاسترداد | تنفيذ تبديل تجريبي عند الفشل (تمرين)، وتبديل مخطط أو غير مخطط عند الفشل، ثم إعادة الحماية والاسترداد. |
المصطلحات الأساسية
- زوج المواقع (Site pair) — رابط موثوق بين مثيلتي Cockpit الرئيسية وموقع التعافي، وهو مطلوب قبل أن يتمكن أي جهاز افتراضي من النسخ المتماثل.
- RPO (هدف نقطة الاستعادة) — مدى تكرار تشغيل النسخ المتماثل، أي الحد الأقصى للبيانات التي يمكن أن تفقدها (مثل 15 دقيقة).
- نقطة الاستعادة (PIT) — حالة لنقطة زمنية على موقع التعافي يمكنك التبديل عند الفشل إليها. تحدد سياسة الاحتفاظ عدد النقاط المحفوظة.
- التبديل عند الفشل (Failover) — تشغيل الجهاز الافتراضي على موقع التعافي. المخطط يُجري إيقاف تشغيل نظيفًا + مزامنة نهائية (دون فقدان بيانات)؛ وغير المخطط يستعيد من آخر نقطة تمت مزامنتها عندما يكون المصدر غير متاح.
- إعادة الحماية (Reprotect) — بعد التبديل عند الفشل، عكس اتجاه النسخ المتماثل بحيث يحمي موقع التعافي باتجاه الموقع الأصلي.
- الاسترداد (Failback) — إعادة بيئة العمل إلى الموقع الأصلي بمجرد عودته إلى حالة سليمة.
قبل أن تبدأ
- تحتاج إلى موقعي Cockpit (رئيسي وموقع تعافٍ)، يدير كل منهما خادم Vapor واحدًا على الأقل مع مساحة تخزين خالية كافية في مستودع التخزين المستهدف.
- للحصول على نقاط استعادة متسقة على مستوى التطبيق وإعادة عنونة IP للضيف، ثبّت QEMU Guest Agent في نظام التشغيل الضيف.
- تحتاج إلى دور يسمح بإجراءات النسخ المتماثل (راجع التحكم في الوصول).