Skip to content

تكرار النظام وتحمل أخطاء العقد (System Redundancy and Node Fault Tolerance)

تم تصميم Awanio مع تكرار في كل طبقة معمارية، مما يضمن أن الفشل في أي مكون فردي لا يسبب توقفًا عن العمل أو تدهورًا في الأداء.

ميزات التكرار

  • تكرار متعدد المستويات (Multi-level Redundancy)
    يتم تطبيق التكرار عبر خوادم الإدارة، والشبكة، والتخزين، وعقد الحوسبة.

  • تجاوز الفشل التلقائي (Automatic Failover)
    يتم ترحيل أحمال العمل (الـ VMs، الحاويات، الخدمات) تلقائيًا إلى العقد السليمة دون الحاجة لتدخل يدوي.

  • تكرار العقد (فشل عقدة واحدة على الأقل)
    تم تصميم كل عنقود لمواصلة العمليات العادية حتى عند تعذر توفر عقدة واحدة.

  • إعادة التوزيع الديناميكي للأحمال (Dynamic Load Redistribution)
    يتم موازنة الحمل من العقدة الفاشلة تلقائيًا عبر العقد النشطة.


الفوائد

  • ضمان التوافر العالي واستمرارية الخدمة
  • التخلص من نقاط الفشل الواحدة (single points of failure)
  • الحفاظ على أداء مستمر أثناء أعطال الأجهزة

البنية التحتية الفنية

يقوم Awanio بتخزين البيانات باستخدام معامل تكرار (RF - Replication Factor) يبلغ 3 (افتراضيًا)، مما يعني أن كل كتلة بيانات يتم تخزينها على ثلاث عقد مختلفة. وهذا يضمن بقاء البيانات متاحة حتى في حال فشل عقدة واحدة أو عقدتين. تقوم طبقة إدارة Awanio بمراقبة صحة العقد وتوزيع أحمال العمل باستمرار.

في بنية عنقود Awanio، والتي تستخدم حدًا أدنى يبلغ 3 عقد وفقًا لمعامل التكرار، تعمل كل عقدة كحوسبة وتخزين معًا. تعمل الأجهزة الافتراضية (VMs) أعلى طبقة المحاكاة الافتراضية لـ Awanio، بينما يتم تخزين جميع بيانات الـ VM في مجمع Ceph للتخزين الموزع (Ceph Distributed Storage pool).


محاكاة تجاوز الفشل – عنقود من 3 عقد (Failover Simulation – 3 Node Cluster)

العقد غير النشطةالعقد النشطةحالة Cephحالة VMحالة الخدمةالوصف
03RF=3عاديعاديمثالي
12RF=2تجاوز فشل تلقائيما زالت تعملآمن
21RF=1غير مستقرخطر التوقفحرج (CRITICAL)
30--متوقف (DOWN)فشل كلي