Pilot Light والنسخة الاحتياطية الدافئة
أبقِ نواة أساسية من حِمل العمل قيد التشغيل في Region ثانية (Pilot Light)، أو نسخة مصغّرة لكنها كاملة الوظائف (نسخة احتياطية دافئة) جاهزة للتوسّع
Pilot Light والنسخة الاحتياطية الدافئة درس مجاني في AWS Solutions Architect على CoddyKit. هذا هو الدرس 3 من أصل 4. يمكنك قراءة الدرس كاملاً أدناه مجاناً — ثم تمرن عليه مباشرة في المتصفح باستخدام محرر أكواد مدمج ومدرس ذكاء اصطناعي متاح 24/7. هذا الدرس جزء من مسار التعلم في AWS Solutions Architect، وتقدمك يتزامن عبر الويب وتطبيق CoddyKit. تتضمن دورة AWS Solutions Architect 4 دروس في المجموع.
ما بعد النسخ الاحتياطي والاستعادة
عندما يكون متطلب RTO لديكم أكثر صرامة من بضع ساعات، لا تكون النسخ الاحتياطية والاستعادة كافية. وتحافظ الطبقتان التاليتان للتعافي من الكوارث — Pilot Light وWarm Standby — على تشغيل بعض بنيتكم الأساسية أو كلها في منطقة التعافي من الكوارث طوال الوقت، مما يقلل وقت الاستعادة بدرجة كبيرة. وتتضمن كلتا الاستراتيجيتين الحفاظ على بيئة تعافٍ من الكوارث بصورة مستمرة، واستخدام التحويل عند الفشل المستند إلى فحوصات سلامة Route 53 لإعادة توجيه حركة المرور أثناء وقوع كارثة. ويكمن الاختلاف في مقدار بيئة التعافي من الكوارث الذي يكون قيد التشغيل فعليًا.
Pilot Light: تشغيل المكوّن الأساسي دائمًا
في استراتيجية Pilot Light، تبقون فقط المكوّن الأساسي الحرج من نظامكم قيد التشغيل في منطقة التعافي من الكوارث — وعادةً ما تكون طبقة قاعدة البيانات فقط مع النسخ المتماثل المستمر. ولا تكون خوادم التطبيقات قيد التشغيل؛ بل تحتفظون مسبقًا بـ AMIs أو قوالب تشغيل أو بنية أساسية كتعليمة برمجية يمكنها تشغيلها بسرعة. تخيلوها كاللهب الدليلي الصغير جدًا في موقد الغاز، والذي يمكنه إشعال اللهب الكامل خلال دقائق عند الحاجة. ويتراوح RTO عادةً بين 30 و60 دقيقة.
# Pilot Light: what runs 24/7 in DR region
# - RDS Read Replica (receiving continuous replication)
# - Minimal VPC/networking (no extra cost if no data transfer)
# - Route 53 failover record (inactive, health check pointing to primary)
# What is prepared but NOT running:
# - EC2 launch template pointing to DR AMI
# - ALB (can be created in minutes)
# - ASG with desired=0, can scale to 10 on demandخطوات التحويل عند فشل Pilot Light
عند فشل المنطقة الأساسية وبدء التحويل عند فشل Pilot Light: الخطوة 1 — رقّوا RDS Read Replica في منطقة التعافي من الكوارث إلى قاعدة بيانات أساسية مستقلة. الخطوة 2 — شغّلوا مثيلات EC2 من AMI أو قالب التشغيل المُعد مسبقًا. الخطوة 3 — أنشئوا Application Load Balancer أو فعّلوه، وسجّلوا مثيلات EC2 الجديدة. الخطوة 4 — حدّثوا إعدادات التطبيق لتشير إلى نقطة نهاية قاعدة البيانات التي تمت ترقيتها. الخطوة 5 — يُكمل تحويل الفشل في فحص سلامة Route 53 التحويلَ في DNS. الوقت الإجمالي: 30-60 دقيقة.
# Step 1: Promote RDS Read Replica
aws rds promote-read-replica \
--db-instance-identifier mydb-dr-replica \
--region us-west-2
# Step 2: Scale up ASG in DR region
aws autoscaling update-auto-scaling-group \
--auto-scaling-group-name app-asg-dr \
--min-size 2 \
--desired-capacity 4 \
--region us-west-2
# Step 3: Route 53 failover happens automatically
# via health check detecting primary region failureWarm Standby: يعمل بكامل الوظائف ولكن بسعة مخفضة
في استراتيجية Warm Standby، تعمل نسخة كاملة ولكن بسعة مخفضة من بيئة الإنتاج باستمرار في منطقة التعافي من الكوارث. وتكون جميع طبقات التطبيق نشطة — خوادم الويب وخوادم التطبيقات وقاعدة البيانات — ولكن بسعة أقل (مثلًا، مثيلان بدلًا من 20). وأثناء التحويل عند الفشل، تزيدون سعة بيئة التعافي من الكوارث لتلائم حمل الإنتاج. ويحوّل Route 53 حركة المرور تلقائيًا عبر التحويل عند الفشل المستند إلى فحص السلامة. ويكون RTO عادةً أقل من 15 دقيقة. وتُعد Warm Standby طبقة التعافي من الكوارث الأكثر شيوعًا للتطبيقات الحرجة للأعمال.
# Production vs Warm Standby capacity:
# Tier Production DR Standby
# Web servers 20 EC2 (c5.xl) 2 EC2 (c5.xl)
# App servers 10 EC2 (m5.xl) 2 EC2 (m5.xl)
# Database RDS db.r5.2xl RDS Read Replica (db.r5.xl)
# Cache Redis r6g.xl Redis r6g.medium
#
# Cost: DR standby ~15% of production costAurora Global Database لـ Warm Standby
تُعد Aurora Global Database تقنية قاعدة البيانات المثالية للتعافي من الكوارث باستخدام Warm Standby. فمجموعة المنطقة الثانوية تعمل دائمًا، وتتلقى النسخ المتماثل دائمًا (بتأخر <1 second lag)، ويمكن ترقيتها إلى أساسية خلال أقل من دقيقة واحدة — وهو أسرع بكثير من ترقية RDS Read Replica، التي تتطلب إيقاف النسخ المتماثل وتطبيق التأخر المتبقي. لذلك تُعد Aurora Global Database الخيار الموصى به عندما يكون متطلب RTO لديكم في نطاق الدقائق بدلًا من عشرات الدقائق.
# Promote Aurora Global DB secondary to primary
# (during DR failover)
aws rds failover-global-cluster \
--global-cluster-identifier my-global-db \
--target-db-cluster-identifier my-aurora-cluster-us-west-2
# Aurora handles promotion automatically
# Typical promotion time: 1-2 minutes
# vs RDS Read Replica promotion: 10-30 minutesإعداد التحويل التلقائي عند الفشل في Route 53
تعتمد كل من Pilot Light وWarm Standby على توجيه التحويل عند الفشل في Route 53 لإعادة توجيه حركة المرور تلقائيًا. اضبطوا سجلًا أساسيًا يشير إلى ALB أو نقطة نهاية منطقة الإنتاج، مع إرفاق فحص سلامة به. واضبطوا سجلًا ثانويًا يشير إلى نقطة نهاية منطقة التعافي من الكوارث. وعندما يكتشف Route 53 أن فحص سلامة السجل الأساسي قد فشل للحد المعين، فإنه يتوقف عن إعادة السجل الأساسي ويقدم السجل الثانوي فقط — وكل ذلك ضمن فترة DNS TTL.
# Primary record (production)
aws route53 change-resource-record-sets \
--hosted-zone-id ZXXX \
--change-batch '{
"Changes": [{
"Action": "UPSERT",
"ResourceRecordSet": {
"Name": "api.example.com",
"Type": "A",
"Failover": "PRIMARY",
"SetIdentifier": "primary",
"HealthCheckId": "hc-us-east-1",
"AliasTarget": {"DNSName": "alb-prod.us-east-1.elb.amazonaws.com","EvaluateTargetHealth": true}
}
}]
}'الإحماء المسبق لبيئة التعافي من الكوارث
لكي تحقق Warm Standby هدف RTO المحدد لها، يجب أن تكون بيئة التعافي من الكوارث مُحمّاة مسبقًا — أي مُهيّأة ومختبرة بالكامل بحيث يكون توسيع نطاقها أثناء التحويل عند الفشل هو الإجراء الوحيد المطلوب. وهذا يعني أن تكون اتصالات قاعدة البيانات قائمة ومخزنة مؤقتًا، وأن تشير ملفات إعداد التطبيق إلى نقاط نهاية منطقة التعافي من الكوارث، وأن تكون مثيلات EC2 قيد الخدمة خلف ALB (حتى لو كان عددها قليلًا)، وأن تكون فحوصات السلامة ناجحة. أجروا تدريبات شهرية للتعافي من الكوارث تحاكون فيها التحويل عند الفشل لضمان بقاء البيئة مواكبة لإعدادات الإنتاج.
# Validate DR warm standby health
# 1. Check DR ALB target health
aws elbv2 describe-target-health \
--target-group-arn arn:aws:elasticloadbalancing:us-west-2:123:targetgroup/app-dr/xyz
# 2. Check Aurora Global DB secondary
aws rds describe-global-clusters \
--global-cluster-identifier my-global-db
# 3. Verify Route 53 health checks
aws route53 get-health-check-status \
--health-check-id hc-us-west-2البنية الأساسية كتعليمة برمجية لاتساق التعافي من الكوارث
يُعد إبقاء بيئة التعافي من الكوارث متزامنة مع بيئة الإنتاج أصعب تحدٍ تشغيلي. فإذا قمتم بتهيئة الإنتاج يدويًا ونسيتم تحديث بيئة التعافي من الكوارث، فقد لا تعمل هذه البيئة بصورة صحيحة أثناء كارثة فعلية. والحل هو استخدام Infrastructure as Code (IaC) مع نشر القوالب نفسها في كلتا المنطقتين. استخدموا AWS CloudFormation StackSets أو Terraform with multiple workspaces لنشر بنية أساسية متطابقة في كلتا المنطقتين انطلاقًا من قاعدة برمجية واحدة. ويؤدي ذلك إلى إزالة انحراف الإعدادات.
# CloudFormation StackSet: deploy to multiple regions
aws cloudformation create-stack-set \
--stack-set-name my-app-infrastructure \
--template-url https://s3.amazonaws.com/mybucket/template.yaml
# Deploy to DR region
aws cloudformation create-stack-instances \
--stack-set-name my-app-infrastructure \
--accounts 123456789012 \
--regions us-west-2 \
--parameter-overrides \
ParameterKey=DesiredCapacity,ParameterValue=2مقارنة التكلفة: Pilot Light مقابل Warm Standby
يُعد الفرق في التكلفة بين الاستراتيجيتين كبيرًا. تكلفكم Pilot Light فقط تكلفة نسخة قاعدة البيانات المتماثلة (عادةً من 50% إلى 100% من تكلفة قاعدة البيانات الأساسية)، إضافةً إلى الحد الأدنى من الشبكات في منطقة التعافي من الكوارث. وتكون خوادم التطبيقات متوقفة، ولذلك لا توجد تكاليف EC2. أما Warm Standby فتضيف تكلفة تشغيل مثيلات EC2 بسعة مخفضة وALB، وربما مجموعة ذاكرة تخزين مؤقت أصغر — وعادةً ما تتراوح بين 15% و30% من تكلفة بيئة الإنتاج الكاملة. والسؤال هو ما إذا كان RTO الأسرع في Warm Standby يبرر التكلفة التشغيلية المستمرة الأعلى.
# Example monthly cost comparison:
# Production environment: $10,000/month
# Pilot Light DR:
# RDS Read Replica: $500/month
# Minimal networking: $50/month
# Total: $550/month (~5.5% of production)
# Warm Standby DR:
# RDS Read Replica: $500/month
# 2x EC2 instances: $400/month
# ALB + networking: $200/month
# Total: $1,100/month (~11% of production)Failback: العودة إلى المنطقة الأساسية
بعد استعادة المنطقة الأساسية، تحتاجون إلى خطة للعودة بعد الفشل إليها. وغالبًا ما تكون العودة بعد الفشل الجزء الأكثر تعقيدًا في التعافي من الكوارث؛ إذ قد تكون منطقة التعافي من الكوارث قد عالجت بيانات جديدة أثناء فترة الانقطاع، ويجب مزامنتها مع المنطقة الأساسية. بالنسبة إلى قواعد البيانات، قد تحتاجون إلى إعداد النسخ المتماثل العكسي أو إعادة المزامنة من منطقة التعافي من الكوارث إلى المنطقة الأساسية. وبالنسبة إلى Route 53، تعيدون تفعيل السجل الأساسي مع فحص حالته. احرصوا دائمًا على تخطيط إجراء العودة بعد الفشل واختباره بعناية مماثلة لإجراء التحويل عند الفشل.
# Failback procedure steps:
# 1. Restore primary region infrastructure
# 2. Set up replication from DR to primary
# (reverse replication to sync new data)
# 3. Verify data consistency
# 4. Re-enable primary Route 53 health check
# 5. Gradually shift traffic back (weighted routing)
# Route 53 weights: Primary=10%, DR=90%
# Primary=50%, DR=50%
# Primary=100%, DR=0%
# 6. Decommission DR region back to standby capacityمتى تختارون Pilot Light أو Warm Standby
اختاروا Pilot Light عندما: يسمح هدف زمن الاستعادة (RTO) لديكم بمدة تتراوح بين 30 و60 دقيقة، وتريدون تقليل تكاليف التعافي من الكوارث. ويتمثل الخطر الأساسي في الوقت اللازم لإطلاق خوادم التطبيقات وتهيئتها أثناء وقوع الكارثة وتحت الضغط. اختاروا Warm Standby عندما: يتطلب RTO لديكم الاستعادة خلال 15 دقيقة، أو يكون تطبيقكم معقدًا بدرجة تجعل إطلاقه من الصفر أثناء وقوع الكارثة أمرًا محفوفًا بالمخاطر، أو يفرض التزام اتفاقية مستوى الخدمة (SLA) تجاه العملاء استعادة أسرع. وبالنسبة إلى معظم أعباء العمل الإنتاجية متوسطة الأهمية، يحقق Warm Standby التوازن المناسب.
# Decision guide:
# RTO > 1 hour: Backup and Restore
# RTO 30-60 min: Pilot Light
# RTO 5-15 min: Warm Standby
# RTO < 5 min: Multi-Site Active-Active
# Additional factors for Warm Standby:
# - Complex application startup procedures
# - Contractual SLA commitments to customers
# - High revenue loss per minute of downtime
# - Regulatory requirements for fast recoveryتحقق سريع
اختبروا مدى فهمكم لمفاهيم AWS Solutions Architect (SAA-C03) التي تناولها هذا الدرس.
مراجعة الدرس
تعلمتم في هذا الدرس أن: Pilot Light يُبقي قاعدة البيانات فقط قيد التشغيل في منطقة التعافي من الكوارث، ويطلق خوادم التطبيقات أثناء التحويل عند الفشل، وأن Warm Standby يشغّل بيئة كاملة مصغّرة تتوسع أثناء التحويل عند الفشل، وأن Infrastructure as Code يمنع انجراف الإعدادات بين البيئتين الأساسية وبيئة التعافي من الكوارث. احرصوا دائمًا على اختبار إجراءات العودة بعد الفشل والتخطيط لها، إلى جانب إجراءات التحويل عند الفشل. بعد ذلك، سنستكشف البنية النشطة-النشطة متعددة المواقع باستخدام DynamoDB Global Tables وRoute 53.
الأسئلة الشائعة
هل درس «Pilot Light والنسخة الاحتياطية الدافئة» مجاني؟
نعم — نص درس «Pilot Light والنسخة الاحتياطية الدافئة» كامل متاح مجاناً هنا على الويب. لتمرينه بشكل تفاعلي (محرر أكواد مدمج ومدرس ذكاء اصطناعي متاح 24/7) وفتح باقي دورة AWS Solutions Architect، انتقل إلى CoddyKit PRO. تتضمن دورة AWS Solutions Architect 4 دروس في المجموع.
ماذا ستتعلم في «Pilot Light والنسخة الاحتياطية الدافئة»؟
أبقِ نواة أساسية من حِمل العمل قيد التشغيل في Region ثانية (Pilot Light)، أو نسخة مصغّرة لكنها كاملة الوظائف (نسخة احتياطية دافئة) جاهزة للتوسّع تتمرن على AWS Solutions Architect مع أكواد عملية تشغلها مباشرة في المتصفح، ومدرس ذكاء اصطناعي متاح 24/7 يجيب على أسئلتك أثناء عملك.
هل أحتاج إلى خبرة سابقة لأبدأ AWS Solutions Architect؟
لا تُشترط خبرة سابقة. AWS Solutions Architect على CoddyKit منظم للمبتدئين حتى المتقدمين، لذا يمكنك البدء من هنا أو من البداية والتقدم بسرعتك الخاصة. هذا هو الدرس 3 من أصل 4.
كم من الوقت يستغرق درس «Pilot Light والنسخة الاحتياطية الدافئة»؟
معظم دروس CoddyKit تستغرق حوالي 5–10 دقائق. كل منها موجز وتفاعلي، لذا تحرز تقدماً مستمراً وتستأنف من حيث توقفت عبر الويب والتطبيق.
هل يمكنني كتابة وتشغيل أكواد في درس AWS Solutions Architect هذا؟
نعم. كل درس في AWS Solutions Architect يتضمن محرر أكواد مدمج، لذا تكتب وتشغل أكواداً حقيقية مباشرة في متصفحك وتحصل على تعليقات فورية من الذكاء الاصطناعي — بدون إعداد محلي.
جميع الدروس في هذه الدورة
- RTO وRPO وطبقات التعافي من الكوارث
- النسخ الاحتياطي والاستعادة
- Pilot Light والنسخة الاحتياطية الدافئة
- نشط-نشط متعدد المواقع مع Global Tables وRoute 53