0Pricing
AWS Solutions Architect · Pelajaran

Pilot Light dan Cadangan Hangat

Pertahankan inti minimal beban kerja Anda di Region kedua (pilot light), atau salinan yang diperkecil tetapi berfungsi penuh (cadangan hangat) yang siap ditingkatkan skalanya.

Pilot Light dan Cadangan Hangat adalah pelajaran AWS Solutions Architect gratis di CoddyKit. Ini adalah pelajaran 3 dari 4. Kamu bisa membaca pelajaran lengkapnya di bawah secara gratis — lalu praktikkan langsung di browser dengan editor kode bawaan dan tutor AI 24/7. Ini adalah bagian dari jalur belajar AWS Solutions Architect, dan progresmu tersinkronisasi di web dan aplikasi CoddyKit. Kursus AWS Solutions Architect mencakup 4 pelajaran total.

Melampaui Backup and Restore

Jika persyaratan RTO Anda lebih ketat daripada beberapa jam, Backup and Restore tidaklah memadai. Dua tingkatan DR berikutnya — Pilot Light dan Warm Standby — mempertahankan sebagian atau seluruh infrastruktur Anda tetap berjalan di Region DR setiap saat, sehingga waktu pemulihan berkurang secara signifikan. Kedua strategi ini melibatkan pemeliharaan lingkungan DR secara terus-menerus dan penggunaan failover pemeriksaan kesehatan Route 53 untuk mengarahkan ulang lalu lintas saat terjadi bencana. Perbedaannya terletak pada seberapa banyak lingkungan DR yang aktif berjalan.

Pilot Light: Inti Sistem Selalu Berjalan

Dalam strategi Pilot Light, Anda hanya mempertahankan inti sistem yang kritis agar tetap berjalan di Region DR — biasanya hanya tingkat database dengan Replication berkelanjutan. Server aplikasi TIDAK berjalan; sebagai gantinya, Anda memelihara AMI, templat peluncuran, atau infrastruktur sebagai kode yang telah dibuat sebelumnya dan dapat meluncurkannya dengan cepat. Bayangkan strategi ini seperti nyala api kecil pada pilot kompor gas yang dapat menyalakan api penuh dalam hitungan menit saat diperlukan. RTO biasanya 30–60 menit.

# Pilot Light: what runs 24/7 in DR region
# - RDS Read Replica (receiving continuous replication)
# - Minimal VPC/networking (no extra cost if no data transfer)
# - Route 53 failover record (inactive, health check pointing to primary)

# What is prepared but NOT running:
# - EC2 launch template pointing to DR AMI
# - ALB (can be created in minutes)
# - ASG with desired=0, can scale to 10 on demand

Langkah-Langkah Failover Pilot Light

Saat Region utama gagal dan failover Pilot Light dipicu: Langkah 1 — Promosikan RDS Read Replica di Region DR menjadi database utama mandiri. Langkah 2 — Luncurkan instans EC2 dari AMI atau templat peluncuran yang telah dibuat sebelumnya. Langkah 3 — Buat atau aktifkan Application Load Balancer dan daftarkan instans EC2 baru. Langkah 4 — Perbarui konfigurasi aplikasi agar menunjuk ke titik akhir database yang telah dipromosikan. Langkah 5 — Failover pemeriksaan kesehatan Route 53 menyelesaikan pengalihan DNS. Total waktu: 30–60 menit.

# Step 1: Promote RDS Read Replica
aws rds promote-read-replica \
  --db-instance-identifier mydb-dr-replica \
  --region us-west-2

# Step 2: Scale up ASG in DR region
aws autoscaling update-auto-scaling-group \
  --auto-scaling-group-name app-asg-dr \
  --min-size 2 \
  --desired-capacity 4 \
  --region us-west-2

# Step 3: Route 53 failover happens automatically
# via health check detecting primary region failure

Warm Standby: Berfungsi Penuh tetapi Diperkecil

Dalam strategi Warm Standby, versi lengkap tetapi diperkecil dari lingkungan produksi Anda berjalan terus-menerus di Region DR. Semua tingkat aplikasi aktif — server web, server aplikasi, dan database — tetapi dengan kapasitas yang lebih rendah (misalnya, 2 instans, bukan 20). Saat failover, Anda meningkatkan skala lingkungan DR agar sesuai dengan beban produksi. Route 53 secara otomatis mengalihkan lalu lintas melalui failover pemeriksaan kesehatan. RTO biasanya kurang dari 15 menit. Warm Standby adalah tingkat DR yang paling populer untuk aplikasi yang kritis bagi bisnis.

# Production vs Warm Standby capacity:
# Tier          Production    DR Standby
# Web servers   20 EC2 (c5.xl) 2 EC2 (c5.xl)
# App servers   10 EC2 (m5.xl) 2 EC2 (m5.xl)
# Database      RDS db.r5.2xl  RDS Read Replica (db.r5.xl)
# Cache         Redis r6g.xl   Redis r6g.medium
#
# Cost: DR standby ~15% of production cost

Database Global Aurora untuk Warm Standby

Aurora Global Database adalah teknologi database yang ideal untuk DR Warm Standby. Klaster Region sekunder selalu berjalan, selalu menerima Replication (keterlambatan <1 detik), dan dapat dipromosikan menjadi utama dalam waktu kurang dari 1 menit — jauh lebih cepat daripada mempromosikan RDS Read Replica (yang memerlukan penghentian Replication dan penerapan keterlambatan yang tersisa). Karena itu, Aurora Global Database direkomendasikan jika persyaratan RTO Anda berada dalam hitungan menit, bukan puluhan menit.

# Promote Aurora Global DB secondary to primary
# (during DR failover)
aws rds failover-global-cluster \
  --global-cluster-identifier my-global-db \
  --target-db-cluster-identifier my-aurora-cluster-us-west-2

# Aurora handles promotion automatically
# Typical promotion time: 1-2 minutes
# vs RDS Read Replica promotion: 10-30 minutes

Konfigurasi Failover Otomatis Route 53

Pilot Light dan Warm Standby sama-sama mengandalkan perutean failover Route 53 untuk mengarahkan ulang lalu lintas secara otomatis. Konfigurasikan catatan Primary yang menunjuk ke ALB atau titik akhir di Region produksi Anda, dengan pemeriksaan kesehatan yang terpasang. Konfigurasikan catatan Sekunder yang menunjuk ke titik akhir di Region DR Anda. Saat Route 53 mendeteksi bahwa pemeriksaan kesehatan utama gagal melewati ambang yang dikonfigurasi, Route 53 berhenti mengembalikan catatan utama dan hanya menyajikan catatan sekunder — semuanya dalam periode TTL DNS.

# Primary record (production)
aws route53 change-resource-record-sets \
  --hosted-zone-id ZXXX \
  --change-batch '{
    "Changes": [{
      "Action": "UPSERT",
      "ResourceRecordSet": {
        "Name": "api.example.com",
        "Type": "A",
        "Failover": "PRIMARY",
        "SetIdentifier": "primary",
        "HealthCheckId": "hc-us-east-1",
        "AliasTarget": {"DNSName": "alb-prod.us-east-1.elb.amazonaws.com","EvaluateTargetHealth": true}
      }
    }]
  }'

Menyiapkan Lingkungan DR Sebelumnya

Agar Warm Standby mencapai target RTO-nya, lingkungan DR harus disiapkan sebelumnya — dikonfigurasi dan diuji sepenuhnya sehingga peningkatan skala saat failover menjadi satu-satunya tindakan yang diperlukan. Artinya: koneksi database telah dibuat dan disimpan dalam cache, file konfigurasi aplikasi merujuk ke titik akhir di Region DR, instans EC2 sudah aktif di belakang ALB (meskipun jumlahnya sedikit), dan pemeriksaan kesehatan berhasil. Lakukan latihan DR bulanan dengan menyimulasikan failover untuk memastikan lingkungan tetap mengikuti konfigurasi produksi.

# Validate DR warm standby health
# 1. Check DR ALB target health
aws elbv2 describe-target-health \
  --target-group-arn arn:aws:elasticloadbalancing:us-west-2:123:targetgroup/app-dr/xyz

# 2. Check Aurora Global DB secondary
aws rds describe-global-clusters \
  --global-cluster-identifier my-global-db

# 3. Verify Route 53 health checks
aws route53 get-health-check-status \
  --health-check-id hc-us-west-2

Infrastruktur sebagai Kode untuk Konsistensi DR

Menjaga lingkungan DR tetap selaras dengan produksi merupakan tantangan operasional yang paling sulit. Jika Anda mengonfigurasi produksi secara manual dan lupa memperbarui DR, lingkungan DR mungkin tidak berfungsi dengan benar saat bencana nyata terjadi. Solusinya adalah Infrastruktur sebagai Kode (IaC) dengan templat yang sama, yang diterapkan ke kedua Region. Gunakan AWS CloudFormation StackSets atau Terraform dengan beberapa ruang kerja untuk menerapkan infrastruktur identik ke kedua Region dari satu basis kode. Hal ini menghilangkan perbedaan konfigurasi.

# CloudFormation StackSet: deploy to multiple regions
aws cloudformation create-stack-set \
  --stack-set-name my-app-infrastructure \
  --template-url https://s3.amazonaws.com/mybucket/template.yaml

# Deploy to DR region
aws cloudformation create-stack-instances \
  --stack-set-name my-app-infrastructure \
  --accounts 123456789012 \
  --regions us-west-2 \
  --parameter-overrides \
    ParameterKey=DesiredCapacity,ParameterValue=2

Perbandingan Biaya: Pilot Light vs Warm Standby

Perbedaan biaya antara kedua strategi ini cukup besar. Pilot Light hanya membebankan biaya replika database (biasanya 50–100% dari biaya DB utama) ditambah biaya networking minimal di Region DR. Server aplikasi dalam keadaan mati, sehingga tidak ada biaya EC2. Warm Standby menambahkan biaya untuk menjalankan instans EC2 yang diperkecil, ALB, dan kemungkinan klaster cache yang lebih kecil — biasanya 15–30% dari total biaya lingkungan produksi. Pertanyaannya adalah apakah RTO Warm Standby yang lebih cepat sepadan dengan biaya berkelanjutan yang lebih tinggi.

# Example monthly cost comparison:
# Production environment: $10,000/month

# Pilot Light DR:
#   RDS Read Replica: $500/month
#   Minimal networking: $50/month
#   Total: $550/month (~5.5% of production)

# Warm Standby DR:
#   RDS Read Replica: $500/month
#   2x EC2 instances: $400/month
#   ALB + networking: $200/month
#   Total: $1,100/month (~11% of production)

Failback: Kembali ke Primary

Setelah region primary dipulihkan, Anda memerlukan rencana pemulihan kembali untuk kembali menggunakannya. Pemulihan kembali sering kali merupakan bagian tersulit dari DR: selama gangguan berlangsung, region DR mungkin telah memproses data baru yang perlu disinkronkan kembali ke primary. Untuk database, Anda mungkin perlu menyiapkan replikasi balik atau menyinkronkan ulang dari DR ke primary. Untuk Route 53, Anda mengaktifkan kembali catatan primary beserta pemeriksaan kesehatannya. Selalu rencanakan dan uji prosedur pemulihan kembali dengan ketelitian yang sama seperti failover itu sendiri.

# Failback procedure steps:
# 1. Restore primary region infrastructure
# 2. Set up replication from DR to primary
#    (reverse replication to sync new data)
# 3. Verify data consistency
# 4. Re-enable primary Route 53 health check
# 5. Gradually shift traffic back (weighted routing)
#    Route 53 weights: Primary=10%, DR=90%
#                      Primary=50%, DR=50%
#                      Primary=100%, DR=0%
# 6. Decommission DR region back to standby capacity

Kapan Memilih Pilot Light atau Warm Standby

Pilih Pilot Light jika RTO Anda memungkinkan waktu 30–60 menit dan Anda ingin meminimalkan biaya DR. Risiko utamanya adalah waktu yang diperlukan untuk meluncurkan dan mengonfigurasi server aplikasi saat terjadi bencana dan semua pihak berada di bawah tekanan. Pilih Warm Standby jika RTO Anda mengharuskan pemulihan dalam 15 menit, aplikasi Anda cukup kompleks sehingga peluncuran baru saat terjadi bencana berisiko, atau komitmen SLA kepada pelanggan menuntut pemulihan yang lebih cepat. Untuk sebagian besar beban kerja produksi dengan tingkat kekritisan menengah, Warm Standby memberikan keseimbangan yang tepat.

# Decision guide:
# RTO > 1 hour:  Backup and Restore
# RTO 30-60 min: Pilot Light
# RTO 5-15 min:  Warm Standby
# RTO < 5 min:   Multi-Site Active-Active

# Additional factors for Warm Standby:
# - Complex application startup procedures
# - Contractual SLA commitments to customers
# - High revenue loss per minute of downtime
# - Regulatory requirements for fast recovery

Pemeriksaan Singkat

Uji pemahaman Anda tentang konsep AWS Solutions Architect (SAA-C03) dari pelajaran ini.

Ringkasan Pelajaran

Dalam pelajaran ini Anda mempelajari bahwa: Pilot Light hanya menjalankan database di DR dan meluncurkan server aplikasi saat failover, Warm Standby menjalankan lingkungan lengkap berskala lebih kecil yang diperbesar saat failover, dan Infrastructure as Code mencegah perbedaan konfigurasi antara lingkungan primary dan DR. Selalu uji dan rencanakan prosedur pemulihan kembali, selain failover. Selanjutnya kita akan membahas multi-site active-active dengan DynamoDB Global Tables dan Route 53.

Pertanyaan yang Sering Diajukan

Apakah pelajaran “Pilot Light dan Cadangan Hangat” gratis?

Ya — teks lengkap “Pilot Light dan Cadangan Hangat” gratis dibaca di sini di web. Untuk praktiknya secara interaktif (editor kode bawaan dan tutor AI 24/7) dan buka sisa kursus AWS Solutions Architect, upgrade ke CoddyKit PRO. Kursus AWS Solutions Architect mencakup 4 pelajaran total.

Apa yang akan aku pelajari di “Pilot Light dan Cadangan Hangat”?

Pertahankan inti minimal beban kerja Anda di Region kedua (pilot light), atau salinan yang diperkecil tetapi berfungsi penuh (cadangan hangat) yang siap ditingkatkan skalanya. Kamu berlatih AWS Solutions Architect dengan kode praktik yang langsung kamu jalankan di browser, dan tutor AI 24/7 menjawab pertanyaanmu saat kamu mengerjakan pelajaran ini.

Apakah aku perlu pengalaman untuk memulai AWS Solutions Architect?

Tidak diperlukan pengalaman sebelumnya. AWS Solutions Architect di CoddyKit dirancang untuk pemula hingga pelajar tingkat lanjut, jadi kamu bisa memulai di sini atau dari awal dan belajar sesuai kecepatan kamu sendiri. Ini adalah pelajaran 3 dari 4.

Berapa lama pelajaran “Pilot Light dan Cadangan Hangat” memakan waktu?

Sebagian besar pelajaran CoddyKit memakan waktu sekitar 5–10 menit. Setiap pelajaran ringkas dan interaktif, jadi kamu membuat kemajuan stabil dan melanjutkan dari tempat kamu tinggalkan di web dan aplikasi.

Bisakah aku menulis dan menjalankan kode dalam pelajaran AWS Solutions Architect ini?

Ya. Setiap pelajaran AWS Solutions Architect menyertakan editor kode bawaan, jadi kamu menulis dan menjalankan kode nyata langsung di browser dan mendapatkan umpan balik AI instan — tidak diperlukan penyiapan lokal.

Semua pelajaran dalam kursus ini

  1. Tingkat RTO, RPO, dan DR
  2. Pencadangan dan Pemulihan
  3. Pilot Light dan Cadangan Hangat
  4. Aktif-Aktif Multi-Situs dengan Global Tables dan Route 53
← Kembali ke AWS Solutions Architect