0Pricing
Cloud & IT Cert Prep · Pelajaran

Tingkat RTO, RPO, dan DR

Tentukan Recovery Time Objective dan Recovery Point Objective, petakan keduanya ke tingkat biaya, lalu pahami komitmen SLA yang didukung setiap strategi DR.

Tingkat RTO, RPO, dan DR adalah pelajaran Cloud & IT Cert Prep gratis di CoddyKit. Ini adalah pelajaran 1 dari 4. Kamu bisa membaca pelajaran lengkapnya di bawah secara gratis — lalu praktikkan langsung di browser dengan editor kode bawaan dan tutor AI 24/7. Ini adalah bagian dari jalur belajar Cloud & IT Cert Prep, dan progresmu tersinkronisasi di web dan aplikasi CoddyKit. Kursus Cloud & IT Cert Prep mencakup 4 pelajaran total.

Memahami RTO dan RPO

Recovery Time Objective (RTO) adalah waktu maksimum yang dapat diterima sejak bencana terjadi hingga sistem Anda kembali beroperasi. Jika RTO Anda adalah 4 jam, bisnis Anda dapat menoleransi 4 jam waktu henti. Recovery Point Objective (RPO) adalah jumlah kehilangan data maksimum yang dapat diterima, diukur berdasarkan waktu—jika RPO Anda adalah 1 jam, Anda harus dapat pulih ke titik yang tidak lebih dari 1 jam sebelum bencana. Kedua metrik ini ditentukan oleh kebutuhan bisnis, bukan preferensi teknis.

# RTO and RPO definitions:
# RTO = max time system can be DOWN
#   Example: RTO=4h means restore within 4 hours
#
# RPO = max data LOSS acceptable
#   Example: RPO=1h means no more than 1 hour of data lost
#
# Lower RTO and RPO = more expensive DR strategy
# Higher RTO and RPO = cheaper but more business impact

Empat Tingkatan DR

AWS menetapkan empat strategi utama Disaster Recovery, yang diurutkan dari biaya terendah / RTO tertinggi hingga biaya tertinggi / RTO terendah: 1) Backup and Restore—paling murah, RTO dalam hitungan jam. 2) Pilot Light—komponen inti minimal selalu berjalan, RTO dalam hitungan menit hingga jam. 3) Warm Standby—berfungsi tetapi diperkecil, RTO dalam hitungan menit. 4) Multi-Site Active-Active—paling mahal, RTO mendekati nol. Pilihan Anda bergantung pada perbandingan biaya waktu henti bagi bisnis dan biaya infrastruktur DR.

# DR Strategy comparison:
# Strategy          | RTO      | RPO      | Cost
# Backup & Restore  | Hours    | Hours    | Lowest
# Pilot Light       | Minutes+ | Minutes  | Low
# Warm Standby      | Minutes  | Seconds  | Medium
# Active-Active     | ~0       | ~0       | Highest

Strategi Backup and Restore

Dalam Backup and Restore, Anda secara rutin membuat snapshot data dan menyimpannya di lokasi lain (misalnya, S3 dengan replikasi lintas region). Saat terjadi bencana, Anda memulihkan data dari backup terbaru. Ini adalah strategi termurah karena Anda tidak menjalankan infrastruktur standby. Konsekuensinya adalah RTO terlama (berjam-jam untuk memulihkan basis data besar dari snapshot) dan RPO tertinggi (data sejak backup terakhir akan hilang). AWS Backup mengotomatiskan jadwal snapshot di EC2, RDS, EFS, DynamoDB, dan lainnya.

# Create AWS Backup plan for RDS
aws backup create-backup-plan \
  --backup-plan '{
    "BackupPlanName": "daily-backup",
    "Rules": [{
      "RuleName": "daily",
      "TargetBackupVaultName": "dr-vault",
      "ScheduleExpression": "cron(0 5 ? * * *)",
      "StartWindowMinutes": 60,
      "CompletionWindowMinutes": 180,
      "Lifecycle": {
        "DeleteAfterDays": 35
      },
      "CopyActions": [{
        "DestinationBackupVaultArn": "arn:aws:backup:us-west-2:123:backup-vault:dr-vault"
      }]
    }]
  }'

Strategi Pilot Light

Strategi Pilot Light menjaga komponen inti sistem Anda tetap berjalan di region DR dengan kapasitas minimal—seperti lampu pilot yang dapat dengan cepat menyalakan api penuh. Biasanya, ini berarti mereplikasi basis data secara terus-menerus ke region DR dan mempertahankan infrastruktur jaringan dasar (VPC, subnet, security group). Server aplikasi TIDAK berjalan, tetapi dapat diluncurkan dengan cepat dari AMI atau template peluncuran yang telah dibuat sebelumnya. RTO biasanya 30 menit hingga beberapa jam, bergantung pada banyaknya pekerjaan manual yang diperlukan.

# Pilot Light: what runs in DR region at all times
# - RDS Read Replica (continuously replicated)
# - Core VPC/networking infrastructure
# - Route 53 DNS (inactive until failover)

# What is NOT running (launched during failover):
# - EC2 application servers
# - ELB (or dormant)

# Failover steps:
# 1. Promote RDS Read Replica to standalone
# 2. Scale up EC2 instances from launch template
# 3. Update Route 53 to point to DR region

Strategi Warm Standby

Strategi Warm Standby menjalankan salinan lingkungan produksi yang berfungsi penuh tetapi diperkecil di region DR. Berbeda dari Pilot Light, lapisan aplikasi sudah berjalan (mungkin dengan 1–2 instance, bukan 20), dan basis datanya berupa secondary Aurora Global Database atau RDS Read Replica. Saat failover terjadi, Anda meningkatkan skala lingkungan DR agar sesuai dengan kapasitas produksi. RTO biasanya kurang dari 15 menit. Ini adalah strategi DR yang paling umum untuk beban kerja dengan tingkat kekritisan sedang hingga tinggi.

# Warm Standby: DR region runs scaled-down version
# Production:  10 EC2 instances (ASG min=10, max=50)
# DR Standby:  2 EC2 instances  (ASG min=2,  max=50)

# During failover:
# 1. Route 53 health check fails for primary
# 2. DNS switches to DR ALB
# 3. ASG in DR scales up from 2 to 10+
# 4. Promote Aurora Global DB secondary
# Total failover time: ~5-15 minutes

Strategi Multi-Site Active-Active

Multi-Site Active-Active menjalankan kapasitas produksi penuh di dua region atau lebih secara bersamaan. Semua region melayani lalu lintas aktif, dan data direplikasi hampir secara real-time (atau menggunakan multi-master). Tidak ada penundaan failover—saat satu region gagal, Route 53 atau Global Accelerator segera merutekan seluruh lalu lintas ke region sehat yang tersisa. Strategi ini memberikan RTO dan RPO terendah, tetapi juga biaya tertinggi karena Anda membayar kapasitas produksi penuh di semua region setiap saat.

# Active-Active: full capacity in both regions
# us-east-1:  ASG 10 instances (serving ~50% traffic)
# eu-west-1:  ASG 10 instances (serving ~50% traffic)

# Route 53 weighted routing:
# us-east-1: weight=50
# eu-west-1: weight=50
# Both records have health checks

# On us-east-1 failure:
# Health check fails -> Route 53 removes us-east-1
# eu-west-1 receives 100% traffic
# ASG in eu-west-1 scales up automatically

Teknologi Replikasi Data RPO

RPO Anda secara langsung menentukan teknologi replikasi yang diperlukan. RPO = 0 memerlukan replikasi sinkron—tidak ada data yang hilang. RPO dalam hitungan detik memerlukan replikasi asinkron hampir real-time seperti Aurora Global Database (latensi <1 d). RPO dalam hitungan menit memungkinkan replikasi asinkron dengan latensi kecil (DynamoDB Streams, RDS Read Replicas). RPO dalam hitungan jam dapat dicapai dengan snapshot berkala (jadwal AWS Backup setiap jam). Tetapkan kebutuhan RPO bisnis Anda dengan jelas sebelum memilih teknologi.

# RPO requirements mapped to replication technology:
# RPO = 0:        RDS Multi-AZ (synchronous)
# RPO < 1 second: Aurora Global Database
# RPO < 1 minute: DynamoDB Global Tables
# RPO < 15 min:   RDS Read Replica
# RPO < 1 hour:   AWS Backup hourly schedule
# RPO < 24 hours: AWS Backup daily schedule

DR untuk Arsitektur Tanpa Server

Arsitektur tanpa server (Lambda, DynamoDB, API Gateway) secara alami lebih tangguh, tetapi tetap memerlukan perencanaan DR. DynamoDB Global Tables menyediakan active-active multi-region untuk lapisan basis data. Lambda dapat diterapkan ke region kedua dari pipeline CI/CD yang sama. API Gateway harus disediakan di region DR. Risiko utamanya adalah perbedaan konfigurasi antarregion—gunakan AWS CDK atau Terraform untuk menerapkan infrastruktur yang identik ke kedua region dari basis kode yang sama.

# Deploy Lambda to multiple regions with CDK
# cdk.json environment configuration:
{
  'primary': {
    'account': '123456789',
    'region': 'us-east-1'
  },
  'dr': {
    'account': '123456789',
    'region': 'us-west-2'
  }
}

# Deploy to both:
# cdk deploy --context env=primary
# cdk deploy --context env=dr

Contoh Pertukaran RTO dan Biaya

Pertimbangkan perusahaan dengan pendapatan tahunan sebesar $10 juta. Jika waktu henti menimbulkan biaya $1.000/menit, gangguan selama 8 jam (RTO=8j) menimbulkan biaya $480.000. Warm standby active-passive dengan RTO=15 menit mengurangi potensi kerugian menjadi $15.000 per insiden. Jika standby tersebut berbiaya $5.000/bulan ($60.000/tahun), pilihan ini baru masuk akal secara ekonomi jika terjadi lebih dari satu gangguan signifikan per tahun. Analisis justifikasi biaya inilah yang diminta untuk Anda lakukan dalam ujian SAA-C03 saat memilih strategi DR.

# DR cost justification formula:
# Annual cost of DR infrastructure
# vs
# Expected annual outage cost
#   = P(outage) x downtime_duration x cost_per_minute
#
# Example:
# P(annual outage) = 0.1 (10% chance per year)
# downtime = 8 hours = 480 minutes
# cost = $1000/min
# Expected loss = 0.1 x 480 x $1000 = $48,000/year
#
# If warm standby costs $30,000/year -> worth it

Pengujian dan Dokumentasi DR

Rencana DR yang belum pernah diuji hanyalah sebuah dokumen. AWS sangat menyarankan latihan DR secara rutin: praktikkan prosedur failover, ukur RTO dan RPO aktual, serta identifikasi kesenjangan. Gunakan AWS Fault Injection Simulator (FIS) untuk menyimulasikan penurunan kinerja regional secara terkendali. Dokumentasikan panduan operasional untuk langkah-langkah failover agar dalam tekanan insiden nyata, tim siaga mengikuti prosedur yang jelas dan telah diuji, bukan bertindak tanpa rencana.

# DR drill checklist:
# 1. Notify stakeholders (planned drill)
# 2. Initiate failover (Route 53 health check override)
# 3. Measure time from trigger to traffic in DR region (RTO)
# 4. Measure data consistency between regions (RPO)
# 5. Test all critical application functions in DR
# 6. Failback to primary region
# 7. Document actual RTO/RPO vs target
# 8. Update runbooks with lessons learned

Persyaratan Kepatuhan dan DR

Banyak industri memiliki persyaratan peraturan terkait DR. PCI DSS mewajibkan rencana DR terdokumentasi dan pengujiannya. HIPAA mewajibkan prosedur backup data dan pemulihan bencana. SOC 2 mengevaluasi kontrol ketersediaan, termasuk DR. Gunakan AWS Config dan AWS Audit Manager untuk terus mengevaluasi dan mendokumentasikan bahwa sumber daya DR Anda (backup, replika, pemeriksaan health) telah dikonfigurasi dengan benar. Hal ini menyediakan bukti untuk audit kepatuhan tanpa pengumpulan manual.

# AWS Config rule to check RDS backup retention
aws configservice put-config-rule \
  --config-rule '{
    "ConfigRuleName": "rds-backup-enabled",
    "Source": {
      "Owner": "AWS",
      "SourceIdentifier": "DB_INSTANCE_BACKUP_ENABLED"
    },
    "InputParameters": "{\"backupRetentionMinimum\":\"7\"}"
  }'

Pemeriksaan Singkat

Uji pemahaman Anda tentang konsep AWS Solutions Architect (SAA-C03) dari pelajaran ini.

Ringkasan Pelajaran

Dalam pelajaran ini, Anda telah mempelajari bahwa: RTO adalah waktu henti maksimum yang dapat diterima, sedangkan RPO adalah kehilangan data maksimum yang dapat diterima, empat tingkatan DR menyeimbangkan biaya dengan kecepatan pemulihan, dan persyaratan RPO Anda menentukan teknologi Replication yang harus digunakan. Selalu lakukan testing terhadap rencana DR Anda untuk memvalidasi RTO dan RPO yang sebenarnya. Selanjutnya, kita akan membahas strategi Backup and Restore secara mendetail.

Pertanyaan yang Sering Diajukan

Apakah pelajaran “Tingkat RTO, RPO, dan DR” gratis?

Ya — teks lengkap “Tingkat RTO, RPO, dan DR” gratis dibaca di sini di web. Untuk praktiknya secara interaktif (editor kode bawaan dan tutor AI 24/7) dan buka sisa kursus Cloud & IT Cert Prep, upgrade ke CoddyKit PRO. Kursus Cloud & IT Cert Prep mencakup 4 pelajaran total.

Apa yang akan aku pelajari di “Tingkat RTO, RPO, dan DR”?

Tentukan Recovery Time Objective dan Recovery Point Objective, petakan keduanya ke tingkat biaya, lalu pahami komitmen SLA yang didukung setiap strategi DR. Kamu berlatih Cloud & IT Cert Prep dengan kode praktik yang langsung kamu jalankan di browser, dan tutor AI 24/7 menjawab pertanyaanmu saat kamu mengerjakan pelajaran ini.

Apakah aku perlu pengalaman untuk memulai Cloud & IT Cert Prep?

Tidak diperlukan pengalaman sebelumnya. Cloud & IT Cert Prep di CoddyKit dirancang untuk pemula hingga pelajar tingkat lanjut, jadi kamu bisa memulai di sini atau dari awal dan belajar sesuai kecepatan kamu sendiri. Ini adalah pelajaran 1 dari 4.

Berapa lama pelajaran “Tingkat RTO, RPO, dan DR” memakan waktu?

Sebagian besar pelajaran CoddyKit memakan waktu sekitar 5–10 menit. Setiap pelajaran ringkas dan interaktif, jadi kamu membuat kemajuan stabil dan melanjutkan dari tempat kamu tinggalkan di web dan aplikasi.

Bisakah aku menulis dan menjalankan kode dalam pelajaran Cloud & IT Cert Prep ini?

Ya. Setiap pelajaran Cloud & IT Cert Prep menyertakan editor kode bawaan, jadi kamu menulis dan menjalankan kode nyata langsung di browser dan mendapatkan umpan balik AI instan — tidak diperlukan penyiapan lokal.

Semua pelajaran dalam kursus ini

  1. Tingkat RTO, RPO, dan DR
  2. Pencadangan dan Pemulihan
  3. Pilot Light dan Cadangan Hangat
  4. Aktif-Aktif Multi-Situs dengan Global Tables dan Route 53
← Kembali ke Cloud & IT Cert Prep