แผนการกู้คืนและการสลับใช้งานอัตโนมัติ
สร้างแผนการกู้คืน ASR ที่จัดลำดับการสลับใช้งาน VM ข้ามชั้นแอปพลิเคชัน เพิ่มจุดอนุมัติด้วยตนเอง และรวมสคริปต์ก่อนและหลังการสลับใช้งาน
แผนการกู้คืนและการสลับใช้งานอัตโนมัติ เป็นบทเรียน Cloud & IT Cert Prep ฟรีบน CoddyKit นี่คือบทเรียนที่ 2 จากทั้งหมด 4 บทเรียน คุณสามารถอ่านบทเรียนทั้งหมดด้านล่างฟรี — จากนั้นลองปฏิบัติด้วยตัวคุณเองในเบราว์เซอร์พร้อมตัวแก้ไขโค้ดในตัวและติวเตอร์ AI ตลอด 24/7 บทเรียนนี้เป็นส่วนหนึ่งของเส้นทางการเรียน Cloud & IT Cert Prep และความก้าวหน้าของคุณจะซิงค์ข้ามเว็บและแอป CoddyKit คอร์ส Cloud & IT Cert Prep มีบทเรียนทั้งหมด 4 บทเรียน
Recovery Plan ของ ASR คืออะไร
Recovery Plan ใน Azure Site Recovery คือลำดับขั้นตอนที่มีโครงสร้างและจัดเรียงตามลำดับ เพื่อควบคุมการสลับระบบของ VMs หลายเครื่องร่วมกัน แทนที่จะสลับระบบทีละ VM แผนการกู้คืนจะจัดกลุ่ม VMs เป็น กลุ่ม ที่สลับระบบตามลำดับ เพื่อให้โครงสร้างพื้นฐาน (ฐานข้อมูล มิดเดิลแวร์ เว็บ) เริ่มทำงานตามลำดับที่ถูกต้อง เช่นเดียวกับตอนติดตั้งครั้งแรก
การสร้าง Recovery Plan
ในการสร้างแผนการกู้คืน ให้เลือก ไซต์ต้นทาง (ภูมิภาคหลัก) และ ไซต์เป้าหมาย (ภูมิภาคสำรอง) จากนั้นเพิ่ม VMs ที่ต้องการรวมไว้ในแผน ตัวช่วยสร้างแผนจะสร้างกลุ่มเริ่มต้นโดยอัตโนมัติ แต่คุณสามารถเพิ่มกลุ่มอื่นเพื่อควบคุมลำดับการสลับระบบได้ VMs ในกลุ่มเดียวกันจะสลับระบบพร้อมกัน ส่วนกลุ่มต่าง ๆ จะทำงานตามลำดับหมายเลข
# Create an ASR Recovery Plan via CLI:
az site-recovery recovery-plan create \
--resource-group myRG \
--vault-name myRecoveryVault \
--name myRecoveryPlan \
--primary-fabric-id '/subscriptions/.../replicationFabrics/eastus' \
--recovery-fabric-id '/subscriptions/.../replicationFabrics/westus' \
--groups '[{"groupType":"Boot","replicationProtectedItems":[...]}]'การจัดลำดับกลุ่มสำหรับแอปหลายระดับ
สำหรับแอปพลิเคชันสามระดับทั่วไป Recovery Plan ควรมีสามกลุ่ม:
- กลุ่ม 1 — VMs ระดับฐานข้อมูล (ต้องเริ่มก่อน)
- กลุ่ม 2 — VMs ระดับแอปพลิเคชัน/มิดเดิลแวร์
- กลุ่ม 3 — VMs ส่วนหน้าเว็บ (เริ่มเป็นลำดับสุดท้าย)
แต่ละกลุ่มจะรอให้กลุ่มก่อนหน้าสลับระบบสำเร็จก่อนจึงเริ่มทำงาน ลำดับนี้สอดคล้องกับลำดับการเริ่มต้นที่ถูกต้อง และป้องกันไม่ให้ VMs ระดับเว็บเริ่มทำงานก่อนที่ฐานข้อมูลจะพร้อมรับการเชื่อมต่อ
การเพิ่มการดำเนินการและสคริปต์ด้วยตนเอง
Recovery Plan รองรับ การดำเนินการก่อน และ การดำเนินการหลัง ที่ขอบเขตของแต่ละกลุ่ม ซึ่งอาจเป็น:
- การดำเนินการด้วยตนเอง — หยุดการสลับระบบชั่วคราวและรอให้บุคคลยืนยัน (เช่น “ตรวจสอบว่าฐานข้อมูลพร้อมแล้ว”)
- Runbook ของ Azure Automation — เรียกใช้สคริปต์โดยอัตโนมัติ (เช่น อัปเดตระเบียน DNS หรือปิดโหมดบำรุงรักษา)
การใช้ Runbook ของ Automation ช่วยให้สลับระบบได้โดยอัตโนมัติทั้งหมดโดยไม่ต้องมีบุคคลดำเนินการ สำหรับเวิร์กโหลดระดับ 1
# Example Automation runbook action in a recovery plan:
# Pre-group-2 action: Run runbook 'UpdateConnectionStrings'
# This runbook updates app config to point to secondary DB endpoint
# before the application tier VMs startการสลับระบบที่ไม่ได้วางแผนเทียบกับที่วางแผนไว้
Azure Site Recovery รองรับการสลับระบบสองประเภท:
- การสลับระบบที่วางแผนไว้ — เริ่มก่อนเหตุการณ์ที่ทราบล่วงหน้า (เช่น การบำรุงรักษาศูนย์ข้อมูล) VM หลักจะถูกปิดอย่างเรียบร้อย ข้อมูลจะถูกทำให้ตรงกัน จากนั้น VM สำรองจึงเริ่มทำงาน ไม่มีข้อมูลสูญหาย
- การสลับระบบที่ไม่ได้วางแผนไว้ — เริ่มขึ้นระหว่างภัยพิบัติจริง VM หลักอาจไม่พร้อมใช้งาน ดังนั้น ASR จะใช้จุดตรวจสอบการจำลองข้อมูลล่าสุด อาจเกิดข้อมูลสูญหายบางส่วน ขึ้นอยู่กับ RPO
# Trigger an unplanned failover via CLI:
az site-recovery recovery-plan failover-unplanned \
--resource-group myRG \
--vault-name myRecoveryVault \
--name myRecoveryPlan \
--failover-direction PrimaryToRecoveryCommit และ Failback
หลังการสลับระบบ VMs ที่กู้คืนในภูมิภาคสำรองจะอยู่ในสถานะ รอการยืนยัน คุณต้อง commit การสลับระบบเพื่อยืนยันว่าไซต์สำรองเป็นไซต์ที่ใช้งานอยู่ในขณะนี้ และคุณไม่ต้องการย้อนกลับ เมื่อ commit แล้ว คุณสามารถตั้งค่า การจำลองข้อมูลย้อนกลับเพื่อปกป้องไซต์สำรอง และทำ fail back กลับไปยังภูมิภาคหลักได้ในภายหลังเมื่อภูมิภาคนั้นได้รับการกู้คืน
# Commit the failover:
az site-recovery recovery-plan commit \
--resource-group myRG \
--vault-name myRecoveryVault \
--name myRecoveryPlan
# Then configure reverse replication to enable failback laterการปกป้องซ้ำหลังการสลับระบบ
หลังจาก commit การสลับระบบแล้ว รายการที่จำลองข้อมูลในภูมิภาคหลักเดิมจะไม่ถูกจำลองข้อมูลต่ออย่างต่อเนื่องอีก หากต้องการคืนค่าการปกป้อง คุณต้อง ปกป้องซ้ำรายการเหล่านั้น ซึ่งจะย้อนทิศทางการจำลองข้อมูลให้ไซต์หลักใหม่ (เดิมคือไซต์สำรอง) จำลองข้อมูลไปยังภูมิภาคหลักเดิม การปกป้องซ้ำใช้เวลา และควรเริ่มดำเนินการทันทีที่ภูมิภาคหลักเดิมกลับมาใช้งานได้อีกครั้ง
การวัด RTO ในแผนกู้คืนระบบ
ทุกขั้นตอนในแผนกู้คืนระบบจะเพิ่มเข้าไปใน RTO รวม ปัจจัยที่ใช้เวลามากมักได้แก่:
- เวลาเริ่มต้น VM (2-5 นาทีต่อ VM)
- เวลาเตรียมแอปพลิเคชันให้พร้อมทำงาน (การเริ่มต้นกลุ่มการเชื่อมต่อฐานข้อมูลและการอุ่นแคช)
- การเผยแพร่ DNS หลังจากเปลี่ยน IP
- เวลารอการอนุมัติด้วยตนเอง
วัดเวลาแต่ละขั้นตอนระหว่างการสลับระบบทดสอบ แล้วรวมเวลาเพื่อคำนวณ Actual RTO ของคุณและเปรียบเทียบกับเป้าหมาย
การทำให้การอัปเดต DNS เป็นแบบอัตโนมัติ
หลังจากเกิดการสลับระบบ VM ในภูมิภาคสำรองจะมีที่อยู่ IP แตกต่างจากเดิม สำหรับแอปพลิเคชันที่เปิดให้เข้าถึงผ่านชื่อ DNS สาธารณะ คุณต้องอัปเดต DNS ให้ชี้ไปยัง IP ใหม่ ใช้สมุดงานระบบอัตโนมัติของ Azure เป็นการดำเนินการหลังการสลับระบบ เพื่ออัปเดตสถานะความสมบูรณ์ของปลายทาง Azure DNS หรือ Traffic Manager และเปลี่ยนเส้นทางการรับส่งข้อมูลโดยอัตโนมัติ วิธีนี้จะช่วยหลีกเลี่ยงขั้นตอนที่ต้องทำด้วยตนเองซึ่งอาจทำให้ RTO ล่าช้า
# Example: Update Azure DNS record in a runbook after failover:
# az network dns record-set a update \
# --resource-group dnsRG \
# --zone-name myapp.com \
# --record-set-name '@' \
# --set 'ARecords[0].ipv4Address=<new-secondary-ip>'การตรวจสอบการทำงานของแผนกู้คืนระบบ
ระหว่างการสลับระบบ มุมมอง Jobs ของ Azure portal ในคลัง Recovery Services จะแสดงความคืบหน้าแบบเรียลไทม์ของแต่ละขั้นตอนในแผนกู้คืนระบบ คุณสามารถดูได้ว่ากลุ่มใดกำลังทำงาน VM ใดเริ่มต้นสำเร็จแล้ว และมีสคริปต์หรือการดำเนินการด้วยตนเองใดที่ยังรอดำเนินการอยู่ การตรวจสอบมุมมองนี้ช่วยให้ทีมกู้คืนระบบเข้าแทรกแซงได้อย่างรวดเร็วหากขั้นตอนใดล้มเหลว
แนวทางปฏิบัติที่ดีที่สุดสำหรับแผนกู้คืนระบบ
แนวทางปฏิบัติที่ดีที่สุดที่สำคัญสำหรับแผนกู้คืนระบบมีดังนี้:
- จัดกลุ่มให้มีขนาดเล็ก (5-10 VM) เพื่อจำกัดขอบเขตผลกระทบหากกลุ่มล้มเหลว
- ใช้สมุดงานระบบอัตโนมัติแทนการดำเนินการด้วยตนเองทุกครั้งที่ทำได้ เพื่อลด RTO
- บันทึกเวลาเริ่มต้นที่คาดไว้ของแต่ละกลุ่ม เพื่อให้คำนวณ RTO ได้
- ดำเนินการ สลับระบบทดสอบ อย่างน้อยทุกไตรมาสเพื่อตรวจสอบแผน
- ทบทวนและอัปเดตแผนทุกครั้งที่เพิ่ม VM ใหม่หรือมีการเปลี่ยนแปลงสถาปัตยกรรมแอปพลิเคชัน
ตรวจสอบความเข้าใจอย่างรวดเร็ว
ทดสอบความเข้าใจแนวคิด Microsoft Azure Fundamentals (AZ-900) จากบทเรียนนี้
สรุปบทเรียน
ในบทเรียนนี้ คุณได้เรียนรู้ว่า แผนกู้คืนระบบ จะประสานการสลับระบบของ VM หลายรายการตามลำดับ โดยมีการดำเนินการก่อนและหลังในแต่ละกลุ่ม การ สลับระบบที่ไม่ได้วางแผน จะใช้จุดตรวจสอบการจำลองแบบล่าสุด ขณะที่การสลับระบบที่วางแผนไว้จะไม่มีข้อมูลสูญหาย และหลังจากสลับระบบแล้ว คุณต้อง ยืนยันและป้องกันระบบใหม่อีกครั้ง เพื่อคืนค่าการป้องกัน DR บทถัดไปเราจะศึกษาวิธีทดสอบแผน DR โดยไม่ส่งผลกระทบต่อระบบที่ใช้งานจริง
คำถามที่พบบ่อย
บทเรียน “แผนการกู้คืนและการสลับใช้งานอัตโนมัติ” ฟรีหรือไม่
ใช่ — ข้อความเต็มของ “แผนการกู้คืนและการสลับใช้งานอัตโนมัติ” ฟรีให้อ่านที่นี่บนเว็บ เพื่อปฏิบัติแบบโต้ตอบ (ตัวแก้ไขโค้ดในตัวและติวเตอร์ AI ตลอด 24/7) และปลดล็อคส่วนที่เหลือของคอร์ส Cloud & IT Cert Prep ให้อัปเกรดเป็น CoddyKit PRO คอร์ส Cloud & IT Cert Prep มีบทเรียนทั้งหมด 4 บทเรียน
คุณจะเรียนรู้อะไรในบทเรียน “แผนการกู้คืนและการสลับใช้งานอัตโนมัติ”
สร้างแผนการกู้คืน ASR ที่จัดลำดับการสลับใช้งาน VM ข้ามชั้นแอปพลิเคชัน เพิ่มจุดอนุมัติด้วยตนเอง และรวมสคริปต์ก่อนและหลังการสลับใช้งาน คุณปฏิบัติ Cloud & IT Cert Prep ด้วยโค้ดที่ใช้งานได้จริงที่คุณเรียกใช้โดยตรงในเบราว์เซอร์ และติวเตอร์ AI ตลอด 24/7 ตอบคำถามของคุณขณะที่คุณไปผ่านบทเรียน
คุณต้องมีประสบการณ์ก่อนที่จะเริ่มเรียน Cloud & IT Cert Prep หรือไม่
ไม่จำเป็นต้องมีประสบการณ์มาก่อน Cloud & IT Cert Prep บน CoddyKit ออกแบบมาสำหรับผู้เริ่มต้นไปจนถึงผู้เรียนขั้นสูง คุณสามารถเริ่มต้นที่นี่หรือเริ่มจากตัวแรกและเรียนด้วยความเร็วของคุณเอง นี่คือบทเรียนที่ 2 จากทั้งหมด 4 บทเรียน
บทเรียน “แผนการกู้คืนและการสลับใช้งานอัตโนมัติ” ใช้เวลานานแค่ไหน
บทเรียน CoddyKit ส่วนใหญ่ใช้เวลาประมาณ 5–10 นาที แต่ละบทเรียนจึงสั้นและเป็นแบบโต้ตอบ คุณสามารถก้าวหน้าอย่างต่อเนื่องและกลับมาเรียนต่อจากตรงที่เพิ่งหยุดบนเว็บและแอปได้เลย
ฉันเขียนและรันโค้ดในบทเรียน Cloud & IT Cert Prep นี้ได้ไหม
ได้ บทเรียน Cloud & IT Cert Prep ทุกบทมีตัวแก้ไขโค้ดในตัว คุณจึงเขียนและรันโค้ดจริงได้เลยในเบราว์เซอร์ และได้รับข้อเสนอแนะจาก AI ในทันที — ไม่ต้องติดตั้งในเครื่องของคุณ
บทเรียนทั้งหมดในหลักสูตรนี้
- การกำหนด RTO, RPO และระดับการกู้คืน
- แผนการกู้คืนและการสลับใช้งานอัตโนมัติ
- การทดสอบ DR โดยไม่กระทบระบบ
- DR สำหรับบริการ PaaS