0Pricing
Cloud & IT Cert Prep · Leçon

Plans de reprise et basculement automatisé

Créez un plan de reprise ASR qui séquence le basculement des VM entre les niveaux applicatifs, ajoutez des étapes d’approbation manuelle et incluez des scripts avant et après basculement.

Plans de reprise et basculement automatisé est une leçon Cloud & IT Cert Prep gratuite sur CoddyKit. Ceci est la leçon 2 sur 4. Tu peux lire la leçon complète ci-dessous gratuitement — puis la pratiquer en direct dans le navigateur avec un éditeur de code intégré et un tuteur IA 24/7. Elle fait partie du parcours d'apprentissage Cloud & IT Cert Prep, et ta progression se synchronise sur le web et l'application CoddyKit. Le cours Cloud & IT Cert Prep comprend 4 leçons au total.

Qu’est-ce qu’un Recovery Plan ASR ?

Un Recovery Plan dans Azure Site Recovery est une séquence structurée et ordonnée d’étapes qui orchestre le basculement de plusieurs VMs simultanément. Plutôt que de basculer chaque VM individuellement, un Recovery Plan les regroupe en groupes qui basculent dans l’ordre — ce qui garantit que l’infrastructure (base de données, intergiciel, interface web) démarre dans le bon ordre, comme lors du déploiement initial.

Création d’un Recovery Plan

Pour créer un Recovery Plan, vous sélectionnez le site source (région Primary) et le site cible (région secondaire), puis vous ajoutez les VMs à inclure. L’assistant du plan crée automatiquement un groupe par défaut, mais vous pouvez en ajouter d’autres pour contrôler la séquence de basculement. Les VMs d’un même groupe basculent simultanément ; les groupes s’exécutent dans l’ordre de leur numéro.

# Create an ASR Recovery Plan via CLI:
az site-recovery recovery-plan create \
  --resource-group myRG \
  --vault-name myRecoveryVault \
  --name myRecoveryPlan \
  --primary-fabric-id '/subscriptions/.../replicationFabrics/eastus' \
  --recovery-fabric-id '/subscriptions/.../replicationFabrics/westus' \
  --groups '[{"groupType":"Boot","replicationProtectedItems":[...]}]'

Organisation des groupes pour les applications à plusieurs niveaux

Pour une application classique à trois niveaux, le Recovery Plan doit comporter trois groupes :

  • Groupe 1 — VMs du niveau base de données (elles doivent démarrer en premier)
  • Groupe 2 — VMs du niveau application/intergiciel
  • Groupe 3 — VMs de l’interface web (elles démarrent en dernier)

Chaque groupe attend que le groupe précédent ait terminé son basculement avec succès avant de démarrer. Cela reproduit l’ordre de démarrage correct et empêche les VMs du niveau web de démarrer avant que la base de données soit prête à accepter les connexions.

Ajout d’actions manuelles et de scripts

Les Recovery Plans prennent en charge des actions Pre et des actions postérieures à chaque limite entre groupes. Il peut s’agir des éléments suivants :

  • Actions manuelles — mettre le basculement en pause et attendre la confirmation d’une personne (par exemple, « Vérifier que la base de données est prête »)
  • Runbooks Azure Automation — exécuter automatiquement un script (par exemple, mettre à jour les enregistrements DNS ou désactiver le mode maintenance)

L’utilisation de runbooks Automation permet un basculement entièrement automatisé, sans intervention humaine, pour les charges de travail de niveau 1.

# Example Automation runbook action in a recovery plan:
# Pre-group-2 action: Run runbook 'UpdateConnectionStrings'
# This runbook updates app config to point to secondary DB endpoint
# before the application tier VMs start

Basculement non planifié ou planifié

Azure Site Recovery prend en charge deux types de basculement :

  • Basculement planifié — lancé avant un événement connu (par exemple, une maintenance du centre de données). La VM Primary est arrêtée proprement, les données sont synchronisées, puis la VM secondaire démarre. Aucune perte de données.
  • Basculement non planifié — déclenché pendant un sinistre réel. La VM Primary peut être indisponible ; ASR utilise donc le point de contrôle de réplication le plus récent. Une perte de données est possible selon le RPO.
# Trigger an unplanned failover via CLI:
az site-recovery recovery-plan failover-unplanned \
  --resource-group myRG \
  --vault-name myRecoveryVault \
  --name myRecoveryPlan \
  --failover-direction PrimaryToRecovery

Commit et retour arrière

Après un basculement, les VMs récupérées dans la région secondaire sont dans un état de Commit en attente. Vous devez Commit le basculement pour confirmer que le site secondaire est désormais le site actif et que vous ne souhaitez pas revenir en arrière. Une fois le Commit effectué, vous pouvez configurer la réplication inversée pour protéger le site secondaire, puis effectuer ultérieurement un retour arrière vers la région Primary lorsque celle-ci aura été restaurée.

# Commit the failover:
az site-recovery recovery-plan commit \
  --resource-group myRG \
  --vault-name myRecoveryVault \
  --name myRecoveryPlan

# Then configure reverse replication to enable failback later

Rétablissement de la protection après un basculement

Après avoir effectué le Commit d’un basculement, les éléments répliqués dans la région Primary d’origine ne sont plus répliqués activement. Pour rétablir la protection, vous devez réactiver la protection des éléments : cela inverse le sens de la réplication afin que la nouvelle région Primary (anciennement secondaire) réplique vers la région Primary d’origine. Le rétablissement de la protection prend du temps et doit être lancé dès que la région Primary d’origine est de nouveau disponible.

Mesure du RTO dans les plans de récupération

Chaque étape d’un plan de récupération contribue au RTO total. Les éléments qui consomment généralement du temps sont notamment :

  • temps de démarrage des VMs (2 à 5 minutes par VM)
  • temps de préparation de l’application (initialisation du pool de connexions à la base de données, mise en cache)
  • propagation du DNS après des modifications d’adresses IP
  • temps d’attente pour l’approbation manuelle

Mesurez chaque étape lors des basculements de test et additionnez-les pour calculer votre RTO réel par rapport à votre objectif.

Automatisation des mises à jour DNS

Après un basculement, les VMs de la région secondaire ont des adresses IP différentes. Pour les applications qui exposent un nom DNS public, vous devez mettre à jour le DNS afin qu’il pointe vers les nouvelles adresses IP. Utilisez un runbook d’automatisation Azure comme action postérieure au basculement pour mettre à jour Azure DNS ou l’état de santé des points de terminaison de Traffic Manager afin de rediriger automatiquement le trafic — ce qui évite une étape manuelle susceptible de retarder votre RTO.

# Example: Update Azure DNS record in a runbook after failover:
# az network dns record-set a update \
#   --resource-group dnsRG \
#   --zone-name myapp.com \
#   --record-set-name '@' \
#   --set 'ARecords[0].ipv4Address=<new-secondary-ip>'

Surveillance de l’exécution du plan de récupération

Pendant un basculement, la vue Jobs du portail Azure dans le coffre Recovery Services affiche en temps réel la progression de chaque étape du plan de récupération. Vous pouvez voir quel groupe est en cours d’exécution, quelles VMs ont démarré correctement et si des scripts ou des actions manuelles sont en attente. La surveillance de cette vue permet à l’équipe de récupération d’intervenir rapidement en cas d’échec d’une étape.

Bonnes pratiques pour les plans de récupération

Principales bonnes pratiques pour les plans de récupération :

  • Gardez les groupes de petite taille (5 à 10 VMs) afin de limiter l’étendue de l’impact en cas d’échec d’un groupe
  • Utilisez des runbooks d’automatisation plutôt que des actions manuelles chaque fois que possible afin de réduire le RTO
  • Documentez le temps de démarrage prévu pour chaque groupe afin de pouvoir calculer le RTO
  • Exécutez un basculement de test au moins une fois par trimestre pour valider le plan
  • Examinez et mettez à jour le plan chaque fois que de nouvelles VMs sont ajoutées ou que l’architecture de l’application change

Vérification rapide

Vérifiez votre compréhension des concepts de Microsoft Azure Fundamentals (AZ-900) abordés dans cette leçon.

Récapitulatif de la leçon

Dans cette leçon, vous avez appris qu’un plan de récupération orchestre le basculement ordonné de plusieurs VMs, avec des actions avant et après chaque groupe ; qu’un basculement imprévu utilise le dernier point de contrôle de réplication, tandis qu’un basculement planifié n’entraîne aucune perte de données ; et qu’après un basculement, vous devez valider et reprotéger les ressources afin de rétablir la protection DR. Nous allons maintenant voir comment tester les plans DR sans affecter la production.

Questions Fréquemment Posées

La leçon « Plans de reprise et basculement automatisé » est-elle gratuite ?

Oui — le texte complet de « Plans de reprise et basculement automatisé » est gratuit à lire ici sur le web. Pour la pratiquer de manière interactive (un éditeur de code intégré et un tuteur IA 24/7) et déverrouiller le reste du cours Cloud & IT Cert Prep, passe à CoddyKit PRO. Le cours Cloud & IT Cert Prep comprend 4 leçons au total.

Qu'est-ce que j'apprendrai dans « Plans de reprise et basculement automatisé » ?

Créez un plan de reprise ASR qui séquence le basculement des VM entre les niveaux applicatifs, ajoutez des étapes d’approbation manuelle et incluez des scripts avant et après basculement. Tu pratiques Cloud & IT Cert Prep avec du code pratique que tu exécutes directement dans le navigateur, et un tuteur IA 24/7 répond à tes questions au fur et à mesure que tu avances dans la leçon.

Dois-je avoir de l'expérience pour commencer Cloud & IT Cert Prep ?

Aucune expérience préalable n'est requise. Cloud & IT Cert Prep sur CoddyKit est structuré pour les débutants jusqu'aux apprenants avancés, donc tu peux commencer ici ou depuis le début et avancer à ton rythme. Ceci est la leçon 2 sur 4.

Combien de temps prend la leçon « Plans de reprise et basculement automatisé » ?

La plupart des leçons CoddyKit prennent environ 5–10 minutes. Chacune est courte et interactive, tu progresses régulièrement et tu repiques exactement où tu t'es arrêté sur le web et l'app.

Peux-tu écrire et exécuter du code dans cette leçon Cloud & IT Cert Prep ?

Oui. Chaque leçon Cloud & IT Cert Prep inclut un éditeur de code intégré, tu écris et exécutes du vrai code directement dans ton navigateur et tu reçois des retours IA instantanés — aucune configuration locale requise.

Toutes les leçons de ce cours

  1. Définir les RTO, RPO et niveaux de reprise
  2. Plans de reprise et basculement automatisé
  3. Tester la DR sans impact
  4. DR pour les services PaaS
← Retour à Cloud & IT Cert Prep