Comment limiter le risque d'indisponibilité d'une VM ?

Christophe Smagghe 0 Points de réputation
2026-06-30T13:35:51.16+00:00

Bonjour,

Depuis une semaine, l'une de nos VM est redéployée (indisponibilité de 10 minutes à 1 heure selon le temps nécessaire à Azure pour détecter le problème) quasiment tous les jours.

Au final, nous avons un Redeploying due to host failure (Unplanned)

Y'a-t-il un moyen d'améliorer ce point, par exemple en changeant de type de VM et en espérant être redéployer sur des serveurs plus résistants ?

Machines virtuelles Azure
Machines virtuelles Azure

Service Azure utilisé pour provisionner des machines virtuelles Windows et Linux.


1 réponse

Trier par : Le plus utile
  1. Prasad Chaganti 785 Points de réputation Personnel externe de Microsoft Corporation Modérateur
    2026-06-30T20:38:53.2133333+00:00

    Bonjour Christophe Smagghe,

    Merci pour votre message et pour le partage des détails concernant les redéploiements fréquents de la machine virtuelle dus à des défaillances de l’hôte.

    1. Compréhension du comportement actuel

    L’événement « Redéploiement en raison d’une défaillance de l’hôte (Non planifiée) » indique que l’hôte physique sous-jacent Azure a rencontré un problème, et qu’Azure a automatiquement déplacé votre machine virtuelle vers un hôte sain.

    Cela fait partie du mécanisme d’auto-réparation de la plateforme Azure visant à maintenir la disponibilité du service. Cependant, pendant ce processus, la machine virtuelle peut subir une interruption (généralement de quelques minutes à des durées plus longues selon le temps de détection et de récupération).

    1. Peut-on éviter cela en changeant le type de VM ?

    Changer la taille/le type de la VM ne garantit pas un placement sur un matériel plus résilient et n’élimine pas la possibilité de défaillances d’hôte.

    Azure gère automatiquement le placement de l’infrastructure, et toutes les tailles de VM suivent les mêmes principes de fiabilité sous-jacents.

    Par conséquent, changer uniquement la taille de la VM ne permettra pas de résoudre le problème.

    1. Approches recommandées pour réduire l’impact (Bonnes pratiques)

    Afin de minimiser l’impact de ces défaillances d’hôte non planifiées, Microsoft recommande d’adopter une architecture hautement disponible plutôt que de s’appuyer sur une seule VM.

    Option 1 : Utiliser les Zones de disponibilité (recommandé)

    • Déployer les VM sur plusieurs centres de données physiques au sein d’une même région
    • Chaque zone dispose d’une alimentation, d’un refroidissement et d’un réseau indépendants
    • Si une zone est affectée, les autres restent disponibles

    Option 2 : Utiliser des groupes de disponibilité (Availability Sets)

    • Répartit les VM sur plusieurs domaines de panne (séparation matérielle) et domaines de mise à jour
    • Protège contre les défaillances d’hôte similaires à celles que vous avez rencontrées

    Option 3 : Utiliser plusieurs VM derrière un équilibreur de charge

    • Exécuter au moins 2 VM en parallèle
    • Les placer derrière un Azure Load Balancer ou Application Gateway
    • Garantit que l’application reste disponible même si une VM est redéployée

    Option 4 : Envisager les groupes de machines virtuelles identiques (VM Scale Sets)

    • Gère automatiquement plusieurs instances de VM
    • Offre une résilience et des capacités de mise à l’échelle intégrées
    1. Recommandation clé pour votre scénario

    Puisque votre charge de travail repose actuellement sur une seule VM, elle est intrinsèquement vulnérable aux interruptions en cas de défaillance d’hôte.

    Pour réduire significativement, voire éliminer les interruptions :

    • Passer à une architecture multi-VM (Zones ou Groupes de disponibilité)
    • Associer cela à un équilibrage de charge pour le basculement
    1. Remarques supplémentaires
    • Des défaillances d’hôte occasionnelles sont normales dans des environnements cloud à grande échelle
    • Azure gère automatiquement la récupération (comme observé dans votre cas)
    • L’objectif est de concevoir pour la résilience plutôt que d’éviter complètement les défaillances d’hôte
    1. Résumé de la réponse à votre question
    • Changer le type de VM → N’améliore pas la résilience
    • Utiliser les Zones / Groupes de disponibilité → Solution recommandée
    • Utiliser plusieurs VM → Meilleure approche pour éviter les interruptions

    Remarque : Ce contenu est traduit depuis l’anglais ; veuillez ignorer toute erreur grammaticale.

    Cette réponse vous a-t-elle été utile?

    0 commentaires Aucun commentaire

Votre réponse

Les réponses peuvent être marquées comme « Acceptées » par l’auteur(e) de la question et « Recommandées » par les modérateurs, ce qui aide les utilisateurs à savoir que la réponse a résolu le problème de l’auteur(e).