Aller au contenu
Tous les projets
AEDE2025

Traitement d'un incident cluster Hyper-V

Analyse d'une coupure en cascade de machines virtuelles causée par la perte d'un volume partagé.

Hyper-VCluster CSViSCSIAnalyse de journaux

Mon rôle

Investigation et rapport d'incident.

Le problème

Reconstituer la chronologie exacte d'une panne en cascade à partir des journaux, pour identifier la cause réelle et non le symptôme.

La démarche

  1. 01Reconstitution de la chronologie à partir des journaux cluster et stockage.
  2. 02Identification de la perte de connectivité iSCSI comme événement déclencheur.
  3. 03Mise en évidence de l'enchaînement suspension du volume CSV puis arrêt des machines virtuelles.

Le résultat

  • Rapport d'incident professionnel remis au prestataire d'infrastructure.
  • Recommandations sur la résilience du chemin de stockage.