AEDE2025
Traitement d'un incident cluster Hyper-V
Analyse d'une coupure en cascade de machines virtuelles causée par la perte d'un volume partagé.
Hyper-VCluster CSViSCSIAnalyse de journaux
Mon rôle
Investigation et rapport d'incident.
Le problème
Reconstituer la chronologie exacte d'une panne en cascade à partir des journaux, pour identifier la cause réelle et non le symptôme.
La démarche
- 01Reconstitution de la chronologie à partir des journaux cluster et stockage.
- 02Identification de la perte de connectivité iSCSI comme événement déclencheur.
- 03Mise en évidence de l'enchaînement suspension du volume CSV puis arrêt des machines virtuelles.
Le résultat
- Rapport d'incident professionnel remis au prestataire d'infrastructure.
- Recommandations sur la résilience du chemin de stockage.