PowerMax : Activez le mode maintenance pour le basculement, la validation et l’annulation NDM lors du basculement du cluster
Résumé: Les migrations sans interruption (NDM) suppriment les chemins de disque du serveur pendant les commandes Cutover, Commit ou Cancel. Dans les environnements d’hôte ou de nœud Microsoft Cluster Failover (MCF), le contrôle d’intégrité périodique du disque peut cibler un chemin en cours de suppression, ce qui déclenche le basculement du cluster sur incident par MCF. ...
Symptômes
Comportement observé pendant les opérations NDM
Les problèmes suivants peuvent se produire lors de l’exécution des commandes de migration sans interruption (NDM) dans un environnement de basculement de cluster Microsoft :
- Le cluster Microsoft bascule pendant la commande NDM Cutover (mode NDM Passthrough).
- Le cluster Microsoft bascule pendant la commande NDM Cancel.
- Le cluster Microsoft bascule pendant la commande NDM Commit (mode NDM Metro IA).
Cause
Cause première du basculement du cluster pendant les opérations NDM
Le cluster de basculement Microsoft exécute régulièrement un bilan de santé du disque. Lors des commandes de basculement, d’annulation ou de validation de la migration sans interruption (NDM), le système de stockage supprime les chemins de disque de l’hôte. Si le processus de bilan de santé tente d’envoyer des E/S vers un chemin qui est en cours de suppression, la vérification échoue, ce qui déclenche un basculement automatique du cluster.
- Le bilan de santé du cluster s’exécute toutes les quelques secondes et s’attend à ce que tous les chemins configurés soient disponibles.
- Les commandes NDM Cutover, Cancel et Commit suppriment les chemins de disque sur le serveur dans le cadre de la migration.
- Les E/S simultanées entre le contrôle d’intégrité et un chemin en cours de suppression entraînent l’échec du bilan de santé.
- L’échec du bilan de santé est interprété par Microsoft Cluster Failover comme une panne de disque, ce qui entraîne le basculement du nœud actif.
Résolution
Empêcher le basculement du cluster pendant les opérations NDM
Procédure étape par étape
1. Identifiez toutes les ressources du cluster (volumes) qui résident sur le nœud qui exécutera la commande NDM Cutover, Commit ou Cancel.
2. Placez chaque ressource identifiée en mode maintenance (suspendez la ressource) avant de démarrer l’opération NDM.
# Example PowerShell command to suspend a cluster resource Suspend-ClusterResource -Name "Cluster Disk 1"
3. Vérifiez que les ressources sont à l’état Suspended .
Get-ClusterResource -Name "Cluster Disk 1" | Format-Table Name, State
4. Exécutez la commande NDM requise (basculement, validation ou annulation) sur la baie PowerMax/VMAX.
5. Une fois la commande NDM exécutée avec succès, rétablissez le fonctionnement normal de chaque ressource.
# Example PowerShell command to resume a cluster resource Resume-ClusterResource -Name "Cluster Disk 1"
6. Vérifiez que les ressources sont revenues à l’état Online .
Get-ClusterResource -Name "Cluster Disk 1" | Format-Table Name, State
Vérification
- Vérifiez l’état de la ressource du cluster dans le gestionnaire du cluster de basculement ou via PowerShell. toutes les ressources doivent s’afficher Online et non Failed .
- Passez en revue le journal des événements Windows pour rechercher les événements de basculement de cluster pendant l’opération de migration sans interruption. Aucun ne doit être présent.
- Vérifiez que la migration NDM signale la réussite dans la console de gestion Dell EMC.