Openshift : Échec de la LCM du cluster lors du redémarrage du nœud
Summary: Échec de la gestion du cycle de vie lors du redémarrage du nœud en raison d’un blocage du pod du contrôleur CSI et du pod du gestionnaire du dépôt.
This article applies to
This article does not apply to
This article is not tied to any specific product.
Not all product versions are identified in this article.
Symptoms
Échec LCM lors de la mise à niveau OCP ou du redémarrage du nœud, l’interface utilisateur de mise à jour a perdu l’accès.
Connectez-vous à OCP et exécutez la commande « oc get pods -n dell-acp » pour vérifier l’état des pods, recherchez un pod csi-vxflexos-controller dans l’état ImagePullBackOff et un pod mcp-depot-manager dans l’état ContainerCreating Par exemple :
exécutez la commande « oc logs <pod_name> -n dell-acp -c driver » pour vérifier les journaux du pod.
Exécutez la commande « oc describe pod <pod_name> -n dell-acp » pour vérifier le ContainerCreating mcp-depot-manager (dans l’exemple de capture d’écran ci-dessus, le nom du pod est mcp-depot-manager-5d5c7cbbb6-twqr5), il signale l’avertissement FailedMount comme suit :
Exécutez la commande « oc get nodes » pour vérifier l’état du nœud, il y a un nœud à l’état SchedulingDisabled, par exemple :
Connectez-vous à OCP et exécutez la commande « oc get pods -n dell-acp » pour vérifier l’état des pods, recherchez un pod csi-vxflexos-controller dans l’état ImagePullBackOff et un pod mcp-depot-manager dans l’état ContainerCreating Par exemple :
exécutez la commande « oc logs <pod_name> -n dell-acp -c driver » pour vérifier les journaux du pod.
- Dans le pod Running csi-vxflexos-controller, le journal indique qu’il tente d’acquérir le bail principal, par exemple :
mystic@mystic-vm :~$ OC logs csi-vxflexos-controller-7d9b97c659-q8d4n -n dell-acp -c driver
I0918 08:33:23.460955 1 leaderelection.go :248] attempting to acquire leader lease dell-acp/driver-csi-vxflexos-dellemc-com...
I0918 08:33:23.460955 1 leaderelection.go :248] attempting to acquire leader lease dell-acp/driver-csi-vxflexos-dellemc-com...
- Dans le pod ImagePullBackOff csi-vxflexos-controller, le journal indique qu’il a acquis avec succès le bail principal, par exemple :
mystic@mystic-vm :~$ OC logs csi-vxflexos-controller-7d9b97c659-4tn2v -n dell-acp -c driver
I0918 09:07:30.076298 1 leaderelection.go :248] Attempting to acquire leader lease dell-acp/driver-csi-vxflexos-dellemc-com...
I0918 09:07:46.074524 1 leaderelection.go :258] successfully acquired lease dell-acp/driver-csi-vxflexos-dellemc-com
time="2023-09-18T09:07:46Z » level=info msg="configured 69de1f95f50e390f » allSystemNames= endpoint="https://dellpowerflex.h01.com » isDefault=true nasName=0xc000489950 nfsAcls= password="******** » skipCertificateValidation=false systemID=69de1f95f50e390f user=admin
time="2023-09-18T09:07:46Z » level=info msg="fichier de configuration du pilote " file=/vxflexos-config-params/driver-config-params.yaml
time="2023-09-18T09:07:46Z » level=info msg="Read CSI_LOG_FORMAT from log configuration file » format=text
time="2023-09-18T09:07:46Z » level=info msg="Read CSI_LOG_LEVEL from log configuration file » fields.level=debug
time="2023-09-18T09:07:46Z » level=info msg="array configuration file » file=/vxflexos-config/config
time="2023-09-18T09:07:46Z » level=info msg="Exploration de toutes les baies. Nombre de baies : 1"
time="2023-09-18T09:07:46Z » level=info msg="default array is set to array ID : 69de1f95f50e390f"
time="2023-09-18T09:07:46Z » level=info msg="69de1f95f50e390f est la baie par défaut, ignorant la mise à jour du mappage VolumePrefixToSystems. \n"
time="2023-09-18T09:07:46Z » level=info msg="array 69de1f95f50e390f probed successfully"
time="2023-09-18T09:07:46Z » level=info msg="configured csi-vxflexos.dellemc.com » IsApproveSDCEnabled=false IsHealthMonitorEnabled=false IsQuotaEnabled=false IsSdcRenameEnabled=false MaxVolumesPerNode=0 allowRWOMultiPodAccess=false autoprobe=true externalAccess= mode=controller nfsAcls= privatedir=/dev/disk/csi-vxflexos sdcGUID= sdcPrefix= thickprovision=false
time="2023-09-18T09:07:46Z » level=info msg="identity service registered"
time="2023-09-18T09:07:46Z » level=info msg="controller service registered"
time="2023-09-18T09:07:46Z » level=info msg="Enregistrement de serveurs GRPC supplémentaires"time=
"2023-09-18T09:07:46Z » level=info msg=serving endpoint="unix:///var/run/csi/csi.sock »
I0918 09:07:30.076298 1 leaderelection.go :248] Attempting to acquire leader lease dell-acp/driver-csi-vxflexos-dellemc-com...
I0918 09:07:46.074524 1 leaderelection.go :258] successfully acquired lease dell-acp/driver-csi-vxflexos-dellemc-com
time="2023-09-18T09:07:46Z » level=info msg="configured 69de1f95f50e390f » allSystemNames= endpoint="https://dellpowerflex.h01.com » isDefault=true nasName=0xc000489950 nfsAcls= password="******** » skipCertificateValidation=false systemID=69de1f95f50e390f user=admin
time="2023-09-18T09:07:46Z » level=info msg="fichier de configuration du pilote " file=/vxflexos-config-params/driver-config-params.yaml
time="2023-09-18T09:07:46Z » level=info msg="Read CSI_LOG_FORMAT from log configuration file » format=text
time="2023-09-18T09:07:46Z » level=info msg="Read CSI_LOG_LEVEL from log configuration file » fields.level=debug
time="2023-09-18T09:07:46Z » level=info msg="array configuration file » file=/vxflexos-config/config
time="2023-09-18T09:07:46Z » level=info msg="Exploration de toutes les baies. Nombre de baies : 1"
time="2023-09-18T09:07:46Z » level=info msg="default array is set to array ID : 69de1f95f50e390f"
time="2023-09-18T09:07:46Z » level=info msg="69de1f95f50e390f est la baie par défaut, ignorant la mise à jour du mappage VolumePrefixToSystems. \n"
time="2023-09-18T09:07:46Z » level=info msg="array 69de1f95f50e390f probed successfully"
time="2023-09-18T09:07:46Z » level=info msg="configured csi-vxflexos.dellemc.com » IsApproveSDCEnabled=false IsHealthMonitorEnabled=false IsQuotaEnabled=false IsSdcRenameEnabled=false MaxVolumesPerNode=0 allowRWOMultiPodAccess=false autoprobe=true externalAccess= mode=controller nfsAcls= privatedir=/dev/disk/csi-vxflexos sdcGUID= sdcPrefix= thickprovision=false
time="2023-09-18T09:07:46Z » level=info msg="identity service registered"
time="2023-09-18T09:07:46Z » level=info msg="controller service registered"
time="2023-09-18T09:07:46Z » level=info msg="Enregistrement de serveurs GRPC supplémentaires"time=
"2023-09-18T09:07:46Z » level=info msg=serving endpoint="unix:///var/run/csi/csi.sock »
Exécutez la commande « oc describe pod <pod_name> -n dell-acp » pour vérifier le ContainerCreating mcp-depot-manager (dans l’exemple de capture d’écran ci-dessus, le nom du pod est mcp-depot-manager-5d5c7cbbb6-twqr5), il signale l’avertissement FailedMount comme suit :
Exécutez la commande « oc get nodes » pour vérifier l’état du nœud, il y a un nœud à l’état SchedulingDisabled, par exemple :
Cause
Si le pod csi-controller actif et mcp-depot-manager se trouvent sur le même nœud, lorsque LCM redémarre le nœud, csi-controller et depot-manager sont reprogrammés sur les nouveaux nœuds. Lors du démarrage du pod, csi-controller et depot-manager se heurtent à un blocage et ne peuvent pas démarrer.
Resolution
1. Exécutez la commande « oc get pods -n dell-acp |grep csi » pour identifier le nom du pod du pod de contrôleur CSI en mauvais état.
2. Exécutez la commande « oc delete pod <pod_name> -n dell-acp » pour supprimer le ou les pods identifiés.
Par exemple :
3. Patientez plusieurs minutes et exécutez la commande « oc get pods -n dell-acp » pour vous assurer que tous les pods sont à l’état En cours d’exécution. Si csi-controller pod ou mcp-depot-manager ne sont toujours pas en cours d’exécution, réessayez à l’étape ci-dessus.
4. Tant que tous les pods ne sont pas en cours d’exécution, réessayez LCM pour poursuivre la mise à niveau du cluster.
2. Exécutez la commande « oc delete pod <pod_name> -n dell-acp » pour supprimer le ou les pods identifiés.
Par exemple :
3. Patientez plusieurs minutes et exécutez la commande « oc get pods -n dell-acp » pour vous assurer que tous les pods sont à l’état En cours d’exécution. Si csi-controller pod ou mcp-depot-manager ne sont toujours pas en cours d’exécution, réessayez à l’étape ci-dessus.
4. Tant que tous les pods ne sont pas en cours d’exécution, réessayez LCM pour poursuivre la mise à niveau du cluster.
Article Properties
Article Number: 000217992
Article Type: Solution
Last Modified: 18 Sept 2026
Version: 4
Find answers to your questions from other Dell users
Support Services
Check if your device is covered by Support Services.