OpenShift: Klynge LCM mislyktes under omstart av noden

Summary: LCM mislyktes under omstart av noden på grunn av at CSI-kontrollerpodden og depotadministratorpodden gikk i vranglås.

This article applies to This article does not apply to This article is not tied to any specific product. Not all product versions are identified in this article.

Symptoms

LCM mislyktes under OCP-oppgradering eller omstart av node, oppdateringsgrensesnittet mistet tilgangen.

Logg på OCP kjør kommandoen "oc get pods -n dell-acp" for å sjekke pods-status, finn en csi-vxflexos-controllerpod er i ImagePullBackOff-status og en mcp-depot-managerpod er i ContainerCreateing-status. For eksempel:


image.png
Kjør kommandoen "oc logs <pod_name> -n dell-acp -c driver" for å sjekke podloggene.
  • I kontrollkapselen som kjører csi-vxflexos-kontrolleren, viser loggen at den prøver å skaffe lederleie, for eksempel:
mystic@mystic-vm:~$ oc logs csi-vxflexos-controller-7d9b97c659-q8d4n-n dell-acp-c driver
I0918 08:33:23.460955 1 leaderelection.go:248] forsøker å kjøpe leder lease dell-acp/driver-csi-vxflexos-dellemc-com...
 
  • I ImagePullBackOff csi-vxflexos-controller pod viser loggen en vellykket ervervet lederleieavtale, for eksempel:
mystic@mystic-vm:~$ oc logs csi-vxflexos-controller-7d9b97c659-4tn2v -n dell-acp-c driver
I0918 09:07:30.076298 1 leaderelection.go:248] Forsøker å kjøpe leder lease dell-ACP/driver-csi-vxflexos-dellemc-com ...
I0918 09:07:46.074524 1 leaderelection.go:258] successfully acquired lease dell-acp/driver-csi-vxflexos-dellemc-com
time="2023-09-18T09:07:46Z" level=info msg="configured 69de1f95f50e390f" allSystemNames= endpoint="https://dellpowerflex.h01.com" isDefault=true nasName=0xc000489950 nfsAcls= password="********" skipCertificateValidation=false systemID=69de1f95f50e390f user=admin
tid="2023-09-18T09:07:46Z" level=info msg="driver configuration file " file=/vxflexos-config-params/driver-config-params.yaml
time="2023-09-18T09:07:46Z" level=info msg="Read CSI_LOG_FORMAT from log configuration file" format=text
time="2023-09-18T09:07:46Z" level=info msg="Read CSI_LOG_LEVEL from log configuration file" fields.level=debug
time="2023-09-18T09:07:46Z" level=info msg="array configuration file" file=/vxflexos-config/config
tid = "2023-09-18T09:07:46Z" level = info msg = "Probing all arrays. Antall matriser: 1"
time="2023-09-18T09:07:46Z" level=info msg="default array is set to array ID: 69de1f95f50e390f"
time="2023-09-18T09:07:46Z" level=info msg="69de1f95f50e390f er standardmatrisen, og hopper over kartoppdatering av VolumePrefixToSystems. \n"
time="2023-09-18T09:07:46Z" level=info msg="array 69de1f95f50e390f probed successfully"
time="2023-09-18T09:07:46Z" level=info msg="configured csi-vxflexos.dellemc.com" IsApproveSDCEnabled=false IsHealthMonitorEnabled=false IsQuotaEnabled=false IsSdcRenameEnabled=false MaxVolumesPerNode=0 allowRWOMultiPodAccess=false autoprobe=true externalAccess= mode=controller nfsAcls= privatedir=/dev/disk/csi-vxflexos, sdcGUID= sdcPrefix= thickprovision=
falsetid="2023-09-18T09:07:46Z" level=info msg="identity service registered"
time="2023-09-18T09:07:46Z" level=info msg="controller service registered"
time="2023-09-18T09:07:46Z" level=info msg="Registering additional GRPC servers"
time="2023-09-18T09:07:46Z" level=info msg=serving endpoint="unix:///var/run/csi/csi.sock"


Kjør kommandoen "oc describe pod <pod_name> -n dell-acp" for å sjekke kommandoen ContainerCreating mcp-depot-manager (i eksempelskjermbildet ovenfor er pod-navnet mcp-depot-manager-5d5c7cbbb6-twqr5), rapporterer den FailedMount-advarsel som nedenfor:

image.png
Kjør kommandoen "oc get nodes" for å sjekke nodestatus, det er en node i SchedulingDisabled-status, for eksempel:
image.png
 

Cause

Hvis den aktive csi-controllerpodden og mcp-depot-manager befinner seg på samme node, og når LCM starter noden på nytt, flyttes csi-controller og depot-manager til nye noder. Under oppstart av podden går csi-kontrolleren og depotlederen i vranglås og kan ikke starte opp.

Resolution

1. Kjør kommandoen "oc get pods -n dell-acp |grep csi" for å identifisere pod-navnet til CSI-kontrollerpodden med dårlig status.
2. Kjør kommandoen "oc delete pod <pod_name> -n dell-acp" for å slette den identifiserte poden/podene.
For eksempel:
image.png

3. Vent i flere minutter og kjør kommandoen "oc get pods -n dell-acp" for å sikre at alle podene har statusen Running. Hvis det fortsatt er csi-controller pod eller mcp-depot-manager som ikke kjører, kan du prøve på nytt ovenfor trinnet igjen.
4. Før alle podene er i Running-status, kan du prøve LCM på nytt for å fortsette klyngeoppgraderingen.
Article Properties
Article Number: 000217992
Article Type: Solution
Last Modified: 18 Sept 2026
Version:  4
Find answers to your questions from other Dell users
Support Services
Check if your device is covered by Support Services.