Openshift: Cluster-LCM ist während des Node-Neustarts fehlgeschlagen
Summary: LCM ist während des Node-Neustarts fehlgeschlagen, da der CSI-Controller-Pod und der Depot-Manager-Pod in einen Deadlock geraten sind.
This article applies to
This article does not apply to
This article is not tied to any specific product.
Not all product versions are identified in this article.
Symptoms
LCM ist während des OCP-Upgrades oder Node-Neustarts fehlgeschlagen, die Update-Benutzeroberfläche hat den Zugriff verloren.
Melden Sie sich an, OCP führen Sie den Befehl "oc get pods -n dell-acp" aus, um den Pod-Status zu überprüfen, einen csi-vxflexos-controller-Pod im Status ImagePullBackOff und einen mcp-depot-manager-Pod im Status ContainerCreating zu finden. Beispiel:
Führen Sie den Befehl "oc logs <pod_name> -n dell-acp -c driver" aus, um die Pod-Protokolle zu überprüfen.
Führen Sie den Befehl "oc describe pod <pod_name> -n dell-acp" aus, um den ContainerCreating mcp-depot-manager zu überprüfen (im Beispiel-Screenshot oben lautet der Pod-Name mcp-depot-manager-5d5c7cbbb6-twqr5), es wird eine FailedMount-Warnung wie folgt ausgegeben
:Führen Sie den Befehl "oc get nodes" aus, um den Node-Status zu überprüfen. Es gibt einen Node im Status SchedulingDisabled, z. B.:
Melden Sie sich an, OCP führen Sie den Befehl "oc get pods -n dell-acp" aus, um den Pod-Status zu überprüfen, einen csi-vxflexos-controller-Pod im Status ImagePullBackOff und einen mcp-depot-manager-Pod im Status ContainerCreating zu finden. Beispiel:
Führen Sie den Befehl "oc logs <pod_name> -n dell-acp -c driver" aus, um die Pod-Protokolle zu überprüfen.
- Im ausgeführten csi-vxflexos-controller-Pod zeigt das Protokoll an, dass versucht wird, ein Leader-Leasing zu erwerben, z. B.:
mystic@mystic-VM:~$ OC-Protokolle csi-vxflexos-controller-7d9b97c659-q8d4n -n Dell-ACP -C-Treiber
I0918 08:33:23.460955 1 leaderelection.go:248] Es wird versucht, eine Führungskraft zu erwerben Lease dell-acp/driver-csi-vxflexos-dellemc-com...
I0918 08:33:23.460955 1 leaderelection.go:248] Es wird versucht, eine Führungskraft zu erwerben Lease dell-acp/driver-csi-vxflexos-dellemc-com...
- Im "ImagePullBackOff csi-vxflexos-controller"-Pod zeigt das Protokoll an, dass das Leader-Leasing erfolgreich abgerufen wurde, z. B.:
mystic@mystic-VM: ~$ OC-Protokolle csi-vxflexos-controller-7d9b97c659-4TN2V -n Dell-ACP -C-Treiber
I0918 09:07:30.076298 1 leaderelection.go:248] Es wird versucht, ein führendes Unternehmen zu leasen dell-acp/driver-csi-vxflexos-dellemc-com...
I0918 09:07:46.074524 1 leaderelection.go:258] Leasing erfolgreich erworben dell-acp/driver-csi-vxflexos-dellemc-com
time="2023-09-18T09:07:46Z" level=info msg="configured 69de1f95f50e390f" allSystemNames= endpoint="https://dellpowerflex.h01.com" isDefault=true nasName=0xc000489950 nfsAcls= password="********" skipCertificateValidation=false systemID=69de1f95f50e390f user=admin
time="2023-09-18T09:07:46Z" level=info msg="Treiberkonfigurationsdatei" file=/vxflexos-config-params/driver-config-params.yaml
time="2023-09-18T09:07:46Z" level=info msg="CSI_LOG_FORMAT aus Protokollkonfigurationsdatei lesen" format=text
time="2023-09-18T09:07:46Z" level=info msg="CSI_LOG_LEVEL aus Protokollkonfigurationsdatei lesen" fields.level=debug
time="2023-09-18T09:07:46Z" level=info msg="Array-Konfigurationsdatei" file=/vxflexos-config/config
time="2023-09-18T09:07:46Z" level=info msg="Alle Arrays werden geprüft. Anzahl der Arrays: 1"
time="2023-09-18T09:07:46Z" level=info msg="Standard-Array ist auf Array-ID eingestellt: 69de1f95f50e390f"
time="2023-09-18T09:07:46Z" level=info msg="69de1f95f50e390f ist das Standardarray, das das VolumePrefixToSystems-Zuordnungsupdate überspringt. \n"
time="2023-09-18T09:07:46Z" level=info msg="array 69de1f95f50e390f probed successfully"
time="2023-09-18T09:07:46Z" level=info msg="konfiguriert csi-vxflexos.dellemc.com" IsApproveSDCEnabled=false IsHealthMonitorEnabled=false IsQuotaEnabled=false IsSdcRenameEnabled=false MaxVolumesPerNode=0 allowRWOMultiPodAccess=false autoprobe=true externalAccess= mode=Controller nfsAcls= privatedir=/dev/disk/csi-vxflexos sdcGUID= sdcPrefix= thickprovision=false
time="2023-09-18T09:07:46Z" level=info msg="Identitätsservice registriert"
time="2023-09-18T09:07:46Z" level=info msg="Controller-Service registriert"
time="2023-09-18T09:07:46Z" level=info msg="Registrieren zusätzlicher GRPC-Server"
time="2023-09-18T09:07:46Z" level=info msg=serving endpoint="unix:///var/run/csi/csi.sock"
I0918 09:07:30.076298 1 leaderelection.go:248] Es wird versucht, ein führendes Unternehmen zu leasen dell-acp/driver-csi-vxflexos-dellemc-com...
I0918 09:07:46.074524 1 leaderelection.go:258] Leasing erfolgreich erworben dell-acp/driver-csi-vxflexos-dellemc-com
time="2023-09-18T09:07:46Z" level=info msg="configured 69de1f95f50e390f" allSystemNames= endpoint="https://dellpowerflex.h01.com" isDefault=true nasName=0xc000489950 nfsAcls= password="********" skipCertificateValidation=false systemID=69de1f95f50e390f user=admin
time="2023-09-18T09:07:46Z" level=info msg="Treiberkonfigurationsdatei" file=/vxflexos-config-params/driver-config-params.yaml
time="2023-09-18T09:07:46Z" level=info msg="CSI_LOG_FORMAT aus Protokollkonfigurationsdatei lesen" format=text
time="2023-09-18T09:07:46Z" level=info msg="CSI_LOG_LEVEL aus Protokollkonfigurationsdatei lesen" fields.level=debug
time="2023-09-18T09:07:46Z" level=info msg="Array-Konfigurationsdatei" file=/vxflexos-config/config
time="2023-09-18T09:07:46Z" level=info msg="Alle Arrays werden geprüft. Anzahl der Arrays: 1"
time="2023-09-18T09:07:46Z" level=info msg="Standard-Array ist auf Array-ID eingestellt: 69de1f95f50e390f"
time="2023-09-18T09:07:46Z" level=info msg="69de1f95f50e390f ist das Standardarray, das das VolumePrefixToSystems-Zuordnungsupdate überspringt. \n"
time="2023-09-18T09:07:46Z" level=info msg="array 69de1f95f50e390f probed successfully"
time="2023-09-18T09:07:46Z" level=info msg="konfiguriert csi-vxflexos.dellemc.com" IsApproveSDCEnabled=false IsHealthMonitorEnabled=false IsQuotaEnabled=false IsSdcRenameEnabled=false MaxVolumesPerNode=0 allowRWOMultiPodAccess=false autoprobe=true externalAccess= mode=Controller nfsAcls= privatedir=/dev/disk/csi-vxflexos sdcGUID= sdcPrefix= thickprovision=false
time="2023-09-18T09:07:46Z" level=info msg="Identitätsservice registriert"
time="2023-09-18T09:07:46Z" level=info msg="Controller-Service registriert"
time="2023-09-18T09:07:46Z" level=info msg="Registrieren zusätzlicher GRPC-Server"
time="2023-09-18T09:07:46Z" level=info msg=serving endpoint="unix:///var/run/csi/csi.sock"
Führen Sie den Befehl "oc describe pod <pod_name> -n dell-acp" aus, um den ContainerCreating mcp-depot-manager zu überprüfen (im Beispiel-Screenshot oben lautet der Pod-Name mcp-depot-manager-5d5c7cbbb6-twqr5), es wird eine FailedMount-Warnung wie folgt ausgegeben
:Führen Sie den Befehl "oc get nodes" aus, um den Node-Status zu überprüfen. Es gibt einen Node im Status SchedulingDisabled, z. B.:
Cause
Wenn sich der aktive csi-controller-pod und der mcp-depot-manager auf demselben Node befinden, werden der csi-controller und der depot-manager beim Neustart von LCM auf neue Nodes verschoben. Während des Pod-Startvorgangs geraten CSI-Controller und Depot-Manager in einen Deadlock und können nicht gestartet werden.
Resolution
1. Führen Sie den Befehl "oc get pods -n dell-acp |grep csi" aus, um den Pod-Namen des CSI-Controller-Pods mit fehlerhaftem Status zu ermitteln.
2. Führen Sie den Befehl "oc delete pod <pod_name> -n dell-acp" aus, um den/die identifizierten Pod/Pods zu löschen.
Beispiel:
3. Warten Sie einige Minuten und führen Sie den Befehl "oc get pods -n dell-acp" aus, um sicherzustellen, dass sich alle Pods im Status "Running" befinden. Wenn der csi-controller-pod oder der mcp-depot-manager immer noch nicht ausgeführt werden, wiederholen Sie den obigen Schritt erneut.
4. Bis alle Pods den Status "Running" haben, wiederholen Sie LCM, um das Clusterupgrade fortzusetzen.
2. Führen Sie den Befehl "oc delete pod <pod_name> -n dell-acp" aus, um den/die identifizierten Pod/Pods zu löschen.
Beispiel:
3. Warten Sie einige Minuten und führen Sie den Befehl "oc get pods -n dell-acp" aus, um sicherzustellen, dass sich alle Pods im Status "Running" befinden. Wenn der csi-controller-pod oder der mcp-depot-manager immer noch nicht ausgeführt werden, wiederholen Sie den obigen Schritt erneut.
4. Bis alle Pods den Status "Running" haben, wiederholen Sie LCM, um das Clusterupgrade fortzusetzen.
Article Properties
Article Number: 000217992
Article Type: Solution
Last Modified: 18 Sept 2026
Version: 4
Find answers to your questions from other Dell users
Support Services
Check if your device is covered by Support Services.