Openshift: Klaster LCM nie powiódł się podczas ponownego uruchamiania węzła

Podsumowanie: LCM nie powiodło się podczas ponownego uruchamiania węzła z powodu zakleszczenia zasobnika kontrolera CSI i zasobnika menedżera magazynu.

Ten artykuł dotyczy Ten artykuł nie dotyczy Ten artykuł nie jest powiązany z żadnym konkretnym produktem. Nie wszystkie wersje produktu zostały zidentyfikowane w tym artykule.

Objawy

Interfejs użytkownika aktualizacji utracił dostęp podczas aktualizacji OCP lub ponownego uruchomienia węzła.

Zaloguj się OCP, uruchom polecenie "oc get pods -n dell-acp", aby sprawdzić stan zasobników. Znajdź jedną zasobnik csi-vxflexos-controller w stanie ImagePullBackOff , a jeden zasobnik mcp-depot-manager ma stan ContainerCreate . Przykład:


image.png
uruchom polecenie "oc logs <pod_name> -n dell-acp -c driver", aby sprawdzić dzienniki zasobników.
  • W zasobniku Running csi-vxflexos-controller dziennik pokazuje, że próbuje on uzyskać dzierżawę lidera, na przykład:
mystic@mystic-vm:~$ oc logs csi-vxflexos-controller-7d9b97c659-q8d4n -n dell-acp -c driver
I0918 08:33:23.460955 1 leaderelection.go:248] Próba przejęcia Leader Lease Dell-acp/driver-csi-vxflexos-dellemc-com...
 
  • W zasobniku ImagePullBackOff csi-vxflexos-controller dziennik pokazuje, że pomyślnie uzyskano dzierżawę lidera, na przykład:
mystic@mystic-vm:~$ oc logs csi-vxflexos-controller-7d9b97c659-4tn2v -n dell-acp -c driver
I0918 09:07:30.076298 1 leaderelection.go:248] Próba przejęcia Leader Lease Dell-acp/driver-csi-vxflexos-dellemc-com...
I0918 09:07:46.074524 1 leaderelection.go:258] pomyślnie nabyta dzierżawa dell-acp/driver-csi-vxflexos-dellemc-com
time="2023-09-18T09:07:46Z" level=info msg="skonfigurowane 69de1f95f50e390f" allSystemNames= endpoint="https://dellpowerflex.h01.com" isDefault=true nasName=0xc000489950 nfsAcls= password="********" skipCertificateValidation=false systemID=69de1f95f50e390f user=admin
time="2023-09-18T09:07:46Z" level=info msg="plik konfiguracyjny sterownika " file=/vxflexos-config-params/driver-config-params.yaml
time="2023-09-18T09:07:46Z" level=info msg="Odczyt CSI_LOG_FORMAT z pliku konfiguracyjnego dziennika" format=text
time="2023-09-18T09:07:46Z" level=info msg="Odczyt CSI_LOG_LEVEL z pliku konfiguracyjnego dziennika" fields.level=
debug time="2023-09-18T09:07:46Z" level=info msg="plik konfiguracyjny macierzy" file=/vxflexos-config/config
time="2023-09-18T09:07:46Z" level=info msg="Sondowanie wszystkich tablic. Liczba macierzy: 1"
time="2023-09-18T09:07:46Z" level=info msg="domyślna tablica jest ustawiona na identyfikator macierzy: 69de1f95f50e390f"
time="2023-09-18T09:07:46Z" level=info msg="69de1f95f50e390f jest macierzą domyślną, pomijając aktualizację mapy VolumePrefixToSystems. \n"
time="2023-09-18T09:07:46Z" level=info msg="tablica 69de1f95f50e390f sondowana pomyślnie"
time="2023-09-18T09:07:46Z" level=info msg="skonfigurowany csi-vxflexos.dellemc.com" IsApproveSDCEnabled=false IsHealthMonitorEnabled=false IsQuotaEnabled=false IsSdcRenameEnabled=false MaxVolumesPerNode=0 allowRWOMultiPodAccess=false autoprobe=true externalAccess= mode=kontroler nfsAcls= privatedir=/dev/disk/csi-vxflexos sdcGUID= sdcPrefix= thickprovision=false
time="2023-09-18T09:07:46Z" level=info msg="zarejestrowana usługa tożsamości"time=
"2023-09-18T09:07:46Z" level=info msg="zarejestrowana usługa kontrolera"time=
"2023-09-18T09:07:46Z" level=info msg="Rejestracja dodatkowych serwerów GRPC"
time="2023-09-18T09:07:46Z" level=info msg=serving endpoint="unix:///var/run/csi/csi.sock"


Uruchom polecenie "oc describe pod <pod_name> -n dell-acp", aby sprawdzić ContainerCreating mcp-depot-manager (na powyższym przykładowym zrzucie ekranu nazwa zasobnika to mcp-depot-manager-5d5c7cbbb6-twqr5), zgłasza ostrzeżenie o niepowodzeniu, jak poniżej:

image.png
Uruchom polecenie "oc get nodes", aby sprawdzić stan węzła, w stanie SchedulingDisabled znajduje się jeden węzeł, na przykład:
image.png
 

Przyczyna

Jeśli aktywny zasobnik csi-controller i mcp-depot-manager znajdują się w tym samym węźle, po ponownym uruchomieniu węzła LCM, csi-controller i depot-manager zostaną przełożone na nowe węzły. Podczas uruchamiania zasobnika csi-controller i depot-manager napotykają blokadę i nie mogą się uruchomić.

Rozwiązanie

1. Uruchom polecenie "oc get pods -n dell-acp |grep csi", aby zidentyfikować nazwę zasobnika kontrolera CSI o nieprawidłowym stanie.
2. Uruchom polecenie "oc delete pod <pod_name> -n dell-acp", aby usunąć zidentyfikowane zasobniki.
Na przykład:
image.png

3. Odczekaj kilka minut i uruchom polecenie "oc get pods -n dell-acp", aby upewnić się, że wszystkie zasobniki mają stan Uruchomione. Jeśli nadal nie są uruchomione zasobniki kontrolera csi-controller lub mcp-depot-manager, spróbuj ponownie w powyższym kroku.
4. Dopóki wszystkie zasobniki nie będą w stanie Uruchomione, ponów próbę LCM, aby kontynuować uaktualnianie klastra.
Właściwości artykułu
Numer artykułu: 000217992
Typ artykułu: Solution
Ostatnia modyfikacja: 18 wrz 2026
Wersja:  4
Znajdź odpowiedzi na swoje pytania u innych użytkowników produktów Dell
Usługi pomocy technicznej
Sprawdź, czy Twoje urządzenie jest objęte usługą pomocy technicznej.