Openshift: Klaster LCM nie powiódł się podczas ponownego uruchamiania węzła

Summary: LCM nie powiodło się podczas ponownego uruchamiania węzła z powodu zakleszczenia zasobnika kontrolera CSI i zasobnika menedżera magazynu.

Acest articol se aplică pentru Acest articol nu se aplică pentru Acest articol nu este legat de un produs specific. Acest articol nu acoperă toate versiunile de produs existente.

Symptoms

Interfejs użytkownika aktualizacji utracił dostęp podczas aktualizacji OCP lub ponownego uruchomienia węzła.

Zaloguj się OCP, uruchom polecenie "oc get pods -n dell-acp", aby sprawdzić stan zasobników. Znajdź jedną zasobnik csi-vxflexos-controller w stanie ImagePullBackOff , a jeden zasobnik mcp-depot-manager ma stan ContainerCreate . Przykład:


image.png
uruchom polecenie "oc logs <pod_name> -n dell-acp -c driver", aby sprawdzić dzienniki zasobników.
  • W zasobniku Running csi-vxflexos-controller dziennik pokazuje, że próbuje on uzyskać dzierżawę lidera, na przykład:
mystic@mystic-vm:~$ oc logs csi-vxflexos-controller-7d9b97c659-q8d4n -n dell-acp -c driver
I0918 08:33:23.460955 1 leaderelection.go:248] Próba przejęcia Leader Lease Dell-acp/driver-csi-vxflexos-dellemc-com...
 
  • W zasobniku ImagePullBackOff csi-vxflexos-controller dziennik pokazuje, że pomyślnie uzyskano dzierżawę lidera, na przykład:
mystic@mystic-vm:~$ oc logs csi-vxflexos-controller-7d9b97c659-4tn2v -n dell-acp -c driver
I0918 09:07:30.076298 1 leaderelection.go:248] Próba przejęcia Leader Lease Dell-acp/driver-csi-vxflexos-dellemc-com...
I0918 09:07:46.074524 1 leaderelection.go:258] pomyślnie nabyta dzierżawa dell-acp/driver-csi-vxflexos-dellemc-com
time="2023-09-18T09:07:46Z" level=info msg="skonfigurowane 69de1f95f50e390f" allSystemNames= endpoint="https://dellpowerflex.h01.com" isDefault=true nasName=0xc000489950 nfsAcls= password="********" skipCertificateValidation=false systemID=69de1f95f50e390f user=admin
time="2023-09-18T09:07:46Z" level=info msg="plik konfiguracyjny sterownika " file=/vxflexos-config-params/driver-config-params.yaml
time="2023-09-18T09:07:46Z" level=info msg="Odczyt CSI_LOG_FORMAT z pliku konfiguracyjnego dziennika" format=text
time="2023-09-18T09:07:46Z" level=info msg="Odczyt CSI_LOG_LEVEL z pliku konfiguracyjnego dziennika" fields.level=
debug time="2023-09-18T09:07:46Z" level=info msg="plik konfiguracyjny macierzy" file=/vxflexos-config/config
time="2023-09-18T09:07:46Z" level=info msg="Sondowanie wszystkich tablic. Liczba macierzy: 1"
time="2023-09-18T09:07:46Z" level=info msg="domyślna tablica jest ustawiona na identyfikator macierzy: 69de1f95f50e390f"
time="2023-09-18T09:07:46Z" level=info msg="69de1f95f50e390f jest macierzą domyślną, pomijając aktualizację mapy VolumePrefixToSystems. \n"
time="2023-09-18T09:07:46Z" level=info msg="tablica 69de1f95f50e390f sondowana pomyślnie"
time="2023-09-18T09:07:46Z" level=info msg="skonfigurowany csi-vxflexos.dellemc.com" IsApproveSDCEnabled=false IsHealthMonitorEnabled=false IsQuotaEnabled=false IsSdcRenameEnabled=false MaxVolumesPerNode=0 allowRWOMultiPodAccess=false autoprobe=true externalAccess= mode=kontroler nfsAcls= privatedir=/dev/disk/csi-vxflexos sdcGUID= sdcPrefix= thickprovision=false
time="2023-09-18T09:07:46Z" level=info msg="zarejestrowana usługa tożsamości"time=
"2023-09-18T09:07:46Z" level=info msg="zarejestrowana usługa kontrolera"time=
"2023-09-18T09:07:46Z" level=info msg="Rejestracja dodatkowych serwerów GRPC"
time="2023-09-18T09:07:46Z" level=info msg=serving endpoint="unix:///var/run/csi/csi.sock"


Uruchom polecenie "oc describe pod <pod_name> -n dell-acp", aby sprawdzić ContainerCreating mcp-depot-manager (na powyższym przykładowym zrzucie ekranu nazwa zasobnika to mcp-depot-manager-5d5c7cbbb6-twqr5), zgłasza ostrzeżenie o niepowodzeniu, jak poniżej:

image.png
Uruchom polecenie "oc get nodes", aby sprawdzić stan węzła, w stanie SchedulingDisabled znajduje się jeden węzeł, na przykład:
image.png
 

Cause

Jeśli aktywny zasobnik csi-controller i mcp-depot-manager znajdują się w tym samym węźle, po ponownym uruchomieniu węzła LCM, csi-controller i depot-manager zostaną przełożone na nowe węzły. Podczas uruchamiania zasobnika csi-controller i depot-manager napotykają blokadę i nie mogą się uruchomić.

Resolution

1. Uruchom polecenie "oc get pods -n dell-acp |grep csi", aby zidentyfikować nazwę zasobnika kontrolera CSI o nieprawidłowym stanie.
2. Uruchom polecenie "oc delete pod <pod_name> -n dell-acp", aby usunąć zidentyfikowane zasobniki.
Na przykład:
image.png

3. Odczekaj kilka minut i uruchom polecenie "oc get pods -n dell-acp", aby upewnić się, że wszystkie zasobniki mają stan Uruchomione. Jeśli nadal nie są uruchomione zasobniki kontrolera csi-controller lub mcp-depot-manager, spróbuj ponownie w powyższym kroku.
4. Dopóki wszystkie zasobniki nie będą w stanie Uruchomione, ponów próbę LCM, aby kontynuować uaktualnianie klastra.
Proprietăți articol
Article Number: 000217992
Article Type: Solution
Ultima modificare: 18 sept. 2026
Version:  4
Găsiți răspunsuri la întrebările dvs. de la alți utilizatori Dell
Servicii de asistență
Verificați dacă dispozitivul dvs. este acoperit de serviciile de asistență.