오픈시프트: 하나의 컨트롤 플레인 노드에서 전원 주기를 수행한 후 클러스터가 작동하지 않습니다.

요약: 하나의 컨트롤 플레인 노드가 정상적으로 종료되지 않고 전원이 켜진 후 "준비되지 않음" 상태가 되어 클러스터가 작동하지 않습니다.

이 문서는 다음에 적용됩니다. 이 문서는 다음에 적용되지 않습니다. 이 문서는 특정 제품과 관련이 없습니다. 모든 제품 버전이 이 문서에 나와 있는 것은 아닙니다.

증상

한 제어 플레인 노드의 전원을 직접 껐다가 켭니다. 노드가 부팅된 후 클러스터가 복구되지 않습니다.
UI 페이지에 오류 또는 빈 정보가 표시됩니다. 예:
image.png

image.png

원인

하나의 컨트롤 플레인 노드의 전원을 직접 껐다 켤 수 없습니다. 이는 재해 복구 시나리오입니다.
컨트롤 플레인 노드가 정상적으로 종료되지 않으면 CSI(Container Storage Interface) 드라이버가 볼륨을 자동으로 분리하지 않으므로 포드가 "Container Creating" 상태가 됩니다. 비정상 종료 후 컨트롤 플레인 노드가 부팅되면 컨트롤 플레인 노드 전원을 껐다 켠 후 depo 관리자 포드가 실행 중 상태가 아닌 동안 도커 이미지 로컬 캐시가 손실되고 depo manager에서 검색을 시도하므로 컨트롤 플레인 노드가 "준비되지 않음" 상태로 전환되고 클러스터가 작동하지 않습니다.

해결

비정상 노드 종료 후 CSI 볼륨을 분리하려면 아래 지침을 따르십시오.

1. 노드가 비정상으로 감지되면 작업자 노드를 종료합니다.
2. 다음 명령을 실행하고 상태가 NotReady인지 확인하여 노드가 종료되었는지 확인합니다
oc get node <node name>
중요: 노드가 완전히 종료되지 않은 경우 노드를 오염시키지 마십시오. 노드가 여전히 작동 중이고 taint가 적용된 경우 파일 시스템 손상이 발생할 수 있습니다.

3. 다음 명령을 실행하여 해당 노드 오브젝트를 오염시킵니다.
oc adm taint node <node name> node.kubernetes.io/out-of-service=nodeshutdown:NoExecute
4. 노드를 재시작합니다.
5. 다음 명령을 실행하여 taint를 제거합니다.
oc adm taint node <node name> node.kubernetes.io/out-of-service-

참고: 위 명령 <에서 노드 이름> = 비정상 종료 노드의 이름

해당 제품

APEX Cloud Platform for Red Hat OpenShift
문서 속성
문서 번호: 000217678
문서 유형: Solution
마지막 수정 시간: 18 9월 2026
버전:  4
다른 Dell 사용자에게 질문에 대한 답변 찾기
지원 서비스
디바이스에 지원 서비스가 적용되는지 확인하십시오.