Código do evento Openshift: 1038NODE0009
Sommaire: O relógio não está sincronizando.
Symptômes
Cause
NodeClockNotSynchronising O alerta é acionado quando um nó é afetado por problemas com o servidor NTP para esse nó. Por exemplo, esse alerta pode ser acionado quando os certificados são girados para o servidor de API em um nó e os certificados falham na validação devido a um horário inválido.Résolution
Diagnóstico
Para diagnosticar o problema subjacente, inicie um pod de depuração no nó afetado e verifique o chronyd do servidor do NMC:
oc -n nó de depuração padrão/<affected_node_name> chronyd de status systemctl |
Mitigação
-
Se a
chronydO serviço está falhando ou parado, inicie-o:systemctl start chonyd
Se o serviço chronyd estiver pronto, reinicie-o
systemctl reiniciar chronyd
Se a solicitação do
chronydInicia ou reinicia com sucesso, o serviço ajusta o relógio e exibe algo semelhante ao seguinte exemplo de saída:18 de outubro 19:39:36 ip-100-67-47-86 chronyd[2055318]: Relógio do sistema errado por 16422.107473 segundos, ajuste iniciado 19 de outubro 00:13:18 ip-100-67-47-86 chronyd[2055318]: O relógio do sistema foi escalonado por 16422.107473 segundos
-
Verifique se a pasta
chronydO serviço está em execução:chronyd de status systemctl
-
Verifique usando o PromQL:
min_over_time(node_timex_sync_status[5m]) node_timex_maxerror_seconds
node_timex_sync_statusRetorna1se o NTP estiver funcionando corretamente, ou0se o NTP não estiver funcionando corretamente.node_timex_maxerror_secondsIndica quantos segundos o NTP está ficando para trás.O alerta é acionado quando o valor de
min_over_time(node_timex_sync_status[5m])Equals0e o valor paranode_timex_maxerror_secondsé maior que ou igual a16.
Serviço de suporte
Se todas as etapas acima não puderem resolver o problema, entre em contato com o suporte técnico da Dell EMC para investigar mais.