Código de evento de OpenShift: 1038NODO0009
Sommaire: El reloj no se sincroniza.
Symptômes
Cause
NodeClockNotSynchronising La alerta se activa cuando un nodo se ve afectado por problemas con el servidor NTP para ese nodo. Por ejemplo, esta alerta podría activarse cuando los certificados se rotan para el servidor de API en un nodo y los certificados fallan en la validación debido a una hora no válida.Résolution
Diagnóstico
Para diagnosticar el problema subyacente, inicie un pod de depuración en el nodo afectado y compruebe el chronyd del servidor NMC:
OC -N nodo< de depuración predeterminado/affected_node_name> systemctl status chronyd |
Mitigación
-
Si
chronydEl servicio falla o se detiene, inícielo:systemctl start chonyd
Si el servicio chronyd está listo, reinícielo
systemctl restart chronyd
Si la solicitud en
chronydSe inicia o reinicia correctamente, el servicio ajusta el reloj y muestra algo similar a la siguiente salida de ejemplo:Oct 18 19:39:36 ip-100-67-47-86 chronyd[2055318]: Reloj del sistema incorrecto por 16422.107473 segundos, se inició el ajuste Oct 19 00:13:18 ip-100-67-47-86 chronyd[2055318]: El reloj del sistema se incrementó en 16422.107473 segundos
-
Verifique que la carpeta
chronydEl servicio está en ejecución:systemctl status chronyd
-
Verifique mediante PromQL:
min_over_time(node_timex_sync_status[5 m]) node_timex_maxerror_seconds
node_timex_sync_statusDevoluciones1si NTP funciona correctamente, o0si NTP no funciona correctamente.node_timex_maxerror_secondsindica cuántos segundos se está retrasando NTP.La alerta se activa cuando el valor de
min_over_time(node_timex_sync_status[5m])es igual a0y el valor denode_timex_maxerror_secondses mayor o igual que16.
Soporte
Si todos los pasos anteriores no pueden resolver el problema, póngase en contacto con el soporte técnico de Dell EMC para una investigación más detallada.