Código de evento de OpenShift: 1030NODO0005

Résumé: El sistema de archivos tiene menos de un 3 % de espacio restante.

Cet article concerne Cet article ne concerne pas Cet article n’est associé à aucun produit spécifique. Toutes les versions du produit ne sont pas identifiées dans cet article.

Symptômes

El hecho de que el sistema de archivos de un nodo se llene puede tener un impacto negativo generalizado. Este problema puede hacer que cualquiera o todas las aplicaciones programadas para ese nodo experimenten desde un rendimiento degradado hasta quedar completamente inoperables.

Según el nodo y el sistema de archivos involucrados, este problema puede representar una amenaza crítica para la estabilidad del clúster.

Cause

La alerta NodeFilesystemAlmostOutOfSpace es similar a la alerta NodeFilesystemSpaceFillingUp, pero en lugar de basarse en una predicción de que un sistema de archivos se completará en un período de tiempo determinado, utiliza umbrales estáticos simples.

Esta alerta se activa en un nivel de advertencia cuando queda un 5 % de espacio en el sistema de archivos y en un nivel crítico cuando hay un 3 % de espacio.

Résolution

Diagnóstico:
estudie las tendencias recientes del uso del sistema de archivos en un tablero. En ocasiones, un patrón periódico de escritura y limpieza en el sistema de archivos puede hacer que el algoritmo de predicción lineal active una alerta falsa.

Utilice las herramientas y utilidades del sistema operativo Linux para investigar qué directorios utilizan la mayor cantidad de espacio en el sistema de archivos. ¿El problema se debe a una condición irregular, como un proceso que no se limpia y utiliza una gran cantidad de espacio? ¿O el problema parece estar relacionado con el crecimiento orgánico?

Para facilitar el diagnóstico, observe la siguiente métrica en PromQL (ejecute la consulta en la consola web de OCP: Observe → Metrics → Run queries):

node_filesystem_free_bytes

A continuación, compruebe el mountpoint para la alerta.

Mitigación:

Si mountpoint La etiqueta es //sysroot o /var, elimine las imágenes no utilizadas para resolver el problema:

1.Depurar el nodo accediendo al sistema de archivos del nodo:
$ NODE_NAME=<etiqueta de instancia de alert$
> oc -n default debug node/$NODE_NAME
$ chroot /host


2.Eliminar imágenes colgantes:$ podman images -q -f dangling=true | xargs --no-run-if-empty podman rmi

3.Eliminar imágenes no utilizadas:
$ podman images | grep -v -e registry.redhat.io -e "quay.io/openshift" -e registry.access.redhat.com -e docker-registry.usersys.redhat.com
-e docker-registry.ops.rhcloud.com -e rhmap | xargs --no-run-if-empty podman rmi 2>/dev/null

4.Exit debug:
$ exit
$ exit

Soporte:
si todos los pasos anteriores no pueden resolver el problema, comuníquese con el soporte técnico de Dell EMC para realizar una investigación más detallada.

Produits concernés

APEX Cloud Platform for Red Hat OpenShift
Propriétés de l’article
Numéro d’article: 000217410
Type d’article: Solution
Dernière modification: 19 févr. 2026
Version:  3
Trouvez des réponses à vos questions auprès d’autres utilisateurs Dell
Services de support
Vérifiez si votre appareil est couvert par les services de support.