Openshift 事件代码:1030NODE0005

Résumé: 文件系统的剩余空间不足 3%。

Cet article concerne Cet article ne concerne pas Cet article n’est associé à aucun produit spécifique. Toutes les versions du produit ne sont pas identifiées dans cet article.

Symptômes

节点的文件系统变满可能会产生广泛的负面影响。此问题可能会导致计划到该节点的任何或所有应用程序出现从性能降级到完全无法运行的任何情况。

根据涉及的节点和文件系统,此问题可能会对群集的稳定性构成严重威胁。

Cause

NodeFilesystemAlmostOutOfSpace 警报类似于 NodeFilesystemSpaceFillingUp 警报,但它使用简单的静态阈值,而不是基于文件系统在一定时间内将满的预测。

当文件系统中剩余 5% 的空间时,会在警告级别触发此警报,当剩余 3% 的空间时,会在严重级别触发此警报。

Résolution

诊断:
在控制面板上研究文件系统使用情况的最新趋势。有时,文件系统中的周期性写入和清理模式可能会导致线性预测算法触发误报。

使用 Linux作系统工具和实用程序调查哪些目录占用了文件系统中最多的空间。问题是否为异常情况(例如进程无法自行清理并使用大量空间)?或者这个问题似乎与有机增长有关?

为了帮助您进行诊断,请在 PromQL 中观察以下指标(在 OCP Web 控制台上执行查询):观察→指标→运行查询):

node_filesystem_free_bytes

然后,检查 mountpoint 警报的标签。

缓解措施:

如果 mountpoint 标签为 /开始, /sysroot 或 /var,请删除未使用的映像以解决此问题:

1.通过访问节点文件系统调试节点:
$ NODE_NAME=<instance label from alert>
$ oc -n default debug node/$NODE_NAME
$ chroot /host


2.删除悬空图像:
$ podman images -q -f dangling=true | xargs --no-run-if-empty podman rmi

3.删除未使用的映像:
$ podman images | grep -v -e registry.redhat.io -e “quay.io/openshift” -e registry.access.redhat.com -e docker-registry.usersys.redhat.com -edocker-registry.ops.rhcloud.com -e rhmap |xargs --no-run-if-empty podman rmi 2>/dev/null

4.退出调试:
$ exit
$ exit

支持:
如果上述所有步骤都无法解决问题,请联系 Dell EMC 技术支持以进行进一步调查。

Produits concernés

APEX Cloud Platform for Red Hat OpenShift
Propriétés de l’article
Numéro d’article: 000217410
Type d’article: Solution
Dernière modification: 19 févr. 2026
Version:  3
Trouvez des réponses à vos questions auprès d’autres utilisateurs Dell
Services de support
Vérifiez si votre appareil est couvert par les services de support.