Dell EMC VxRail:VSAN 群集节点扩展测试期间无法访问虚拟机 (VM)
Summary: 在 VSAN 群集节点扩展任务期间,生产虚拟机在数小时内无法访问,导致数据不可用。
This article applies to
This article does not apply to
This article is not tied to any specific product.
Not all product versions are identified in this article.
Symptoms
在 VSAN 群集节点扩展任务期间,生产虚拟机在数小时内无法访问,导致数据不可用。
在节点扩展测试期间,三个节点在 VxRail 扩展任务后退出维护模式。非生产虚拟机会迁移到这些节点。
同时,DRS(设置为完全自动化)开始移动工作负载。
此迁移的虚拟机上也存在网络配置问题。
为了解决虚拟机上的网络配置问题,已将非生产虚拟机迁移回现有节点。
在此期间,客户观察到虚拟机变得无法访问,从而导致数据不可用 (DU)。
2021-08-23T16:46:03.444+08:00 INFO vsan-mgmt[08861] [VsanHealthSummaryLogUtil::P rintHealthResult opID=noOpId] Cluster VxRail-Virtual-SAN-Cluster Overall Health : red
组数据运行状况:红色
测试对象运行状况:红色
概述:Health/Objects ObjectCount
(Healthy, 413), (Datamove, 13), (Reduced-Availability-with-no-rebuild-delay-timer, 84),
2021-08-23T16:50:23.911+08:00 INFO vsan-mgmt[08861] [VsanHealthSummaryLogUtil::P rintHealthResult opID=noOpId] Cluster VxRail-Virtual-SAN-Cluster Overall Health : red
Group data health : red
Test objecthealth health : red
Overview:Health/Objects ObjectCount
(healthy, 364), (datamove, 4), (reduced-availability-with-active-rebuild, 1), (reduced-availability-with-no-rebuild-delay-timer, 131), (inaccessible, 11),
2021-08-23T16:53:41.081+08:00 INFO vsan-mgmt[08861] [VsanHealthSummaryLogUtil::P rintHealthResult opID=noOpId] Cluster VxRail-Virtual-SAN-Cluster Overall Health : red
Group data health : red
Test objecthealth health : red
Overview:Health/Objects ObjectCount
(healthy, 318), (datamove, 2), (reduced-availability-with-active-rebuild, 3), (reduced-availability-with-no-rebuild-delay-timer, 158), (inaccessible, 29),
测试节点通过无数据迁移模式
进入维护模式2021-08-23T07:14: 28.848 Z:[UserLevelCorrelator] 12121590652us:[esx.audit.maintenancemode.exited] 主机已退出维护模式。
2021-08-23T08:52:28.717 Z:[UserLevelCorrelator] 18001459300us:[esx.audit.maintenancemode.entering] 主机已开始进入维护模式。
2021-08-23T08:52:30.346 Z:[UserLevelCorrelator] 18003088181us:[esx.audit.maintenancemode.entered] 主机已进入维护模式。
2021-08-23T11:48:19Z bootstop:主机正在重新启动
2021-08-23T11:52:22.478 Z:[UserLevelCorrelator] 28795220410us:[esx.audit.maintenancemode.exited] 主机已退出维护模式。
mode 0
2021-08-23T08:52:18.681Z info clomd[2167677] [Originator@6876] CLOMWhatIfEntityDecom:在实体 611fefdd-3160-e572-eb47-78ac444cf5b0 上启动 decom,模式 0,ensureDurability 0 wipeDisk 0,实体类型为 CdbObjectNode,使用静态 dedupRatio 1.000000,假设原因 0,dedupScope 0,加密 0
在所有这些新添加的节点退出维护模式之前,无法访问的生产虚拟机不会恢复。
2021-08-23T19:52:45.831+08:00 INFO vsan-mgmt[08861] [VsanHealthSummaryLogUtil::P rintHealthResult opID=noOpId] Cluster VxRail-Virtual-SAN-Cluster
整体运行状况:红色
组数据运行状况:红色
测试对象运行状况:红色
概述:Health/Objects ObjectCount
(healthy, 474), (datamove, 10), (reduced-availability-with-active-rebuild, 14), (reduced-availability-with-no-rebuild, 3), (inaccessible, 11),
在节点扩展测试期间,三个节点在 VxRail 扩展任务后退出维护模式。非生产虚拟机会迁移到这些节点。
同时,DRS(设置为完全自动化)开始移动工作负载。
此迁移的虚拟机上也存在网络配置问题。
为了解决虚拟机上的网络配置问题,已将非生产虚拟机迁移回现有节点。
在此期间,客户观察到虚拟机变得无法访问,从而导致数据不可用 (DU)。
2021-08-23T16:46:03.444+08:00 INFO vsan-mgmt[08861] [VsanHealthSummaryLogUtil::P rintHealthResult opID=noOpId] Cluster VxRail-Virtual-SAN-Cluster Overall Health : red
组数据运行状况:红色
测试对象运行状况:红色
概述:Health/Objects ObjectCount
(Healthy, 413), (Datamove, 13), (Reduced-Availability-with-no-rebuild-delay-timer, 84),
2021-08-23T16:50:23.911+08:00 INFO vsan-mgmt[08861] [VsanHealthSummaryLogUtil::P rintHealthResult opID=noOpId] Cluster VxRail-Virtual-SAN-Cluster Overall Health : red
Group data health : red
Test objecthealth health : red
Overview:Health/Objects ObjectCount
(healthy, 364), (datamove, 4), (reduced-availability-with-active-rebuild, 1), (reduced-availability-with-no-rebuild-delay-timer, 131), (inaccessible, 11),
2021-08-23T16:53:41.081+08:00 INFO vsan-mgmt[08861] [VsanHealthSummaryLogUtil::P rintHealthResult opID=noOpId] Cluster VxRail-Virtual-SAN-Cluster Overall Health : red
Group data health : red
Test objecthealth health : red
Overview:Health/Objects ObjectCount
(healthy, 318), (datamove, 2), (reduced-availability-with-active-rebuild, 3), (reduced-availability-with-no-rebuild-delay-timer, 158), (inaccessible, 29),
测试节点通过无数据迁移模式
进入维护模式2021-08-23T07:14: 28.848 Z:[UserLevelCorrelator] 12121590652us:[esx.audit.maintenancemode.exited] 主机已退出维护模式。
2021-08-23T08:52:28.717 Z:[UserLevelCorrelator] 18001459300us:[esx.audit.maintenancemode.entering] 主机已开始进入维护模式。
2021-08-23T08:52:30.346 Z:[UserLevelCorrelator] 18003088181us:[esx.audit.maintenancemode.entered] 主机已进入维护模式。
2021-08-23T11:48:19Z bootstop:主机正在重新启动
2021-08-23T11:52:22.478 Z:[UserLevelCorrelator] 28795220410us:[esx.audit.maintenancemode.exited] 主机已退出维护模式。
mode 0
2021-08-23T08:52:18.681Z info clomd[2167677] [Originator@6876] CLOMWhatIfEntityDecom:在实体 611fefdd-3160-e572-eb47-78ac444cf5b0 上启动 decom,模式 0,ensureDurability 0 wipeDisk 0,实体类型为 CdbObjectNode,使用静态 dedupRatio 1.000000,假设原因 0,dedupScope 0,加密 0
在所有这些新添加的节点退出维护模式之前,无法访问的生产虚拟机不会恢复。
2021-08-23T19:52:45.831+08:00 INFO vsan-mgmt[08861] [VsanHealthSummaryLogUtil::P rintHealthResult opID=noOpId] Cluster VxRail-Virtual-SAN-Cluster
整体运行状况:红色
组数据运行状况:红色
测试对象运行状况:红色
概述:Health/Objects ObjectCount
(healthy, 474), (datamove, 10), (reduced-availability-with-active-rebuild, 14), (reduced-availability-with-no-rebuild, 3), (inaccessible, 11),
Cause
发生这种情况的原因是将节点置于维护模式且“无数据迁移”。
测试期间的生产虚拟机迁移到 RAID 5 下的新节点。当将节点置于维护模式以调整虚拟机的网络配置时,现有群集节点失去了对生产虚拟机数据块的控制。
测试期间的生产虚拟机迁移到 RAID 5 下的新节点。当将节点置于维护模式以调整虚拟机的网络配置时,现有群集节点失去了对生产虚拟机数据块的控制。
Resolution
使用 RAID 5 保护模式时,当将节点置于维护模式时,请使用“Ensure accessibility”。
检查是否不存在现有的 VSAN 重新同步数据活动,并且 DRS 未在运行。
如果使用 vSphere 7.x,请检查 Skyline 运行状况和数据和/或 VSAN 对象运行状况。如果存在任何错误,请勿继续进行任何活动。
检查是否不存在现有的 VSAN 重新同步数据活动,并且 DRS 未在运行。
如果使用 vSphere 7.x,请检查 Skyline 运行状况和数据和/或 VSAN 对象运行状况。如果存在任何错误,请勿继续进行任何活动。
Affected Products
VMware VSANArticle Properties
Article Number: 000191096
Article Type: Solution
Last Modified: 16 Feb 2026
Version: 3
Find answers to your questions from other Dell users
Support Services
Check if your device is covered by Support Services.