PowerScale: un clúster en una relación de SyncIQ informa más espacio en disco utilizado que el otro clúster.
Сводка: En este artículo, se explica por qué un clúster en una relación de SyncIQ (origen o destino) puede informar más espacio en disco utilizado que el otro clúster. Ambos clústeres deben mostrar el mismo espacio en disco utilizado. Los trabajos de SyncIQ están actualizados. ...
Симптомы
Un clúster PowerScale en una relación SyncIQ (fuente o objetivo) tiene más espacio en disco utilizado que el otro clúster PowerScale. Ambos clústeres deben tener espacio utilizado de manera idéntica.
Por ejemplo, como se ve con el 'isi status' comando:
El clúster de destino muestra que 349T utilizó el almacenamiento del disco duro (HDD):
Cluster Name: TARGET-POWERSCALE Cluster Health: [ ATTN] Data Reduction: 1.00 : 1 Storage Efficiency: 0.73 : 1 Cluster Storage: HDD SSD Storage Size: 417.2T (432.5T Raw) 5.7T (5.7T Raw) VHS Size: 15.4T Used: 348.6T (84%) 669.1G (11%) ==================> Avail: 68.6T (16%) 5.1T (89%) Health Throughput (bps) HDD Storage SSD Storage ID |IP Address |DASR | In Out Total| Used / Size |Used / Size ---+---------------+-----+-----+-----+-----+-----------------+----------------- 9|1099.2.6 | OK | 1.0M| 488k| 1.5M|87.2T/ 104T( 84%)| 167G/ 1.4T( 11%) 10|10.99.2.7 | OK | 820M| 4.2M| 824M|87.2T/ 104T( 84%)| 167G/ 1.4T( 11%) 11|10.99.2.8 | OK | 678M| 2.9M| 681M|87.2T/ 104T( 84%)| 167G/ 1.4T( 11%) 12|10.99.2.9 | OK | 0| 123k| 123k|87.1T/ 104T( 84%)| 167G/ 1.4T( 11%) ---+---------------+-----+-----+-----+-----+-----------------+----------------- Cluster Totals: | 1.5G| 7.7M| 1.5G| 349T/ 417T( 84%)| 669G/ 5.7T( 11%) Health Fields: D = Down, A = Attention, S = Smartfailed, R = Read-Only
La fuente solo tiene 286 TB de almacenamiento de HDD utilizado:
Cluster Name: SOURCE-POWERSCALE Cluster Health: [ ATTN] Data Reduction: 1.00 : 1 Storage Efficiency: 0.71 : 1 Cluster Storage: HDD SSD Storage Size: 417.2T (432.5T Raw) 5.7T (5.7T Raw) VHS Size: 15.4T Used: 285.5T (68%) 721.9G (12%) ========> Avail: 131.7T (32%) 5.0T (88%) Health Throughput (bps) HDD Storage SSD Storage ID |IP Address |DASR | In Out Total| Used / Size |Used / Size ---+---------------+-----+-----+-----+-----+-----------------+----------------- 9|10.99.3.13 | OK | 290M| 9.9M| 300M|71.4T/ 104T( 68%)| 180G/ 1.4T( 12%) 10|10.99.3.11 | OK | 324M| 832M| 1.2G|71.4T/ 104T( 68%)| 181G/ 1.4T( 12%) 11|10.99.3.12 | OK | 194M| 8.4M| 202M|71.4T/ 104T( 68%)| 181G/ 1.4T( 12%) 12|10.99.3.10 | OK | 1.9M| 2.0M| 3.8M|71.4T/ 104T( 68%)| 181G/ 1.4T( 12%) ---+---------------+-----+-----+-----+-----+-----------------+----------------- Cluster Totals: | 809M| 852M| 1.7G| 286T/ 417T( 68%)| 722G/ 5.7T( 12%)
Причина
Las causas comunes de las diferencias de espacio entre los clústeres en una relación de SyncIQ son las siguientes:
archivos de sistema grandes o registros de auditoría que residen dentro /ifs/.ifsvar (más común)
--diferencias en el tamaño
de las instantáneas--diferencias en los niveles
de protección--el trabajo de recolección no se ejecuta en un clúster, por lo que no se liberan bloques de discos huérfanos.
--grandes archivos/carpetas relacionados con el soporte que se encuentran dentro de /ifs/data/Isilon_Support
Разрешение
Suponiendo que todos los trabajos de SyncIQ están actualizados con la replicación, compruebe lo siguiente:
1) A menudo, el clúster que utiliza más espacio tiene archivos de sistema o registros de auditoría grandes que residen dentro de /ifs/.ifsvar.
En cada clúster, desde una sesión de pantalla (ya que el comando puede tardar mucho en aparecer), ejecute lo siguiente:
# du -sh /ifs/.ifsvar
Ejecute ese comando en cada clúster.
El soporte de PowerScale ha visto que este es el culpable en el pasado, especialmente debido a los grandes registros de auditoría.
Compruebe el /ifs/.ifsvar/audit y los siguientes subdirectorios,
Where <nodeXXX> is the node ID (for example node001):/ifs/.ifsvar/audit/logs/.
/ifs/.ifsvar/audit/logs/<nodeXXX>
/ifs/.ifsvar/audit/logs/<nodeXXX>/protocol
Si es necesario, elimine los archivos de auditoría siguiendo el artículo:
KB 000167091Powerscale: Cómo eliminar archivos de registro de auditoría
2) confirme que no haya diferencias en el nivel de protección entre los dos clústeres.
Clúster activo:
isi stat -p -q -v
Registros:
# cat <base log set>/local/isi_stat-p
Dell Technologies también puede comprobar la diskpools niveles de protección con un comando interno con asistencia de soporte.
3) Confirme que no haya una gran diferencia con el uso de instantáneas entre los dos clústeres mediante la ejecución del siguiente comando en cada clúster:
# isi snapshot usage
4) En el clúster que informa más espacio utilizado, compruebe si hay grandes archivos o carpetas relacionados con el soporte dentro de /ifs/data/Isilon_Support:
# du -so /ifs/data/Isilon_Support
5) Si aún está atascado, el siguiente paso es comprobar cuándo se ejecutó por última vez la recopilación en cada clúster.
(Nota: Es importante tener en cuenta que "MultiScan" no siempre ejecuta el trabajo de Collect).
Este trabajo de recolección libera los bloques de disco obsoletos en el clúster y, a menudo, puede ser la causa de que un clúster muestre más espacio en disco utilizado que el otro. Una forma rápida de hacerlo es comprobar el /var/log/messages en los nodos para la última vez que la recopilación se ejecutó correctamente, por ejemplo:
# grep Collect /var/log/messages|grep Succeed
# zgrep Collect /var/log/messages*
6) Si aún está atascado, ejecute FSAnalyze y utilice InsightIQ para ver qué carpeta está ocupando más espacio en el clúster con más espacio utilizado.
'isi stat heat' en el clúster que está más lleno también puede proporcionar algunas pistas sobre dónde se están produciendo las escrituras nuevas.