PowerScale: Um cluster em um relacionamento com o SyncIQ relata mais espaço em disco usado do que o outro cluster.
Сводка: Este artigo explica por que um cluster em um relacionamento do SyncIQ (origem ou destino) pode relatar mais espaço em disco usado do que o outro cluster. Ambos os clusters devem exibir de forma idêntica o espaço em disco usado. Os trabalhos do SyncIQ estão atualizados. ...
Симптомы
Um cluster do PowerScale em uma relação do SyncIQ (origem ou destino) tem mais espaço em disco usado do que o outro cluster do PowerScale. Ambos os clusters devem ter espaço usado de maneira idêntica.
Exemplo, como visto com o 'isi status' command:
Target cluster mostra que o 349T usou armazenamento de disco rígido (HDD):
Cluster Name: TARGET-POWERSCALE Cluster Health: [ ATTN] Data Reduction: 1.00 : 1 Storage Efficiency: 0.73 : 1 Cluster Storage: HDD SSD Storage Size: 417.2T (432.5T Raw) 5.7T (5.7T Raw) VHS Size: 15.4T Used: 348.6T (84%) 669.1G (11%) ==================> Avail: 68.6T (16%) 5.1T (89%) Health Throughput (bps) HDD Storage SSD Storage ID |IP Address |DASR | In Out Total| Used / Size |Used / Size ---+---------------+-----+-----+-----+-----+-----------------+----------------- 9|1099.2.6 | OK | 1.0M| 488k| 1.5M|87.2T/ 104T( 84%)| 167G/ 1.4T( 11%) 10|10.99.2.7 | OK | 820M| 4.2M| 824M|87.2T/ 104T( 84%)| 167G/ 1.4T( 11%) 11|10.99.2.8 | OK | 678M| 2.9M| 681M|87.2T/ 104T( 84%)| 167G/ 1.4T( 11%) 12|10.99.2.9 | OK | 0| 123k| 123k|87.1T/ 104T( 84%)| 167G/ 1.4T( 11%) ---+---------------+-----+-----+-----+-----+-----------------+----------------- Cluster Totals: | 1.5G| 7.7M| 1.5G| 349T/ 417T( 84%)| 669G/ 5.7T( 11%) Health Fields: D = Down, A = Attention, S = Smartfailed, R = Read-Only
A origem tem apenas armazenamento de disco rígido 286T usado:
Cluster Name: SOURCE-POWERSCALE Cluster Health: [ ATTN] Data Reduction: 1.00 : 1 Storage Efficiency: 0.71 : 1 Cluster Storage: HDD SSD Storage Size: 417.2T (432.5T Raw) 5.7T (5.7T Raw) VHS Size: 15.4T Used: 285.5T (68%) 721.9G (12%) ========> Avail: 131.7T (32%) 5.0T (88%) Health Throughput (bps) HDD Storage SSD Storage ID |IP Address |DASR | In Out Total| Used / Size |Used / Size ---+---------------+-----+-----+-----+-----+-----------------+----------------- 9|10.99.3.13 | OK | 290M| 9.9M| 300M|71.4T/ 104T( 68%)| 180G/ 1.4T( 12%) 10|10.99.3.11 | OK | 324M| 832M| 1.2G|71.4T/ 104T( 68%)| 181G/ 1.4T( 12%) 11|10.99.3.12 | OK | 194M| 8.4M| 202M|71.4T/ 104T( 68%)| 181G/ 1.4T( 12%) 12|10.99.3.10 | OK | 1.9M| 2.0M| 3.8M|71.4T/ 104T( 68%)| 181G/ 1.4T( 12%) ---+---------------+-----+-----+-----+-----+-----------------+----------------- Cluster Totals: | 809M| 852M| 1.7G| 286T/ 417T( 68%)| 722G/ 5.7T( 12%)
Причина
Estas são as causas comuns para as diferenças de espaço entre clusters em uma relação do SyncIQ:--
grandes arquivos do sistema ou logs de auditoria que residem no /ifs/.ifsvar (mais comum)
--diferenças no tamanho
dos snapshots--diferenças nos níveis
de proteção--O trabalho de coleta não está em execução em um cluster, portanto, não libera blocos de disco órfãos.
--grandes arquivos / pastas relacionados ao suporte que vivem dentro /ifs/data/Isilon_Support
Разрешение
Supondo que todos os trabalhos do syncIQ estejam atualizados com a replicação, verifique o seguinte:
1) Geralmente, o cluster que usa mais espaço tem arquivos grandes do sistema ou logs de auditoria que residem dentro /ifs/.ifsvar.
Em cada cluster, em uma sessão de tela (pois o comando pode levar muito tempo para retornar), execute o seguinte:
# du -sh /ifs/.ifsvar
Execute esse comando em cada cluster.
No passado, o suporte ao PowerScale considerou isso o culpado, especialmente devido ao grande número de logs de auditoria.
Verifique o /ifs/.ifsvar/audit e os seguintes subdiretórios,
Where <nodeXXX> is the node ID (for example node001):/ifs/.ifsvar/audit/logs/.
/ifs/.ifsvar/audit/logs/<nodeXXX>
/ifs/.ifsvar/audit/logs/<nodeXXX>/protocol
Se necessário, exclua os arquivos de auditoria seguindo o artigo:
KB 000167091Powerscale: How to Remove Audit Log Files
2) Confirme se não há diferenças no nível de proteção entre os dois clusters.
Cluster ativo:
isi stat -p -q -v
Logs:
# cat <base log set>/local/isi_stat-p
A Dell Technologies também pode verificar a diskpools níveis de proteção com um comando interno com assistência do Suporte.
3) Confirme se não há grande diferença com o uso de snapshots entre os dois clusters executando o seguinte comando em cada cluster:
# isi snapshot usage
4) No cluster que relata mais espaço usado, verifique se há arquivos/pastas grandes relacionados ao suporte que residam dentro /ifs/data/Isilon_Support:
# du -so /ifs/data/Isilon_Support
5) Se ainda estiver travado, a próxima etapa é verificar quando a coleta foi executada pela última vez em cada cluster.
(Nota: é importante observar que o 'MultiScan' nem sempre executa o trabalho Collect).
Esse trabalho Collect libera todos os blocos de disco obsoletos no cluster e, muitas vezes, pode ser a causa pelo qual um cluster mostra mais espaço em disco usado do que o outro cluster. Uma maneira rápida de fazer isso é verificar o /var/log/messages nos nós da última vez em que a coleta foi executada com sucesso, por exemplo:
# grep Collect /var/log/messages|grep Succeed
# zgrep Collect /var/log/messages*
6) Se ainda estiver preso, corra FSAnalyze trabalhe e use o InsightIQ para ver qual pasta está ocupando mais espaço no cluster com mais espaço usado.
'isi stat heat' O comando no cluster que está mais cheio também pode fornecer algumas pistas sobre onde novas gravações estão ocorrendo.