PowerScale: un cluster in una relazione SyncIQ segnala più spazio su disco utilizzato rispetto all'altro cluster.
Сводка: Questo articolo spiega perché un cluster in una relazione syncIQ (origine o destinazione) può segnalare più spazio su disco utilizzato rispetto all'altro cluster. Lo spazio su disco utilizzato in modo identico dovrebbe essere visualizzato in entrambi i cluster. I job SyncIQ sono aggiornati. ...
Симптомы
Un cluster PowerScale in una relazione syncIQ (origine o destinazione) dispone di più spazio su disco utilizzato rispetto all'altro cluster PowerScale. Lo spazio utilizzato in modo identico deve essere lo stesso per entrambi i cluster.
Esempio, come si vede con il metodo 'isi status' command:
Il cluster di destinazione mostra che lo storage del disco rigido (HDD) utilizzato da 349T:
Cluster Name: TARGET-POWERSCALE Cluster Health: [ ATTN] Data Reduction: 1.00 : 1 Storage Efficiency: 0.73 : 1 Cluster Storage: HDD SSD Storage Size: 417.2T (432.5T Raw) 5.7T (5.7T Raw) VHS Size: 15.4T Used: 348.6T (84%) 669.1G (11%) ==================> Avail: 68.6T (16%) 5.1T (89%) Health Throughput (bps) HDD Storage SSD Storage ID |IP Address |DASR | In Out Total| Used / Size |Used / Size ---+---------------+-----+-----+-----+-----+-----------------+----------------- 9|1099.2.6 | OK | 1.0M| 488k| 1.5M|87.2T/ 104T( 84%)| 167G/ 1.4T( 11%) 10|10.99.2.7 | OK | 820M| 4.2M| 824M|87.2T/ 104T( 84%)| 167G/ 1.4T( 11%) 11|10.99.2.8 | OK | 678M| 2.9M| 681M|87.2T/ 104T( 84%)| 167G/ 1.4T( 11%) 12|10.99.2.9 | OK | 0| 123k| 123k|87.1T/ 104T( 84%)| 167G/ 1.4T( 11%) ---+---------------+-----+-----+-----+-----+-----------------+----------------- Cluster Totals: | 1.5G| 7.7M| 1.5G| 349T/ 417T( 84%)| 669G/ 5.7T( 11%) Health Fields: D = Down, A = Attention, S = Smartfailed, R = Read-Only
La sorgente ha solo 286T di storage HDD utilizzato:
Cluster Name: SOURCE-POWERSCALE Cluster Health: [ ATTN] Data Reduction: 1.00 : 1 Storage Efficiency: 0.71 : 1 Cluster Storage: HDD SSD Storage Size: 417.2T (432.5T Raw) 5.7T (5.7T Raw) VHS Size: 15.4T Used: 285.5T (68%) 721.9G (12%) ========> Avail: 131.7T (32%) 5.0T (88%) Health Throughput (bps) HDD Storage SSD Storage ID |IP Address |DASR | In Out Total| Used / Size |Used / Size ---+---------------+-----+-----+-----+-----+-----------------+----------------- 9|10.99.3.13 | OK | 290M| 9.9M| 300M|71.4T/ 104T( 68%)| 180G/ 1.4T( 12%) 10|10.99.3.11 | OK | 324M| 832M| 1.2G|71.4T/ 104T( 68%)| 181G/ 1.4T( 12%) 11|10.99.3.12 | OK | 194M| 8.4M| 202M|71.4T/ 104T( 68%)| 181G/ 1.4T( 12%) 12|10.99.3.10 | OK | 1.9M| 2.0M| 3.8M|71.4T/ 104T( 68%)| 181G/ 1.4T( 12%) ---+---------------+-----+-----+-----+-----+-----------------+----------------- Cluster Totals: | 809M| 852M| 1.7G| 286T/ 417T( 68%)| 722G/ 5.7T( 12%)
Причина
Le cause più comuni delle differenze di spazio tra i cluster in una relazione syncIQ sono le seguenti:
file di sistema di grandi dimensioni o audit log che risiedono all'interno di /ifs/.ifsvar (più comune)
--differenze nelle dimensioni
delle istantanee--differenze nei livelli
di protezione--Il lavoro di raccolta non viene eseguito in un cluster, senza quindi liberare blocchi di dischi orfani.
--grandi file/cartelle relativi al supporto che risiedono all'interno /ifs/data/Isilon_Support
Разрешение
Supponendo che tutti i job syncIQ siano aggiornati con la replica, controllare quanto segue:
1) Spesso il cluster che utilizza più spazio dispone di file di sistema o audit log di grandi dimensioni all'interno /ifs/.ifsvar.
In ogni cluster, da una sessione dello schermo (poiché la restituzione del comando potrebbe richiedere molto tempo), eseguire quanto segue:
# du -sh /ifs/.ifsvar
Eseguire questo comando in ogni cluster.
Il supporto PowerScale ha rilevato questo come colpevole in passato, soprattutto a causa di audit log di grandi dimensioni.
Controllare il /ifs/.ifsvar/audit e le seguenti sottodirectory,
Where <nodeXXX> is the node ID (for example node001):/ifs/.ifsvar/audit/logs/.
/ifs/.ifsvar/audit/logs/<nodeXXX>
/ifs/.ifsvar/audit/logs/<nodeXXX>/protocol
Se necessario, eliminare i file di audit seguendo l'articolo:
Knowledge Base 000167091 PowerScale: come rimuovere i file di audit log
2) Verificare che non vi siano differenze nel livello di protezione tra i due cluster.
Cluster attivo:
isi stat -p -q -v
Registri
# cat <base log set>/local/isi_stat-p
Dell Technologies può anche controllare diskpools livelli di protezione con un comando interno con assistenza di supporto.
3) Verificare che non vi siano grandi differenze con l'utilizzo delle istantanee tra i due cluster eseguendo il seguente comando su ciascun cluster:
# isi snapshot usage
4) Nel cluster che segnala più spazio utilizzato, verificare la presenza di file/cartelle di supporto di grandi dimensioni all'interno /ifs/data/Isilon_Support:
# du -so /ifs/data/Isilon_Support
5) Se il sistema è ancora bloccato, il passaggio successivo consiste nel verificare quando è stata eseguita l'ultima volta la raccolta su ciascun cluster.
(Nota: è importante notare che "MultiScan" non sempre esegue il lavoro Collect).
Questo lavoro di raccolta libera eventuali blocchi di dischi obsoleti nel cluster e spesso può essere la causa del motivo per cui un cluster mostra più spazio su disco utilizzato rispetto all'altro. Un modo rapido per eseguire questa operazione consiste nel controllare il /var/log/messages sui nodi per l'ultima volta che la raccolta è stata eseguita correttamente, ad esempio:
# grep Collect /var/log/messages|grep Succeed
# zgrep Collect /var/log/messages*
6) Se sei ancora bloccato, corri FSAnalyze e utilizzare InsightIQ per vedere quale cartella occupa più spazio nel cluster con più spazio utilizzato.
'isi stat heat' Il comando sul cluster che è più pieno può anche fornire alcuni indizi sulla posizione in cui si verificano le nuove scritture.