PowerScale: Ein Cluster in einer SyncIQ-Beziehung meldet mehr belegten Speicherplatz als das andere Cluster.
Сводка: In diesem Artikel wird erläutert, warum ein Cluster in einer syncIQ-Beziehung (Quelle oder Ziel) möglicherweise mehr belegten Speicherplatz meldet als der andere Cluster. Beide Cluster sollten identisch genutzten Speicherplatz anzeigen. SyncIQ-Jobs sind auf dem neuesten Stand. ...
Симптомы
Ein PowerScale Cluster in einer syncIQ-Beziehung (Quelle oder Ziel) hat mehr belegten Speicherplatz als das andere PowerScale Cluster. Beide Cluster sollten über identisch genutzten Speicherplatz verfügen.
Beispiel: 'isi status' command:
Target cluster zeigt an, dass 349T Festplattenspeicher (HDD) verwendet hat:
Cluster Name: TARGET-POWERSCALE Cluster Health: [ ATTN] Data Reduction: 1.00 : 1 Storage Efficiency: 0.73 : 1 Cluster Storage: HDD SSD Storage Size: 417.2T (432.5T Raw) 5.7T (5.7T Raw) VHS Size: 15.4T Used: 348.6T (84%) 669.1G (11%) ==================> Avail: 68.6T (16%) 5.1T (89%) Health Throughput (bps) HDD Storage SSD Storage ID |IP Address |DASR | In Out Total| Used / Size |Used / Size ---+---------------+-----+-----+-----+-----+-----------------+----------------- 9|1099.2.6 | OK | 1.0M| 488k| 1.5M|87.2T/ 104T( 84%)| 167G/ 1.4T( 11%) 10|10.99.2.7 | OK | 820M| 4.2M| 824M|87.2T/ 104T( 84%)| 167G/ 1.4T( 11%) 11|10.99.2.8 | OK | 678M| 2.9M| 681M|87.2T/ 104T( 84%)| 167G/ 1.4T( 11%) 12|10.99.2.9 | OK | 0| 123k| 123k|87.1T/ 104T( 84%)| 167G/ 1.4T( 11%) ---+---------------+-----+-----+-----+-----+-----------------+----------------- Cluster Totals: | 1.5G| 7.7M| 1.5G| 349T/ 417T( 84%)| 669G/ 5.7T( 11%) Health Fields: D = Down, A = Attention, S = Smartfailed, R = Read-Only
Die Quelle verfügt nur über 286 T belegten HDD-Storage:
Cluster Name: SOURCE-POWERSCALE Cluster Health: [ ATTN] Data Reduction: 1.00 : 1 Storage Efficiency: 0.71 : 1 Cluster Storage: HDD SSD Storage Size: 417.2T (432.5T Raw) 5.7T (5.7T Raw) VHS Size: 15.4T Used: 285.5T (68%) 721.9G (12%) ========> Avail: 131.7T (32%) 5.0T (88%) Health Throughput (bps) HDD Storage SSD Storage ID |IP Address |DASR | In Out Total| Used / Size |Used / Size ---+---------------+-----+-----+-----+-----+-----------------+----------------- 9|10.99.3.13 | OK | 290M| 9.9M| 300M|71.4T/ 104T( 68%)| 180G/ 1.4T( 12%) 10|10.99.3.11 | OK | 324M| 832M| 1.2G|71.4T/ 104T( 68%)| 181G/ 1.4T( 12%) 11|10.99.3.12 | OK | 194M| 8.4M| 202M|71.4T/ 104T( 68%)| 181G/ 1.4T( 12%) 12|10.99.3.10 | OK | 1.9M| 2.0M| 3.8M|71.4T/ 104T( 68%)| 181G/ 1.4T( 12%) ---+---------------+-----+-----+-----+-----+-----------------+----------------- Cluster Totals: | 809M| 852M| 1.7G| 286T/ 417T( 68%)| 722G/ 5.7T( 12%)
Причина
Häufige Ursachen für Speicherplatzunterschiede zwischen Clustern in einer syncIQ-Beziehung sind:
große Systemdateien oder Auditprotokolle, die sich in /ifs/.ifsvar (am häufigsten)
--Unterschiede in der Snapshot-Größe
---Unterschiede in den Schutzleveln
--Collect-Job wird nicht auf einem Cluster ausgeführt, sodass verwaiste Festplattenblöcke nicht freigegeben werden.
--große Support-bezogene Dateien/Ordner in /ifs/data/Isilon_Support
Разрешение
Unter der Annahme, dass alle syncIQ-Jobs mit der Replikation auf dem neuesten Stand sind, überprüfen Sie Folgendes:
1) Es ist häufig der Fall, dass der Cluster, der mehr Speicherplatz verwendet, große Systemdateien oder Auditprotokolle enthält, die sich in /ifs/.ifsvar.
Führen Sie auf jedem Cluster über eine Bildschirmsitzung (da die Rückkehr des Befehls viel Zeit in Anspruch nehmen kann) Folgendes aus:
# du -sh /ifs/.ifsvar
Führen Sie diesen Befehl auf jedem Cluster aus.
Der PowerScale-Support hat dies in der Vergangenheit als Übeltäter erkannt, insbesondere aufgrund der umfangreichen Auditprotokolle.
Aktivieren Sie die Option /ifs/.ifsvar/audit Verzeichnis und die folgenden Unterverzeichnisse,
Where <nodeXXX> is the node ID (for example node001):/ifs/.ifsvar/audit/logs/.
/ifs/.ifsvar/audit/logs/<nodeXXX>
/ifs/.ifsvar/audit/logs/<nodeXXX>/protocol
Falls erforderlich, löschen Sie die Auditdateien anhand des folgenden Artikels:
Wissensdatenbank-000167091Powerscale: Anleitung zum Entfernen von Auditprotokolldateien
2) Vergewissern Sie sich, dass es keine Unterschiede im Schutzlevel zwischen den beiden Clustern gibt.
Live-Cluster:
isi stat -p -q -v
Protokolle:
# cat <base log set>/local/isi_stat-p
Dell Technologies kann auch die diskpools Schutzlevel mit einem internen Befehl mit Supportunterstützung.
3) Vergewissern Sie sich, dass es keinen großen Unterschied bei der Snapshot-Nutzung zwischen den beiden Clustern gibt, indem Sie auf jedem Cluster den folgenden Befehl ausführen:
# isi snapshot usage
4) Suchen Sie auf dem Cluster, der mehr belegten Speicherplatz meldet, nach großen supportbezogenen Dateien/Ordnern, die sich darin befinden. /ifs/data/Isilon_Support:
# du -so /ifs/data/Isilon_Support
5) Wenn es weiterhin hängen bleibt, besteht der nächste Schritt darin, zu überprüfen, wann die Erfassung zuletzt auf jedem Cluster ausgeführt wurde.
(Hinweis: Es ist wichtig zu beachten, dass "MultiScan" nicht immer den Collect-Job ausführt.)
Dieser Collect-Job gibt alle veralteten Festplattenblöcke auf dem Cluster frei und kann oft die Ursache dafür sein, dass ein Cluster mehr belegten Speicherplatz anzeigt als das andere Cluster. Eine schnelle Möglichkeit, dies zu tun, besteht darin, die /var/log/messages auf den Nodes zum letzten Mal Die Erfassung wurde erfolgreich ausgeführt, z. B.:
# grep Collect /var/log/messages|grep Succeed
# zgrep Collect /var/log/messages*
6) Wenn es immer noch hängen bleibt, führen Sie Folgendes aus: FSAnalyze Job und verwenden Sie InsightIQ, um zu sehen, welcher Ordner mehr Speicherplatz auf dem Cluster mit mehr belegtem Speicherplatz belegt.
'isi stat heat' Befehl auf dem Cluster, der vollständiger ist, kann auch Hinweise darauf geben, wo neue Schreibvorgänge stattfinden.