Avamar: So erfassen Sie Informationen zum Troubleshooting von Kapazitätsproblemen
Summary: In diesem Artikel wird beschrieben, welche Informationen bei der Behebung von Avamar-Kapazitätsproblemen benötigt werden und wie sie gesammelt werden.
Instructions
Beheben von Kapazitätsproblemen in Avamar:
Bei der Bewältigung von Kapazitätsproblemen in einem Avamar-Grid ist es entscheidend, die Ursache zu kennen. Dies erfordert eine Reihe von Schritten, beginnend mit der Datenerhebung für eine gründliche Untersuchung.
Avamar-Grids haben verschiedene Arten von Kapazitätslimits. Ein umfassendes Verständnis dieser Grenzwerte zusammen mit ihrem historischen Kontext kann sowohl aktuelle als auch frühere Kapazitätsprobleme des Systems klären.
-
80 %: Kapazitätswarnung
-
95 %: Grenzwert für Integritätsprüfung erreicht
-
100 %: Server-Grenzwert für Schreibschutz wird erreicht, was dazu führt, dass das Raster in den Administratormodus wechselt.
-
Garbage Collection (GC) schlägt fehl, was zu MSG_ERR_DISKFULL oder MSG_ERR_STRIPECREATE Fehlern führt.
-
Prüfpunkte schlagen aufgrund eines MSG_ERR_DISKFULL Fehlers fehl.
-
Backups können aufgrund von voller Kapazität nicht ausgeführt werden oder fehlschlagen.
-
Backups schlagen mit MSG_ERR_STRIPECREATE Fehlern oder Meldungen fehl, die darauf hinweisen, dass der Zielserver voll ist.
-
Der Zugriffsstatus wechselt in den Administratormodus (sofern keine Wartung ausgeführt wird).
-
Der Backup-Planer ist deaktiviert und kann aufgrund von Kapazitätsbeschränkungen für Metadaten nicht fortgesetzt werden.
Das Verständnis dieser Aspekte kann beim Management und der Behebung von Kapazitätsproblemen in einem Avamar-Grid hilfreich sein.
Erfassen von Informationen
Melden Sie sich beim Avamar Utility Node als Nutzer „admin“ an.
(Diese erfassen nur Informationen, übernehmen keine Änderungen.)
1. Falls nicht bereits bekannt, wird der vollständige Name oder der vollständig qualifizierte Domainname (FQDN) des Avamar-Servers bereitgestellt:
hostname -f
2. Überprüfen Sie, ob alle Services aktiviert sind, einschließlich des Wartungsplaners:
dpnctl status
3. Der Gesamtzustand:
status.dpn
4. Führen Sie die Kapazität aus.SH-Skript zum Sammeln von Daten über 60 Tage und die 10 wichtigsten beitragenden Kunden:
capacity.sh --days=60 --top=10
5. Protokolle mit grundlegendem Verhalten bei der automatischen Speicherbereinigung in den letzten 30 Tagen:
dumpmaintlogs --types=gc --days=30 | grep "4202"
6. Die Menge der Daten, die von der automatischen Speicherbereinigung entfernt wurden, wie viele Durchläufe sie abgeschlossen hat und wie lange sie ausgeführt wurde:
dumpmaintlogs --types=gc --days=30 | grep passes | cut -d ' ' -f1,10,14,15,17
7. Überprüfen Sie, wie lange hfscheck Wird ausgeführt für:
dumpmaintlogs --types=hfscheck --days=30 | grep -i elapsed|cut -d ' ' -f1,12 | grep -v check
8. Details zur Kapazitätsauslastung pro Node und pro Partition:
avmaint nodelist | egrep 'nodetag|fs-percent-full'
9. – Zeigt eine Liste der Prüfpunkte an.
cplist
10. Geplante Start-/Endzeiten des Wartungsjobs:
avmaint sched status --ava | egrep -A 2 "maintenance-window|backup-window" | tail -16
11. Alle Festplatteneinstellungen erfassen:
avmaint config --ava | egrep -i 'disk|crunching|balance'
Ändern Sie Werte nie, es sei denn, Sie werden von einem Avamar Subject Matter Expert (SME) dazu aufgefordert. Nichtstandardwerte können aus einem guten Grund vorhanden sein. Machen Sie sich ein umfassendes Bild von der Situation.
12. Erfassen Sie die Anzahl verschiedener Arten von Stripes pro Node und Datenpartition:
avmaint nodelist --xmlperline=99 | grep 'comp='
13. Überprüfen Sie die Menge an Arbeitsspeicher (und Swap), die auf jedem Node verwendet wird:
mapall free -m