Avamar: Så här samlar du in information för att felsöka kapacitetsproblem
Summary: I den här artikeln beskrivs vilken information som behövs vid felsökning av Avamar-kapacitetsproblem och hur du samlar in den.
Instructions
Hantering av kapacitetsproblem i Avamar:
När man hanterar kapacitetsproblem i ett Avamar-rutnät är det viktigt att förstå grundorsaken. Detta kräver en serie steg, som börjar med datainsamling för grundlig undersökning.
Avamar-rutnät har flera typer av kapacitetsbegränsningar. En omfattande förståelse av dessa gränser, tillsammans med deras historiska sammanhang, kan klargöra både nuvarande och tidigare kapacitetsproblem som systemet upplever.
-
80%: Kapacitetsvarning
-
95 %: Hälsokontrollgränsen har nåtts
-
100 %: Gränsen för skrivskyddad server har nåtts, vilket gör att rutnätet växlar till administratörsläge
-
Skräpinsamling (GC) misslyckas, vilket resulterar i MSG_ERR_DISKFULL eller MSG_ERR_STRIPECREATE fel.
-
Kontrollpunkter misslyckas på grund av MSG_ERR_DISKFULL fel.
-
Säkerhetskopieringar kan inte köras eller misslyckas på grund av full kapacitet.
-
Säkerhetskopieringar misslyckas med MSG_ERR_STRIPECREATE fel eller meddelanden som anger att målservern är full.
-
Åtkomsttillståndet växlar till administratörsläge (såvida inte underhåll körs).
-
Schemaläggaren för säkerhetskopiering är inaktiverad och kan inte återupptas på grund av begränsningar i metadatakapaciteten.
Att förstå dessa aspekter kan hjälpa till att hantera och lösa kapacitetsproblem i ett Avamar-rutnät.
Insamling av information:
Logga in på Avamar-verktygsnoden och kör följande kommandon:
(Dessa samlar endast in information och tillämpar inga ändringar)
1. Om den inte redan är känd innehåller den Avamar-serverns fullständiga namn eller fullständigt kvalificerade domännamn (FQDN):
hostname -f
2. Kontrollera att alla tjänster är aktiverade, inklusive underhållsschemaläggaren:
dpnctl status
3. Det övergripande tillståndet:
status.dpn
4. Kör kapaciteten.SH-skript för att samla in 60 dagars data och de 10 främsta bidragande klienterna:
capacity.sh --days=60 --top=10
5. Loggar som visar grundläggande skräpinsamlingsbeteende under de senaste 30 dagarna:
dumpmaintlogs --types=gc --days=30 | grep "4202"
6. Mängden data som skräpinsamlingen tog bort, hur många som slutfördes och hur länge den kördes:
dumpmaintlogs --types=gc --days=30 | grep passes | cut -d ' ' -f1,10,14,15,17
7. Kontrollera hur länge hfscheck Körs för:
dumpmaintlogs --types=hfscheck --days=30 | grep -i elapsed|cut -d ' ' -f1,12 | grep -v check
8. Information om kapacitetsanvändning per nod och per partition:
avmaint nodelist | egrep 'nodetag|fs-percent-full'
9. En lista över kontrollpunkter:
cplist
10. Underhållsjobbets schemalagda start-/stopptider:
avmaint sched status --ava | egrep -A 2 "maintenance-window|backup-window" | tail -16
11. Samla in alla diskinställningar:
avmaint config --ava | egrep -i 'disk|crunching|balance'
Ändra aldrig värden om du inte fått råd av en Avamar-ämnesexpert (SME). Icke-standardvärden kan finnas på plats av en bra anledning. Förstå situationen noggrant.
12. Samla in antal olika typer av stripes per nod per datapartition:
avmaint nodelist --xmlperline=99 | grep 'comp='
13. Kontrollera mängden minne (och växling) som används på varje nod:
mapall free -m