Avamar: Sådan indsamler du oplysningerne til fejlfinding af kapacitetsproblemer
Summary: Denne artikel beskriver, hvilke oplysninger der er nødvendige ved fejlfinding af Avamar-kapacitetsproblemer, og hvordan de indsamles.
Instructions
Håndtering af kapacitetsproblemer i Avamar:
Når du håndterer kapacitetsproblemer på et Avamar-net, er det afgørende at forstå den grundlæggende årsag. Dette kræver en række trin, der starter med dataindsamling til grundig undersøgelse.
Avamar-net har flere typer kapacitetsbegrænsninger. En omfattende forståelse af disse grænser sammen med deres historiske kontekst kan afklare både nuværende og tidligere kapacitetsproblemer, som systemet oplever.
-
80 %: Kapacitetsadvarsel
-
95 %: Sundhedstjekgrænsen er nået
-
100 %: Servergrænsen er nået, hvilket får gitteret til at skifte til administratortilstand
-
Garbage Collection (GC) mislykkes, hvilket resulterer i MSG_ERR_DISKFULL eller MSG_ERR_STRIPECREATE fejl.
-
Kontrolpunkter mislykkes på grund af MSG_ERR_DISKFULL fejl.
-
Sikkerhedskopieringer kan ikke køre eller mislykkes på grund af fuld kapacitet.
-
Sikkerhedskopieringer mislykkes med MSG_ERR_STRIPECREATE fejl eller meddelelser, der angiver, at destinationsserveren er fuld.
-
Adgangstilstanden skifter til administratortilstand (medmindre vedligeholdelsen kører).
-
Sikkerhedskopieringsprogrammet er deaktiveret og kan ikke genoptages pga. begrænsninger i metadatakapaciteten.
En forståelse af disse aspekter kan hjælpe med at administrere og løse kapacitetsproblemer på et Avamar-net.
Indsamling af oplysninger:
Log på Avamar-hjælpenoden, og kør følgende kommandoer:
(Disse indsamler kun oplysninger og anvender ingen ændringer)
1. Hvis den ikke allerede er kendt, angives Avamar-serverens fulde navn eller fulde domænenavn (FQDN):
hostname -f
2. Kontrollér, at alle services er aktiveret, herunder maintenance scheduler:
dpnctl status
3. Den samlede tilstand:
status.dpn
4. Kør kapaciteten.SH-script til indsamling af 60 dages data og de 10 bedste bidragende kunder:
capacity.sh --days=60 --top=10
5. Logfiler, der viser grundlæggende adfærd for affaldsindsamling i løbet af de sidste 30 dage:
dumpmaintlogs --types=gc --days=30 | grep "4202"
6. Mængden af data, som affaldssamlingen fjernede, hvor mange passager den gennemførte, og hvor længe den kørte:
dumpmaintlogs --types=gc --days=30 | grep passes | cut -d ' ' -f1,10,14,15,17
7. Kontroller, hvor længe hfscheck kører for:
dumpmaintlogs --types=hfscheck --days=30 | grep -i elapsed|cut -d ' ' -f1,12 | grep -v check
8. Oplysninger om kapacitetsforbrug pr. node og pr. partition:
avmaint nodelist | egrep 'nodetag|fs-percent-full'
9. En liste over kontrolpunkter:
cplist
10. Planlagte start-/stoptidspunkter for vedligeholdelsesjob:
avmaint sched status --ava | egrep -A 2 "maintenance-window|backup-window" | tail -16
11. Indsaml alle diskindstillinger:
avmaint config --ava | egrep -i 'disk|crunching|balance'
Du må aldrig ændre værdier, medmindre du er anbefalet af en Avamar Subject Matter Expert (SME). Der kan være en god grund til, at ikke-standardværdier findes. Forstå situationen grundigt.
12. Indsaml antal forskellige typer striber pr. node pr. datapartition:
avmaint nodelist --xmlperline=99 | grep 'comp='
13. Kontrollér mængden af hukommelse (og swap), der er i brug på hver node:
mapall free -m