Avamar: Jak shromáždit informace pro odstraňování problémů s kapacitou
Summary: Tento článek popisuje, jaké informace jsou potřeba při odstraňování problémů s kapacitou softwaru Avamar a jak je shromáždit.
Instructions
Řešení problémů s kapacitou v softwaru Avamar:
Při řešení problémů s kapacitou v mřížce Avamar je zásadní pochopit hlavní příčinu. To vyžaduje řadu kroků, počínaje sběrem dat pro důkladné prozkoumání.
Mřížky Avamar mají několik typů omezení kapacity. Komplexní pochopení těchto limitů spolu s jejich historickým kontextem může objasnit současné i minulé problémy s kapacitou, se kterými se systém potýkal.
-
80 %: Varování kapacity
-
95 %: Bylo dosaženo limitu kontroly stavu
-
100 %: Bylo dosaženo limitu serveru pouze pro čtení, což způsobilo, že se síť přepnula do režimu správce.
-
Uvolňování paměti (GC) selže, což vede k chybám MSG_ERR_DISKFULL nebo MSG_ERR_STRIPECREATE.
-
Kontrolní body selžou kvůli chybě MSG_ERR_DISKFULL.
-
Zálohy nelze spustit nebo selhat z důvodu plné kapacity.
-
Zálohování se nezdaří s chybami MSG_ERR_STRIPECREATE nebo zprávami oznamujícími, že cílový server je plný.
-
Stav přístupu se přepne do režimu správce (pokud není spuštěna údržba).
-
Plánovač zálohování je zakázán a nelze jej obnovit kvůli omezením kapacity metadat.
Pochopení těchto aspektů vám může pomoci při správě a řešení problémů s kapacitou v mřížce Avamar.
Shromažďování informací:
Přihlaste se k uzlu nástroje Avamar jako uživatel „admin“.
(Shromažďují pouze informace a neuplatňují žádné změny.)
1. Pokud jej ještě neznáte, poskytne úplný název serveru Avamar nebo plně kvalifikovaný název domény (FQDN):
hostname -f
2. Ověřte, zda jsou povoleny všechny služby, včetně plánovače údržby:
dpnctl status
3. Celkový stav:
status.dpn
4. Spusťte kapacitu.SH skript pro sběr dat za 60 dní a 10 nejlepších přispívajících klientů:
capacity.sh --days=60 --top=10
5. Protokoly zobrazující základní chování uvolňování paměti za posledních 30 dnů:
dumpmaintlogs --types=gc --days=30 | grep "4202"
6. Množství dat, která uvolňování paměti odebralo, kolik průchodů bylo dokončeno a jak dlouho běželo:
dumpmaintlogs --types=gc --days=30 | grep passes | cut -d ' ' -f1,10,14,15,17
7. Zkontrolujte, jak dlouho hfscheck Běží pro:
dumpmaintlogs --types=hfscheck --days=30 | grep -i elapsed|cut -d ' ' -f1,12 | grep -v check
8. Podrobnosti o využití kapacity na uzel a oddíl:
avmaint nodelist | egrep 'nodetag|fs-percent-full'
9. Seznam kontrolních bodů:
cplist
10. Plánované časy zahájení/ukončení údržbové práce:
avmaint sched status --ava | egrep -A 2 "maintenance-window|backup-window" | tail -16
11. Shromážděte všechna nastavení disku:
avmaint config --ava | egrep -i 'disk|crunching|balance'
Nikdy neměňte hodnoty, pokud vám to nedoporučí odborník na danou problematiku (SME) systému Avamar. Nevýchozí hodnoty mohou být zavedeny z dobrého důvodu. Důkladně pochopte situaci.
12. Shromážděte počty různých typů prokládání na uzel a datový oddíl:
avmaint nodelist --xmlperline=99 | grep 'comp='
13. Zkontrolujte množství paměti (a swapu) využité v jednotlivých uzlech:
mapall free -m