Avamar: gromadzenie informacji w celu rozwiązywania problemów z pojemnością
Summary: W tym artykule opisano, jakie informacje są potrzebne podczas rozwiązywania problemów z pojemnością Avamar i jak je zbierać.
Instructions
Rozwiązywanie problemów z pojemnością w systemie Avamar:
Podczas rozwiązywania problemów z przepustowością w siatce Avamar ważne jest zrozumienie ich pierwotnej przyczyny. Wymaga to szeregu kroków, począwszy od zebrania danych w celu dokładnego zbadania.
Siatki Avamar mają kilka rodzajów limitów pojemności. Kompleksowe zrozumienie tych limitów, wraz z ich kontekstem historycznym, może wyjaśnić zarówno obecne, jak i przeszłe problemy z przepustowością, których doświadcza system.
-
80%: Ostrzeżenie o pojemności
-
95%: osiągnięto limit kontroli poprawności działania
-
100%: Osiągnięto limit tylko do odczytu serwera, co powoduje przełączenie siatki w tryb administratora
-
Wyrzucanie elementów bezużytecznych (GC) kończy się niepowodzeniem, co powoduje błędy MSG_ERR_DISKFULL lub MSG_ERR_STRIPECREATE.
-
Punkty kontrolne kończą się niepowodzeniem z powodu MSG_ERR_DISKFULL błędu.
-
Tworzenie kopii zapasowych nie może działać lub kończyć się niepowodzeniem z powodu pełnej pojemności.
-
Tworzenie kopii zapasowych kończy się niepowodzeniem z powodu MSG_ERR_STRIPECREATE błędów lub komunikatów wskazujących, że serwer docelowy jest pełny.
-
Stan dostępu przełącza się w tryb administratora (chyba że uruchomiono konserwację).
-
Harmonogram tworzenia kopii zapasowych jest wyłączony i nie można go wznowić ze względu na ograniczenia pojemności metadanych.
Zrozumienie tych aspektów może pomóc w zarządzaniu i rozwiązywaniu problemów z przepustowością w siatce Avamar.
Zebranie informacji.
Zaloguj się do węzła Avamar Utility Node jako użytkownik „admin”.
(Zbierają one tylko informacje i nie wprowadzają żadnych zmian)
1. Jeśli nie jest jeszcze znana, podaje pełną nazwę serwera Avamar lub w pełni kwalifikowaną nazwę domeny (FQDN):
hostname -f
2. Sprawdź, czy wszystkie usługi są włączone, w tym harmonogram konserwacji:
dpnctl status
3. Stan ogólny:
status.dpn
4. Uruchom pojemność.sh do zbierania danych z 60 dni i 10 klientów z największym wkładem:
capacity.sh --days=60 --top=10
5. Dzienniki przedstawiające podstawowe zachowanie związane z wyrzucaniem elementów bezużytecznych w ciągu ostatnich 30 dni:
dumpmaintlogs --types=gc --days=30 | grep "4202"
6. Ilość danych, które zostały usunięte z wyrzucania elementów bezużytecznych, liczba ukończonych przebiegów i czas działania:
dumpmaintlogs --types=gc --days=30 | grep passes | cut -d ' ' -f1,10,14,15,17
7. Sprawdź, jak długo hfscheck Działa dla:
dumpmaintlogs --types=hfscheck --days=30 | grep -i elapsed|cut -d ' ' -f1,12 | grep -v check
8. Szczegółowe informacje o wykorzystaniu pojemności na węzeł i partycję:
avmaint nodelist | egrep 'nodetag|fs-percent-full'
9. Lista punktów kontrolnych:
cplist
10. Zaplanowane godziny rozpoczęcia/zakończenia zadania konserwacji:
avmaint sched status --ava | egrep -A 2 "maintenance-window|backup-window" | tail -16
11. Zbierz wszystkie ustawienia dysku:
avmaint config --ava | egrep -i 'disk|crunching|balance'
Nigdy nie zmieniaj wartości, chyba że zaleci to ekspert Avamar Subject Matter Expert (SME). Wartości inne niż domyślne mogą być stosowane z ważnego powodu. Dokładnie zrozum sytuację.
12. Zbieraj liczby różnych typów przeplotów na węzeł na partycję danych:
avmaint nodelist --xmlperline=99 | grep 'comp='
13. Sprawdź ilość pamięci (i wymiany) używanej w każdym węźle:
mapall free -m