Avamar : comment collecter les informations nécessaires au dépannage des problèmes de capacité
Summary: Cet article décrit les informations nécessaires lors du dépannage des problèmes de capacité d’Avamar et la façon de les collecter.
Instructions
Résolution des problèmes de capacité dans Avamar :
Lorsque vous rencontrez des problèmes de capacité sur une grille Avamar, il est essentiel d’en comprendre la cause première. Cela nécessite une série d’étapes, à commencer par la collecte de données pour une enquête approfondie.
Les grilles Avamar ont plusieurs types de limites de capacité. Une compréhension complète de ces limites, ainsi que de leur contexte historique, peut clarifier les problèmes de capacité actuels et passés rencontrés par le système.
-
80 % : avertissement de capacité
-
95 % : la limite du bilan de santé est atteinte
-
100 % : la limite de lecture seule du serveur est atteinte, ce qui entraîne le basculement de la grille en mode admin
-
Le nettoyage de la mémoire (GC) échoue, ce qui entraîne des erreurs de MSG_ERR_DISKFULL ou de MSG_ERR_STRIPECREATE.
-
Les points de contrôle échouent en raison d’une erreur de MSG_ERR_DISKFULL.
-
Les sauvegardes ne peuvent pas s’exécuter ou échouer en raison de la capacité maximale.
-
Les sauvegardes échouent avec des erreurs de MSG_ERR_STRIPECREATE ou des messages indiquant que le serveur cible est saturé.
-
L’état d’accès bascule en mode administrateur (sauf si la maintenance est en cours d’exécution).
-
Le planificateur de sauvegarde est désactivé et ne peut pas être repris en raison des limites de capacité des métadonnées.
La compréhension de ces aspects peut vous aider à gérer et à résoudre les problèmes de capacité sur une grille Avamar.
Collecte d’informations
Connectez-vous au nœud utilitaire Avamar en tant qu’utilisateur « admin ».
(Ils collectent uniquement des informations et n’appliquent aucune modification)
1. Si ce n’est pas déjà fait, il fournit le nom complet ou le nom de domaine complet (FQDN) d’Avamar Server :
hostname -f
2. Vérifiez que tous les services sont activés, y compris le planificateur de maintenance :
dpnctl status
3. L’état général :
status.dpn
4. Exécutez la capacité.Script SH pour collecter 60 jours de données et les 10 principaux clients contributeurs :
capacity.sh --days=60 --top=10
5. Journaux montrant le comportement de base du nettoyage de la mémoire au cours des 30 derniers jours :
dumpmaintlogs --types=gc --days=30 | grep "4202"
6. Quantité de données supprimées par le nettoyage de la mémoire, nombre de passages effectués et durée d’exécution :
dumpmaintlogs --types=gc --days=30 | grep passes | cut -d ' ' -f1,10,14,15,17
7. Vérifiez combien de temps hfscheck S’exécute pour :
dumpmaintlogs --types=hfscheck --days=30 | grep -i elapsed|cut -d ' ' -f1,12 | grep -v check
8. Détails de l’utilisation de la capacité par nœud et par partition :
avmaint nodelist | egrep 'nodetag|fs-percent-full'
9. - Affiche la liste des points de contrôle.
cplist
10. Heures de début/fin planifiées de la tâche de maintenance :
avmaint sched status --ava | egrep -A 2 "maintenance-window|backup-window" | tail -16
11. Collectez tous les paramètres de disque :
avmaint config --ava | egrep -i 'disk|crunching|balance'
Ne modifiez jamais les valeurs, sauf avis contraire d’un expert en la matière (SME) Avamar. Des valeurs différentes de celles par défaut peuvent être en place pour une bonne raison. Comprenez bien la situation.
12. Collectez le nombre de différents types de bandes par nœud et par partition de données :
avmaint nodelist --xmlperline=99 | grep 'comp='
13. Vérifiez la quantité de mémoire (et la capacité d’échange) utilisée sur chaque nœud :
mapall free -m