NetWorker : NetWorker Server déployé sur Red Le cluster de basculement Enterprise Linux Pacemaker n’a aucune méthode de réglage de l’intervalle de surveillance.

摘要: Pannes intermittentes de NetWorker observées dans les environnements de clusters de grande taille en raison de brèves interruptions de surveillance. Par défaut, la fonction de surveillance fait trois tentatives. Aucun paramètre « retry count » n’est disponible. Cet article de la base de connaissances définit les solutions de contournement possibles, ainsi que les détails d’une demande d’amélioration (RFE) pour une opportunité d’amélioration de NetWorker. ...

本文章適用於 本文章不適用於 本文無關於任何特定產品。 本文未識別所有產品版本。

症狀

  • Le serveur NetWorker est installé sur un système Red Hat Pacemaker (pcs) du cluster de basculement.
  • Il existe des pannes intermittentes dans NetWorker en raison de brèves interruptions du pacemaker (pcs) pour NetWorker Server (la valeur par défaut est nws)

原因

La cause des pannes de cluster peut varier. Cette section définit les fonctionnalités utilisées pour exécuter les fonctions de surveillance de cluster NetWorker. 

Par défaut, la ressource Pacemaker pour NetWorker dispose d’un «monitor" l’opération. L’opération a «interval» et «timeout" qui sont configurés par l’administrateur de cluster lors de la configuration initiale du cluster NetWorker.

root@NWrhelNodeA:~# pcs resource
  * Resource Group: NW_group:
    * fs        (ocf::heartbeat:Filesystem):     Started NWrhelNodeA.emclab.local
    * ip        (ocf::heartbeat:IPaddr):         Started NWrhelNodeA.emclab.local
    * nws       (ocf::EMC_NetWorker:Server):     Started NWrhelNodeA.emclab.local
root@NWrhelNodeA:~# pcs resource config nws Resource: nws (class=ocf provider=EMC_NetWorker type=Server) Meta Attrs: is-managed=true Operations: meta-data interval=0 timeout=10 (nws-meta-data-interval-0) migrate_from interval=0 timeout=120 (nws-migrate_from-interval-0) migrate_to interval=0 timeout=60 (nws-migrate_to-interval-0) start interval=0 timeout=300 (nws-start-interval-0) stop interval=0s timeout=300 (nws-stop-interval-0s) validate-all interval=0 timeout=10 (nws-validate-all-interval-0) monitor interval=120s timeout=300 (nws-monitor-interval-120s)

NetWorker est configuré pour utiliser Open Cluster Framework (OCF). La fonction de surveillance est définie dans /usr/lib/ocf/resource.d/EMC_NetWorker/Server:

NWServer_monitor() {
        local count

        # exit immediately if configuration is not valid
        NWServer_validate_all || exit $?

        quick_monitor
        if [ $? -eq 0 ]; then
                count=0
                while [ $count -lt 3 ]; do
                        echo "q" | nsradmin -s ${NSR_SERVERHOST} -i - > /dev/null 2>&1
                        if [ $? -eq 0 ]; then
                                return $OCF_SUCCESS
                        else
                                count=`expr ${count} + 1`
                                sleep 1
                        fi
                done
        else
                return $OCF_NOT_RUNNING
        fi

        return $OCF_NOT_RUNNING
}

NOTE: Une défaillance de l’écran ne devrait techniquement jamais se produire dans des circonstances normales et doit indiquer une erreur irrécupérable. Toutefois, certains environnements de grande taille peuvent observer des problèmes intermittents où nsradmin peut échouer lors du test de moniteur d’un stimulateur cardiaque, même si ce n’est que temporairement, ce qui entraîne une panne complète du stimulateur cardiaque.

解析度

L’administrateur de cluster doit examiner tous les problèmes de panne du cluster. Vous pouvez consulter les logs du cluster pour obtenir des informations sur les interruptions :

  • /var/log/pcsd/pcsd.log
  • /var/log/pacemaker/pacemaker.log
  • /var/log/messages

Vous pouvez également consulter les logs du NetWorker Server. Le daemon.log du NetWorker Server se trouve sur le disque partagé (par exemple, /nsr_share).

  • /nsr_share/nsr/logs/daemon.log

Si le rendu en temps réel n’est pas activé, le .raw Le journal peut être rendu dans un fichier .log à l’aide de la commande suivante :

nsr_render_log /nsr_share/nsr/logs/daemon.raw > /nsr_share/nsr/logs/daemon_`date -I`.log

L’administrateur de cluster peut augmenter l’intervalle de surveillance et les valeurs de délai d’expiration pour la ressource PC du serveur NetWorker. Reportez-vous à la documentation Red Hat Pacemaker pour obtenir des instructions sur la modification des valeurs du délai d’expiration, car les commandes Pacemaker peuvent changer entre les versions de Pacemaker.

Par défaut, le pacemaker relance la fonction de moniteur trois fois. Si vous souhaitez que ce paramètre soit réglable, contactez votre responsable de compte ou agent commercial Dell pour ouvrir une demande d’amélioration (RFE).

其他資訊

Les touches /usr/lib/ocf/resource.d/EMC_NetWorker/Server nsr_monitor La fonction peut être modifiée par l’administrateur du cluster pour inclure des fonctions supplémentaires ; Toutefois, cette rédaction de scripts n’entre pas dans le cadre de la prise en charge de NetWorker. Toutes les modifications apportées à ces scripts sont supprimées lors d’une mise à niveau de NetWorker Server.

受影響的產品

NetWorker

產品

NetWorker Family, NetWorker Series
文章屬性
文章編號: 000216735
文章類型: Solution
上次修改時間: 23 7月 2026
版本:  7
向其他 Dell 使用者尋求您問題的答案
支援服務
檢查您的裝置是否在支援服務的涵蓋範圍內。