NetWorker: NetWorker-server implementeret på Red Had Enterprise Linux Pacemaker-failoverklynge har ingen metode til justering af overvågningsintervallet.

摘要: Sporadiske NetWorker-afbrydelser observeret i store klyngemiljøer på grund af korte overvågningsafbrydelser. Som standard forsøger skærmfunktionen igen tre gange. Der er ingen tilgængelig parameter for "antal forsøg igen". Denne KB definerer potentielle løsninger og oplysninger om en anmodning om forbedring (RFE) for en NetWorker-forbedringsmulighed. ...

本文章適用於 本文章不適用於 本文無關於任何特定產品。 本文未識別所有產品版本。

症狀

  • NetWorker-serveren er installeret på en Red Hat pacemaker (pcs) failover-klynge.
  • Der er periodiske afbrydelser i NetWorker på grund af korte afbrydelser af pacemakeren (pcs) ressource til NetWorker-server (standard er nws)

原因

Årsagen til klyngeafbrydelser kan variere. Dette afsnit definerer, hvad der bruges til at udføre NetWorker-klyngeovervågningsfunktioner. 

Som standard har pacemakerressourcen til NetWorker en "monitor" operation. Operationen har "interval" og "timeout" indstillinger, som konfigureres af klyngeadministratoren under den indledende NetWorker-klyngekonfiguration.

root@NWrhelNodeA:~# pcs resource
  * Resource Group: NW_group:
    * fs        (ocf::heartbeat:Filesystem):     Started NWrhelNodeA.emclab.local
    * ip        (ocf::heartbeat:IPaddr):         Started NWrhelNodeA.emclab.local
    * nws       (ocf::EMC_NetWorker:Server):     Started NWrhelNodeA.emclab.local
root@NWrhelNodeA:~# pcs resource config nws Resource: nws (class=ocf provider=EMC_NetWorker type=Server) Meta Attrs: is-managed=true Operations: meta-data interval=0 timeout=10 (nws-meta-data-interval-0) migrate_from interval=0 timeout=120 (nws-migrate_from-interval-0) migrate_to interval=0 timeout=60 (nws-migrate_to-interval-0) start interval=0 timeout=300 (nws-start-interval-0) stop interval=0s timeout=300 (nws-stop-interval-0s) validate-all interval=0 timeout=10 (nws-validate-all-interval-0) monitor interval=120s timeout=300 (nws-monitor-interval-120s)

NetWorker er konfigureret til at bruge OCF (Open Cluster Framework). Overvågningsfunktionen er defineret i /usr/lib/ocf/resource.d/EMC_NetWorker/Server:

NWServer_monitor() {
        local count

        # exit immediately if configuration is not valid
        NWServer_validate_all || exit $?

        quick_monitor
        if [ $? -eq 0 ]; then
                count=0
                while [ $count -lt 3 ]; do
                        echo "q" | nsradmin -s ${NSR_SERVERHOST} -i - > /dev/null 2>&1
                        if [ $? -eq 0 ]; then
                                return $OCF_SUCCESS
                        else
                                count=`expr ${count} + 1`
                                sleep 1
                        fi
                done
        else
                return $OCF_NOT_RUNNING
        fi

        return $OCF_NOT_RUNNING
}

BEMÆRK: Overvågningsfejl bør teknisk set aldrig forekomme under normale omstændigheder og bør være tegn på en uoprettelig fejl. Nogle store miljøer kan dog opleve periodiske problemer, hvor nsradmin kan mislykkes på skærmtest af en pacemaker, selvom det kun er midlertidigt, og det resulterer i, at pacemakeren tager en fuld afbrydelse.

解析度

Klyngeadministratoren bør undersøge alle problemer med klyngeafbrydelse. Klyngelogfilerne kan gennemses for at få oplysninger om afbrydelser:

  • /var/log/pcsd/pcsd.log
  • /var/log/pacemaker/pacemaker.log
  • /var/log/messages

NetWorker-serverlogfiler kan også gennemses. NetWorker-serverens daemon.log er placeret på den delte disk (f.eks. /nsr_share).

  • /nsr_share/nsr/logs/daemon.log

Hvis gengivelse i realtid ikke er aktiveret, vises ikonet .raw Log kan gengives i en .log fil med følgende kommando:

nsr_render_log /nsr_share/nsr/logs/daemon.raw > /nsr_share/nsr/logs/daemon_`date -I`.log

Klyngeadministratoren kan øge skærminterval- og timeoutværdierne for NetWorker-server-pc'ens ressource. Se dokumentationen til Red Hat Pacemaker for anvisninger i, hvordan du ændrer timeoutværdierne, da pacemakerkommandoer kan ændres på tværs af pacemakerversioner.

Som standard forsøger pacemakeren at overvåge funktionen igen tre gange. Hvis du ønsker, at dette skal være en justerbar parameter, skal du kontakte din Dell-konto eller salgsrepræsentant for at åbne en anmodning om forbedring (RFE).

其他資訊

Meddelelsen /usr/lib/ocf/resource.d/EMC_NetWorker/Server nsr_monitor funktionen kan ændres af klyngeadministratoren til at omfatte yderligere funktioner; Denne scripting er dog uden for NetWorker-understøttelse. Alle ændringer af disse scripts fjernes under en NetWorker-serveropgradering.

受影響的產品

NetWorker

產品

NetWorker Family, NetWorker Series
文章屬性
文章編號: 000216735
文章類型: Solution
上次修改時間: 23 7月 2026
版本:  7
向其他 Dell 使用者尋求您問題的答案
支援服務
檢查您的裝置是否在支援服務的涵蓋範圍內。