NetWorker: NetWorker-serveren implementert på rødt Hadde Enterprise Linux Pacemaker failover-klynge ingen metode for å justere overvåkingsintervallet.

摘要: Periodiske NetWorker-avbrudd observert i store klyngemiljøer på grunn av kortvarige overvåkingsavbrudd. Skjermfunksjonen prøver på nytt tre ganger som standard. Det er ingen "retry count"-parameter tilgjengelig. Denne kunnskapsartikkelen definerer potensielle midlertidige løsninger, og en RFE-forespørsel (Request For Enhancement) for en mulighet for NetWorker-forbedring. ...

本文章適用於 本文章不適用於 本文無關於任何特定產品。 本文未識別所有產品版本。

症狀

  • NetWorker-serveren er installert på en Red Hat Pacemaker (pcs) failover-klynge.
  • Det er periodisk nedetid i NetWorker på grunn av korte avbrudd i pacemakeren (pcs) ressurs for NetWorker-serveren (standard er nws)

原因

Årsaken til klyngebrudd kan variere. Denne delen definerer hva som brukes til å utføre NetWorker-klyngeovervåkingsfunksjoner. 

Pacemakerressursen for NetWorker har som standard en "monitor" operasjon. Operasjonen har "interval" og "timeout" -innstillinger som konfigureres av klyngeadministratoren under den første konfigurasjonen av NetWorker-klyngen.

root@NWrhelNodeA:~# pcs resource
  * Resource Group: NW_group:
    * fs        (ocf::heartbeat:Filesystem):     Started NWrhelNodeA.emclab.local
    * ip        (ocf::heartbeat:IPaddr):         Started NWrhelNodeA.emclab.local
    * nws       (ocf::EMC_NetWorker:Server):     Started NWrhelNodeA.emclab.local
root@NWrhelNodeA:~# pcs resource config nws Resource: nws (class=ocf provider=EMC_NetWorker type=Server) Meta Attrs: is-managed=true Operations: meta-data interval=0 timeout=10 (nws-meta-data-interval-0) migrate_from interval=0 timeout=120 (nws-migrate_from-interval-0) migrate_to interval=0 timeout=60 (nws-migrate_to-interval-0) start interval=0 timeout=300 (nws-start-interval-0) stop interval=0s timeout=300 (nws-stop-interval-0s) validate-all interval=0 timeout=10 (nws-validate-all-interval-0) monitor interval=120s timeout=300 (nws-monitor-interval-120s)

NetWorker er konfigurert til å bruke Open Cluster Framework (OCF). Overvåkingsfunksjonen er definert i /usr/lib/ocf/resource.d/EMC_NetWorker/Server:

NWServer_monitor() {
        local count

        # exit immediately if configuration is not valid
        NWServer_validate_all || exit $?

        quick_monitor
        if [ $? -eq 0 ]; then
                count=0
                while [ $count -lt 3 ]; do
                        echo "q" | nsradmin -s ${NSR_SERVERHOST} -i - > /dev/null 2>&1
                        if [ $? -eq 0 ]; then
                                return $OCF_SUCCESS
                        else
                                count=`expr ${count} + 1`
                                sleep 1
                        fi
                done
        else
                return $OCF_NOT_RUNNING
        fi

        return $OCF_NOT_RUNNING
}

MERK: Overvåkingsfeil skal teknisk sett aldri forekomme under normale omstendigheter og skal være en indikasjon på en uopprettelig feil. Noen store miljøer kan imidlertid observere periodiske problemer der nsradmin kan mislykkes på monitortest av en pacemaker selv om det bare er midlertidig, og det resulterer i at pacemakeren tar full strømbrudd.

解析度

Klyngeadministratoren bør undersøke alle problemer med klyngebrudd. Klyngeloggene kan gjennomgås for detaljer om avbrudd:

  • /var/log/pcsd/pcsd.log
  • /var/log/pacemaker/pacemaker.log
  • /var/log/messages

NetWorker-serverlogger kan også gjennomgås. NetWorker-serverens daemon.log er plassert på den delte disken (for eksempel /nsr_share).

  • /nsr_share/nsr/logs/daemon.log

Hvis sanntidsgjengivelse ikke er aktivert, vises .raw logg kan gjengis i en .log fil med følgende kommando:

nsr_render_log /nsr_share/nsr/logs/daemon.raw > /nsr_share/nsr/logs/daemon_`date -I`.log

Klyngeadministratoren kan øke verdiene for skjermintervall og tidsavbrudd for NetWorker-serverdatamaskinen. Se Red Hat Pacemaker-dokumentasjonen for instruksjoner om hvordan du endrer verdiene for tidsavbrudd, da Pacemaker-kommandoer kan endres på tvers av Pacemaker-versjoner.

Pacemakeren prøver skjermfunksjonen på nytt tre ganger som standard. Hvis du vil at dette skal være en justerbar parameter, kontakter du Dell-kontoen eller kundekontakten din for å åpne en forespørsel om forbedring (RFE).

其他資訊

Meldingen /usr/lib/ocf/resource.d/EMC_NetWorker/Server nsr_monitor funksjonen kan endres av klyngeadministratoren for å inkludere tilleggsfunksjoner. Denne skriptingen er imidlertid utenfor NetWorker-støtten. Alle endringer i disse skriptene fjernes under en oppgradering av NetWorker-serveren.

受影響的產品

NetWorker

產品

NetWorker Family, NetWorker Series
文章屬性
文章編號: 000216735
文章類型: Solution
上次修改時間: 23 7月 2026
版本:  7
向其他 Dell 使用者尋求您問題的答案
支援服務
檢查您的裝置是否在支援服務的涵蓋範圍內。