NetWorker: NetWorker-server geïmplementeerd op Red Had Enterprise Linux Pacemaker failover cluster geen methode voor het afstemmen van het bewakingsinterval.

摘要: Onregelmatige NetWorker-storingen waargenomen in grote clusteromgevingen als gevolg van korte onderbrekingen van de bewaking. Standaard wordt de monitorfunctie drie keer opnieuw geprobeerd. Er is geen parameter "aantal nieuwe pogingen" beschikbaar. Dit KB-artikel definieert mogelijke tijdelijke oplossingen en een Request For Enhancement (RFE)-details voor een NetWorker-verbeteringsmogelijkheid. ...

本文章適用於 本文章不適用於 本文無關於任何特定產品。 本文未識別所有產品版本。

症狀

  • De NetWorker-server is geïnstalleerd op een Red Hat-pacemaker (pcs) failovercluster.
  • Er zijn af en toe storingen in NetWorker als gevolg van korte onderbrekingen van de pacemaker (pcs) resource voor NetWorker-server (standaard is nws)

原因

De oorzaak van clusterstoringen kan variëren. In deze sectie wordt gedefinieerd wat wordt gebruikt om de monitorfuncties van het NetWorker cluster uit te voeren. 

Standaard heeft de pacemakerbron voor NetWorker een "monitor" werking. De operatie heeft "interval" en "timeout" instellingen die zijn geconfigureerd door de clusterbeheerder tijdens de initiële NetWorker-clusterconfiguratie.

root@NWrhelNodeA:~# pcs resource
  * Resource Group: NW_group:
    * fs        (ocf::heartbeat:Filesystem):     Started NWrhelNodeA.emclab.local
    * ip        (ocf::heartbeat:IPaddr):         Started NWrhelNodeA.emclab.local
    * nws       (ocf::EMC_NetWorker:Server):     Started NWrhelNodeA.emclab.local
root@NWrhelNodeA:~# pcs resource config nws Resource: nws (class=ocf provider=EMC_NetWorker type=Server) Meta Attrs: is-managed=true Operations: meta-data interval=0 timeout=10 (nws-meta-data-interval-0) migrate_from interval=0 timeout=120 (nws-migrate_from-interval-0) migrate_to interval=0 timeout=60 (nws-migrate_to-interval-0) start interval=0 timeout=300 (nws-start-interval-0) stop interval=0s timeout=300 (nws-stop-interval-0s) validate-all interval=0 timeout=10 (nws-validate-all-interval-0) monitor interval=120s timeout=300 (nws-monitor-interval-120s)

NetWorker is geconfigureerd voor gebruik van Open Cluster Framework (OCF). De bewakingsfunctie is gedefinieerd in /usr/lib/ocf/resource.d/EMC_NetWorker/Server:

NWServer_monitor() {
        local count

        # exit immediately if configuration is not valid
        NWServer_validate_all || exit $?

        quick_monitor
        if [ $? -eq 0 ]; then
                count=0
                while [ $count -lt 3 ]; do
                        echo "q" | nsradmin -s ${NSR_SERVERHOST} -i - > /dev/null 2>&1
                        if [ $? -eq 0 ]; then
                                return $OCF_SUCCESS
                        else
                                count=`expr ${count} + 1`
                                sleep 1
                        fi
                done
        else
                return $OCF_NOT_RUNNING
        fi

        return $OCF_NOT_RUNNING
}

OPMERKING: Monitorstoringen zouden onder normale omstandigheden technisch gezien nooit moeten optreden en moeten wijzen op een onherstelbare fout. Sommige grote omgevingen kunnen echter af en toe problemen waarnemen waarbij nsradmin kan falen bij de monitortest van een pacemaker, al is het maar tijdelijk, en dat resulteert in een volledige uitval van de pacemaker.

解析度

De clusterbeheerder moet alle problemen met clusterstoringen onderzoeken. De clusterlogboeken kunnen worden gecontroleerd op details over onderbrekingen:

  • /var/log/pcsd/pcsd.log
  • /var/log/pacemaker/pacemaker.log
  • /var/log/messages

NetWorker-serverlogboeken kunnen ook worden gecontroleerd. De daemon.log van de NetWorker-server bevindt zich op de gedeelde schijf (bijvoorbeeld: /nsr_share).

  • /nsr_share/nsr/logs/daemon.log

Als realtimeweergave niet is ingeschakeld, wordt het .raw Log kan worden gerenderd in een .log bestand met de volgende opdracht:

nsr_render_log /nsr_share/nsr/logs/daemon.raw > /nsr_share/nsr/logs/daemon_`date -I`.log

De clusterbeheerder kan de waarden voor het monitorinterval en de time-out voor de NetWorker-server-pc's verhogen. Zie de documentatie bij Red Hat Pacemaker voor aanwijzingen voor het wijzigen van de time-outwaarden, aangezien pacemakeropdrachten kunnen veranderen in verschillende versies van de pacemaker.

Standaard probeert de pacemaker de monitorfunctie drie keer opnieuw. Als u wilt dat dit een afstembare parameter is, neemt u contact op met uw Dell account of verkoopvertegenwoordiger om een Request for Enhancement (RFE) te openen.

其他資訊

De toetsen /usr/lib/ocf/resource.d/EMC_NetWorker/Server nsr_monitor functie kan door de clusterbeheerder worden gewijzigd om extra functies op te nemen; Deze scripting valt echter buiten de ondersteuning voor NetWorker. Wijzigingen in deze scripts worden verwijderd tijdens een upgrade van de NetWorker-server.

受影響的產品

NetWorker

產品

NetWorker Family, NetWorker Series
文章屬性
文章編號: 000216735
文章類型: Solution
上次修改時間: 23 7月 2026
版本:  7
向其他 Dell 使用者尋求您問題的答案
支援服務
檢查您的裝置是否在支援服務的涵蓋範圍內。