NetWorker: Red에 배포된 NetWorker Server Had Enterprise Linux Pacemaker 페일오버 클러스터에는 모니터링 간격을 튜닝할 방법이 없습니다.

Сводка: 대규모 클러스터 환경에서 짧은 모니터링 중단으로 인한 간헐적인 NetWorker 운영 중단이 관찰됩니다. 기본적으로 monitor 함수는 세 번 재시도합니다. 사용 가능한 "재시도 횟수" 매개변수가 없습니다. 이 KB는 잠재적인 해결 방법 및 NetWorker 개선 기회에 대한 RFE(Request For Enhancement) 세부 정보를 정의합니다. ...

Данная статья применяется к Данная статья не применяется к Эта статья не привязана к какому-либо конкретному продукту. В этой статье указаны не все версии продуктов.

Симптомы

  • NetWorker Server는 Red Hat Pacemaker(pcs) 장애 조치(failover) 클러스터.
  • Pacemaker(pcs) 리소스를 NetWorker Server에 사용할 수 있습니다(기본값: nws)

Причина

클러스터 운영 중단의 원인은 다양할 수 있습니다. 이 섹션에서는 NetWorker 클러스터 모니터 기능을 수행하는 데 사용되는 내용을 정의합니다. 

기본적으로 NetWorker의 Pacemaker 리소스에는 "monitor" 작업. 작업에 "interval" 및 "timeout" 설정은 초기 NetWorker 클러스터 구성 중에 클러스터 관리자가 구성합니다.

root@NWrhelNodeA:~# pcs resource
  * Resource Group: NW_group:
    * fs        (ocf::heartbeat:Filesystem):     Started NWrhelNodeA.emclab.local
    * ip        (ocf::heartbeat:IPaddr):         Started NWrhelNodeA.emclab.local
    * nws       (ocf::EMC_NetWorker:Server):     Started NWrhelNodeA.emclab.local
root@NWrhelNodeA:~# pcs resource config nws Resource: nws (class=ocf provider=EMC_NetWorker type=Server) Meta Attrs: is-managed=true Operations: meta-data interval=0 timeout=10 (nws-meta-data-interval-0) migrate_from interval=0 timeout=120 (nws-migrate_from-interval-0) migrate_to interval=0 timeout=60 (nws-migrate_to-interval-0) start interval=0 timeout=300 (nws-start-interval-0) stop interval=0s timeout=300 (nws-stop-interval-0s) validate-all interval=0 timeout=10 (nws-validate-all-interval-0) monitor interval=120s timeout=300 (nws-monitor-interval-120s)

NetWorker는 OCF(Open Cluster Framework)를 사용하도록 구성됩니다. 모니터링 기능은 /usr/lib/ocf/resource.d/EMC_NetWorker/Server:

NWServer_monitor() {
        local count

        # exit immediately if configuration is not valid
        NWServer_validate_all || exit $?

        quick_monitor
        if [ $? -eq 0 ]; then
                count=0
                while [ $count -lt 3 ]; do
                        echo "q" | nsradmin -s ${NSR_SERVERHOST} -i - > /dev/null 2>&1
                        if [ $? -eq 0 ]; then
                                return $OCF_SUCCESS
                        else
                                count=`expr ${count} + 1`
                                sleep 1
                        fi
                done
        else
                return $OCF_NOT_RUNNING
        fi

        return $OCF_NOT_RUNNING
}

참고: 모니터 장애는 기술적으로 정상적인 상황에서 발생해서는 안 되며 복구할 수 없는 오류를 나타내야 합니다. 그러나 일부 대규모 환경에서는 간헐적으로 문제가 발생할 수 있습니다. nsradmin 일시적일지라도 Pacemaker의 모니터 테스트에 실패할 수 있으며, 이로 인해 Pacemaker가 완전히 중단됩니다.

Разрешение

클러스터 관리자는 모든 클러스터 운영 중단 문제를 조사해야 합니다. 클러스터 로그에서 중단에 대한 세부 정보를 검토할 수 있습니다.

  • /var/log/pcsd/pcsd.log
  • /var/log/pacemaker/pacemaker.log
  • /var/log/messages

NetWorker Server 로그도 검토할 수 있습니다. NetWorker Server의 daemon.log 공유 디스크에 있습니다(예: /nsr_share).

  • /nsr_share/nsr/logs/daemon.log

실시간 렌더링이 활성화되지 않은 경우 .raw 로그는 다음 명령을 사용하여 .log 파일로 렌더링할 수 있습니다.

nsr_render_log /nsr_share/nsr/logs/daemon.raw > /nsr_share/nsr/logs/daemon_`date -I`.log

클러스터 관리자는 NetWorker Server PC 리소스의 모니터 간격 및 시간 초과 값을 늘릴 수 있습니다. Pacemaker 명령이 Pacemaker 버전 간에 변경될 수 있으므로 시간 제한 값 변경에 대한 지침은 Red Hat Pacemaker 설명서를 참조하십시오.

기본적으로 Pacemaker는 모니터 기능을 세 번 다시 시도합니다. 이를 조정 가능한 매개변수로 사용하려면 Dell 계정 또는 영업 담당자에게 문의하여 RFE(Request for Enhancement)를 개설하십시오.

Дополнительная информация

OPER는 /usr/lib/ocf/resource.d/EMC_NetWorker/Server nsr_monitor 클러스터 관리자는 추가 기능을 포함하도록 기능을 수정할 수 있습니다. 그러나 이 스크립팅은 NetWorker 지원 범위를 벗어납니다. 이러한 스크립트에 대한 모든 변경 사항은 NetWorker Server 업그레이드 중에 제거됩니다.

Затронутые продукты

NetWorker

Продукты

NetWorker Family, NetWorker Series
Свойства статьи
Номер статьи: 000216735
Тип статьи: Solution
Последнее изменение: 23 Jul 2026
Версия:  7
Получите ответы на свои вопросы от других пользователей Dell
Услуги технической поддержки
Проверьте, распространяются ли на ваше устройство услуги технической поддержки.