NetWorker: сервер NetWorker, развернутый в отказоустойчивом кластере Red Enterprise Linux Pacemaker, не имеет метода настройки интервала мониторинга.

Сводка: Периодические перебои в работе NetWorker, наблюдаемые в больших кластерных средах из-за кратковременных перерывов мониторинга. По умолчанию функция мониторинга повторяет три раза. Параметр «количество повторных попыток» недоступен. В этой статье базы знаний описаны потенциальные временные решения проблемы, а также приведены сведения о запросе на улучшение (RFE) для возможности улучшения NetWorker. ...

Данная статья применяется к Данная статья не применяется к Эта статья не привязана к какому-либо конкретному продукту. В этой статье указаны не все версии продуктов.

Симптомы

  • Сервер NetWorker установлен на Red Hat Pacemaker (pcs) отказоустойчивый кластер.
  • Кратковременные перебои в работе Pacemaker в NetWorker происходят периодические перебои в работе (pcs) для сервера NetWorker (по умолчанию nws)

Причина

Причины перебоев в работе кластера могут быть различными. В этом разделе определяется, что используется для выполнения функций монитора кластера NetWorker. 

По умолчанию ресурс Pacemaker для NetWorker имеет параметр «monitor" операции. Операция имеет «interval" и "timeout», которые настраиваются администратором кластера во время первоначальной настройки кластера NetWorker.

root@NWrhelNodeA:~# pcs resource
  * Resource Group: NW_group:
    * fs        (ocf::heartbeat:Filesystem):     Started NWrhelNodeA.emclab.local
    * ip        (ocf::heartbeat:IPaddr):         Started NWrhelNodeA.emclab.local
    * nws       (ocf::EMC_NetWorker:Server):     Started NWrhelNodeA.emclab.local
root@NWrhelNodeA:~# pcs resource config nws Resource: nws (class=ocf provider=EMC_NetWorker type=Server) Meta Attrs: is-managed=true Operations: meta-data interval=0 timeout=10 (nws-meta-data-interval-0) migrate_from interval=0 timeout=120 (nws-migrate_from-interval-0) migrate_to interval=0 timeout=60 (nws-migrate_to-interval-0) start interval=0 timeout=300 (nws-start-interval-0) stop interval=0s timeout=300 (nws-stop-interval-0s) validate-all interval=0 timeout=10 (nws-validate-all-interval-0) monitor interval=120s timeout=300 (nws-monitor-interval-120s)

NetWorker настроен на использование Open Cluster Framework (OCF). Функция мониторинга определяется в /usr/lib/ocf/resource.d/EMC_NetWorker/Server:

NWServer_monitor() {
        local count

        # exit immediately if configuration is not valid
        NWServer_validate_all || exit $?

        quick_monitor
        if [ $? -eq 0 ]; then
                count=0
                while [ $count -lt 3 ]; do
                        echo "q" | nsradmin -s ${NSR_SERVERHOST} -i - > /dev/null 2>&1
                        if [ $? -eq 0 ]; then
                                return $OCF_SUCCESS
                        else
                                count=`expr ${count} + 1`
                                sleep 1
                        fi
                done
        else
                return $OCF_NOT_RUNNING
        fi

        return $OCF_NOT_RUNNING
}

ПРИМЕЧАНИЕ: Сбой монитора технически никогда не должен возникать при нормальных обстоятельствах и должен указывать на неустранимую ошибку. Тем не менее, в некоторых крупных средах могут периодически возникать проблемы, когда nsradmin может завершиться сбоем при проверке кардиостимулятора монитором, даже если это временно, и это приведет к полному отключению кардиостимулятора.

Разрешение

Администратор кластера должен изучить все проблемы, связанные с перебоями в работе кластера. Можно просмотреть журналы кластера для получения любых сведений о прерываниях:

  • /var/log/pcsd/pcsd.log
  • /var/log/pacemaker/pacemaker.log
  • /var/log/messages

Также можно просмотреть журналы сервера NetWorker. daemon.log сервера NetWorker находится на общем диске (например, /nsr_share).

  • /nsr_share/nsr/logs/daemon.log

Если рендеринг в реальном времени не включен, .raw Журнал можно преобразовать в файл .log с помощью следующей команды:

nsr_render_log /nsr_share/nsr/logs/daemon.raw > /nsr_share/nsr/logs/daemon_`date -I`.log

Администратор кластера может увеличить значения интервала мониторинга и времени ожидания для ресурса ПК сервера NetWorker. Инструкции по изменению значений тайм-аута см. в документации по Red Hat Pacemaker, так как команды Pacemaker могут различаться в разных версиях Pacemaker.

По умолчанию Pacemaker трижды повторяет функцию монитора. Если вы хотите, чтобы этот параметр был настраиваемым, обратитесь к менеджеру по работе с клиентами или менеджеру по продажам Dell, чтобы создать запрос на улучшение (RFE).

Дополнительная информация

В строке /usr/lib/ocf/resource.d/EMC_NetWorker/Server nsr_monitor функция может быть изменена администратором кластера, чтобы включить дополнительные функции; однако эти сценарии находятся за пределами поддержки NetWorker. Любые изменения в этих сценариях удаляются во время модернизации сервера NetWorker.

Затронутые продукты

NetWorker

Продукты

NetWorker Family, NetWorker Series
Свойства статьи
Номер статьи: 000216735
Тип статьи: Solution
Последнее изменение: 23 Jul 2026
Версия:  7
Получите ответы на свои вопросы от других пользователей Dell
Услуги технической поддержки
Проверьте, распространяются ли на ваше устройство услуги технической поддержки.