NetWorker: Сервер NetWorker, розгорнутий на Red Якщо кластер аварійного перемикання Linux Linux Pacemaker не має способу налаштувати інтервал моніторингу.

Сводка: Періодичні збої NetWorker спостерігалися у великих кластерних середовищах через короткі перерви моніторингу. За замовчуванням функція монітора повторюється тричі. Параметр «кількість повторних спроб» недоступний. Ця база знань визначає потенційні обхідні шляхи, а також деталі запиту на покращення (RFE) для можливості покращення NetWorker. ...

Данная статья применяется к Данная статья не применяется к Эта статья не привязана к какому-либо конкретному продукту. В этой статье указаны не все версии продуктов.

Симптомы

  • Сервер NetWorker встановлений на кардіостимуляторі Red Hat (pcs) кластер аварійного перемикання.
  • У NetWorker трапляються періодичні перебої через короткі перерви в роботі Pacemaker (pcs) ресурс для сервера NetWorker (за замовчуванням nws)

Причина

Причини перебоїв у кластері можуть бути різними. У цьому розділі визначено, що використовується для виконання функцій моніторингу кластера NetWorker. 

За замовчуванням ресурс Pacemaker для NetWorker має "monitor" операція. Операція має "interval" і "timeout" налаштування, які налаштовуються адміністратором кластера під час початкової конфігурації кластера NetWorker.

root@NWrhelNodeA:~# pcs resource
  * Resource Group: NW_group:
    * fs        (ocf::heartbeat:Filesystem):     Started NWrhelNodeA.emclab.local
    * ip        (ocf::heartbeat:IPaddr):         Started NWrhelNodeA.emclab.local
    * nws       (ocf::EMC_NetWorker:Server):     Started NWrhelNodeA.emclab.local
root@NWrhelNodeA:~# pcs resource config nws Resource: nws (class=ocf provider=EMC_NetWorker type=Server) Meta Attrs: is-managed=true Operations: meta-data interval=0 timeout=10 (nws-meta-data-interval-0) migrate_from interval=0 timeout=120 (nws-migrate_from-interval-0) migrate_to interval=0 timeout=60 (nws-migrate_to-interval-0) start interval=0 timeout=300 (nws-start-interval-0) stop interval=0s timeout=300 (nws-stop-interval-0s) validate-all interval=0 timeout=10 (nws-validate-all-interval-0) monitor interval=120s timeout=300 (nws-monitor-interval-120s)

NetWorker налаштований на використання Open Cluster Framework (OCF). Функція моніторингу визначається у /usr/lib/ocf/resource.d/EMC_NetWorker/Server:

NWServer_monitor() {
        local count

        # exit immediately if configuration is not valid
        NWServer_validate_all || exit $?

        quick_monitor
        if [ $? -eq 0 ]; then
                count=0
                while [ $count -lt 3 ]; do
                        echo "q" | nsradmin -s ${NSR_SERVERHOST} -i - > /dev/null 2>&1
                        if [ $? -eq 0 ]; then
                                return $OCF_SUCCESS
                        else
                                count=`expr ${count} + 1`
                                sleep 1
                        fi
                done
        else
                return $OCF_NOT_RUNNING
        fi

        return $OCF_NOT_RUNNING
}

ПРИМІТКА: Технічно відмова монітора не повинна траплятися за нормальних обставин і має свідчити про невиправну помилку. Однак деякі великі середовища можуть спостерігати періодичні проблеми, де nsradmin може не працювати на моніторному тесті кардіостимулятора навіть тимчасово, і це призводить до повного відключення кардіостимулятора.

Разрешение

Адміністратор кластера повинен розслідувати всі проблеми з відключеннями кластера. Журнали кластера можна переглянути на наявність деталей щодо переривань:

  • /var/log/pcsd/pcsd.log
  • /var/log/pacemaker/pacemaker.log
  • /var/log/messages

Також можна переглядати логи серверів NetWorker. daemon.log сервера NetWorker розташований на спільному диску (наприклад, /nsr_share).

  • /nsr_share/nsr/logs/daemon.log

Якщо рендеринг у реальному часі не увімкнений, то .raw log можна відобразити у .log-файл за допомогою наступної команди:

nsr_render_log /nsr_share/nsr/logs/daemon.raw > /nsr_share/nsr/logs/daemon_`date -I`.log

Адміністратор кластера може збільшувати інтервал монітора та значення тайм-ауту для ресурсу сервера NetWorker PC. Дивіться документацію Red Hat Pacemaker для інструкцій щодо зміни значень тайм-ауту, оскільки команди Pacemaker можуть змінюватися між версіями Pacemaker.

За замовчуванням Pacemaker тричі повторює функцію монітора. Якщо ви хочете, щоб це був налаштовуваний параметр, зверніться до свого акаунта Dell або торгового представника, щоб відкрити запит на покращення (RFE).

Дополнительная информация

Повідомлення /usr/lib/ocf/resource.d/EMC_NetWorker/Server nsr_monitor функцію може модифікувати адміністратор кластера, щоб включити додаткові функції; однак цей скрипт поза підтримкою NetWorker. Будь-які зміни в цих скриптах видаляються під час оновлення сервера NetWorker.

Затронутые продукты

NetWorker

Продукты

NetWorker Family, NetWorker Series
Свойства статьи
Номер статьи: 000216735
Тип статьи: Solution
Последнее изменение: 23 Jul 2026
Версия:  7
Получите ответы на свои вопросы от других пользователей Dell
Услуги технической поддержки
Проверьте, распространяются ли на ваше устройство услуги технической поддержки.