RecoverPoint для віртуальних машин: Збої процесів на vRPA, що спричиняють вплив реплікації
Summary: Групи узгодженості (CG), які перебувають у стані помилок як пристрої RecoverPoint (RPA), не можуть отримати доступ до томів репозиторію (KVOL) та журналу (JVOL).
Symptoms
У середовищах RecoverPoint for VM (RP4VM) групи узгодженості (CG) можуть перейти у стан помилки, оскільки RPA не можуть отримати доступ до репозиторію та томів журналу.
Помилки у панелі керування або на виводі статусу системи:
ERROR: Journal volume [Copy, PROD, IOFilter_JVOL_00044] cannot be accessed by: RPA 2
Можливі помилки в журналах керування/реплікації:
2020/02/12 23:40:02.275 - #0 - 13659/13550 - MultiPath: errno=0 PathImporter::importFinished: got MPI error: SanDiscoveryBoxMgrProxy connection lost (maybe storage process died?) a_res.error = 1 2020/02/12 23:40:02.275 - #2 - 13631/13550 - MultiPath: MPVolumeConnectingState::handleImportedPaths: requesting non-optimized: a_volume = 0x483a04edc455f87e (StorageType=RP_VSTORAGE, revision= 2020/02/12 23:40:02.275 - #0 - 13631/13550 - MultiPath: errno=0 PathImporter::importFinished: got MPI error: SanDiscoveryBoxMgrProxy connection lost (maybe storage process died?) a_res.error = 1 2020/02/12 23:40:02.275 - #2 - 13631/13550 - MultiPath: MPVolumeConnectingState::handleImportedPaths: requesting all: a_volume = 0x483a04edc455f87e (StorageType=RP_VSTORAGE, revision= 2020/02/12 23:40:02.275 - #0 - 13631/13550 - MultiPath: errno=0 PathImporter::importFinished: got MPI error: SanDiscoveryBoxMgrProxy connection lost (maybe storage process died?) a_res.error = 1 2020/02/12 23:40:02.275 - #2 - 13631/13550 - MultiPath: MultiIOSender::finish: IO error m_volume.getGuid() = 0x483a04edc455f87e &m_io = 0x7f5ef4887950 this = 0x7f5ef4887940 a_status = general error MPVolumeConnectingState
Журнал зберігання показує, що журналування припинилося до поточного часу (процес не запущений).
Ще одним симптомом може бути повторний процес реплікації.
Журнал ядра RPA (витягнутий як "*/files/var/log/kern.log") показує "Kill of of memory killing" процесу реплікації:
Nov 26 13:36:40 localhost kernel: [4545420.314953] Out of memory: Kill process 4842 (replication) score 530 or sacrifice child Nov 26 13:36:40 localhost kernel: [4545420.354484] Out of memory: Kill process 4842 (replication) score 530 or sacrifice child
Cause
Процеси RPA виходять з ладу через нестачу пам'яті. Віртуальні машини RPA не мали всю пам'ять зарезервованою.
Resolution
Обхідний шлях:
Перезавантажте RPA.
Розв'язка:
Перевірте, чи всі RPA мають зарезервовану всю гостьову пам'ять.
У розділі vSphere клацніть правою кнопкою миші на налаштуваннях vRPA VM > Edit... > Розгорніть розділ >Пам'ять, виберіть Зарезервувати всю гостьову пам'ять (Вся заблокована) Натисніть>OK.
