RecoverPoint for Virtual Machines: Awarie procesów na vRPA powodujące wpływ na replikację
Summary: Grupy spójności (CG) w stanie błędu, ponieważ urządzenia RecoverPoint Appliance (RPA) nie mogą uzyskać dostępu do woluminów repozytorium (KVOL) i dziennika (JVOL).
Symptoms
W środowiskach RecoverPoint dla maszyn wirtualnych (RP4VMs) grupy spójności (CG) mogą przejść w stan błędu, ponieważ RPA nie mogą uzyskać dostępu do repozytorium i woluminów dziennika.
Błędy na pulpicie nawigacyjnym lub w danych wyjściowych stanu systemu:
ERROR: Journal volume [Copy, PROD, IOFilter_JVOL_00044] cannot be accessed by: RPA 2
Możliwe błędy w dziennikach sterowania/replikacji:
2020/02/12 23:40:02.275 - #0 - 13659/13550 - MultiPath: errno=0 PathImporter::importFinished: got MPI error: SanDiscoveryBoxMgrProxy connection lost (maybe storage process died?) a_res.error = 1 2020/02/12 23:40:02.275 - #2 - 13631/13550 - MultiPath: MPVolumeConnectingState::handleImportedPaths: requesting non-optimized: a_volume = 0x483a04edc455f87e (StorageType=RP_VSTORAGE, revision= 2020/02/12 23:40:02.275 - #0 - 13631/13550 - MultiPath: errno=0 PathImporter::importFinished: got MPI error: SanDiscoveryBoxMgrProxy connection lost (maybe storage process died?) a_res.error = 1 2020/02/12 23:40:02.275 - #2 - 13631/13550 - MultiPath: MPVolumeConnectingState::handleImportedPaths: requesting all: a_volume = 0x483a04edc455f87e (StorageType=RP_VSTORAGE, revision= 2020/02/12 23:40:02.275 - #0 - 13631/13550 - MultiPath: errno=0 PathImporter::importFinished: got MPI error: SanDiscoveryBoxMgrProxy connection lost (maybe storage process died?) a_res.error = 1 2020/02/12 23:40:02.275 - #2 - 13631/13550 - MultiPath: MultiIOSender::finish: IO error m_volume.getGuid() = 0x483a04edc455f87e &m_io = 0x7f5ef4887950 this = 0x7f5ef4887940 a_status = general error MPVolumeConnectingState
Dziennik pamięci masowej pokazuje, że rejestrowanie zostało zatrzymane przed bieżącą godziną (proces nie jest uruchomiony).
Innym objawem może być ponowne uruchomienie procesu replikacji.
Dziennik jądra RPA (wyodrębniony "*/files/var/log/kern.log") pokazuje "Out of memory killing" procesu replikacji:
Nov 26 13:36:40 localhost kernel: [4545420.314953] Out of memory: Kill process 4842 (replication) score 530 or sacrifice child Nov 26 13:36:40 localhost kernel: [4545420.354484] Out of memory: Kill process 4842 (replication) score 530 or sacrifice child
Cause
Procesy RPA ulegają awarii z powodu braku pamięci. Maszyny wirtualne RPA nie miały zarezerwowanej całej pamięci.
Resolution
Obejście:
Uruchom ponownie RPA.
Rozdzielczość:
Sprawdź, czy wszystkie RPA mają zarezerwowaną całą pamięć gościa.
W obszarze vSphere kliknij prawym przyciskiem myszy vRPA VM > Edit settings... > Rozwiń sekcję >MemorySelect Reserve all guest memory (All locked)> Kliknij przycisk OK.
