RecoverPoint til virtuelle maskiner: Procesnedbrud på vRPA'er, der forårsager replikeringspåvirkning
Summary: Konsistensgrupper (CG er) er i fejltilstand, da RecoverPoint-enheder (RPA er) ikke kan få adgang til lager- (KVOL) og journaldiskenheder (JVOL).
Symptoms
I miljøer med RecoverPoint for VMs (RP4VMs) kan CG'er (Consistency Groups) gå i fejltilstand, da RPA erne ikke kan få adgang til lageret og journaldiskenhederne.
Fejl i dashboard- eller systemstatusoutput:
ERROR: Journal volume [Copy, PROD, IOFilter_JVOL_00044] cannot be accessed by: RPA 2
Mulige fejl i kontrol-/replikeringslogfiler:
2020/02/12 23:40:02.275 - #0 - 13659/13550 - MultiPath: errno=0 PathImporter::importFinished: got MPI error: SanDiscoveryBoxMgrProxy connection lost (maybe storage process died?) a_res.error = 1 2020/02/12 23:40:02.275 - #2 - 13631/13550 - MultiPath: MPVolumeConnectingState::handleImportedPaths: requesting non-optimized: a_volume = 0x483a04edc455f87e (StorageType=RP_VSTORAGE, revision= 2020/02/12 23:40:02.275 - #0 - 13631/13550 - MultiPath: errno=0 PathImporter::importFinished: got MPI error: SanDiscoveryBoxMgrProxy connection lost (maybe storage process died?) a_res.error = 1 2020/02/12 23:40:02.275 - #2 - 13631/13550 - MultiPath: MPVolumeConnectingState::handleImportedPaths: requesting all: a_volume = 0x483a04edc455f87e (StorageType=RP_VSTORAGE, revision= 2020/02/12 23:40:02.275 - #0 - 13631/13550 - MultiPath: errno=0 PathImporter::importFinished: got MPI error: SanDiscoveryBoxMgrProxy connection lost (maybe storage process died?) a_res.error = 1 2020/02/12 23:40:02.275 - #2 - 13631/13550 - MultiPath: MultiIOSender::finish: IO error m_volume.getGuid() = 0x483a04edc455f87e &m_io = 0x7f5ef4887950 this = 0x7f5ef4887940 a_status = general error MPVolumeConnectingState
Lagerloggen viser, at logføringen stoppede før det aktuelle tidspunkt (processen kører ikke).
Et andet symptom kan være, at replikationsprocessen genstartes.
RPA-kerneloggen (udpakket "*/files/var/log/kern.log") viser "Out of memory killing" af replikeringsprocessen:
Nov 26 13:36:40 localhost kernel: [4545420.314953] Out of memory: Kill process 4842 (replication) score 530 or sacrifice child Nov 26 13:36:40 localhost kernel: [4545420.354484] Out of memory: Kill process 4842 (replication) score 530 or sacrifice child
Cause
RPA-processerne går ned på grund af manglende hukommelse. RPA VM'er havde ikke al hukommelse reserveret.
Resolution
Løsning:
Genstart RPA erne.
Opløsning:
Kontroller, at alle RPA erne har al gæstehukommelse reserveret.
Højreklik på indstillingerne for vRPA VM > Edit under vSphere...> Udvid sektionen >Hukommelse Vælg Reservér al gæstehukommelse (alle låst)> Klik på OK.
