RecoverPoint: Proces replikace se zhroutí, což způsobí poškození deníku a úplné vyčištění
Summary: Proces replikace se zhroutí, což způsobí poškození deníku a úplné vymazání skupiny konzistence
Symptoms
Kvůli problému s kódem může chyba distribuce způsobit ztrátu deníku, což vede k úplnému úklidu skupiny konzistence (CG) a ztrátě všech položek deníku.
To má vliv na standardní kopii repliky, ale ne na pole Data Domain nebo XtremIO.
V protokolech replikace zařízení Site Control RecoverPoint jsou zaznamenány následující poznatky:
2019/05/25 00:00:43.684 - #2 - 7872/7573 - DistributorGroupHandler::tryDistributeForward: highPerf m_GroupGridCopyRID = (groupCopyRID=(kVolSlot=XXXXXX,globalCopyID=GlobalCopy(SiteUID(0XXXXXXX..a) 0) ),gridCopyID=0)... 2019/05/25 00:00:46.427 - #2 - 7691/7573 - ReplicationControl_AO_IMPL::closePipe_i: enter groupCopyID = GroupCopy(XXXXXXXXXX SiteUID() 0) destCopyID = GlobalCopy(SiteUID(0x0XXXXXX..a) 0)... 2019/05/25 00:00:46.435 - #2 - 7691/7573 - DistributorGroupHandler::closeSession: close session free a_Data.m_bPartialReleaseStarted = 1 a_Data.m_bPartialReleaseSessionStarted = 1 ... a_Data.m_InitDoSnapHead = StreamPointer(streamID=13060353732993089537 blockID=1839 offset=261304942) ... ... 2019/05/25 00:00:46.575 - #2 - 7704/7573 - ReplicationControl_AO_IMPL::openPipe_i: groupCopyID = GroupCopy(XXXXXX SiteUID(0xxxxxx..a) 0)... 2019/05/25 00:01:16.552 - #2 - 10582/7573 - Fetcher_AO_IMPL::fetch_i: ... m_readLoc = StreamPointer(streamID=13060353732993089537 blockID=1839 offset=318942206) 2019/05/25 00:01:16.621 - #2 - 7869/7573 - Fetcher_AO_IMPL::read: a_startPtr = StreamPointer(streamID=13060353732993089537 blockID=1839 offset=318942206) a_isFastForward = 0 a_fastForwardTimeStamp = NoOption 2019/05/25 00:01:16.634 - #0 - 10582/7573 - PersistentObjectVersion: errno=0 Call to deserialization with unknown version=62, current version =16
Cause
Během inicializace se kanál zavře, proces replikace může uvolnit bloky žurnálu, o kterých si autor není vědom, což přeruší snímek a povede k poškození.
Resolution
Zástupné řešení: Na každém zařízení RecoverPoint (RPA) v každém clusteru změňte v závislosti na verzi RecoverPoint následující vylepšení v rámci správce boxmgmt nebo správce: t_maxHighPerfGroups = 0
Výchozí hodnota je 3 a měla by být změněna na 0.
Poté je nutné restartovat každé zařízení RecoverPoint, aby se změna projevila.
Řešení: Tento problém je vyřešen ve verzi RecoverPoint 5.1.4.1 (5.1 SP4 Patch 1 a novější).