RecoverPoint: Replikeringsprocesnedbrud, der forårsager journalbeskadigelse og fuld fejning
Summary: Replikeringsprocesnedbrud, der forårsager journalbeskadigelse og fuld fejning af en konsistensgruppe
Symptoms
På grund af et kodeproblem kan en distributionsfejl forårsage tab af journaler, hvilket fører til, at en konsistensgruppe (CG) fejer alle kladdeposter fuldt ud og går tabt.
Dette påvirker en standard replikakopi, men ikke Data Domain eller XtremIO-systemer.
Fra replikeringslogfilerne i Site Control RecoverPoint-enheden ses følgende:
2019/05/25 00:00:43.684 - #2 - 7872/7573 - DistributorGroupHandler::tryDistributeForward: highPerf m_GroupGridCopyRID = (groupCopyRID=(kVolSlot=XXXXXX,globalCopyID=GlobalCopy(SiteUID(0XXXXXXX..a) 0) ),gridCopyID=0)... 2019/05/25 00:00:46.427 - #2 - 7691/7573 - ReplicationControl_AO_IMPL::closePipe_i: enter groupCopyID = GroupCopy(XXXXXXXXXX SiteUID() 0) destCopyID = GlobalCopy(SiteUID(0x0XXXXXX..a) 0)... 2019/05/25 00:00:46.435 - #2 - 7691/7573 - DistributorGroupHandler::closeSession: close session free a_Data.m_bPartialReleaseStarted = 1 a_Data.m_bPartialReleaseSessionStarted = 1 ... a_Data.m_InitDoSnapHead = StreamPointer(streamID=13060353732993089537 blockID=1839 offset=261304942) ... ... 2019/05/25 00:00:46.575 - #2 - 7704/7573 - ReplicationControl_AO_IMPL::openPipe_i: groupCopyID = GroupCopy(XXXXXX SiteUID(0xxxxxx..a) 0)... 2019/05/25 00:01:16.552 - #2 - 10582/7573 - Fetcher_AO_IMPL::fetch_i: ... m_readLoc = StreamPointer(streamID=13060353732993089537 blockID=1839 offset=318942206) 2019/05/25 00:01:16.621 - #2 - 7869/7573 - Fetcher_AO_IMPL::read: a_startPtr = StreamPointer(streamID=13060353732993089537 blockID=1839 offset=318942206) a_isFastForward = 0 a_fastForwardTimeStamp = NoOption 2019/05/25 00:01:16.634 - #0 - 10582/7573 - PersistentObjectVersion: errno=0 Call to deserialization with unknown version=62, current version =16
Cause
Under start lukkes et rør, replikeringsprocessen kan frigøre journalblokke, som fetcheren ikke er opmærksom på, afbryde et snapshot og føre til beskadigelse.
Resolution
Løsning: På hver RecoverPoint-enhed (RPA) ved hver klynge skal du ændre følgende justering fra enten boxmgmt- eller admin-brugeren, afhængigt af din version af RecoverPoint: t_maxHighPerfGroups = 0
Standardværdien er 3 og skal ændres til 0.
Når dette er gjort, skal hvert RecoverPoint-apparat genstartes for at sikre, at ændringen påvirkes.
Løsning: Dette problem er løst i RecoverPoint version 5.1.4.1 (5.1 SP4, programrettelse 1 og nyere).