RecoverPoint: Il processo di replica si arresta in modo anomalo causando il danneggiamento del journal e lo sweep completo
Summary: Il processo di replica si arresta in modo anomalo causando il danneggiamento del journal e la scansione completa di un consistency group
Symptoms
A causa di un problema di codice, un errore di distribuzione può causare la perdita del journal, determinando uno sweep completo del consistency group (CG) e perdendo tutte le voci del journal.
Ciò influisce su una copia di replica standard, ma non sugli array Data Domain o XtremIO.
Dai registri di replica di Site Control RecoverPoint Appliance, si verifica quanto segue:
2019/05/25 00:00:43.684 - #2 - 7872/7573 - DistributorGroupHandler::tryDistributeForward: highPerf m_GroupGridCopyRID = (groupCopyRID=(kVolSlot=XXXXXX,globalCopyID=GlobalCopy(SiteUID(0XXXXXXX..a) 0) ),gridCopyID=0)... 2019/05/25 00:00:46.427 - #2 - 7691/7573 - ReplicationControl_AO_IMPL::closePipe_i: enter groupCopyID = GroupCopy(XXXXXXXXXX SiteUID() 0) destCopyID = GlobalCopy(SiteUID(0x0XXXXXX..a) 0)... 2019/05/25 00:00:46.435 - #2 - 7691/7573 - DistributorGroupHandler::closeSession: close session free a_Data.m_bPartialReleaseStarted = 1 a_Data.m_bPartialReleaseSessionStarted = 1 ... a_Data.m_InitDoSnapHead = StreamPointer(streamID=13060353732993089537 blockID=1839 offset=261304942) ... ... 2019/05/25 00:00:46.575 - #2 - 7704/7573 - ReplicationControl_AO_IMPL::openPipe_i: groupCopyID = GroupCopy(XXXXXX SiteUID(0xxxxxx..a) 0)... 2019/05/25 00:01:16.552 - #2 - 10582/7573 - Fetcher_AO_IMPL::fetch_i: ... m_readLoc = StreamPointer(streamID=13060353732993089537 blockID=1839 offset=318942206) 2019/05/25 00:01:16.621 - #2 - 7869/7573 - Fetcher_AO_IMPL::read: a_startPtr = StreamPointer(streamID=13060353732993089537 blockID=1839 offset=318942206) a_isFastForward = 0 a_fastForwardTimeStamp = NoOption 2019/05/25 00:01:16.634 - #0 - 10582/7573 - PersistentObjectVersion: errno=0 Call to deserialization with unknown version=62, current version =16
Cause
Durante l'avvio, una pipe si chiude, il processo di replica potrebbe liberare blocchi del journal di cui il fetcher non è a conoscenza, interrompendo un'istantanea e causando il danneggiamento.
Resolution
Soluzione alternativa: Su ogni RecoverPoint Appliance (RPA) in ogni cluster, modificare la seguente modifica dall'interno dell'utente boxmgmt o admin, a seconda della versione di RecoverPoint: t_maxHighPerfGroups = 0
Il valore predefinito è 3 e deve essere modificato in 0.
Al termine di questa operazione, è necessario riavviare ciascun RecoverPoint Appliance per garantire che la modifica abbia effetto.
Risoluzione: Questo problema è stato risolto in RecoverPoint versione 5.1.4.1 (5.1 SP4 Patch 1 e successive).