RecoverPoint: El proceso de replicación se bloquea, lo que provoca daños en el registro y un barrido completo
Summary: El proceso de replicación se bloquea, lo que provoca daños en el registro y un barrido completo de un grupo de coherencia
Symptoms
Debido a un problema de código, un error de distribución puede causar la pérdida del registro, lo que lleva a un barrido completo del grupo de coherencia (CG) y a la pérdida de todas las entradas del registro.
Esto afecta a una copia de réplica estándar, pero no a Data Domain ni a los arreglos XtremIO.
En los registros de replicación del dispositivo RecoverPoint de control del sitio, se observa lo siguiente:
2019/05/25 00:00:43.684 - #2 - 7872/7573 - DistributorGroupHandler::tryDistributeForward: highPerf m_GroupGridCopyRID = (groupCopyRID=(kVolSlot=XXXXXX,globalCopyID=GlobalCopy(SiteUID(0XXXXXXX..a) 0) ),gridCopyID=0)... 2019/05/25 00:00:46.427 - #2 - 7691/7573 - ReplicationControl_AO_IMPL::closePipe_i: enter groupCopyID = GroupCopy(XXXXXXXXXX SiteUID() 0) destCopyID = GlobalCopy(SiteUID(0x0XXXXXX..a) 0)... 2019/05/25 00:00:46.435 - #2 - 7691/7573 - DistributorGroupHandler::closeSession: close session free a_Data.m_bPartialReleaseStarted = 1 a_Data.m_bPartialReleaseSessionStarted = 1 ... a_Data.m_InitDoSnapHead = StreamPointer(streamID=13060353732993089537 blockID=1839 offset=261304942) ... ... 2019/05/25 00:00:46.575 - #2 - 7704/7573 - ReplicationControl_AO_IMPL::openPipe_i: groupCopyID = GroupCopy(XXXXXX SiteUID(0xxxxxx..a) 0)... 2019/05/25 00:01:16.552 - #2 - 10582/7573 - Fetcher_AO_IMPL::fetch_i: ... m_readLoc = StreamPointer(streamID=13060353732993089537 blockID=1839 offset=318942206) 2019/05/25 00:01:16.621 - #2 - 7869/7573 - Fetcher_AO_IMPL::read: a_startPtr = StreamPointer(streamID=13060353732993089537 blockID=1839 offset=318942206) a_isFastForward = 0 a_fastForwardTimeStamp = NoOption 2019/05/25 00:01:16.634 - #0 - 10582/7573 - PersistentObjectVersion: errno=0 Call to deserialization with unknown version=62, current version =16
Cause
Durante el inicio del cierre de una canalización, el proceso de replicación podría liberar bloques de registro que el captador desconoce, lo que interrumpe una instantánea y provoca daños.
Resolution
Solución alternativa: En cada dispositivo RecoverPoint (RPA) en cada clúster, cambie el siguiente ajuste en el usuario boxmgmt o admin, según su versión de RecoverPoint: t_maxHighPerfGroups = 0
El valor predeterminado es 3 y se debe cambiar a 0.
Después de esto, se debe reiniciar cada dispositivo RecoverPoint para asegurarse de que el cambio surta efecto.
Solución: Este problema se resuelve en RecoverPoint versión 5.1.4.1 (parche 1 de 5.1 SP4 y posteriores).