RecoverPoint: Falhas no processo de replicação que causam corrupção de registro e varredura completa
Summary: Falhas no processo de replicação, causando corrupção de registro e varredura completa de um grupo de consistência
Symptoms
Devido a um problema de código, um erro de distribuição pode causar perda de registro, levando a uma varredura completa do grupo de consistência (CG) e perdendo todas as entradas de registro.
Isso afeta uma cópia de réplica padrão, mas não os arrays Data Domain ou XtremIO.
Nos registros de replicação do dispositivo RecoverPoint de controle do local, o seguinte é testemunhado:
2019/05/25 00:00:43.684 - #2 - 7872/7573 - DistributorGroupHandler::tryDistributeForward: highPerf m_GroupGridCopyRID = (groupCopyRID=(kVolSlot=XXXXXX,globalCopyID=GlobalCopy(SiteUID(0XXXXXXX..a) 0) ),gridCopyID=0)... 2019/05/25 00:00:46.427 - #2 - 7691/7573 - ReplicationControl_AO_IMPL::closePipe_i: enter groupCopyID = GroupCopy(XXXXXXXXXX SiteUID() 0) destCopyID = GlobalCopy(SiteUID(0x0XXXXXX..a) 0)... 2019/05/25 00:00:46.435 - #2 - 7691/7573 - DistributorGroupHandler::closeSession: close session free a_Data.m_bPartialReleaseStarted = 1 a_Data.m_bPartialReleaseSessionStarted = 1 ... a_Data.m_InitDoSnapHead = StreamPointer(streamID=13060353732993089537 blockID=1839 offset=261304942) ... ... 2019/05/25 00:00:46.575 - #2 - 7704/7573 - ReplicationControl_AO_IMPL::openPipe_i: groupCopyID = GroupCopy(XXXXXX SiteUID(0xxxxxx..a) 0)... 2019/05/25 00:01:16.552 - #2 - 10582/7573 - Fetcher_AO_IMPL::fetch_i: ... m_readLoc = StreamPointer(streamID=13060353732993089537 blockID=1839 offset=318942206) 2019/05/25 00:01:16.621 - #2 - 7869/7573 - Fetcher_AO_IMPL::read: a_startPtr = StreamPointer(streamID=13060353732993089537 blockID=1839 offset=318942206) a_isFastForward = 0 a_fastForwardTimeStamp = NoOption 2019/05/25 00:01:16.634 - #0 - 10582/7573 - PersistentObjectVersion: errno=0 Call to deserialization with unknown version=62, current version =16
Cause
Durante a inicialização, um pipe é fechado e o processo de replicação pode liberar blocos de registro que o buscador desconhece, interrompendo um snapshot e levando à corrupção.
Resolution
Solução temporária: Em cada RecoverPoint Appliance (RPA) em cada cluster, altere o seguinte ajuste no usuário boxmgmt ou admin, dependendo de sua versão do RecoverPoint: t_maxHighPerfGroups = 0
O valor padrão é 3 e deve ser alterado para 0.
Depois que isso for feito, cada RecoverPoint Appliance deverá ser reinicializado para garantir que a alteração seja aplicada.
Resolução: Esse problema foi resolvido no RecoverPoint versão 5.1.4.1 (5.1 SP4 Patch 1 e posterior).