Vamos gerar um procedimento para remover um módulo de CPU em um compartimento de controladora VNX5700 ou 7500. Então, vamos abordar o procedimento para isso. No gerador de procedimentos do VNX, vou selecionar "Next" para 5700. E esta é uma substituição de hardware de arquivo/unificado. Novamente, "Next". E, nesse caso, vou refinar o hardware de cinquenta e sete arquivos/SPE unificada do VNX. Vou gerar selecionando o botão de opção para "Replace SPE CPU module".
Vou selecionar "Next" e gerar o procedimento para isso. Assim que concluir o procedimento, vamos ler novamente toda a documentação inicial sobre a descarga eletrostática e quaisquer problemas, e começaremos a escrever analisando e tentando diagnosticar e identificar a FRU ou CRU que está com defeito. Então, esse é o meu procedimento.
Vou seguir em frente e encerrar isso. Certifique-se de que eu tenho o correto. Sim. Como substituir um módulo de CPU. Então, vamos encerrar por aí. E lancei o Unisphere. Eu vou olhar o sistema e o hardware para armazenamento.
Então, seleciono o sistema de armazenamento VNX, seleciono a guia Storage e, em seguida, seleciono o hardware para armazenamento. Em vez de armazenamento para arquivo. E novamente, quero procurar quaisquer condições de falha que possam estar presentes. Agora você procura isso na árvore. Se você visse um F vermelho, por exemplo, ele se propagaria de um componente até a árvore, e é aí que podemos confirmar que algo falhou. Vamos supor que algo falhou aqui, neste caso, uma controladora de armazenamento.
Assim que determinarmos isso, podemos seguir em frente e, como opção, executar o assistente Verify Storage System para realizar uma verificação de integridade. E eu poderia fazer isso vindo para cá. Eu poderia iniciar o USM e passar pelos procedimentos semelhantes ao que fizemos na parte 2 do lançamento do USM e coletar uma verificação do sistema. Então, eu vou assumir que nós fizemos isso e isso foi feito.
A próxima coisa que podemos querer fazer e é recomendável é preparar o armazenamento para o processo de armazenamento para o procedimento de substituição, trocando as LUNs no destino que queremos substituir. Então, por exemplo, em um sistema com duas SPs, A e B, e a SP B precisa ser substituída, queremos substituir as LUNs que são associadas ou de propriedade atual da SP B. Para isso, teríamos que acessar Storage e LUNs. E então, há mais de uma maneira de fazer isso; Estou mostrando um caminho aqui.
O proprietário atual é mostrado aqui. Novamente, estou substituindo a SP B, selecionando-a, clicando com o botão direito do mouse e trocando a LUN. E eu vou em frente e fazer isso. Ao contrário de outras opções com o Unisphere, você não pode ir em frente e selecionar muitas delas como invasoras; você tem que invadir um de cada vez, pelo menos a partir do Unisphere. Então, vou seguir em frente e fazer todas essas LUNs. Na verdade, descobri que, se apertarmos o botão Ctrl, os selecionamos. Parece que depende de quantos você selecionar, mas, neste caso, quando eu tiver três, vou tentar invadir todas, e parece que vai funcionar, então a ideia é que precisamos invadir as LUNs.
Agora, vejo tudo desativado, pelo menos neste sistema, que pertence à SP B, e então ultrapassei as LUNs. E posso continuar e estabelecer uma conexão serial usando os mesmos parâmetros que temos usado o tempo todo aqui que listei para você no guia, e então vou fazer logon no Control Station 0 e me tornar um superusuário ou usuário root. Interromperemos novamente nossos serviços ConnectHome e de e-mail.
E verifique. E, agora, precisamos desligar o processo de armazenamento. Então, novamente, vamos usar um comando navicli para fazer isso. Então, vamos lá e já ultrapassamos as LUNs. E, novamente, se você não tiver um arquivo de segurança, você teria que ir em frente e criar um ou você tem que usar as credenciais completas na linha de comando. Então, aqui está um exemplo do comando, bastante longo. Mesmo às vezes, em uma sessão PuTTY, você não tem wraparound suficiente para emitir esse comando, então talvez seja necessário expandir um pouco essa caixa.
De qualquer forma, temos a SP que, neste caso, a SP A, e vamos desligar o par da controladora, que é a SP B. E lembre-se, nós já ultrapassamos isso, então eu não faria isso. Opa! Ah, vou tentar de novo mais uma vez. Você tem que saber digitar nesse negócio, aparentemente. Então, você deseja desligar e manter a SP agora? Sim, eu faço. E vamos fazer isso.
Esse está acabando de cair, posso usar um comando ping para verificar se ele realmente caiu. Se eu fizer ping nesse endereço IP, ele deverá voltar como indisponível. Eu vou para 153 na verdade, a SP B, e posso ver que não tem resposta, então Ctrl-C fora disso. Então, neste ponto, eu ultrapassei as LUNs, parei ou interrompi a controladora de armazenamento, e você pode prosseguir neste ponto e localizar a documentação para realizar a remoção e substituição dos componentes de acordo com o guia de procedimento.
Lembre-se de que, depois de instalar a CPU específica, você terá que trocar os DIMMs, trocar tudo isso e substituir tudo de novo, fazer o cabeamento de volta como antes. Feito isso, estaremos prontos para continuar. Depois que a placa XP ou X tiver sido preparada para remoção, comece removendo os dois módulos de refrigeração da fonte de alimentação na frente da SP ou da placa X com defeito.
Em seguida, aperte as duas abas laranjas marcadas com um número dois preto uma em direção à outra para desbloquear as travas. Afaste as travas umas das outras para soltar totalmente o módulo do compartimento. Coloque o módulo sobre uma superfície antiestática e transfira os módulos de memória para a nova SP ou X Plate.
Para reinstalar a SP ou a placa X, alinhe o módulo com as guias na lateral do compartimento. Deslize-a para dentro do compartimento até que as travas comecem a se mover para dentro. Empurre as travas uma em direção à outra para encaixar totalmente e travar o módulo no lugar. Para reinstalar as fontes de alimentação, alinhe o módulo ao respectivo slot e empurre-o para dentro do compartimento. Levante a trava preta para fixar o módulo no lugar.
Você deve ouvir um clique audível quando a trava estiver devidamente encaixada. Na verdade, se formos ao EMC Unisphere, como você vê aqui, e analisarmos o hardware para armazenamento, podemos ver o "F" de que falamos anteriormente, onde diz que uma SP B não é gerenciável, ou removida neste caso. E isso novamente é propagado até a árvore. Agora, depois da substituição, da troca de todos os componentes, você deve colocar a controladora de armazenamento.
E, novamente, você pode ver seu guia porque ele depende agora. Este é um problema com a versão 5.31, mas se você teve algo antes disso, certifique-se de consultar o guia sobre como fazer isso. E nós vamos emitir o par SP de reinicialização. Então, vamos emitir esse comando aqui. Então, digitei reboot peer SP. E nós vamos executar o comando. Nesse ponto, vamos aguardar o processo de armazenamento ligar, para que ele seja ligado quando o LED de falha não estiver aceso e o LED de energia estiver verde.
Como na substituição da parte 2 do módulo de E/S, isso pode levar até dez minutos. Portanto, vamos permitir que ele seja ligado. Em seguida, você pode validar nos LEDs frontais ou acessar a seção de hardware de armazenamento e verificar se o "F" se apagou e se a controladora de armazenamento é gerenciável novamente. Então, apenas como uma observação enquanto aguarda a SP voltar, não se esqueça de que você tem logs de eventos da SP e você pode olhar para esses logs, por exemplo, olhando para A aqui, e eles podem lhe dar pistas sobre o que está acontecendo no sistema também. Muitas delas são informativas. E procuramos diferentes.
Há um ponto crítico aqui que ocorreu e o armazenamento em cache foi desativado. E ele fornece a data e a hora, para que possamos dar uma olhada nisso. Agora, provavelmente não conseguiremos ler isso, a menos que o SP tenha voltado ao ponto em que realmente podemos, mas não o fez neste momento, então não conseguiremos nos comunicar com isso.
E, é claro, sempre há apenas os alertas que surgem aqui, você vê vários aqui, que você sempre pode clicar e obter detalhes também. Então, ainda estamos procurando, ainda aguardando o sistema voltar a funcionar. Podemos monitorá-lo, podemos analisar o hardware de armazenamento real. Uma vez que isso seja liberado, devemos estar prontos para ir. Parece que foi limpo agora e que o SP finalmente está presente.
Então, a SP é reinicializada, e vamos continuar com o laboratório, quando você vai ter que restaurar quaisquer LUNs trocadas que ocorreram. Percebo aqui que, observando a propriedade atual, as LUNs voltaram para a SP atual depois que a SP surgiu. Então, isso é uma coisa boa. E isso foi feito... Eu não quero ir para o armazenamento; Quero acessar LUNs. E, novamente, podemos ver que tudo parece bem lá.
Portanto, é sempre uma boa ideia atribuir e tentar restaurá-los também, como fizemos no laboratório 2. Podemos fazer isso com a CLI ou com o Unisphere. Se eu for para a guia System, eu olhei para LUNs trocados, não parece haver nenhum LUN que foi trocado, então estamos em boa forma aqui. Vou dizer "OK" para isso. E, novamente, se você tiver nossos LUNs, vamos dar uma olhada nisso.
Tudo o que fiz foi abrir uma sessão PuTTY e emitir um nas_storage, listar os comandos, e isso é o que foi visto antes. E eu poderia realmente passar por cima e falhar se tivéssemos LUNs que precisavam sofrer failback. E eu tenho que fazer failback, é claro, usando o nome do número de série, então vou apenas recortar e colar isso lá. E isso deve voltar e fazer isso. E mostramos como fazer isso no início do exercício de laboratório parte 2 deste laboratório 7.
Então, parece bom. Parece que, depois que isso passar, podemos ir em frente e executar um check-up do NAS novamente. Depois de executar a verificação do NAS, você poderá executar o assistente de verificação do sistema de armazenamento novamente. Depois disso, você ativaria as notificações do ConnectHome para concluir o exercício de laboratório. Então, aqui vemos isso de volta. Em seguida, prossiga e execute uma verificação de NAS novamente. E vamos deixar isso acontecer.
Então, novamente, a verificação foi executada. Não vejo falhas, avisos, mas não falhas. Nesse ponto, você pode ativar o ConnectHome e os serviços de e-mail e executar uma verificação novamente se quiser com o software Verify Storage System. Se você precisar fazer isso, consulte o laboratório anterior. E isso vai concluir a parte 3 do laboratório 7.