Desativar nós StorageGRID desconectados
Pode ser necessário desativar um nó que não está atualmente conectado à grid (um nó cujo estado de integridade seja desconhecido ou administrativamente inativo).
-
Você compreende as considerações para o descomissionamento "Nós de administração e gateway" e as considerações para o descomissionamento "Nós de armazenamento".
-
Você obteve todos os itens pré-requisito.
-
Você verificou se não há tarefas de reparo de dados ativas. Consulte "Verifique os trabalhos de reparo de dados".
-
Você confirmou que a recuperação do nó de armazenamento não está em andamento em nenhum lugar da grade. Caso esteja, você deve aguardar até que qualquer reconstrução do Cassandra realizada como parte da recuperação seja concluída. Em seguida, você poderá prosseguir com o descomissionamento.
-
Você garantiu que outros procedimentos de manutenção não serão executados enquanto o procedimento de desativação do nó estiver em andamento, a menos que o procedimento de desativação do nó seja pausado.
-
A coluna Desativação Possível para o(s) nó(s) desconectado(s) que você deseja desativar inclui uma marca de seleção verde.
-
Você possui a senha de provisionamento.
Você pode identificar nós desconectados procurando o ícone azul "Desconhecido"
ou o ícone cinza "Administrativamente inativo"
na coluna Saúde.
Antes de desativar qualquer nó desconectado, observe o seguinte:
-
Este procedimento destina-se principalmente à remoção de um único nó desconectado. Se sua grid contiver vários nós desconectados, o software exigirá que você os descomissione todos ao mesmo tempo, o que aumenta o potencial para resultados inesperados.
Pode ocorrer perda de dados se você desativar mais de um nó de armazenamento desconectado por vez. Consulte "Considerações sobre nós de storage desconectados". Tenha cuidado ao desativar nós de armazenamento em uma grade que contenha nós baseados em software que armazenam apenas metadados. Se você desativar todos os nós configurados para armazenar tanto objetos quanto metadados, a capacidade de armazenar objetos será removida da grade. Consulte "Tipos de nós de armazenamento" para obter mais informações sobre nós de armazenamento que armazenam apenas metadados. -
Se um nó desconectado não puder ser removido (por exemplo, um Storage Node que é necessário para o quorum do ADC), nenhum outro nó desconectado pode ser removido.
-
A menos que você esteja desativando um Archive Node (que deve ser desconectado), tente colocar novamente online ou recuperar quaisquer nós de grid desconectados.
Consulte "Procedimentos de recuperação de nós da grade" para obter instruções.
-
Se você não conseguir recuperar um nó de rede desconectado e quiser desativá-lo enquanto ele estiver desconectado, selecione a caixa de seleção correspondente a esse nó.
Se a sua grid contiver vários nós desconectados, o software exigirá que você os descomissione todos ao mesmo tempo, o que aumenta o potencial para resultados inesperados. Tenha cuidado ao optar por desativar mais de um nó de rede desconectado por vez, especialmente se estiver selecionando vários nós de armazenamento desconectados. Se você tiver mais de um nó de armazenamento desconectado que não consegue recuperar, entre em contato com o suporte técnico para determinar o melhor curso de ação. -
Digite a senha de provisionamento.
O botão Iniciar Desativação está ativado.
-
Clique em Iniciar desativação.
Aparece um aviso indicando que você selecionou um nó desconectado e que os dados do objeto serão perdidos se o nó tiver a única cópia de um objeto.
-
Analise a lista de nós e clique em OK.
O procedimento de desativação é iniciado e o progresso é exibido para cada nó. Durante o procedimento, um novo pacote de recuperação é gerado contendo a alteração na configuração do grid.
-
Assim que o novo pacote de recuperação estiver disponível, clique no link ou selecione Manutenção > Sistema > Pacote de recuperação para acessar a página do pacote de recuperação. Em seguida, faça o download do
.ziparquivo.Consulte as instruções para "baixando o pacote de recuperação".
Faça o download do pacote de recuperação o mais rápido possível para garantir que você possa recuperar sua grid caso algo dê errado durante o procedimento de desativação. O arquivo do pacote de recuperação deve ser protegido porque contém chaves de criptografia e senhas que podem ser usadas para obter dados do sistema StorageGRID. -
Monitore periodicamente a página de Desativação para garantir que todos os nós selecionados sejam desativados com sucesso.
A desativação de Storage Nodes pode levar dias ou semanas. Quando todas as tarefas forem concluídas, a lista de seleção de nós será exibida novamente com uma mensagem de sucesso. Se você desativou um Storage Node desconectado, uma mensagem informativa indica que os trabalhos de reparo foram iniciados.
-
Após os nós serem desligados automaticamente como parte do procedimento de desativação, remova quaisquer máquinas virtuais restantes ou outros recursos associados ao nó desativado.
Não execute esta etapa até que os nós tenham sido desligados automaticamente. -
Se você estiver desativando um nó de armazenamento, monitore o status das tarefas de reparo de dados replicados e dados com código de apagamento (EC) que são iniciadas automaticamente durante o processo de desativação.
-
Para obter uma estimativa da porcentagem de conclusão do reparo replicado, adicione a
show-replicated-repair-statusopção ao comando repair-data.repair-data show-replicated-repair-status -
Para determinar se os reparos foram concluídos:
-
Selecione Nodes > Storage Node being repaired > ILM.
-
Analise os atributos na seção Avaliação. Quando os reparos estiverem concluídos, o atributo Aguardando - Todos indica 0 objetos.
-
-
Para monitorar o reparo com mais detalhes:
-
Selecione Nós.
-
Selecione grid name > ILM.
-
Posicione o cursor sobre o gráfico da fila ILM para ver o valor do atributo Taxa de varredura (objetos/seg), que é a taxa na qual os objetos na grid são verificados e enfileirados para o ILM.
-
Na seção Fila ILM, observe os seguintes atributos:
-
Período de digitalização - estimado: tempo estimado para concluir uma digitalização completa do ILM de todos os objetos.
Uma varredura completa não garante que o ILM tenha sido aplicado a todos os objetos.
-
Tentativas de reparo: O número total de tentativas de reparo de objetos para dados replicados considerados de alto risco. Objetos de alto risco são quaisquer objetos com uma cópia restante, seja especificado pela política ILM ou como resultado de cópias perdidas. Essa contagem incrementa cada vez que um Storage Node tenta reparar um objeto de alto risco. Os reparos ILM de alto risco são priorizados se a grid ficar ocupada.
O reparo do mesmo objeto pode incrementar novamente se a replicação falhar após o reparo. + Esses atributos podem ser úteis quando você estiver monitorando o progresso da recuperação do volume do Storage Node. Se o número de reparos tentados parar de aumentar e uma verificação completa for concluída, o reparo provavelmente foi concluído.
-
-
Alternativamente, envie uma consulta Prometheus para
storagegrid_ilm_scan_period_estimated_minutesestoragegrid_ilm_repairs_attempted.
-
Para monitorar o reparo de dados com codificação de eliminação e repetir quaisquer solicitações que possam ter falhado:
-
Determine o status dos reparos de dados codificados por apagamento:
-
Selecione Support > Tools > Metrics para visualizar o tempo estimado de conclusão e a porcentagem de conclusão da tarefa atual. Em seguida, selecione EC Overview na seção Grafana. Observe os painéis Grid EC Job Estimated Time to Completion e Grid EC Job Percentage Completed.
-
Use este comando para ver o status de uma operação
repair-dataespecífica:repair-data show-ec-repair-status --repair-id repair ID -
Use este comando para listar todos os reparos:
repair-data show-ec-repair-status
A lista de resultados exibe informações, incluindo
repair ID, sobre todos os reparos anteriores e atuais em andamento. -
-
Se o resultado mostrar que a operação de reparo falhou, use a
--repair-idopção para tentar o reparo novamente.Este comando tenta novamente um reparo de nó com falha, usando o ID de reparo 6949309319275667690:
repair-data start-ec-node-repair --repair-id 6949309319275667690Este comando tenta novamente um reparo de volume com falha, usando o ID de reparo 6949309319275667690:
repair-data start-ec-volume-repair --repair-id 6949309319275667690
Assim que os nós desconectados forem desativados e todas as tarefas de reparo de dados forem concluídas, você poderá desativar quaisquer nós de grid conectados, conforme necessário.
Em seguida, conclua estas etapas após finalizar o procedimento de desativação:
-
Certifique-se de que os discos rígidos do nó de rede desativado estejam completamente apagados. Utilize uma ferramenta ou serviço de apagamento de dados disponível comercialmente para remover os dados dos discos de forma permanente e segura.
-
Se você desativou um nó de appliance e os dados no appliance estavam protegidos usando criptografia de nó, use o StorageGRID Appliance Installer para limpar a configuração do servidor de gerenciamento de chaves (Limpar KMS). Você deve limpar a configuração do KMS se quiser adicionar o appliance a outra grid. Para obter instruções, consulte "Monitorar a criptografia do nó em modo de manutenção".