Reequilibre os dados codificados por apagamento após adicionar nós ao seu sistema StorageGRID
Após adicionar nós de armazenamento, você pode usar o procedimento de rebalanceamento de codificação de apagamento (EC) para redistribuir fragmentos codificados por apagamento entre os nós de armazenamento existentes e os novos.
-
Você concluiu as etapas de expansão para adicionar os novos Storage Nodes.
-
Você revisou o "Considerações para o reequilíbrio de dados codificados por apagamento".
-
Você compreende que os dados de objetos replicados não serão movidos por este procedimento e que o procedimento de rebalanceamento do EC não move dados replicados. No entanto, os dados replicados são considerados ao determinar para onde mover os dados do EC.
-
Você tem o arquivo
Passwords.txt.
Antes de iniciar o procedimento, observe o seguinte:
-
O procedimento de rebalanceamento do EC não será iniciado se um ou mais volumes estiverem offline (desmontados) ou se estiverem online (montados) mas em estado de erro.
-
O procedimento de rebalanceamento do EC reserva temporariamente uma grande quantidade de armazenamento. Alertas de armazenamento podem ser acionados, mas serão resolvidos quando o rebalanceamento for concluído. Se não houver armazenamento suficiente para a reserva, o procedimento de rebalanceamento do EC falhará. As reservas de armazenamento são liberadas quando o procedimento de rebalanceamento do EC é concluído, independentemente de ter falhado ou sido bem-sucedido.
-
Se um volume ficar offline enquanto o procedimento de rebalanceamento do EC estiver em andamento, o procedimento de rebalanceamento será encerrado. Quaisquer fragmentos de dados que já tenham sido movidos permanecerão em seus novos locais e nenhum dado será perdido.
Você pode executar o procedimento novamente depois que todos os volumes estiverem online.
-
Quando o procedimento de rebalanceamento do EC estiver em execução, o desempenho das operações do ILM e das operações do cliente S3 pode ser afetado.
As operações da API S3 para carregar objetos (ou partes de objetos) podem falhar durante o procedimento de rebalanceamento do EC se levarem mais de 24 horas para serem concluídas. Operações PUT de longa duração falharão se a regra ILM aplicável usar posicionamento Balanceado ou Estrito na ingestão. O seguinte erro será relatado: 500 Internal Server Error. -
Condições de conclusão da tarefa. O procedimento de rebalanceamento do EC é considerado concluído quando qualquer uma das seguintes condições for verdadeira:
-
Não consegue transferir mais dados codificados por apagamento.
-
Os dados em todos os nós estão dentro de um desvio de 5% da partição de dados de destino.
-
O procedimento está em execução há 30 dias.
-
-
Revise os detalhes atuais do storage de objetos para o site que você planeja rebalancear.
-
Selecione Nós.
-
Selecione o primeiro nó de armazenamento no site.
-
Selecione a guia Storage.
-
Posicione o cursor sobre o gráfico "Armazenamento Utilizado - Dados do Objeto" para visualizar a quantidade atual de dados replicados e dados com codificação de apagamento no Storage Node.
-
Repita estes passos para visualizar os outros nós de armazenamento no site.
-
-
Faça login no nó de administração principal:
-
Digite o seguinte comando:
ssh admin@primary_Admin_Node_IP -
Digite a senha listada no arquivo
Passwords.txt. -
Digite o seguinte comando para alternar para root:
su - -
Digite a senha listada no arquivo
Passwords.txt.Quando você está logado como root, o prompt muda de
$para#.
-
-
Inicie o procedimento:
`rebalance-data start --site "site-name"
Em "site-name", especifique o primeiro site onde você adicionou um novo Storage Node ou nós. Inclua
site-nameentre aspas.O procedimento de rebalanceamento do EC é iniciado e um ID de tarefa é retornado.
-
Copie o ID do job.
-
Monitore o status do procedimento de rebalanceamento do EC.
-
Para visualizar o status de um único procedimento de rebalanceamento de EC:
rebalance-data status --job-id job-idPara
job-id, especifique o ID que foi retornado quando você iniciou o procedimento. -
Para consultar o status do procedimento de reequilíbrio de EC em andamento e de quaisquer procedimentos concluídos anteriormente:
rebalance-data status
Para obter ajuda sobre o comando rebalance-data:
rebalance-data --help -
-
Execute etapas adicionais com base no status retornado:
-
Se
StateforIn progress, a operação de rebalanceamento do EC ainda está em andamento. Você deve monitorar o procedimento periodicamente até que seja concluído.Acesse a página Nodes para avaliar a distribuição de dados entre os Storage Nodes no site.
A tarefa de rebalanceamento do EC é considerada concluída e será interrompida quando os dados em todos os nós estiverem dentro de um desvio de 5% da partição de dados de destino.
-
Se
State`é `Success, opcionalmente revisar storage de objetos para ver os detalhes atualizados do site.Os dados codificados por apagamento agora devem estar mais equilibrados entre os Storage Nodes no site.
-
Se
StateforFailure:-
Confirme se todos os nós de armazenamento no local estão conectados à grid.
-
Verifique e resolva quaisquer alertas que possam estar afetando esses Storage Nodes.
-
Reinicie o procedimento de reequilíbrio do EC:
rebalance-data start –-job-id job-id -
Veja o status do novo procedimento. Se
StateaindaFailure, entre em contato com o suporte técnico.
-
-
-
Se o procedimento de rebalanceamento do EC estiver gerando muita carga (por exemplo, se as operações de ingest forem afetadas), pause o procedimento.
rebalance-data pause --job-id job-id -
Se você precisar encerrar o procedimento de rebalanceamento do EC (por exemplo, para realizar uma atualização do software StorageGRID), digite o seguinte:
rebalance-data terminate --job-id job-idAo finalizar um procedimento de rebalanceamento EC, quaisquer fragmentos de dados que já tenham sido movidos permanecem em seus novos locais. Os dados não são movidos de volta para o local original. -
Se você estiver usando codificação de apagamento em mais de um site, execute este procedimento para todos os outros sites afetados.