Skip to main content
Uma versão mais recente deste produto está disponível.
O português é fornecido por meio de tradução automática para sua conveniência. O inglês precede o português em caso de inconsistências.

Reequilibre os dados codificados por apagamento após adicionar nós ao seu sistema StorageGRID

Após adicionar nós de armazenamento, você pode usar o procedimento de rebalanceamento de codificação de apagamento (EC) para redistribuir fragmentos codificados por apagamento entre os nós de armazenamento existentes e os novos.

Antes de começar
  • Você concluiu as etapas de expansão para adicionar os novos Storage Nodes.

  • Você revisou o "Considerações para o reequilíbrio de dados codificados por apagamento".

  • Você compreende que os dados de objetos replicados não serão movidos por este procedimento e que o procedimento de rebalanceamento do EC não move dados replicados. No entanto, os dados replicados são considerados ao determinar para onde mover os dados do EC.

  • Você tem o arquivo Passwords.txt.

O que acontece quando este procedimento é executado

Antes de iniciar o procedimento, observe o seguinte:

  • O procedimento de rebalanceamento do EC não será iniciado se um ou mais volumes estiverem offline (desmontados) ou se estiverem online (montados) mas em estado de erro.

  • O procedimento de rebalanceamento do EC reserva temporariamente uma grande quantidade de armazenamento. Alertas de armazenamento podem ser acionados, mas serão resolvidos quando o rebalanceamento for concluído. Se não houver armazenamento suficiente para a reserva, o procedimento de rebalanceamento do EC falhará. As reservas de armazenamento são liberadas quando o procedimento de rebalanceamento do EC é concluído, independentemente de ter falhado ou sido bem-sucedido.

  • Se um volume ficar offline enquanto o procedimento de rebalanceamento do EC estiver em andamento, o procedimento de rebalanceamento será encerrado. Quaisquer fragmentos de dados que já tenham sido movidos permanecerão em seus novos locais e nenhum dado será perdido.

    Você pode executar o procedimento novamente depois que todos os volumes estiverem online.

  • Quando o procedimento de rebalanceamento do EC estiver em execução, o desempenho das operações do ILM e das operações do cliente S3 pode ser afetado.

    Observação As operações da API S3 para carregar objetos (ou partes de objetos) podem falhar durante o procedimento de rebalanceamento do EC se levarem mais de 24 horas para serem concluídas. Operações PUT de longa duração falharão se a regra ILM aplicável usar posicionamento Balanceado ou Estrito na ingestão. O seguinte erro será relatado: 500 Internal Server Error.
  • Condições de conclusão da tarefa. O procedimento de rebalanceamento do EC é considerado concluído quando qualquer uma das seguintes condições for verdadeira:

    • Não consegue transferir mais dados codificados por apagamento.

    • Os dados em todos os nós estão dentro de um desvio de 5% da partição de dados de destino.

    • O procedimento está em execução há 30 dias.

Passos
  1. Revise os detalhes atuais do storage de objetos para o site que você planeja rebalancear.

    1. Selecione Nós.

    2. Selecione o primeiro nó de armazenamento no site.

    3. Selecione a guia Storage.

    4. Posicione o cursor sobre o gráfico "Armazenamento Utilizado - Dados do Objeto" para visualizar a quantidade atual de dados replicados e dados com codificação de apagamento no Storage Node.

    5. Repita estes passos para visualizar os outros nós de armazenamento no site.

  2. Faça login no nó de administração principal:

    1. Digite o seguinte comando: ssh admin@primary_Admin_Node_IP

    2. Digite a senha listada no arquivo Passwords.txt.

    3. Digite o seguinte comando para alternar para root: su -

    4. Digite a senha listada no arquivo Passwords.txt.

      Quando você está logado como root, o prompt muda de $ para #.

  3. Inicie o procedimento:

    `rebalance-data start --site "site-name"

    Em "site-name", especifique o primeiro site onde você adicionou um novo Storage Node ou nós. Inclua site-name entre aspas.

    O procedimento de rebalanceamento do EC é iniciado e um ID de tarefa é retornado.

  4. Copie o ID do job.

  5. Monitore o status do procedimento de rebalanceamento do EC.

    • Para visualizar o status de um único procedimento de rebalanceamento de EC:

      rebalance-data status --job-id job-id

      Para job-id, especifique o ID que foi retornado quando você iniciou o procedimento.

    • Para consultar o status do procedimento de reequilíbrio de EC em andamento e de quaisquer procedimentos concluídos anteriormente:

      rebalance-data status

    Observação

    Para obter ajuda sobre o comando rebalance-data:

    rebalance-data --help

  6. Execute etapas adicionais com base no status retornado:

    • Se State for In progress, a operação de rebalanceamento do EC ainda está em andamento. Você deve monitorar o procedimento periodicamente até que seja concluído.

      Acesse a página Nodes para avaliar a distribuição de dados entre os Storage Nodes no site.

    A tarefa de rebalanceamento do EC é considerada concluída e será interrompida quando os dados em todos os nós estiverem dentro de um desvio de 5% da partição de dados de destino.

    • Se State`é `Success, opcionalmente revisar storage de objetos para ver os detalhes atualizados do site.

      Os dados codificados por apagamento agora devem estar mais equilibrados entre os Storage Nodes no site.

    • Se State for Failure:

      1. Confirme se todos os nós de armazenamento no local estão conectados à grid.

      2. Verifique e resolva quaisquer alertas que possam estar afetando esses Storage Nodes.

      3. Reinicie o procedimento de reequilíbrio do EC:

        rebalance-data start –-job-id job-id

      4. Veja o status do novo procedimento. Se State ainda Failure, entre em contato com o suporte técnico.

  7. Se o procedimento de rebalanceamento do EC estiver gerando muita carga (por exemplo, se as operações de ingest forem afetadas), pause o procedimento.

    rebalance-data pause --job-id job-id

  8. Se você precisar encerrar o procedimento de rebalanceamento do EC (por exemplo, para realizar uma atualização do software StorageGRID), digite o seguinte:

    rebalance-data terminate --job-id job-id

    Observação Ao finalizar um procedimento de rebalanceamento EC, quaisquer fragmentos de dados que já tenham sido movidos permanecem em seus novos locais. Os dados não são movidos de volta para o local original.
  9. Se você estiver usando codificação de apagamento em mais de um site, execute este procedimento para todos os outros sites afetados.