Restaurar nós do StorageGRID para o host
Para restaurar um nó de grid com falha em um novo host Linux, você executa estas etapas para restaurar o arquivo de configuração do nó.
-
Restaure e valide o nó restaurando o arquivo de configuração do nó. Para uma nova instalação, você cria um arquivo de configuração do nó para cada nó da grade a ser instalado em um host. Ao restaurar um nó da grade para um host de substituição, você restaura ou substitui o arquivo de configuração do nó para quaisquer nós da grade com falha.
-
Conforme necessário, recupere quaisquer nós que não iniciarem.
Se algum volume de armazenamento em bloco tiver sido preservado do host anterior, talvez seja necessário executar procedimentos de recuperação adicionais. Os comandos nesta seção ajudam você a determinar quais procedimentos adicionais são necessários.
Restaurar e validar nós da grade
Você deve restaurar os arquivos de configuração da grid para quaisquer nós da grid com falha e, em seguida, validar os arquivos de configuração da grid e resolver quaisquer erros.
Você pode importar qualquer nó de grid que deva estar presente no host, desde que seu /var/local volume não tenha sido perdido devido à falha do host anterior. Por exemplo, o /var/local volume ainda pode existir se você usou storage compartilhado para volumes de dados do sistema StorageGRID, conforme descrito nas instruções de instalação do StorageGRID para seu sistema operacional Linux. Importar o nó restaura seu arquivo de configuração no host.
Caso não seja possível importar os nós ausentes, você deve recriar os respectivos arquivos de configuração da grade.
Em seguida, você deve validar o arquivo de configuração da grid e resolver quaisquer problemas de rede ou de storage que possam ocorrer antes de reiniciar o StorageGRID. Ao recriar o arquivo de configuração para um nó, você deve usar o mesmo nome para o nó de substituição que foi usado para o nó que você está recuperando.
Consulte a "Instruções de instalação do Linux" para obter mais informações sobre a localização do volume /var/local de um nó.
-
Na linha de comando do host recuperado, liste todos os nós StorageGRID configurados atualmente:
sudo storagegrid node listSe nenhum nó da grade estiver configurado, não haverá saída. Se alguns nós da grade estiverem configurados, espere uma saída no seguinte formato:
Name Metadata-Volume ================================================================ dc1-adm1 /dev/mapper/sgws-adm1-var-local dc1-gw1 /dev/mapper/sgws-gw1-var-local dc1-sn1 /dev/mapper/sgws-sn1-var-local dc1-arc1 /dev/mapper/sgws-arc1-var-local
Se alguns ou todos os nós da grid que deveriam estar configurados no host não estiverem listados, você precisará restaurar os nós da grid ausentes.
-
Para importar nós de grid que possuem um
/var/localvolume:-
Execute o seguinte comando para cada nó que você deseja importar:
sudo storagegrid node import node-var-local-volume-pathO
storagegrid node importcomando só terá sucesso se o nó de destino tiver sido desligado corretamente no host em que foi executado pela última vez. Caso contrário, você verá um erro semelhante ao seguinte:This node (node-name) appears to be owned by another host (UUID host-uuid).
Use the --force flag if you are sure import is safe.-
Se você vir o erro informando que o nó pertence a outro host, execute o comando novamente com a
--forceflag para concluir a importação:sudo storagegrid --force node import node-var-local-volume-pathQuaisquer nós importados com a --forceflag exigirão etapas de recuperação adicionais antes de poderem se reintegrar à grade, conforme descrito em "Próximos passos: execute etapas adicionais de recuperação, se necessário".
-
-
Para nós de grid que não possuem um
/var/localvolume, recrie o arquivo de configuração do nó para restaurá-lo no host. Para obter instruções, consulte "Criar arquivos de configuração de nó".Ao recriar o arquivo de configuração de um nó, você deve usar o mesmo nome para o nó de substituição que foi usado para o nó que está sendo recuperado. Para implantações Linux, certifique-se de que o nome do arquivo de configuração contenha o nome do nó. Você deve usar as mesmas interfaces de rede, mapeamentos de dispositivos de bloco e endereços IP sempre que possível. Essa prática minimiza a quantidade de dados que precisa ser copiada para o nó durante a recuperação, o que pode tornar a recuperação significativamente mais rápida (em alguns casos, minutos em vez de semanas). Se você usar quaisquer novos dispositivos de bloco (dispositivos que o nó StorageGRID não usava anteriormente) como valores para quaisquer variáveis de configuração que começam com BLOCK_DEVICE_quando você estiver recriando o arquivo de configuração para um nó, siga as diretrizes em Corrigir erros de dispositivo de bloco ausente. -
Execute o seguinte comando no host recuperado para listar todos os nós do StorageGRID.
sudo storagegrid node list -
Valide o arquivo de configuração de cada nó da grid cujo nome foi exibido na saída do comando storagegrid node list:
sudo storagegrid node validate node-nameVocê deve corrigir quaisquer erros ou avisos antes de iniciar o serviço de host do StorageGRID. As seções a seguir fornecem mais detalhes sobre erros que podem ter importância especial durante a recuperação.
Corrigir erros de interface de rede ausente
Se a rede do host não estiver configurada corretamente ou se um nome estiver escrito incorretamente, ocorrerá um erro quando StorageGRID verificar o mapeamento especificado no arquivo /etc/storagegrid/nodes/node-name.conf.
Você poderá ver um erro ou aviso que corresponda a este padrão:
Checking configuration file /etc/storagegrid/nodes/<node-name>.conf for node <node-name>...
ERROR: <node-name>: GRID_NETWORK_TARGET = <host-interface-name>
<node-name>: Interface <host-interface-name>' does not exist
O erro pode ser relatado para a Grid Network, a Admin Network ou a Client Network. Esse erro significa que o arquivo /etc/storagegrid/nodes/node-name.conf mapeia a rede StorageGRID indicada para a interface do host chamada host-interface-name, mas não existe nenhuma interface com esse nome no host atual.
Se você receber este erro, verifique se concluiu as etapas em "Implantar novos hosts Linux". Use os mesmos nomes para todas as interfaces de host que foram usados no host original.
Se não for possível nomear as interfaces do host para corresponder ao arquivo de configuração do nó, você pode editar o arquivo de configuração do nó e alterar o valor de GRID_NETWORK_TARGET, ADMIN_NETWORK_TARGET ou CLIENT_NETWORK_TARGET para corresponder a uma interface de rede existente do host.
Certifique-se de que a interface do host forneça acesso à porta de rede física ou VLAN apropriada e que a interface não faça referência direta a um dispositivo de agregação de links ou ponte. Você deve configurar uma VLAN (ou outra interface virtual) sobre o dispositivo de agregação de links no host ou usar uma ponte e um par de Ethernet virtual (veth).
Corrigir erros de dispositivo de bloco ausente
O sistema verifica se cada nó recuperado está mapeado para um arquivo especial de dispositivo de bloco válido ou para um link simbólico válido para um arquivo especial de dispositivo de bloco. Se StorageGRID encontrar um mapeamento inválido no arquivo /etc/storagegrid/nodes/node-name.conf, será exibido um erro de dispositivo de bloco ausente.
Se você observar um erro que corresponda a este padrão:
Checking configuration file /etc/storagegrid/nodes/<node-name>.conf for node <node-name>...
ERROR: <node-name>: BLOCK_DEVICE_PURPOSE = <path-name>
<node-name>: <path-name> does not exist
Significa que `/etc/storagegrid/nodes/node-name.conf`mapeia o dispositivo de bloco usado por nome do nó para `PURPOSE`o caminho fornecido no sistema de arquivos Linux, mas não existe um arquivo especial de dispositivo de bloco válido, ou um link simbólico para um arquivo especial de dispositivo de bloco, nesse local.
Verifique se você concluiu as etapas em "Implantar novos hosts Linux". Use os mesmos nomes de dispositivos persistentes para todos os dispositivos de bloco que foram usados no host original.
Caso não seja possível restaurar ou recriar o arquivo especial do dispositivo de bloco ausente, você pode alocar um novo dispositivo de bloco com o tamanho e a categoria de storage apropriados e editar o arquivo de configuração do nó para alterar o valor de BLOCK_DEVICE_PURPOSE para apontar para o novo arquivo especial do dispositivo de bloco.
Determine o tamanho e a categoria de armazenamento adequados usando as tabelas para o seu sistema operacional Linux. Consulte "Requisitos de armazenamento e desempenho".
Analise as recomendações "configurando o storage do host" antes de prosseguir com a substituição do dispositivo de bloco.
|
|
Se você precisar fornecer um novo dispositivo de storage em bloco para qualquer uma das variáveis do arquivo de configuração que começam com BLOCK_DEVICE_, porque o dispositivo de storage em bloco original foi perdido com a falha do host, certifique-se de que o novo dispositivo de storage em bloco esteja desformatado antes de tentar outros procedimentos de recuperação. O novo dispositivo de storage em bloco estará desformatado se você estiver usando storage compartilhado e tiver criado um novo volume. Se você não tiver certeza, execute o seguinte comando em qualquer novo arquivo especial de dispositivo de storage em bloco.
|
|
|
Execute o seguinte comando apenas para novos dispositivos de storage em bloco. Não execute este comando se você acredita que o storage em bloco ainda contém dados válidos para o nó que está sendo recuperado, pois todos os dados no dispositivo serão perdidos.
|
Iniciar o serviço de host StorageGRID
Para iniciar seus nós do StorageGRID e garantir que eles reiniciem após uma reinicialização do host, você deve habilitar e iniciar o serviço de host do StorageGRID.
-
Execute os seguintes comandos em cada host:
sudo systemctl enable storagegrid sudo systemctl start storagegrid
-
Execute o seguinte comando para garantir que a implantação esteja em andamento:
sudo storagegrid node status node-name
-
Se algum nó retornar o status "Não está em execução" ou "Parado", execute o seguinte comando:
sudo storagegrid node start node-name
-
Se você já habilitou e iniciou o serviço de host do StorageGRID (ou se não tiver certeza se o serviço foi habilitado e iniciado), execute também o seguinte comando:
sudo systemctl reload-or-restart storagegrid
Recuperar nós que não iniciam normalmente
Se um nó do StorageGRID não se reconectar à grade normalmente e não aparecer como recuperável, ele pode estar corrompido. Você pode forçar o nó a entrar no modo de recuperação.
-
Confirme se a configuração de rede do nó está correta.
O nó pode não ter conseguido se reconectar à grid devido a mapeamentos incorretos de interface de rede ou a um endereço IP ou gateway da Grid Network incorretos.
-
Se a configuração de rede estiver correta, execute o comando
force-recovery:sudo storagegrid node force-recovery node-name -
Execute as etapas adicionais de recuperação para o nó. Consulte "Próximos passos: execute etapas adicionais de recuperação, se necessário".