Identifique e desmonte volumes de storage com falha no StorageGRID
Ao recuperar um nó de armazenamento com volumes de armazenamento com falha, você deve identificar e desmontar os volumes com falha. Você deve verificar se apenas os volumes de armazenamento com falha são reformatados como parte do procedimento de recuperação.
Você está conectado ao Gerenciador de Grade usando um "navegador web compatível".
Você deve recuperar os volumes de armazenamento com falha o mais rápido possível.
O primeiro passo do processo de recuperação é detectar volumes que foram desconectados, precisam ser desmontados ou apresentam erros de E/S. Se os volumes com falha ainda estiverem conectados, mas apresentarem um sistema de arquivos corrompido aleatoriamente, o sistema pode não detectar nenhuma corrupção em partes não utilizadas ou não alocadas do disco.
|
|
Você deve concluir este procedimento antes de executar etapas manuais para recuperar os volumes, como adicionar ou reconectar os discos, parar o nó, iniciar o nó ou reiniciar. Caso contrário, ao executar o reformat_storage_block_devices.rb script, você pode encontrar um erro no sistema de arquivos que faz com que o script trave ou falhe.
|
|
|
Repare o hardware e conecte os discos corretamente antes de executar o comando reboot.
|
|
|
Identifique cuidadosamente os volumes de armazenamento com falha. Você usará essas informações para verificar quais volumes precisam ser reformatados. Depois que um volume for reformatado, os dados no volume não poderão ser recuperados. |
Para recuperar volumes de armazenamento com falha, você precisa saber tanto os nomes dos dispositivos dos volumes de armazenamento com falha quanto seus IDs de volume.
Durante a instalação, cada dispositivo de storage recebe um identificador único universal (UUID) do sistema de arquivos e é montado em um diretório rangedb no Storage Node usando esse UUID do sistema de arquivos atribuído. O UUID do sistema de arquivos e o diretório rangedb são listados no /etc/fstab arquivo. O ponto de montagem, o nome do dispositivo e o tamanho do volume são exibidos no Grid Manager.
-
Conclua as etapas a seguir para registrar os volumes de armazenamento com falha e seus nomes de dispositivo:
-
Selecione Nodes > site > failed Storage Node > Storage.
-
Desça a página para localizar a tabela Volumes e a tabela Object stores e registre as seguintes informações para cada volume com status de Unknown ou Offline.
-
Na tabela de volumes, registre o ponto de montagem, o dispositivo e o tamanho.
-
Na tabela de armazenamentos de objetos, registre o
object_store_ID.O
object_store_IDé o ID do volume de storage com falha. Por exemplo, especifique0no comando para um armazenamento de objetos com ID 0000.
-
-
-
Faça login no Storage Node com falha:
-
Digite o seguinte comando:
ssh admin@grid_node_IP -
Digite a senha listada no arquivo
Passwords.txt. -
Digite o seguinte comando para alternar para root:
su - -
Digite a senha listada no arquivo
Passwords.txt.Quando você está logado como root, o prompt muda de
$para#.
-
-
Execute o seguinte script para desmontar um volume de armazenamento com falha:
sn-unmount-volume object_store_ID -
Se solicitado, pressione y para interromper o serviço Cassandra dependendo do volume de armazenamento 0.
Se o serviço Cassandra já estiver parado, você não será solicitado. O serviço Cassandra é parado apenas para o volume 0. root@Storage-180:~/var/local/tmp/storage~ # sn-unmount-volume 0 Services depending on storage volume 0 (cassandra) aren't down. Services depending on storage volume 0 must be stopped before running this script. Stop services that require storage volume 0 [y/N]? y Shutting down services that require storage volume 0. Services requiring storage volume 0 stopped. Unmounting /var/local/rangedb/0 /var/local/rangedb/0 is unmounted.
Em poucos segundos, o volume é desmontado. Mensagens aparecem indicando cada etapa do processo. A mensagem final indica que o volume é desmontado.
-
Se o desmontar falhar porque o volume está ocupado, você pode forçar o desmontar usando a opção
--use-umountof:Forçar um desmontar usando a opção --use-umountofpode fazer com que processos ou serviços que utilizam o volume se comportem de maneira inesperada ou apresentem falhas.root@Storage-180:~ # sn-unmount-volume --use-umountof /var/local/rangedb/2 Unmounting /var/local/rangedb/2 using umountof /var/local/rangedb/2 is unmounted. Informing LDR service of changes to storage volumes