Ripristina i nodi StorageGRID sull'host
Per ripristinare un nodo della griglia guasto su un nuovo host Linux, segui questi passaggi per ripristinare il file di configurazione del nodo.
-
Ripristina e convalida il nodo ripristinando il file di configurazione del nodo. Per una nuova installazione, crei un file di configurazione del nodo per ogni nodo della griglia da installare su un host. Quando ripristini un nodo della griglia su un host sostitutivo, ripristini o sostituisci il file di configurazione del nodo per qualsiasi nodo della griglia non funzionante.
-
Se necessario, recupera tutti i nodi che non si avviano.
Se alcuni volumi di storage a blocchi sono stati conservati dall'host precedente, potresti dover eseguire procedure di ripristino aggiuntive. I comandi in questa sezione ti aiutano a determinare quali procedure aggiuntive sono necessarie.
Ripristina e convalida i nodi della griglia
Devi ripristinare i file di configurazione della griglia per tutti i nodi della griglia non funzionanti, poi convalidare i file di configurazione della griglia e risolvere eventuali errori.
Puoi importare qualsiasi nodo della griglia che dovrebbe essere presente sull'host, purché il suo volume /var/local non sia andato perso a causa del guasto dell'host precedente. Ad esempio, il volume /var/local potrebbe essere ancora presente se hai usato uno storage condiviso per i volumi di dati di sistema di StorageGRID, come descritto nelle istruzioni di installazione di StorageGRID per il tuo sistema operativo Linux. Importando il nodo, viene ripristinato il suo file di configurazione sull'host.
Se non è possibile importare i nodi mancanti, devi ricreare i loro file di configurazione della griglia.
Devi quindi convalidare il file di configurazione della grid e risolvere eventuali problemi di rete o di storage che potrebbero verificarsi prima di riavviare StorageGRID. Quando ricrei il file di configurazione per un nodo, devi usare lo stesso nome per il nodo sostitutivo che è stato usato per il nodo che stai recuperando.
Consulta la "Istruzioni per l'installazione di Linux" per maggiori informazioni sulla posizione del volume /var/local per un nodo.
-
Dalla riga di comando dell'host ripristinato, elenca tutti i nodi StorageGRID attualmente configurati:
sudo storagegrid node listSe non è configurato alcun nodo della griglia, non verrà generato alcun output. Se sono configurati alcuni nodi della griglia, l'output sarà nel seguente formato:
Name Metadata-Volume ================================================================ dc1-adm1 /dev/mapper/sgws-adm1-var-local dc1-gw1 /dev/mapper/sgws-gw1-var-local dc1-sn1 /dev/mapper/sgws-sn1-var-local dc1-arc1 /dev/mapper/sgws-arc1-var-local
Se alcuni o tutti i nodi della griglia che dovrebbero essere configurati sull'host non sono elencati, devi ripristinare i nodi della griglia mancanti.
-
Per importare nodi della griglia che hanno un
/var/localvolume:-
Esegui il seguente comando per ogni nodo che desideri importare:
sudo storagegrid node import node-var-local-volume-pathIl
storagegrid node importcomando viene eseguito correttamente solo se il nodo di destinazione è stato arrestato in modo pulito sull'host su cui è stato eseguito l'ultima volta. Se così non fosse, vedrai un errore simile al seguente:This node (node-name) appears to be owned by another host (UUID host-uuid).
Use the --force flag if you are sure import is safe.-
Se visualizzi l'errore relativo al nodo di proprietà di un altro host, esegui di nuovo il comando con il flag
--forceper completare l'importazione:sudo storagegrid --force node import node-var-local-volume-pathTutti i nodi importati con il --forceflag richiederanno ulteriori passaggi di ripristino prima di poter rientrare nella griglia, come descritto in "Cosa fare dopo: esegui ulteriori passaggi di ripristino, se necessario".
-
-
Per i nodi della griglia che non dispongono di un
/var/localvolume, ricrea il file di configurazione del nodo per ripristinarlo sull'host. Per istruzioni, vedi "Crea i file di configurazione del nodo".Quando ricrei il file di configurazione per un nodo, devi usare lo stesso nome per il nodo sostitutivo che è stato usato per il nodo che stai recuperando. Per le implementazioni Linux, assicurati che il nome del file di configurazione contenga il nome del nodo. Dovresti usare le stesse interfacce di rete, mappature dei dispositivi a blocchi e indirizzi IP quando possibile. Questa pratica riduce al minimo la quantità di dati che deve essere copiata sul nodo durante il ripristino, il che può rendere il ripristino significativamente più veloce (in alcuni casi, minuti invece di settimane). Se usi nuovi dispositivi a blocchi (dispositivi che il nodo StorageGRID non utilizzava in precedenza) come valori per una qualsiasi delle variabili di configurazione che iniziano con BLOCK_DEVICE_quando ricrei il file di configurazione per un nodo, segui le linee guida in Correggi gli errori relativi ai dispositivi a blocchi mancanti. -
Esegui il seguente comando sull'host ripristinato per elencare tutti i nodi StorageGRID.
sudo storagegrid node list -
Convalida il file di configurazione del nodo per ciascun nodo della griglia il cui nome è stato mostrato nell'output del comando storagegrid node list:
sudo storagegrid node validate node-nameDevi risolvere eventuali errori o avvisi prima di avviare il servizio host StorageGRID. Le sezioni seguenti forniscono maggiori dettagli sugli errori che potrebbero avere particolare rilevanza durante il ripristino.
Correggi gli errori di interfaccia di rete mancante
Se la rete host non è configurata correttamente o un nome è scritto in modo errato, si verifica un errore quando StorageGRID verifica la mappatura specificata nel /etc/storagegrid/nodes/node-name.conf file.
Potresti visualizzare un errore o un avviso corrispondente a questo schema:
Checking configuration file /etc/storagegrid/nodes/<node-name>.conf for node <node-name>...
ERROR: <node-name>: GRID_NETWORK_TARGET = <host-interface-name>
<node-name>: Interface <host-interface-name>' does not exist
L'errore potrebbe essere segnalato per la Grid Network, la Admin Network o la Client Network. Questo errore significa che il file /etc/storagegrid/nodes/node-name.conf mappa la rete StorageGRID indicata all'interfaccia verso gli host denominata host-interface-name, ma non esiste alcuna interfaccia con quel nome sull'host corrente.
Se ricevi questo errore, verifica di aver completato i passaggi descritti in "Distribuisci nuovi host Linux". Usa gli stessi nomi per tutte le interfacce verso gli host che sono stati usati sull'host originale.
Se non riesci a dare alle interfacce verso gli host un nome che corrisponda al file di configurazione del nodo, puoi modificare il file di configurazione del nodo e cambiare il valore di GRID_NETWORK_TARGET, ADMIN_NETWORK_TARGET o CLIENT_NETWORK_TARGET in modo che corrisponda a un'interfaccia verso gli host esistente.
Assicurati che l'interfaccia verso gli host fornisca accesso alla porta di rete fisica o alla VLAN appropriata e che l'interfaccia non faccia riferimento direttamente a un dispositivo di aggregazione (bond) o bridge. Devi configurare una VLAN (o un'altra interfaccia virtuale) sopra il dispositivo di aggregazione (bond) sull'host, oppure usare una bridge e una coppia di Ethernet virtuale (veth).
Correggi gli errori relativi ai dispositivi a blocchi mancanti
Il sistema verifica che ogni nodo recuperato sia mappato a un file speciale di dispositivo a blocchi valido o a un collegamento simbolico valido a un file speciale di dispositivo a blocchi. Se StorageGRID rileva una mappatura non valida nel /etc/storagegrid/nodes/node-name.conf file, viene visualizzato un errore relativo a un dispositivo a blocchi mancante.
Se riscontri un errore corrispondente a questo schema:
Checking configuration file /etc/storagegrid/nodes/<node-name>.conf for node <node-name>...
ERROR: <node-name>: BLOCK_DEVICE_PURPOSE = <path-name>
<node-name>: <path-name> does not exist
Significa che /etc/storagegrid/nodes/node-name.conf`mappa il dispositivo a blocchi utilizzato da node-name per `PURPOSE al percorso specificato nel file system Linux, ma non esiste un file speciale del dispositivo a blocchi valido, né un collegamento simbolico a un file speciale del dispositivo a blocchi, in quella posizione.
Verifica di aver completato i passaggi in "Distribuisci nuovi host Linux". Usa gli stessi nomi di dispositivo persistente per tutti i dispositivi a blocchi che sono stati usati sull'host originale.
Se non riesci a ripristinare o ricreare il file speciale del dispositivo a blocchi mancante, puoi allocare un nuovo dispositivo a blocchi della dimensione e categoria di storage appropriate e modificare il file di configurazione del nodo per cambiare il valore di BLOCK_DEVICE_PURPOSE in modo che punti al nuovo file speciale del dispositivo a blocchi.
Determina le dimensioni e la categoria di archiviazione appropriate utilizzando le tabelle per il tuo sistema operativo Linux. Vedi "Requisiti di storage e prestazioni".
Prima di procedere con la sostituzione del dispositivo a blocchi, leggi le raccomandazioni per "configurare lo storage host".
|
|
Se devi fornire un nuovo dispositivo di storage a blocchi per una delle variabili del file di configurazione che iniziano con BLOCK_DEVICE_ perché il dispositivo a blocchi originale è andato perso insieme all'host guasto, assicurati che il nuovo dispositivo a blocchi sia non formattato prima di tentare ulteriori procedure di ripristino. Il nuovo dispositivo a blocchi sarà non formattato se stai usando storage condiviso e hai creato un nuovo volume. Se non sei sicuro, esegui il seguente comando su qualsiasi nuovo file speciale di dispositivo di storage a blocchi.
|
|
|
Esegui il comando seguente solo per i nuovi dispositivi di storage a blocchi. Non eseguire questo comando se pensi che lo storage a blocchi contenga ancora dati validi per il nodo da recuperare, perché tutti i dati presenti sul dispositivo andranno persi.
|
Avvia il servizio host StorageGRID
Per avviare i nodi StorageGRID e assicurarti che si riavviino dopo il riavvio dell'host, devi abilitare e avviare il servizio host StorageGRID.
-
Esegui i seguenti comandi su ciascun host:
sudo systemctl enable storagegrid sudo systemctl start storagegrid
-
Esegui il seguente comando per verificare che la distribuzione stia procedendo:
sudo storagegrid node status node-name
-
Se un nodo restituisce lo stato "Non in esecuzione" o "Arrestato", esegui il seguente comando:
sudo storagegrid node start node-name
-
Se in precedenza hai abilitato e avviato il servizio host StorageGRID (o se non sei sicuro che il servizio sia stato abilitato e avviato), esegui anche il seguente comando:
sudo systemctl reload-or-restart storagegrid
Ripristina i nodi che non si avviano normalmente
Se un nodo StorageGRID non si riconnette normalmente alla grid e non risulta recuperabile, potrebbe essere danneggiato. Puoi forzare il nodo in modalità di ripristino.
-
Conferma che la configurazione di rete del nodo sia corretta.
Il nodo potrebbe non essere riuscito a riconnettersi alla griglia a causa di mappature errate dell'interfaccia di rete o di un indirizzo IP o gateway della Grid Network non corretti.
-
Se la configurazione di rete è corretta, esegui il comando
force-recovery:sudo storagegrid node force-recovery node-name -
Esegui i passaggi di ripristino aggiuntivi per il nodo. Vedi "Cosa fare dopo: esegui ulteriori passaggi di ripristino, se necessario".