Skip to main content
È disponibile una versione più recente di questo prodotto.
La versione in lingua italiana fornita proviene da una traduzione automatica. Per eventuali incoerenze, fare riferimento alla versione in lingua inglese.

Ripristina i dati dell'oggetto sul volume di storage StorageGRID (guasto dell'unità di sistema)

Dopo aver ripristinato i volumi di archiviazione per un nodo di archiviazione non appliance, puoi ripristinare i dati degli oggetti replicati o codificati con erasure coding che sono andati persi quando il nodo di archiviazione si è guastato.

Quale procedura devo utilizzare?

Quando possibile, ripristina i dati degli oggetti utilizzando la pagina Ripristino del volume in Grid Manager.

  • Se i volumi sono elencati in Manutenzione > Ripristino del volume > Nodi da ripristinare, ripristina i dati dell'oggetto utilizzando il "Pagina di ripristino del volume in Grid Manager".

  • Se i volumi non sono elencati in Manutenzione > Ripristino volumi > Nodi da ripristinare, segui i passaggi seguenti per usare lo repair-data script per ripristinare i dati degli oggetti.

    Se il nodo di archiviazione ripristinato contiene un numero di volumi inferiore rispetto al nodo che sta sostituendo, devi usare lo repair-data script.

Nota Lo script repair-data è obsoleto e verrà rimosso in una versione futura. Quando possibile, usa "Procedura di ripristino del volume in Grid Manager".

Usa lo repair-data script per ripristinare i dati dell'oggetto

Prima di iniziare
  • Hai confermato che il nodo di archiviazione ripristinato ha uno stato di connessione Connesso icona avviso segno di spunta verde nella scheda Nodi > Panoramica del Grid Manager.

Informazioni su questa attività

I dati degli oggetti possono essere ripristinati da altri Storage Node o da un Cloud Storage Pool, a condizione che le regole ILM della grid siano state configurate in modo tale da rendere disponibili copie degli oggetti.

Nota quanto segue:

  • Se una regola ILM è stata configurata per memorizzare una sola copia replicata e tale copia si trovava su un volume di archiviazione che ha subito un errore, non potrai recuperare l'oggetto.

  • Se l'unica copia rimanente di un oggetto si trova in un Cloud Storage Pool, StorageGRID deve inviare più richieste all'endpoint del Cloud Storage Pool per ripristinare i dati dell'oggetto. Prima di eseguire questa procedura, contatta il supporto tecnico per ottenere aiuto nella stima dei tempi di ripristino e dei relativi costi.

Informazioni sul `repair-data`script

Per ripristinare i dati degli oggetti, esegui lo script repair-data. Questo script avvia il processo di ripristino dei dati degli oggetti e lavora con la scansione ILM per garantire che le regole ILM siano rispettate.

Seleziona Dati replicati o Dati con codifica di cancellazione (EC) qui sotto per conoscere le diverse opzioni per lo script repair-data, a seconda che tu stia ripristinando dati replicati o dati con codifica di cancellazione. Se devi ripristinare entrambi i tipi di dati, devi eseguire entrambi i set di comandi.

Nota Per ulteriori informazioni sullo repair-data script, inserisci repair-data --help dalla riga di comando del nodo Admin principale.
Nota Lo script repair-data è obsoleto e verrà rimosso in una versione futura. Quando possibile, usa "Procedura di ripristino del volume in Grid Manager".
Dati replicati

Sono disponibili due comandi per il ripristino dei dati replicati, a seconda che tu debba riparare l'intero nodo o solo determinati volumi sul nodo:

repair-data start-replicated-node-repair

repair-data start-replicated-volume-repair

Puoi monitorare le riparazioni dei dati replicati con questo comando:

repair-data show-replicated-repair-status

Dati codificati con cancellazione (EC)

Sono disponibili due comandi per il ripristino dei dati con codifica di cancellazione, a seconda che tu debba riparare l'intero nodo o solo determinati volumi sul nodo:

repair-data start-ec-node-repair

repair-data start-ec-volume-repair

Puoi monitorare le riparazioni dei dati codificati con cancellazione con questo comando:

repair-data show-ec-repair-status

Nota La riparazione dei dati codificati per la cancellazione può iniziare mentre alcuni nodi di archiviazione sono offline. Tuttavia, se non è possibile individuare tutti i dati codificati per la cancellazione, la riparazione non può essere completata. La riparazione si completerà quando tutti i nodi saranno disponibili.
Nota L'operazione di riparazione EC riserva temporaneamente una grande quantità di storage. Potrebbero essere generati avvisi relativi allo storage, che si risolveranno al termine della riparazione. Se lo storage non è sufficiente per la prenotazione, l'operazione di riparazione EC non andrà a buon fine. Le prenotazioni di storage vengono rilasciate al termine dell'operazione di riparazione EC, indipendentemente dal fatto che questa abbia avuto esito positivo o negativo.

Trova il nome host per Storage Node

  1. Accedi a qualsiasi nodo amministratore:

    1. Inserisci il seguente comando: ssh admin@primary_Admin_Node_IP

    2. Inserisci la password indicata nel file Passwords.txt.

    3. Inserisci il seguente comando per passare all'utente root: su -

    4. Inserisci la password indicata nel file Passwords.txt.

      Quando sei connesso come root, il prompt cambia da $ a #.

  2. Usa il file /etc/hosts per trovare il nome host dello Storage Node per i volumi di storage ripristinati. Per vedere un elenco di tutti i nodi nella grid, inserisci quanto segue: cat /etc/hosts.

Ripara i dati se tutti i volumi sono guasti

Se tutti i volumi di archiviazione sono guasti, ripara l'intero nodo. Segui le istruzioni per i dati replicati, i dati con codifica di cancellazione (EC) o entrambi, a seconda che tu usi dati replicati, dati con codifica di cancellazione (EC) o entrambi.

Se solo alcuni volumi hanno riscontrato errori, vai a Ripara i dati se solo alcuni volumi hanno subito un errore.

Nota Non puoi eseguire repair-data operazioni su più di un nodo contemporaneamente. Per ripristinare più nodi, contatta il supporto tecnico.
Dati replicati

Se la tua griglia include dati replicati, usa il repair-data start-replicated-node-repair comando con l'opzione --nodes, dove --nodes è l'hostname (nome del sistema), per riparare l'intero Storage Node.

Questo comando ripara i dati replicati su un nodo di archiviazione denominato SG-DC-SN3:

repair-data start-replicated-node-repair --nodes SG-DC-SN3

Nota Quando i dati degli oggetti vengono ripristinati, l'avviso Oggetti persi viene attivato se il sistema StorageGRID non riesce a individuare i dati degli oggetti replicati. Gli avvisi potrebbero essere attivati sui nodi di storage in tutto il sistema. Dovresti determinare la causa della perdita e se il recupero è possibile. Vedi "Indaga su eventuali oggetti smarriti".
Dati codificati con cancellazione (EC)

Se la tua griglia contiene dati codificati per la cancellazione, usa il repair-data start-ec-node-repair comando con l'opzione --nodes, dove --nodes è l'hostname (nome del sistema), per riparare l'intero Storage Node.

Questo comando ripara i dati codificati per la cancellazione su un nodo di archiviazione denominato SG-DC-SN3:

repair-data start-ec-node-repair --nodes SG-DC-SN3

L'operazione restituisce un repair ID`univoco che identifica questa `repair_data operazione. Usa questo `repair ID`per monitorare l'avanzamento e il risultato dell' `repair_data`operazione. Non viene restituito nessun altro feedback quando il processo di ripristino si completa.

La riparazione dei dati codificati con cancellazione può iniziare mentre alcuni nodi di archiviazione sono offline. La riparazione si completerà dopo che tutti i nodi saranno disponibili.

Ripara i dati se solo alcuni volumi hanno subito un errore

Se solo alcuni volumi sono guasti, ripara i volumi interessati. Segui le istruzioni per i dati replicati, i dati con codifica di cancellazione (EC) o entrambi, a seconda che tu usi dati replicati, dati con codifica di cancellazione (EC) o entrambi.

Se tutti i volumi hanno fallito, vai a Ripara i dati se tutti i volumi sono guasti.

Inserisci gli ID dei volumi in formato esadecimale. Ad esempio, 0000 è il primo volume e 000F è il sedicesimo volume. Puoi specificare un singolo volume, un intervallo di volumi o più volumi non in sequenza.

Tutti i volumi devono trovarsi sullo stesso Storage Node. Se devi ripristinare volumi per più di uno Storage Node, contatta il supporto tecnico.

Dati replicati

Se la tua griglia contiene dati replicati, usa il start-replicated-volume-repair comando con l'opzione --nodes per identificare il nodo (dove --nodes è il nome host del nodo). Poi aggiungi l'opzione --volumes oppure --volume-range, come mostrato nei seguenti esempi.

Volume singolo: Questo comando ripristina i dati replicati sul volume 0002 su un nodo di archiviazione denominato SG-DC-SN3:

repair-data start-replicated-volume-repair --nodes SG-DC-SN3 --volumes 0002

Intervallo di volumi: Questo comando ripristina i dati replicati su tutti i volumi nell'intervallo 0003 a 0009 su un nodo di archiviazione denominato SG-DC-SN3:

repair-data start-replicated-volume-repair --nodes SG-DC-SN3 --volume-range 0003,0009

Volumi multipli non in sequenza: Questo comando ripristina i dati replicati nei volumi 0001, 0005, e 0008 su un Storage Node chiamato SG-DC-SN3:

repair-data start-replicated-volume-repair --nodes SG-DC-SN3 --volumes 0001,0005,0008

Nota Durante il ripristino dei dati degli oggetti, viene attivato l'avviso Oggetti persi se il sistema StorageGRID non riesce a individuare i dati degli oggetti replicati. Gli avvisi potrebbero essere attivati sui nodi di storage in tutto il sistema. Nota la descrizione dell'avviso e le azioni consigliate per determinare la causa della perdita e se il recupero è possibile.
Dati codificati con cancellazione (EC)

Se la tua griglia contiene dati codificati con cancellazione, usa il start-ec-volume-repair comando con l'opzione --nodes per identificare il nodo (dove --nodes è il nome host del nodo). Poi aggiungi l'opzione --volumes oppure --volume-range, come mostrato nei seguenti esempi.

Volume singolo: Questo comando ripristina i dati codificati per la cancellazione sul volume 0007 su un Storage Node chiamato SG-DC-SN3:

repair-data start-ec-volume-repair --nodes SG-DC-SN3 --volumes 0007

Intervallo di volumi: Questo comando ripristina i dati codificati per la cancellazione su tutti i volumi nell'intervallo 0004 a 0006 su un nodo di archiviazione denominato SG-DC-SN3:

repair-data start-ec-volume-repair --nodes SG-DC-SN3 --volume-range 0004,0006

Volumi multipli non in sequenza: Questo comando ripristina i dati codificati per la cancellazione nei volumi 000A, 000C, e 000E su un Storage Node chiamato SG-DC-SN3:

repair-data start-ec-volume-repair --nodes SG-DC-SN3 --volumes 000A,000C,000E

L'operazione repair-data restituisce un repair ID identificativo univoco repair_data che identifica questa operazione. Usa questo repair ID per monitorare l'avanzamento e il risultato dell' repair_data operazione. Non viene restituito alcun altro feedback al completamento del processo di ripristino.

Nota La riparazione dei dati codificati con cancellazione può iniziare mentre alcuni nodi di archiviazione sono offline. La riparazione si completerà dopo che tutti i nodi saranno disponibili.

Ripara il monitor

Monitora lo stato delle attività di riparazione, a seconda che tu utilizzi dati replicati, dati codificati con cancellazione (EC) o entrambi.

Puoi anche monitorare lo stato dei lavori di ripristino del volume in corso e visualizzare la cronologia dei lavori di ripristino completati in "Grid Manager".

Dati replicati
  • Per ottenere una stima della % di completamento della riparazione replicata, aggiungi l' `show-replicated-repair-status`opzione al comando repair-data.

    repair-data show-replicated-repair-status

  • Per verificare se le riparazioni sono complete:

    1. Seleziona Nodes > Storage Node being repaired > ILM.

    2. Esamina gli attributi nella sezione Valutazione. Quando le riparazioni sono complete, l'attributo In attesa - Tutti indica 0 oggetti.

  • Per monitorare la riparazione in modo più dettagliato:

    1. Selezionare Nodi.

    2. Seleziona grid name > ILM.

    3. Posiziona il cursore sul grafico della coda ILM per visualizzare il valore dell'attributo Frequenza di scansione (oggetti/sec), che indica la velocità con cui gli oggetti nella griglia vengono scansionati e messi in coda per ILM.

    4. Nella sezione Coda ILM, guarda i seguenti attributi:

      • Periodo di scansione - stimato: Tempo stimato per completare una scansione ILM completa di tutti gli oggetti.

        Una scansione completa non garantisce che ILM sia stato applicato a tutti gli oggetti.

      • Tentativi di riparazione: il numero totale di operazioni di riparazione di oggetti tentate per i dati replicati considerati ad alto rischio. Gli oggetti ad alto rischio sono tutti gli oggetti di cui rimane una sola copia, sia che sia specificato dalla policy ILM sia a seguito della perdita di copie. Questo conteggio aumenta ogni volta che un nodo di storage tenta di riparare un oggetto ad alto rischio. Le riparazioni ILM ad alto rischio hanno la priorità se la grid diventa occupata.

        Lo stesso oggetto di riparazione potrebbe incrementare nuovamente se la replica non riesce dopo la riparazione. Questi attributi possono essere utili quando monitori l'avanzamento del ripristino del volume dello Storage Node. Se il numero di riparazioni tentate ha smesso di aumentare ed è stata completata una scansione completa, la riparazione probabilmente è terminata.

    5. In alternativa, invia una query Prometheus per storagegrid_ilm_scan_period_estimated_minutes e storagegrid_ilm_repairs_attempted.

Dati codificati con cancellazione (EC)

Per monitorare la riparazione dei dati codificati con erasure coding e riprovare eventuali richieste che potrebbero non essere andate a buon fine:

  1. Determina lo stato delle riparazioni dei dati codificati per la cancellazione:

    • Seleziona Support > Tools > Metrics per visualizzare il tempo stimato di completamento e la % di completamento per il lavoro corrente. Quindi, seleziona EC Overview nella sezione Grafana. Consulta le dashboard Grid EC Job Estimated Time to Completion e Grid EC Job Percentage Completed.

    • Utilizza questo comando per vedere lo stato di una specifica repair-data operazione:

      repair-data show-ec-repair-status --repair-id repair ID

    • Utilizza questo comando per elencare tutte le riparazioni:

      repair-data show-ec-repair-status

    L'output elenca le informazioni, tra cui repair ID, per tutte le riparazioni eseguite in precedenza e quelle attualmente in corso.

  2. Se l'output indica che l'operazione di riparazione non è riuscita, usa l'opzione --repair-id per riprovare la riparazione.

    Questo comando riprova una riparazione del nodo non riuscita, utilizzando l'ID di riparazione 6949309319275667690:

    repair-data start-ec-node-repair --repair-id 6949309319275667690

    Questo comando riprova una riparazione del volume non riuscita, usando l'ID di riparazione 6949309319275667690:

    repair-data start-ec-volume-repair --repair-id 6949309319275667690