Come i messaggi di controllo si spostano attraverso il sistema StorageGRID nel file di log audit.log per la conservazione
Tutti i servizi StorageGRID generano messaggi di audit durante il normale funzionamento del sistema. Dovresti capire come questi messaggi di audit si spostano attraverso il sistema StorageGRID fino al file audit.log.
I seguenti workflow per i messaggi di audit e la conservazione dei messaggi di audit sono applicabili solo se StorageGRID è configurato per nodi Admin/nodi locali o nodo Admin e server syslog esterno. Se StorageGRID è configurato per "Solo nodi locali" (impostazione predefinita) o "Server syslog esterno", i messaggi di audit vengono salvati localmente su ciascun nodo nel file /var/local/log/localaudit.log e non possono essere elaborati dai nodi Admin o dai nodi Storage.
${post_edited_translations.segment}
${post_edited_translations.segment}
Come mostrato nel diagramma di flusso dei messaggi di audit, ciascun nodo StorageGRID invia i propri messaggi di audit a uno dei servizi ADC presso il sito del data center. Il servizio ADC viene abilitato automaticamente per i primi tre Storage Node installati in ciascun sito.
A sua volta, ogni servizio ADC funge da relè e invia la propria raccolta di messaggi di audit a ogni nodo di amministrazione nel sistema StorageGRID, dando così a ciascun nodo di amministrazione una registrazione completa dell'attività di sistema.
Ciascun nodo Admin memorizza i messaggi di audit in file di log di testo; il file di log attivo è denominato audit.log.

Conservazione dei messaggi di audit
StorageGRID utilizza un processo di copia ed eliminazione per garantire che nessun messaggio di audit venga perso prima di essere scritto nel file di log di audit.
Quando un nodo genera o inoltra un messaggio di audit, il messaggio viene memorizzato in una coda di messaggi di audit sul disco di sistema del nodo della griglia. Una copia del messaggio viene sempre conservata in una coda di messaggi di audit finché il messaggio non viene scritto nel file di log di audit nella directory dell'Admin Node /var/local/audit/export. Questo aiuta a prevenire la perdita di un messaggio di audit durante il trasporto.

La coda dei messaggi di audit può aumentare temporaneamente a causa di problemi di connettività di rete o di una capacità di audit insufficiente. Man mano che le code aumentano, consumano più spazio disponibile nella directory /var/local/ di ciascun nodo. Se il problema persiste e la directory dei messaggi di audit di un nodo si riempie troppo, i singoli nodi danno priorità all'elaborazione dell'arretrato e diventano temporaneamente non disponibili per nuovi messaggi.
Nello specifico, potresti osservare i seguenti comportamenti:
-
Se la
/var/local/audit/exportdirectory utilizzata da un Admin Node si riempie, l'Admin Node viene contrassegnato come non disponibile per i nuovi messaggi di audit finché la directory non si svuota. Le richieste client S3 non sono influenzate. L'allarme XAMS (Unreachable Audit Repositories) viene attivato quando un repository di audit non è raggiungibile. -
Se la
/var/local/directory utilizzata da un nodo di Storage Node con il servizio ADC raggiunge il 92%, il nodo viene contrassegnato come non disponibile per i messaggi di audit finché la directory non scende all'87%. Le richieste client S3 verso altri nodi non sono influenzate. L'allarme NRLY (Available Audit Relays) viene attivato quando i relay di audit non sono raggiungibili.Se non ci sono nodi di archiviazione disponibili con il servizio ADC, i nodi di archiviazione memorizzano i messaggi di audit localmente nel file /var/local/log/localaudit.log. -
Se la
/var/local/directory utilizzata da un Storage Node raggiunge l'85% di riempimento, il nodo inizia a rifiutare le richieste dei client S3 con503 Service Unavailable.
I seguenti tipi di problemi possono causare una crescita molto elevata delle code dei messaggi di audit:
-
Interruzione di un Admin Node o di uno Storage Node con il servizio ADC. Se uno dei nodi del sistema non è disponibile, i nodi rimanenti potrebbero subire un sovraccarico.
-
Un ritmo di attività sostenuto che supera la capacità di audit del sistema.
-
Lo
/var/local/spazio su un nodo di archiviazione ADC si esaurisce per motivi non correlati ai messaggi di audit. Quando succede, il nodo smette di accettare nuovi messaggi di audit e dà priorità al backlog attuale, il che può causare backlog su altri nodi.
Avviso di coda di audit di grandi dimensioni e allarme Audit Messages Queued (AMQS)
${post_edited_translations.segment}
Se viene attivato l'avviso Coda di audit di grandi dimensioni o l'allarme AMQS legacy, inizia verificando il carico sul sistema: se c'è stato un numero significativo di transazioni recenti, l'avviso e l'allarme dovrebbero risolversi nel tempo e puoi ignorarli.
Se l'avviso o l'allarme persiste e aumenta di gravità, visualizza un grafico della dimensione della coda. Se il numero aumenta costantemente nel corso di ore o giorni, è probabile che il carico di audit abbia superato la capacità di audit del sistema. Riduci la frequenza delle operazioni del client o diminuisci il numero di messaggi di audit registrati modificando il livello di audit per Client Writes e Client Reads su Error o Off. Vedi "Configura la gestione dei log e il server syslog esterno".
Messaggi duplicati
Il sistema StorageGRID adotta un approccio prudente in caso di guasto della rete o di un nodo. Per questo motivo, potrebbero essere presenti messaggi duplicati nel file di log.