Scopri la dashboard Panoramica in Workload Factory per EDA
La dashboard Panoramica offre agli amministratori IT un unico punto di accesso per monitorare i carichi di lavoro EDA su più file system FSx for ONTAP. Usala per verificare rapidamente lo stato e l'utilizzo del sistema, scegliere dove posizionare nuovi volumi o job, trovare volumi o SVM che potrebbero dover essere spostati e vedere quando è il momento di aumentare la capacità o il throughput.
Panoramica
La dashboard Panoramica raccoglie le metriche CloudWatch per tutti i file system FSx for ONTAP associati alle credenziali AWS configurate.
Comprende:
-
Stato di salute del cluster: un riepilogo nella parte superiore evidenzia gli eventi di latenza, l'utilizzo delle unità SSD, lo stato della modalità throughput, i consigli sulla capacità e gli eventi ONTAP EMS sui tuoi file system.
-
Tabella dei cluster: una tabella ricercabile che mostra l'utilizzo e le performance di ciascun cluster. Puoi filtrare e ordinare i dati, spostarti tra le pagine ed esportarli come file CSV.
Ti aiuta a:
-
Posiziona nuovi volumi e ribilancia i carichi di lavoro
-
Pianifica la scalabilità della capacità o del throughput
-
Monitorare lo stato di salute dei cluster su larga scala
-
Prendi decisioni informate sul posizionamento dei volumi
-
Identificare i cluster che si avvicinano ai limiti di capacità
Componenti della dashboard
Stato di salute del cluster
Lo stato di salute del cluster mostra una panoramica rapida dell'attività sui file system che hai selezionato. Questa visualizzazione appare solo se almeno un collegamento FSx for ONTAP è connesso ai tuoi file system.
Lo stato di salute comprende le seguenti aree:
- Latenza
-
Mostra il numero di eventi di latenza rilevati nei file system selezionati. Queste informazioni vengono visualizzate solo se il monitoraggio della latenza è abilitato.
- Elasticità del file system
-
-
Capacità SSD: mostra quanti file system usano Automate, Recommend o None per gestire la capacità SSD.
-
Throughput: mostra quanti file system utilizzano Automate, Recommend o None per gestire il throughput.
-
- Eventi ONTAP
-
Visualizza il numero di eventi EMS rilevati, categorizzati per Capacità, Disponibilità & protezione e Sicurezza & altro.
Tabella dei cluster
La tabella dei cluster fornisce una visualizzazione dettagliata di ciascun file system FSx for ONTAP, filtrata in base alla regione attiva e alle selezioni dell'account AWS. I dati vengono raccolti dalle metriche di CloudWatch.
Utilizzare la tabella per:
-
Identificare i file system che si stanno avvicinando ai limiti di capacità (colonna Utilizzo SSD)
-
Confronta la domanda di throughput con il throughput SKU fornito (colonna Utilizzo throughput P99)
-
Monitora le metriche delle prestazioni su più cluster
-
Verifica lo stato della configurazione del collegamento (colonna Collegamento associato) - la validità della connessione viene verificata quotidianamente
-
Selezionare più cluster per aggiornamenti di parametri in blocco
Seleziona un file system per aprire i dettagli del cluster, incluse le informazioni sul cluster, i valori di capacità SSD e il grafico della capacità SSD nel tempo.
gestione della capacità SSD
Modalità di gestione
- Solo notifica (modalità consigliata)
-
Workload Factory analizza il modo in cui utilizzi i tuoi SSD e suggerisce quando aumentarne la capacità. Esamini questi suggerimenti e decidi se applicarli. Così mantieni il pieno controllo sulle modifiche di capacità, beneficiando comunque dell'analisi automatizzata.
- Automatizzare
-
Workload Factory aggiunge automaticamente ulteriore spazio SSD quando l'utilizzo raggiunge i limiti preimpostati. Se ne occupa da solo, quindi non serve alcun intervento manuale. Funziona bene per ambienti che preferiscono la gestione automatica.
- Nessuno
-
Se non hai abilitato la gestione della capacità SSD, il sistema non fornisce consigli sulla capacità né intraprende azioni automatiche. Usa questa opzione se vuoi gestire tu stesso la capacità.
Parametri di gestione SSD
I parametri controllano il modo in cui il sistema di gestione della capacità analizza e agisce sull'utilizzo dell'SSD:
- Soglia (10-90%)
-
La percentuale di utilizzo dell'SSD che attiva i consigli sulla capacità o le azioni automatizzate. Ad esempio, una soglia dell'80% significa che i consigli o le azioni vengono attivati quando l'utilizzo dell'SSD raggiunge l'80%. Questa impostazione è disponibile sia nella modalità Recommend che nella modalità Automate.
- Lookback (1-200 ore)
-
Periodo di tempo utilizzato per analizzare gli schemi storici di utilizzo degli SSD. Un periodo di analisi più lungo fornisce un contesto storico più ampio per le decisioni relative alla capacità. Disponibile solo in modalità Automate.
- Previsioni (1-200 ore)
-
Il periodo di tempo utilizzato per prevedere il fabbisogno di capacità futuro. Un periodo di previsione più lungo consente di pianificare la crescita della capacità a lungo termine. Disponibile solo in modalità Automate.
Puoi impostare questi parametri per ciascun file system singolarmente oppure usare la modifica in blocco per applicare le stesse impostazioni a più file system.
Gestione del throughput
Puoi configurare il comportamento di incremento elastico del throughput per uno o più file system.
Modalità di gestione
- Solo notifica (modalità consigliata)
-
Workload Factory valuta la pressione sul throughput e fornisce raccomandazioni che puoi applicare.
- Automatizzare
-
Workload Factory aumenta automaticamente il throughput quando vengono soddisfatte le condizioni configurate.
- Nessuno
-
Se non hai abilitato la gestione del throughput, il sistema non fornisce raccomandazioni né intraprende azioni automatiche. Usa questa opzione se vuoi gestire tu stesso la capacità.
Parametri di throughput
La finestra di dialogo per la configurazione del throughput include:
-
Soglia di utilizzo (50-100%, valore predefinito 80%): Percentuale di utilizzo del throughput che attiva raccomandazioni o automazione.
I parametri avanzati di throughput sono disponibili in una sezione espandibile Configurazione avanzata.
-
Periodo di valutazione (ore) (12-72 ore, predefinito 24)
-
Breached metrics (%) (predefinito 66%): Soglia % per determinare la violazione
-
Intervallo di tempo consecutivo in caso di violazione (ore) (1-5 ore, predefinito 2)
-
Metriche di violazione consecutive (%) (predefinito 95%)
-
Latenza minima (ms) (predefinita 10 ms)
-
SKU di throughput massimo (predefinito None)
Raccomandazioni sull'elasticità del file system
Quando Workload Factory è in modalità Automate o Recommend, controlla automaticamente ogni FSx for ONTAP file system ed esegue un algoritmo di raccomandazione della capacità. Il sistema esegue scansioni periodiche per verificare se la capacità dell'SSD o il throughput devono essere regolati.
Quando viene individuata una raccomandazione:
-
Ricevi una notifica immediata in base alle impostazioni di notifica di Workload Factory.
-
Identifica i file system con suggerimenti filtrando la tabella Cluster.
-
L'interfaccia mostra il numero totale di file system che attualmente hanno raccomandazioni attive.
La raccomandazione spiega la modifica suggerita e le motivazioni alla base di essa, ad esempio: Consigliamo di aumentare le dimensioni dell'SSD in base allo schema di utilizzo dell'SSD del file system.
Comprendere i punti decisionali relativi alla capacità
Il grafico di utilizzo dell'SSD indica quando il sistema ha fornito raccomandazioni sulla capacità o ha intrapreso azioni automatiche. Questi indicatori mostrano come l'algoritmo di gestione della capacità si è comportato nel tempo.
- Punti decisionali per la raccomandazione
-
Compaiono quando il sistema rileva che è necessaria più capacità SSD. Se la capacità non è stata aumentata, questi punti possono comparire anche ogni 30 minuti. Il grafico mostra ogni punto decisionale quando possibile. Se l'intervallo di tempo selezionato è troppo denso, i punti vengono raggruppati.
- Punti decisionali per l'automazione
-
Compaiono quando il sistema di automazione tenta di aumentare la capacità dell'SSD. Mostrano se l'azione è riuscita o meno.
Usa il grafico della cronologia di utilizzo dell'SSD per:
-
Scopri con quale frequenza devi modificare le dimensioni dello storage
-
Decidi se la modalità automatica o quella di raccomandazione si adatta meglio alle tue abitudini di utilizzo
-
Individua le ripetute carenze di storage
-
Pianifica le future esigenze di archiviazione in base alla crescita nel tempo
-
Scopri perché i tentativi di automazione non sono riusciti