Workload Factory for EDA의 개요 대시보드에 대해 알아보십시오
개요 대시보드는 IT 관리자가 여러 FSx for ONTAP 파일 시스템에 걸쳐 있는 EDA 워크로드를 한 곳에서 모니터링할 수 있도록 지원합니다. 이 대시보드를 사용하여 시스템 상태 및 사용량을 신속하게 확인하고, 새 볼륨이나 작업을 배치할 위치를 선택하고, 이동이 필요할 수 있는 볼륨이나 SVM을 찾고, 용량 또는 처리량을 늘려야 할 시점을 파악할 수 있습니다.
개요
개요 대시보드는 구성된 AWS 자격 증명과 연결된 모든 FSx for ONTAP 파일 시스템에 대한 CloudWatch 메트릭을 수집합니다.
다음 내용이 포함됩니다.
-
클러스터 상태: 상단의 요약 정보에는 파일 시스템 전반의 지연 이벤트, SSD 사용량, 처리량 모드 상태, 용량 권장 사항 및 ONTAP EMS 이벤트가 표시됩니다.
-
클러스터 테이블: 각 클러스터의 사용량과 성능을 보여주는 검색 가능한 테이블입니다. 데이터를 필터링하고 정렬할 수 있으며, 페이지 간 이동이 가능하고 CSV 파일로 내보낼 수도 있습니다.
다음과 같은 도움이 됩니다.
-
새 볼륨을 배치하고 워크로드의 균형을 재조정합니다
-
용량 또는 처리량 확장 계획
-
대규모 클러스터 상태 모니터링
-
볼륨 배치에 대해 정보에 입각한 결정을 내리십시오
-
용량 한계에 가까워지는 클러스터를 식별합니다
대시보드 구성 요소
클러스터 상태
클러스터 상태는 선택한 파일 시스템 전반의 활동을 빠르게 보여줍니다. 이 기능은 FSx for ONTAP 링크가 하나 이상 파일 시스템에 연결된 경우에만 표시됩니다.
상태에는 다음 영역이 포함됩니다.
- 지연 시간
-
선택한 파일 시스템에서 발견된 지연 이벤트 수를 표시합니다. 이 정보는 지연 모니터링이 활성화된 경우에만 나타납니다.
- 파일 시스템 탄력성
-
-
SSD 용량: SSD 용량 관리에 Automate, Recommend 또는 None을 사용하는 파일 시스템의 수를 보여줍니다.
-
처리량: 파일 시스템 중 Automate, Recommend 또는 None으로 처리량을 관리하는 시스템의 수를 보여줍니다.
-
- ONTAP 이벤트
-
감지된 EMS 이벤트 수를 용량, 가용성 및 보호, 보안 및 기타 범주별로 표시합니다.
클러스터 테이블
클러스터 테이블은 활성 리전 및 AWS 계정 선택 항목을 기준으로 필터링된 각 FSx for ONTAP 파일 시스템에 대한 자세한 보기를 제공합니다. 데이터는 CloudWatch 메트릭에서 수집됩니다.
다음 표를 사용하여 다음을 수행하십시오.
-
용량 한계에 도달하는 파일 시스템 식별(SSD 사용량 열)
-
처리량 수요를 프로비저닝된 처리량 SKU와 비교(처리량 사용량 P99 열)
-
여러 클러스터에 걸쳐 성능 지표를 추적합니다.
-
링크 구성 상태 확인(연결된 링크 열) - 연결 유효성은 매일 검증됩니다
-
대량 매개 변수 업데이트를 위해 여러 클러스터 선택
파일 시스템을 선택하여 클러스터 정보, SSD 용량 값 및 시간 경과에 따른 SSD 용량 그래프를 포함한 클러스터 세부 정보를 엽니다.
SSD 용량 관리
관리 모드
- 알림 전용 (추천 모드)
-
Workload Factory는 사용자의 SSD 사용 방식을 분석하여 용량 증설이 필요한 시점을 제안합니다. 사용자는 이러한 제안을 검토하고 적용 여부를 결정할 수 있습니다. 이를 통해 자동화된 분석의 이점을 누리면서도 용량 변경을 완벽하게 제어할 수 있습니다.
- 자동화
-
Workload Factory는 사용량이 설정된 한도에 도달하면 자동으로 SSD 공간을 추가합니다. 이 과정은 Workload Factory가 자체적으로 처리하므로 수동 작업이 필요하지 않습니다. 따라서 자동 관리를 선호하는 환경에 적합합니다.
- 없음
-
SSD 용량 관리를 활성화하지 않은 경우 시스템에서 용량 권장 사항을 제시하거나 자동 조치를 취하지 않습니다. 용량을 직접 관리하려면 이 옵션을 사용하십시오.
SSD 관리 매개 변수
매개 변수는 용량 관리 시스템이 SSD 사용량을 분석하고 처리하는 방식을 제어합니다.
- 임계값 (10-90%)
-
용량 권장 사항 또는 자동화 작업을 트리거하는 SSD 사용량 백분율입니다. 예를 들어, 임계값을 80%로 설정하면 SSD 사용량이 80%에 도달할 때 권장 사항 또는 작업이 실행됩니다. 이 설정은 권장 모드와 자동화 모드 모두에서 사용할 수 있습니다.
- Lookback (1-200시간)
-
과거 SSD 사용 패턴을 분석하는 데 사용되는 기간입니다. 분석 기간이 길수록 용량 결정에 필요한 더 많은 과거 데이터를 확보할 수 있습니다. Automate 모드에서만 사용 가능합니다.
- Lookahead (1-200시간)
-
미래 용량 수요를 예측하는 데 사용되는 기간입니다. 더 긴 기간을 예측하면 미래의 용량 증가를 더 멀리까지 계획할 수 있습니다. Automate 모드에서만 사용 가능합니다.
각 파일 시스템에 대해 이러한 매개변수를 개별적으로 설정하거나 일괄 편집 기능을 사용하여 여러 파일 시스템에 동일한 설정을 적용할 수 있습니다.
처리량 관리
하나 또는 여러 파일 시스템에 대해 탄력적인 처리량 증가 동작을 구성할 수 있습니다.
관리 모드
- 알림 전용 (추천 모드)
-
Workload Factory는 처리량 압력을 평가하고 적용해야 할 권장 사항을 제공합니다.
- 자동화
-
워크로드 팩토리는 설정된 조건이 충족되면 처리량을 자동으로 증가시킵니다.
- 없음
-
처리량 관리를 활성화하지 않은 경우 시스템에서 권장 사항을 제시하거나 자동 조치를 취하지 않습니다. 용량을 직접 관리하려면 이 옵션을 사용하십시오.
처리량 매개변수
처리량 구성 대화 상자에는 다음이 포함됩니다.
-
활용률 임계값 (50-100%, 기본값 80%): 권장 사항 또는 자동화를 트리거하는 처리량 활용률 비율입니다.
고급 처리량 매개변수는 확장 가능한 고급 구성 섹션에서 사용할 수 있습니다.
-
평가 기간(시간) (12~72시간, 기본값 24시간)
-
위반 지표(%) (기본값 66%): 위반 여부를 판단하는 데 사용되는 백분율 임계값
-
연속 위반 기간(시간) (1~5시간, 기본값 2시간)
-
연속 침해 지표(%) (기본값 95%)
-
최소 지연 시간(ms) (기본값 10ms)
-
최대 처리량 SKU (기본값 없음)
파일 시스템 탄력성 권장 사항
Workload Factory가 자동화 또는 권장 모드일 때, 각 FSx for ONTAP 파일 시스템을 자동으로 확인하고 용량 권장 알고리즘을 실행합니다. 시스템은 주기적으로 스캔하여 SSD 용량이나 처리량을 조정해야 하는지 확인합니다.
권장 사항이 확인되면:
-
워크로드 팩토리 알림 설정에 따라 즉시 알림을 받게 됩니다.
-
클러스터 테이블을 필터링하여 권장 사항이 있는 파일 시스템을 식별합니다.
-
이 인터페이스는 현재 활성 권장 사항이 있는 파일 시스템의 총 수를 보여줍니다.
권장 사항에는 제안된 변경 사항과 그 이유가 설명되어 있습니다. 예를 들어, 파일 시스템 SSD 사용 패턴을 기반으로 SSD 크기를 늘리는 것이 좋습니다.
권장 사항, 용량 증가 성공, 경고 알림, 용량 확인 또는 증가 작업 중 오류 등 스토리지 용량 이벤트에 대한 알림이 전송됩니다. 오류 알림에는 권한 누락, 이미 진행 중인 파일 시스템 업데이트, 최근 스토리지 변경 후 AWS 대기 기간, 최대 용량 도달, 사용할 수 없는 CloudWatch 데이터 등 원인이 설명되어 있습니다.
용량 결정 지점 이해
SSD 사용량 그래프는 시스템이 용량 권장 사항을 제시하거나 자동화된 조치를 취한 시점을 표시합니다. 이러한 표시는 용량 관리 알고리즘이 시간에 따라 어떻게 작동했는지 보여줍니다.
- 권장 사항 결정 사항
-
시스템에서 SSD 용량 증설이 필요하다고 감지되면 이 메시지가 나타납니다. 용량이 증설되지 않은 경우, 이 메시지는 최대 30분마다 나타날 수 있습니다. 그래프는 가능한 경우 각 결정 시점을 표시합니다. 선택한 시간 간격이 너무 좁은 경우, 메시지들은 그룹으로 묶여서 표시됩니다.
- 자동화 의사 결정 지점
-
자동화 시스템이 SSD 용량을 늘리려고 시도할 때 나타납니다. 이 메시지는 작업이 성공했는지 실패했는지를 보여줍니다.
SSD 사용량 기록 그래프를 사용하여 다음을 수행하십시오.
-
스토리지 크기를 얼마나 자주 변경해야 하는지 확인하십시오.
-
사용 패턴에 따라 자동화 모드와 권장 모드 중 어느 모드가 더 적합한지 결정하십시오.
-
반복되는 스토리지 부족 현상 파악
-
시간 경과에 따른 증가를 고려하여 미래의 스토리지 필요량을 계획하십시오.
-
자동화 시도가 실패한 이유 조사