EDA용 Workload Factory에서 지연 시간 모니터링 구성
FSx for ONTAP 볼륨 성능을 추적하기 위해 읽기 및 쓰기 지연 시간에 대한 경고 및 임계 한계를 설정할 수 있습니다. 또한 지연 문제가 발생할 경우 실시간 알림을 받도록 이메일 또는 Amazon SNS 알림을 활성화할 수 있습니다.
시작하기 전에
지연 시간 모니터링을 구성하기 전에 다음 요구 사항을 충족하는지 확인하십시오.
AWS 자격 증명 및 권한
Workload Factory에 읽기/쓰기 권한이 있는 AWS 자격 증명을 추가해야 합니다. 지연 시간 모니터링 기능을 사용하려면 AWS 자격 증명과 연결된 모든 FSx for ONTAP 볼륨에 대한 CloudWatch 메트릭에 액세스해야 합니다.
Basic 모드 및 Read-only 모드 권한은 지연 시간 모니터링에 지원되지 않습니다.
AWS 자격 증명을 구성하지 않은 경우 "AWS 자격 증명 추가"을 참조하십시오.
ONTAP 파일 시스템용 FSx
AWS 환경에 볼륨이 배포된 FSx for ONTAP 파일 시스템이 하나 이상 필요합니다.
FSx for ONTAP에 연결
기본 분석에서 구성 요소 분석을 보려면 FSx for ONTAP 파일 시스템과 링크를 연결해야 합니다. 링크가 없더라도 지연 시간, IOPS 및 처리량 그래프는 볼 수 있습니다. 연결된 링크가 없는 경우 EDA에서 *링크 연결*을 선택하고 새 링크를 생성할지 또는 기존 링크를 연결할지 선택한 다음 *계속*을 선택하여 Storage workloads의 링크 생성 페이지로 자동 이동합니다.
링크를 생성하고 연결하는 방법에 대한 지침은 "링크 생성"을 참조하십시오.
Amazon Bedrock 모델 ARN(선택 사항)
(선택 사항) AI 분석을 사용하려면 워크로드 팩토리 설정에서 Amazon Bedrock 모델 ARN을 제공해야 합니다. ARN을 제공하지 않아도 지연 시간 모니터링 및 기본 분석은 사용할 수 있습니다.
자세한 내용은 "기본 GenAI 요구 사항"을 참조하십시오.
알림 구성(선택 사항)
지연 이벤트가 감지될 때 이메일 또는 Amazon SNS 알림을 받으려면 Workload Factory 설정에서 알림 기본 설정을 구성하십시오. 자세한 내용은 지연 시간 알림 구성를 참조하십시오.
지연 시간 임계값 구성
읽기 및 쓰기에 대한 경고 및 임계 한계를 설정합니다. 시스템은 이러한 한계를 지속적으로 확인하고 한계에 도달하면 경고를 보냅니다.
|
|
중요 이벤트 임계값을 경고 임계값보다 높게 설정하십시오. 그렇지 않으면 구성을 저장할 수 없습니다. |
|
|
EDA에서 설정한 지연 시간 임계값은 기본적으로 계정 전체에 적용됩니다. 일반 스토리지 워크로드에서 개별 볼륨의 지연 시간 임계값을 설정할 수도 있으며, 해당 볼륨에 대해서는 볼륨 설정이 우선 적용됩니다. EDA에서 계정 수준 임계값을 업데이트해도 볼륨 수준 설정은 변경되지 않습니다. |
-
다음 중 하나를 사용하여 로그인하세요. "콘솔 경험".
-
메뉴
를 선택한 다음 *EDA*를 선택하십시오. -
지연 시간 탭을 선택합니다.
-
EDA 지연 시간 구성 페이지에서 다음에 대한 임계값을 구성합니다.
-
읽기 지연 시간(경고 및 위험)
-
쓰기 지연 시간(경고 및 심각)
-
각 항목별 IOPS 임계값
-
평가 기간
-
-
*적용*을 선택하여 구성을 저장합니다.
Workload Factory는 AWS 자격 증명에 연결된 모든 FSx for ONTAP 볼륨의 지연 시간 메트릭을 수집합니다. 이러한 메트릭은 최소 20분마다 수집됩니다. 설정한 임계값을 초과하는 볼륨은 지연 시간 이벤트 테이블에 표시됩니다.
지연 시간 알림 구성
지연 시간이 길어질 경우 알림을 받도록 이메일 또는 Amazon SNS 알림을 설정하세요. 알림 빈도는 두 가지 옵션으로 제어할 수 있습니다.
-
매일 알림 설정(권장): 파일 시스템에서 새로운 침해 사고가 발생하면 알림을 받습니다. 파일 시스템에 대한 알림을 보낸 후, 동일한 파일 시스템에 대해 다시 알림을 보내기 전에 24시간을 기다립니다.
-
지연 시간 초과 시 알림(20분마다): 지연 시간 초과가 감지되면 최대 20분마다 한 번씩 알림을 받습니다.
지연 시간 알림은 파일 시스템 단위로 전송됩니다. 파일 시스템 내 하나 이상의 볼륨이 지연 시간 임계값을 초과하면 영향을 받는 모든 볼륨 목록이 포함된 단일 알림을 받게 됩니다.
|
|
영향을 받는 볼륨이 10개 이상인 경우, 이메일에는 처음 10개의 볼륨과 추가로 영향을 받는 볼륨의 수가 표시됩니다. 영향을 받는 모든 볼륨은 Workload Factory 콘솔에서 확인할 수 있습니다. |
알림 채널:
-
이메일: Workload Factory 알림 설정에서 구성한 이메일 주소로 전송됩니다.
-
Amazon SNS: 다른 시스템과의 통합을 위해 구성된 SNS 주제에 게시됩니다
알림을 활성화하려면 "알림 설정 구성"을 참조하십시오.
지연 시간 구성 관리
설정 후에는 언제든지 임계값을 변경할 수 있습니다.
-
지연 시간 페이지에서 *편집*을 선택합니다.
-
필요에 따라 임계값을 수정하십시오.
위험 임계값은 경고 임계값보다 높게 설정하십시오. 위험 임계값을 낮게 설정하면 시스템에 오류가 표시됩니다. -
변경 사항을 저장하려면 *적용*을 선택합니다.
모범 사례
지연 시간 모니터링을 구성할 때 다음 권장 사항을 고려하십시오.
-
현실적인 임계값 설정: 작업 부하에 맞춰 임계값을 설정하십시오. 기본값은 시작점일 뿐이며, 사용 환경에 맞게 조정해야 할 수도 있습니다.
-
경고 임계값부터 시작하세요: 먼저 경고 알림을 검토하여 정상적인 성능을 파악한 다음, 중요 한계를 설정하세요.
-
시간 범위를 신중하게 고려하십시오: 짧은 시간 범위(5~10분)는 문제를 더 빨리 감지하지만 더 많은 경보가 발생할 수 있습니다. 긴 시간 범위(15~20분)는 오경보를 줄여주지만 문제를 더 늦게 감지할 수 있습니다.
-
IOPS 및 지연 시간 임계값 조정: 두 조건 모두 충족해야 합니다. IOPS 제한이 너무 높게 설정되면 지연 시간이 높더라도 시스템에서 경고를 보내지 않을 수 있습니다.
-
기각된 이벤트 검토: 이벤트가 기각된 이유를 정기적으로 검토하여 임계값을 조정하거나 시스템을 개선해야 하는지 확인하십시오.