Skip to main content
본 한국어 번역은 사용자 편의를 위해 제공되는 기계 번역입니다. 영어 버전과 한국어 버전이 서로 어긋나는 경우에는 언제나 영어 버전이 우선합니다.

EDA용 Workload Factory에서 지연 시간 문제 분석

기여자 netapp-sineadd

감지된 지연을 확인하고 자동화 도구를 사용하여 FSx for ONTAP 볼륨의 성능 저하 원인을 찾아 해결하십시오.

시작하기 전에

지연 시간 이벤트를 보고 분석하려면 먼저 "구성된 지연 시간 모니터링"이(가) 있어야 합니다.

지연 시간이 임계값 이상인 볼륨 보기

지연 시간이 임계값을 초과한 볼륨 테이블은 지난 72시간 동안 경고 또는 심각한 지연 시간 임계값을 초과한 볼륨을 보여줍니다.

이 작업 정보
  • 각 볼륨에 대해 가장 최근에 발생한 침해 사례만 표시됩니다. 동일한 볼륨에 대한 이전 침해 사례는 표시되지 않습니다.

  • 이벤트는 72시간 후 자동으로 제거됩니다.

  • 최대 200개의 이벤트가 표시됩니다. 새로운 이벤트가 추가되면 오래된 이벤트는 삭제됩니다.

  • 파일 시스템 링크가 없더라도 이벤트는 표시됩니다. 기본 분석 세부 정보를 보거나 AI 분석을 실행하려면 링크가 필요합니다.

단계
  1. 다음 중 하나를 사용하여 로그인하세요. "콘솔 경험".

  2. 메뉴 햄버거 메뉴 아이콘를 선택한 다음 *EDA*를 선택하십시오.

  3. 지연 시간 탭을 선택합니다.

  4. 표에 있는 각 이벤트 정보를 검토하십시오.

  5. 지연 이벤트에 대한 세부 정보를 보려면 심각도 열에서 해당 이벤트를 선택하십시오. 그러면 해당 이벤트에 대한 지연 분석 패널이 열립니다.

  6. 표를 정렬하려면 열 머리글을 선택합니다. 기본적으로 중요 이벤트가 시간별로 먼저 표시되고 그 다음 경고 이벤트가 시간별로 표시됩니다.

  7. 하나 이상의 이벤트를 해제하려면 각 이벤트 옆에 있는 작업 메뉴 아이콘 *해제*를 선택합니다.

  8. 표에 열을 추가하려면 열 아이콘을(를) 선택하고 열을 선택한 다음 * 적용 * 을 선택합니다.

  9. 지연 시간 분석 패널은 지연 시간 차트와 시간 범위 및 유형 제어 기능을 포함하여 침해 상황을 빠르게 확인할 수 있도록 해줍니다. *전체 분석 보기*를 선택하면 기본 분석, AI 분석(선택 사항) 및 추가 차트를 포함한 자세한 지연 시간 분석 페이지가 열립니다. 자세한 내용은 "지연 시간 추세 분석"을 참조하십시오.

지연 이벤트 분석

시작하기 전에

Workload Factory 설정에서 Amazon Bedrock 모델 ARN을 구성하려면 "기본 GenAI 요구 사항"을(를) 참조하십시오.

기본 분석을 통해 수동으로 조사할 필요 없이 속도 저하의 원인을 신속하게 찾을 수 있습니다.

지연 시간 분석 패널

심각도 열에서 지연 이벤트를 선택하면 해당 이벤트에 대한 지연 분석 패널이 열립니다. 패널에는 지연 이벤트에 대한 다양한 보기를 제공하는 탭이 포함되어 있습니다.

Amazon Bedrock 모델 ARN이 구성된 경우 데이터 및 클러스터 시나리오에 대한 AI 분석을 실행할 수 있습니다. Bedrock이 구성되지 않은 경우 해당 파일 시스템의 Storage Workloads 구성 페이지 링크가 제공되며, 여기에서 Bedrock 액세스를 설정할 수 있습니다.

  • 기본: 자동 분석 결과를 보여줍니다. 파일 시스템에 연결된 경우 구성 요소별 분석 결과를 표시하고 지연을 유발하는 요소를 보여줍니다. 연결이 없는 경우 연결을 추가하라는 메시지가 표시됩니다. 영향을 받는 볼륨에 대한 CloudWatch 메트릭의 대화형 지연 시간 그래프가 표시됩니다. 이벤트 발생 원인에 따라 읽기 또는 쓰기 메트릭이 표시됩니다. 다양한 시간 범위를 선택하고 필터를 사용하여 전체, 읽기, 쓰기 또는 메타데이터 작업을 볼 수 있습니다.

  • AI 분석: 보다 심층적인 조사를 통해 구체적인 근본 원인과 잠재적인 해결 방안을 제시합니다.

  • 상세 지연 시간 분석: 영향을 받는 볼륨에 대한 CloudWatch 메트릭의 대화형 그래프를 표시합니다. 이 그래프는 시간 경과에 따른 지연 시간, IOPS 및 처리량을 보여줍니다. 이벤트 발생 원인에 따라 읽기 또는 쓰기 메트릭이 표시됩니다. 다양한 시간 범위를 선택하고 필터를 사용하여 전체, 읽기, 쓰기 또는 메타데이터 작업을 볼 수 있습니다.

그래프 사용에 대한 자세한 지침은 "지연 시간 추세 분석"을 참조하십시오.

단계

  1. 지연 시간 탭에서 분석하려는 이벤트를 찾습니다.

  2. 심각도 열에서 지연 이벤트를 선택하여 해당 이벤트에 대한 분석 패널을 엽니다.

  3. 기본 탭을 검토하세요. 링크가 연결되어 있으면 구성 요소 분석을 열어 지연 원인을 확인하세요. 링크가 연결되어 있지 않으면 구성 요소를 분석할 수 있도록 링크를 연결하라는 메시지를 선택하세요.

  4. AI 분석 탭에서 *분석*을 선택하면 데이터 또는 클러스터 문제와 같은 심층 조사 결과를 확인할 수 있습니다. 이를 통해 구체적인 근본 원인과 해결 방안을 파악할 수 있습니다.

    결과를 검토하세요. 여기에는 다음 사항이 포함됩니다.

    • 잠재적 근본 원인 설명

    • 영향을 받는 EC2 클라이언트 목록

    • 권장 해결 단계

  5. AI 분석의 전체 결과를 보려면 *전체 분석 보기*를 선택하세요. 여기에는 선택한 기간 동안 CloudWatch 지표를 기반으로 한 볼륨 지연 시간, IOPS 및 처리량을 보여주는 성능 차트가 포함됩니다.

  6. 지연 문제를 해결하려면 권장 단계를 따르십시오.

  7. 변경 사항을 적용한 후 지연 이벤트 테이블을 확인하여 문제가 해결되었는지 확인하십시오.

모범 사례

지연 시간 문제를 분석할 때 다음 권장 사항을 고려하십시오.

  • 모니터링 추세: 임계값 이상의 지연 시간을 보이는 볼륨 테이블을 정기적으로 확인하여 구성 문제를 나타낼 수 있는 패턴이나 반복적인 문제를 파악하십시오.

  • AI 분석을 전략적으로 활용하세요: 기본 분석 결과 AI 분석이 필요하다고 판단되면 데이터 검토 시 AI 분석을 활용하십시오. AI 분석은 상세한 문제 해결이 필요한 복잡한 성능 문제에 대한 심층적인 통찰력을 제공할 수 있습니다.

  • 기각된 이벤트 검토: 이벤트가 기각된 이유를 정기적으로 검토하여 임계값을 조정하거나 시스템을 개선해야 하는지 확인하십시오.

지연 시간 추세 분석에 대한 모범 사례는 "그래프 해석"을 참조하십시오.