NetApp Console 로컬 배포 환경에서 볼륨의 높은 지연 시간 문제 조사
NetApp Console 로컬 배포 환경에서 워크로드 분석기를 사용하여 볼륨 응답 속도 저하의 원인을 찾으십시오.
알림이나 볼륨 인벤토리에서 분석기를 열면 볼륨이 이미 선택되어 있으므로 시간 범위와 차트 분석에 집중할 수 있습니다.
애플리케이션 성능이 저하될 경우, I/O 경로의 어느 부분이 속도 저하를 유발하는지 파악하십시오. 지연 시간 분석 섹션에서는 응답 시간을 지연 중심별로 분류하여 네트워크 문제, 데이터 처리 오버헤드, 애그리게이트 경합 및 기타 원인을 구분할 수 있습니다.
-
다음 방법 중 하나를 사용하여 워크로드 분석기를 엽니다.
-
상태 메뉴에서 워크로드 분석기*를 선택한 다음 *볼륨 필드에서 조사하려는 볼륨을 검색하여 선택합니다.
-
Storage > Fleets > Inventory 페이지에서 분석하려는 볼륨으로 이동한 다음 작업 메뉴에서 *분석*을 선택합니다.
-
경고 > 개요 페이지에서 조사하려는 볼륨에 대한 용량 관련 경고를 선택한 다음 경고 세부 정보에서 *분석*을 선택합니다.
-
-
성능 문제가 발생한 기간을 포함하도록 *시간 범위*를 설정한 다음 *분석*을 선택하십시오.
-
이벤트 타임라인 섹션을 검토하여 지연 시간 증가와 관련된 구성 변경 사항 및 알림을 확인하십시오.
분석기는 구성 변경 이벤트(렌치 아이콘)와 경고 이벤트(경고 및 심각 아이콘)를 지연 시간 차트와 동일한 시간 축에 표시하여 변경 사항이 성능 저하보다 먼저 발생했는지 여부를 쉽게 확인할 수 있도록 합니다.
-
지연 시간 섹션에서 보기 드롭다운 메뉴를 열고 *지연 센터별 분석*을 선택합니다. 차트는 시간에 따른 전체 지연 시간에 대한 각 지연 센터의 기여도를 보여줍니다. 지연 센터는 다음과 같습니다.
-
읽기 지연 시간
-
쓰기 지연 시간
-
기타 지연 시간
-
-
차트에서 지연 시간이 가장 높은 지점에 마우스를 올리면 각 지연 센터의 값과 전체 지연 시간에서 차지하는 비율을 확인할 수 있습니다.
일반적으로 가장 큰 지연 발생 지점은 경합이 발생한 리소스입니다. 공유 리소스가 수요를 따라가지 못하면 해당 리소스를 사용하는 볼륨은 I/O 대기 시간이 길어집니다. 워크로드를 이동하거나 QoS 제한을 조정하는 등의 방법으로 해당 리소스의 부하를 줄여 지연 시간을 낮추십시오.
-
주요 원인 요인을 파악하고 해당 값을 기준으로 다음 단계를 결정하십시오.
-
높은 읽기 지연 시간*은 디스크 경합을 나타낼 수 있습니다. *리소스 활용률 섹션을 확인하여 애그리게이트 사용 중 비율을 확인하십시오.
-
높은 쓰기 지연 시간 은 NIC 포화 상태 또는 클러스터 외부의 네트워크 경로 문제를 나타낼 수 있습니다.
-
*기타 지연 시간*이 높게 나타나는 것은 인라인 효율성 설정이 워크로드가 감당할 수 있는 것보다 더 많은 CPU 자원을 소비하고 있음을 나타낼 수 있습니다. 효율성 설정 또는 QoS를 조정하는 것을 고려하십시오.
-
높은 Cloud Latency 는 워크로드가 용량 계층에서 콜드 데이터에 자주 액세스하고 있음을 나타낼 수 있습니다. 계층화 정책을 조정하는 것을 고려하십시오.
-
-
지연 센터가 속도 저하의 원인이 아닌 경우 용량 분석 섹션을 확인하십시오. ONTAP 시스템이 85% 이상 가득 찬 경우, 높은 사용률로 인해 지연 센터 분석 결과와 관계없이 성능 문제가 발생할 수 있습니다.
-
변경 이벤트 직후 지연 시간이 증가했다면, 이벤트 세부 정보와 관련 차트를 함께 사용하여 가능한 원인을 검증하십시오.
-
QoS 변경의 경우, 지연 시간 그래프를 QoS 제한선과 비교하고 처리량 차트를 검토하여 수요가 정책 상한선을 충족하는지 확인하십시오.
-
애그리게이트 또는 볼륨 이동의 경우, 지연 시간 급증을 동일 기간 동안 표시된 노드 및 애그리게이트 사용률 값과 비교하십시오.
-
티어링 정책 변경 시 클라우드 지연 시간 기여도를 검토하여 변경 후 콜드 데이터 액세스가 증가했는지 확인하십시오.
-
구성 또는 배치 문제로 인해 문제가 발생했고 Console 로컬 배포로 해결할 수 있는 경우 볼륨의 알림에 문제 해결 옵션이 제공될 수 있습니다.