StorageGRID 플랫폼 서비스 문제 해결
플랫폼 서비스에서 사용되는 엔드포인트는 테넌트 사용자가 테넌트 관리자에서 생성하고 관리합니다. 하지만 테넌트 플랫폼 서비스 구성 또는 사용에 문제가 있는 경우, 그리드 관리자를 사용하여 문제를 해결할 수 있습니다.
새로운 엔드포인트 관련 문제
테넌트가 플랫폼 서비스를 사용하려면 먼저 테넌트 관리자를 통해 하나 이상의 엔드포인트를 생성해야 합니다. 각 엔드포인트는 StorageGRID S3 버킷, Amazon Web Services 버킷, Amazon Simple Notification Service 토픽, Kafka 토픽 또는 로컬이나 AWS에서 호스팅되는 Elasticsearch 클러스터와 같은 플랫폼 서비스의 외부 대상을 나타냅니다. 각 엔드포인트에는 외부 리소스의 위치와 해당 리소스에 액세스하는 데 필요한 자격 증명이 모두 포함됩니다.
테넌트가 엔드포인트를 생성하면 StorageGRID 시스템은 해당 엔드포인트가 존재하는지, 그리고 지정된 자격 증명을 사용하여 접근할 수 있는지 확인합니다. 엔드포인트에 대한 연결은 각 사이트의 한 노드에서 검증됩니다.
엔드포인트 유효성 검사에 실패하면 실패 사유를 설명하는 오류 메시지가 표시됩니다. 테넌트 사용자는 문제를 해결한 후 엔드포인트를 다시 생성해야 합니다.
|
|
테넌트 계정에 플랫폼 서비스가 활성화되어 있지 않으면 엔드포인트 생성이 실패합니다. |
기존 엔드포인트 관련 문제
StorageGRID가 기존 엔드포인트에 연결을 시도하는 동안 오류가 발생하면 테넌트 관리자의 대시보드에 메시지가 표시됩니다.

테넌트 사용자는 엔드포인트 페이지에서 각 엔드포인트에 대한 최근 오류 메시지를 확인하고 오류 발생 시점을 파악할 수 있습니다. 마지막 오류 열에는 각 엔드포인트의 최근 오류 메시지와 오류 발생 시점이 표시됩니다.
아이콘이 포함된 오류는 지난 7일 이내에 발생한 오류입니다.

|
|
마지막 오류 열의 일부 오류 메시지에는 괄호 안에 logID가 포함될 수 있습니다. 그리드 관리자 또는 기술 지원 담당자는 이 ID를 사용하여 bycast.log에서 오류에 대한 자세한 정보를 찾을 수 있습니다. |
프록시 서버 관련 문제
스토리지 노드와 플랫폼 서비스 엔드포인트 간에 "스토리지 프록시"를 구성한 경우, 프록시 서비스에서 StorageGRID의 메시지를 허용하지 않으면 오류가 발생할 수 있습니다. 이러한 문제를 해결하려면 프록시 서버의 설정을 확인하여 플랫폼 서비스 관련 메시지가 차단되지 않도록 하십시오.
오류가 발생했는지 확인합니다.
지난 7일 동안 엔드포인트 오류가 발생한 경우, 테넌트 관리자의 대시보드에 알림 메시지가 표시됩니다. 엔드포인트 페이지에서 오류에 대한 자세한 내용을 확인할 수 있습니다.
클라이언트 작업이 실패합니다.
일부 플랫폼 서비스 문제로 인해 S3 버킷에 대한 클라이언트 작업이 실패할 수 있습니다. 예를 들어, 내부 복제 상태 머신(RSM) 서비스가 중지되거나 전송 대기 중인 플랫폼 서비스 메시지가 너무 많으면 S3 클라이언트 작업이 실패합니다.
서비스 상태를 확인하려면:
-
노드 > 사이트 > 스토리지 노드 > 개요 를 선택합니다.
-
알림 테이블에서 활성화된 알림을 확인하십시오.
-
활성화된 경고를 모두 해결하십시오. 필요한 경우 기술 지원에 문의하십시오.
복구 가능한 엔드포인트 오류 및 복구 불가능한 엔드포인트 오류
엔드포인트가 생성된 후 플랫폼 서비스 요청 오류는 다양한 이유로 발생할 수 있습니다. 일부 오류는 사용자 개입을 통해 복구할 수 있습니다. 예를 들어, 복구 가능한 오류는 다음과 같은 이유로 발생할 수 있습니다.
-
사용자의 자격 증명이 삭제되었거나 만료되었습니다.
-
대상 버킷이 존재하지 않습니다.
-
알림을 전달할 수 없습니다.
StorageGRID에서 복구 가능한 오류가 발생하면 플랫폼 서비스 요청이 성공할 때까지 재시도됩니다.
다른 오류는 복구할 수 없습니다. 예를 들어, 복구 불가능한 오류는 다음과 같은 이유로 발생할 수 있습니다.
-
해당 엔드포인트가 삭제되었습니다.
-
웹훅 엔드포인트 대상이 알림 요청에
400 Bad Request오류로 응답합니다.
StorageGRID에서 복구할 수 없는 엔드포인트 오류가 발생하는 경우:
-
Grid Manager에서 지원 > 도구 > 메트릭 > Grafana > *플랫폼 서비스 개요*로 이동하여 오류 세부 정보를 확인하십시오.
-
테넌트 관리자에서 STORAGE (S3) > *Platform Services Endpoints*로 이동하여 오류 세부 정보를 확인하십시오.
-
`/var/local/log/bycast-err.log`관련 오류가 있는지 확인하십시오. ADC 서비스가 있는 스토리지 노드에는 이 로그 파일이 포함되어 있습니다.
플랫폼 서비스 메시지를 전달할 수 없습니다
대상에서 플랫폼 서비스 메시지를 수락할 수 없는 문제가 발생하면 버킷에 대한 클라이언트 작업은 성공하지만 플랫폼 서비스 메시지는 전달되지 않습니다. 예를 들어, 대상의 자격 증명이 업데이트되어 StorageGRID가 더 이상 대상 서비스에 인증할 수 없는 경우 이 오류가 발생할 수 있습니다.
관련 알림을 확인하십시오.
플랫폼 서비스 요청 처리 속도가 느려짐
StorageGRID 소프트웨어는 버킷으로 들어오는 S3 요청 속도가 대상 엔드포인트가 요청을 수신할 수 있는 속도를 초과하는 경우 해당 요청 속도를 제한할 수 있습니다. 속도 제한은 대상 엔드포인트로 전송될 요청이 누적되어 대기 중인 경우에만 발생합니다.
눈에 띄는 유일한 영향은 수신 S3 요청 실행 시간이 더 오래 걸린다는 것입니다. 성능 저하가 현저하게 감지되기 시작하면 수집 속도를 줄이거나 용량이 더 큰 엔드포인트를 사용해야 합니다. 요청 백로그가 계속 증가하면 클라이언트의 S3 작업(예: PUT 요청)이 결국 실패하게 됩니다.
CloudMirror 요청은 일반적으로 검색 통합 또는 이벤트 알림 요청보다 더 많은 데이터 전송을 포함하므로 대상 엔드포인트의 성능에 더 큰 영향을 받을 가능성이 높습니다.
플랫폼 서비스 요청이 실패합니다
플랫폼 서비스의 요청 실패율을 보려면:
-
*노드*를 선택합니다.
-
사이트 > *플랫폼 서비스*를 선택합니다.
-
요청 오류율 차트를 확인합니다.

플랫폼 서비스 이용 불가 알림
플랫폼 서비스 이용 불가 경고는 RSM 서비스를 사용하는 스토리지 노드 중 실행 중이거나 사용 가능한 노드 수가 너무 적어 해당 사이트에서 플랫폼 서비스 작업을 수행할 수 없음을 나타냅니다.
RSM 서비스는 플랫폼 서비스 요청이 각각의 엔드포인트로 전송되도록 보장합니다.
이 경고를 해결하려면 사이트에서 RSM 서비스가 포함된 스토리지 노드를 확인하십시오. (RSM 서비스는 ADC 서비스가 포함된 스토리지 노드에 있습니다.) 그런 다음 해당 스토리지 노드 중 과반수가 실행 중이고 사용 가능한 상태인지 확인하십시오.
|
|
한 사이트에서 RSM 서비스를 포함하는 스토리지 노드가 두 개 이상 장애가 발생하면 해당 사이트에 대한 보류 중인 플랫폼 서비스 요청이 모두 손실됩니다. |
플랫폼 서비스 엔드포인트에 대한 추가 문제 해결 지침
자세한 내용은 "테넌트 계정 사용 > 플랫폼 서비스 엔드포인트 문제 해결"을 참조하십시오.