StorageGRID에서 오브젝트 데이터의 무결성 확인
StorageGRID 시스템은 스토리지 노드의 객체 데이터 무결성을 검증하여 손상되었거나 누락된 객체가 있는지 확인합니다.
검증 프로세스는 크게 두 가지로 나뉩니다. 하나는 백그라운드 검증이고 다른 하나는 객체 존재 여부 확인(이전에는 포그라운드 검증이라고 불렀음)입니다. 이 두 프로세스는 함께 작동하여 데이터 무결성을 보장합니다. 백그라운드 검증은 자동으로 실행되며 객체 데이터의 정확성을 지속적으로 확인합니다. 객체 존재 여부 확인은 사용자가 객체의 존재 여부(정확성은 아님)를 보다 빠르게 검증하기 위해 실행할 수 있습니다.
백그라운드 검증이란 무엇인가요?
백그라운드 검증 프로세스는 스토리지 노드에서 객체 데이터의 손상된 복사본을 자동으로 지속적으로 검사하고, 발견된 모든 문제를 자동으로 복구하려고 시도합니다.
백그라운드 검증은 다음과 같이 복제된 객체와 이레이저 코딩된 객체의 데이터 무결성을 확인합니다.
-
복제된 오브젝트: 백그라운드 검증 프로세스에서 손상된 복제된 오브젝트를 발견하면, 손상된 복사본은 해당 위치에서 제거되고 Storage Node의 다른 위치로 격리됩니다. 그런 다음, 활성 ILM 정책을 충족하기 위해 손상되지 않은 새 복사본이 생성 및 배치됩니다. 새 복사본은 원래 복사본에 사용되었던 Storage Node에 배치되지 않을 수도 있습니다.
|
|
손상된 객체 데이터는 시스템에서 삭제되는 대신 격리되므로 계속 액세스할 수 있습니다. 격리된 객체 데이터 액세스에 대한 자세한 내용은 기술 지원 부서에 문의하십시오. |
-
소거 코딩된 객체: 백그라운드 검증 프로세스에서 소거 코딩된 객체의 일부가 손상된 것으로 감지되면 StorageGRID는 나머지 데이터 및 패리티 조각을 사용하여 동일한 스토리지 노드에서 누락된 조각을 자동으로 재구성하려고 시도합니다. 손상된 조각을 재구성할 수 없는 경우, 해당 객체의 다른 복사본을 검색하려고 시도합니다. 검색에 성공하면 ILM 평가를 수행하여 소거 코딩된 객체의 대체 복사본을 생성합니다.
백그라운드 검증 프로세스는 스토리지 노드에 있는 객체만 확인합니다. 클라우드 스토리지 풀에 있는 객체는 확인하지 않습니다. 백그라운드 검증을 받으려면 객체가 생성된 지 4일 이상 되어야 합니다.
백그라운드 검증은 일반적인 시스템 작업에 지장을 주지 않도록 지속적인 속도로 실행됩니다. 백그라운드 검증은 중지할 수 없습니다. 하지만 문제가 의심되는 경우 백그라운드 검증 속도를 높여 스토리지 노드의 내용을 더 빠르게 검증할 수 있습니다.
백그라운드 검증 관련 알림
시스템이 자동으로 수정할 수 없는 손상된 객체(손상으로 인해 객체를 식별할 수 없는 경우)를 감지하면 Unidentified corrupt object detected 경고가 트리거됩니다.
백그라운드 검증에서 손상된 개체를 다른 복사본을 찾을 수 없어 교체할 수 없는 경우 Objects potentially lost 경고가 발생합니다.
객체 존재 여부 검사란 무엇인가요?
객체 존재 검사는 스토리지 노드에 객체의 예상되는 복제본과 이레이저 코딩된 조각이 모두 존재하는지 확인합니다. 객체 존재 검사는 객체 데이터 자체를 검증하지 않으며(백그라운드 검증에서 수행), 대신 스토리지 장치의 무결성을 확인하는 방법을 제공합니다. 특히 최근 하드웨어 문제로 인해 데이터 무결성이 영향을 받을 수 있는 경우에 유용합니다.
자동으로 수행되는 백그라운드 검증과 달리 객체 존재 여부 확인 작업은 수동으로 시작해야 합니다.
객체 존재 여부 확인은 StorageGRID에 저장된 모든 객체의 메타데이터를 읽고 복제된 객체 사본과 이레이저 코딩된 객체 조각의 존재 여부를 확인합니다. 누락된 데이터는 다음과 같이 처리됩니다.
-
복제본: 복제된 객체 데이터의 사본이 누락된 경우, StorageGRID 시스템의 다른 위치에 저장된 사본을 사용하여 자동으로 해당 사본을 대체하려고 시도합니다. 스토리지 노드는 기존 사본에 대해 ILM 평가를 수행하여 다른 사본이 누락되었기 때문에 현재 ILM 정책이 더 이상 해당 객체에 대해 충족되지 않는다는 것을 확인합니다. 그러면 시스템의 활성 ILM 정책을 충족하기 위해 새 사본이 생성되어 배치됩니다. 이 새 사본은 누락된 사본이 저장되었던 위치와 다른 위치에 배치될 수 있습니다.
-
소거 코딩된 조각: 소거 코딩된 객체의 조각이 누락된 경우, StorageGRID는 나머지 조각을 사용하여 동일한 스토리지 노드에서 누락된 조각을 자동으로 재구성하려고 시도합니다. 누락된 조각을 재구성할 수 없는 경우(너무 많은 조각이 손실된 경우), ILM은 새 소거 코딩된 조각을 생성하는 데 사용할 수 있는 객체의 다른 복사본을 찾으려고 시도합니다.
객체 존재 여부 검사 실행
객체 존재 여부 확인 작업은 한 번에 하나씩 생성하고 실행할 수 있습니다. 작업을 생성할 때 검증할 Storage Node와 볼륨을 선택합니다. 작업에 대한 일관성도 선택합니다.
-
현재 Grid Manager에 "지원되는 웹 브라우저"을(를) 사용하여 로그인되어 있습니다.
-
다음이 있습니다. "유지 관리 또는 루트 액세스 권한"
-
확인하려는 스토리지 노드가 모두 온라인 상태인지 확인하십시오. 노드 목록을 보려면 *노드*를 선택하십시오. 확인하려는 노드의 노드 이름 옆에 경고 아이콘이 표시되지 않는지 확인하십시오.
-
확인하려는 노드에서 다음 절차가 실행되고 있지 않은지 확인했습니다.
-
스토리지 노드를 추가하기 위한 그리드 확장
-
${post_edited_translations.segment}
-
손상된 스토리지 볼륨 복구
-
시스템 드라이브 오류가 발생한 스토리지 노드 복구
-
EC 리밸런스
-
어플라이언스 노드 클론
-
${post_edited_translations.segment}
객체 존재 여부 확인 작업은 그리드에 있는 객체 수, 선택한 스토리지 노드 및 볼륨, 선택한 일관성 수준에 따라 완료하는 데 며칠 또는 몇 주가 걸릴 수 있습니다. 한 번에 하나의 작업만 실행할 수 있지만, 여러 스토리지 노드와 볼륨을 동시에 선택할 수 있습니다.
-
유지 관리 > 작업 > *객체 존재 확인*을 선택합니다.
-
*작업 생성*을 선택합니다. 객체 존재 확인 작업 생성 마법사가 나타납니다.
-
검증할 볼륨이 포함된 노드를 선택하십시오. 모든 온라인 노드를 선택하려면 열 헤더에서 노드 이름 확인란을 선택하십시오.
노드 이름 또는 사이트 이름으로 검색할 수 있습니다.
그리드에 연결되지 않은 노드는 선택할 수 없습니다.
-
*Continue*를 선택합니다.
-
목록에서 각 노드에 대해 하나 이상의 볼륨을 선택하십시오. 스토리지 볼륨 번호 또는 노드 이름을 사용하여 볼륨을 검색할 수 있습니다.
선택한 각 노드의 모든 볼륨을 선택하려면 열 헤더에서 Storage volume 확인란을 선택하십시오.
-
*Continue*를 선택합니다.
-
작업에 대한 일관성을 선택합니다.
일관성은 객체 존재 여부 확인에 사용되는 객체 메타데이터 복사본의 수를 결정합니다.
-
Strong-site: 단일 사이트에 메타데이터 사본이 두 개 있습니다.
-
Strong-global: 각 사이트에 메타데이터 사본이 두 개씩 있습니다.
-
모두 (기본값): 각 사이트의 메타데이터 사본 세 개 모두.
일관성에 대한 자세한 내용은 마법사의 설명을 참조하십시오.
-
-
*Continue*를 선택합니다.
-
선택 사항을 검토하고 확인하십시오. *이전*을 선택하면 마법사의 이전 단계로 돌아가 선택 사항을 업데이트할 수 있습니다.
객체 존재 여부 확인 작업이 생성되어 다음 중 하나가 발생할 때까지 실행됩니다.
-
작업이 완료됩니다.
-
작업을 일시 중지하거나 취소할 수 있습니다. 일시 중지한 작업은 다시 시작할 수 있지만, 취소한 작업은 다시 시작할 수 없습니다.
-
작업이 중단되었습니다. 객체 존재 확인이 중단되었습니다 경고가 발생했습니다. 경고에 명시된 해결 조치를 따르십시오.
-
작업이 실패했습니다. 객체 존재 확인에 실패했습니다 경고가 발생했습니다. 경고에 명시된 해결 조치를 따르십시오.
-
"서비스를 사용할 수 없습니다" 또는 "내부 서버 오류" 메시지가 나타납니다. 1분 후 페이지를 새로 고침하여 작업 모니터링을 계속하십시오.
필요에 따라 객체 존재 여부 확인 페이지에서 벗어나 다시 돌아와 작업 모니터링을 계속할 수 있습니다.
-
-
작업이 실행되는 동안 활성 작업 탭을 확인하고 누락된 개체 복사본 감지됨 값을 기록해 두십시오.
이 값은 복제된 객체의 누락된 복사본 수와 하나 이상의 조각이 누락된 이레이저 코딩된 객체의 누락된 복사본 수를 모두 나타냅니다.
누락된 객체 복사본 수가 100개를 초과하는 경우 스토리지 노드의 스토리지에 문제가 있을 수 있습니다.
-
작업이 완료되면 필요한 추가 조치를 취하십시오.
-
누락된 객체 복사본 감지 결과가 0이면 문제가 발견되지 않은 것입니다. 별도의 조치가 필요하지 않습니다.
-
누락된 객체 복사본 감지 결과가 0보다 크고 객체 손실 가능성 경고가 발생하지 않은 경우, 시스템에서 누락된 모든 복사본을 복구한 것입니다. 향후 객체 복사본 손상을 방지하기 위해 하드웨어 문제가 해결되었는지 확인하십시오.
-
누락된 객체 복사본 감지 값이 0보다 크고 객체 손실 가능성 경고가 발생한 경우 데이터 무결성 문제가 있을 수 있습니다. 기술 지원에 문의하십시오.
-
grep 명령어를 사용하여 LLST 감사 메시지를 추출하면 잠재적으로 손실된 객체 복사본을 조사할 수 있습니다.
grep LLST audit_file_name이 절차는 "분실 가능성이 있는 오브젝트 조사"에 대한 절차와 유사하지만, 오브젝트 복사본의 경우
OLST대신 `LLST`을(를) 검색합니다.
-
-
작업에 대해 강력한 사이트 일관성 또는 강력한 글로벌 일관성을 선택한 경우 메타데이터 일관성이 확보될 때까지 약 3주 정도 기다린 후 동일한 볼륨에서 작업을 다시 실행하십시오.
StorageGRID가 작업에 포함된 노드 및 볼륨에 대한 메타데이터 일관성을 확보할 시간을 가진 후 작업을 다시 실행하면 잘못 보고된 누락된 객체 복사본을 수정하거나 누락된 경우 추가 객체 복사본을 확인할 수 있습니다.
-
유지 관리 > 객체 존재 확인 > *작업 기록*을 선택합니다.
-
재실행할 준비가 된 작업을 확인합니다.
-
3주 이상 전에 실행된 작업을 확인하려면 종료 시간 열을 참조하십시오.
-
해당 작업의 경우 일관성 제어 열에서 strong-site 또는 strong-global을 검색하십시오.
-
-
다시 실행할 각 작업의 확인란을 선택한 다음 *다시 실행*을 선택하십시오.
-
재실행 작업 마법사에서 선택한 노드와 볼륨, 그리고 일관성을 검토하십시오.
-
작업을 다시 실행할 준비가 되면 *다시 실행*을 선택하십시오.
-
활성 작업 탭이 나타납니다. 선택한 모든 작업이 하나의 작업으로 강력한 사이트 일관성 수준으로 다시 실행됩니다. 세부 정보 섹션의 관련 작업 필드에는 원래 작업의 작업 ID가 표시됩니다.