VMware 노드를 SG1000 또는 SG100으로 교체
기본 관리 노드가 VMware 노드로 실행되는 경우 SG1000 또는 SG100 서비스 어플라이언스로 교체할 수 있습니다.
|
|
노드 교체를 완료하고 확인한 후에는 기존 VMware 노드를 삭제해야 합니다. 기존 노드를 그대로 두면 해당 노드가 다시 온라인 상태가 될 경우 대규모 그리드 장애가 발생할 위험이 있습니다. |
-
가상 머신을 복구할 수 없으며 교체해야 한다고 판단했습니다.
-
진행 중인 그리드 유지보수 절차가 없음을 확인했습니다.
-
StorageGRID SG1000 또는 SG100 서비스 어플라이언스에 설치된 StorageGRID Appliance Installer 버전이 StorageGRID 시스템의 소프트웨어 버전과 일치하는지 확인하셨습니다.
-
기존 기본 관리 노드에 대한 다음 정보가 있습니다.
노드 이름: 기존의 기본 관리 노드와 동일한 노드 이름을 사용하여 서비스 어플라이언스를 설치해야 합니다. 노드 이름은 호스트 이름(시스템 이름)입니다.
IP 주소: 서비스 어플라이언스에 기존 기본 관리 노드와 동일한 IP 주소를 할당하거나(권장), 각 네트워크에서 사용되지 않는 새 IP 주소를 선택할 수 있습니다.
-
프로비저닝 암호가 있습니다.
1단계: VMware 노드 교체
먼저 Grid Manager에서 기존 기본 관리 노드를 제거합니다. 그런 다음 StorageGRID Appliance Installer를 사용하여 SG1000 또는 SG100 서비스 어플라이언스를 새 기본 관리 노드로 설치하고 노드를 복구합니다. 새 IP 주소를 사용하는 경우 기존 기본 관리 노드를 제거하기 전에 서비스 어플라이언스를 설치할 수 있습니다.
기존 기본 관리 노드 IP 주소를 사용하여 기본 관리 노드를 교체합니다.
-
-
유지보수 > *복구 패키지*를 선택하십시오.
-
프로비저닝 암호를 입력하고 패키지를 다운로드하십시오.
-
-
기존 기본 관리자 노드에 로그인하십시오.
-
다음 명령을 입력합니다.
ssh admin@grid_node_IP -
파일에 나열된 암호를
Passwords.txt입력합니다. -
루트 권한으로 전환:
su - -
파일에 나열된 암호를
Passwords.txt입력합니다.
루트로 로그인하면 프롬프트가 에서
$로 `#`변경됩니다. -
-
그리드 노드에서 서버 관리자 및 모든 서비스를 중지합니다.
shutdown -h now
서비스가 중단되는 데 최대 15분이 소요될 수 있습니다.
-
설치 시작*을 선택한 후, *StorageGRID 설치 프로그램 로드 단계에 도달할 때까지 약 10분 정도 기다리십시오.
6~7분 후 브라우저가 복구 시작 페이지로 이동합니다.
-
기기의 시계가 정확한지 확인하십시오.
-
SSH를 사용하여 포트 8022에 연결합니다.
-
명령을 입력합니다:
ssh -p 8022 admin@grid_node_IP. -
루트 권한으로 전환:
su - -
입력
netapp1!.
-
-
기기의 시계가 현재 UTC 시간과 몇 분 이내의 오차 범위 내에 있는지 확인하십시오. 필요한 경우, 올바른 날짜와 시간을 설정하십시오.
date -s "DD Mon YYYY HH:MM:SS"
-
-
웹 브라우저로 돌아가서 *실패한 기본 관리 노드 복구*를 선택하십시오.
-
다운로드한 복구 패키지을(를) 업로드하세요.
-
프로비저닝 암호를 입력하고 *복구 시작*을 선택하십시오.
복구 진행률 표시줄이 나타납니다. 복구 프로세스가 완료되고 서비스가 시작될 때까지 6~10분 정도 소요될 수 있습니다.
-
메시지가 표시되면 Grid Manager에 로그인하십시오.
새 IP 주소를 사용하여 기본 관리 노드를 교체합니다.
-
복구 중 NTP 오류를 방지하려면 기기의 시계가 정확한지 확인하십시오.
-
SSH를 사용하여 포트 8022에 연결합니다.
-
명령을 입력합니다:
ssh -p 8022 admin@grid_node_IP. -
루트 권한으로 전환:
su - -
입력
netapp1!.
-
-
기기의 시계가 현재 협정 세계시(UTC)와 몇 분 이내의 오차 범위 내에 있는지 확인하십시오. 필요한 경우, 올바른 날짜와 시간으로 설정하십시오.
date -s "DD Mon YYYY HH:MM:SS"
-
-
StorageGRID 어플라이언스 설치 프로그램에서 *StorageGRID 소프트웨어 업로드*로 이동하여 어플라이언스에 사전 설치된 소프트웨어 버전이 그리드에서 실행 중인 StorageGRID 버전과 일치하는지 확인하십시오. 버전이 일치하지 않으면 다음을 수행하십시오.
-
올바른 StorageGRID Debian 설치 패키지를 "NetApp 지원 사이트"에서 다운로드하십시오.
-
설치 소프트웨어를 제거하려면 *제거*를 선택하십시오.
-
storagegrid-webscale-images-<sg-version>.deb및storagegrid-webscale-images-<sgversion>.deb.md5파일을 업로드합니다.
-
-
StorageGRID Appliance Installer의 홈 탭에서 노드 유형으로 *기본 관리자(로드 밸런서 포함)*를 선택합니다.
-
노드 이름을 입력합니다. 노드 이름은 기존의 기본 관리자 노드 이름과 일치해야 합니다.
*설치 시작*을 선택하지 마세요. -
새 IP 주소의 서브넷이 그리드 네트워크에 있는지 확인하십시오. 새 IP 서브넷이 없으면 그리드 네트워크에 추가하십시오.
-
Grid Manager에서 유지 관리 > *그리드 네트워크*를 선택합니다.
-
서브넷 목록을 업데이트하려면 프로비저닝 암호를 입력하십시오.
-
-
GRID Manager에서 복구 패키지를 다운로드하십시오.
-
유지보수 > *복구 패키지*를 선택하십시오.
-
프로비저닝 암호를 입력한 다음 패키지를 다운로드하십시오.
-
-
기존 기본 관리자 노드에 로그인하십시오.
-
다음 명령을 입력합니다.
ssh admin@grid_node_IP -
파일에 나열된 암호를
Passwords.txt입력합니다. -
다음 명령을 입력하여 루트로 전환합니다.
su - -
파일에 나열된 암호를
Passwords.txt입력합니다.
루트로 로그인하면 프롬프트가 에서
$로 `#`변경됩니다. -
-
그리드 노드에서 서버 관리자 및 모든 서비스를 중지합니다.
service servermanager stop
서비스가 중단되는 데 최대 15분이 소요될 수 있습니다.
-
StorageGRID 어플라이언스 설치 관리자 홈 탭에서:
-
다음 설정을 확인하십시오.
-
노드 유형이 *Primary Admin (with Load Balancer)*로 설정되었습니다.
-
노드 이름이 기존 기본 관리자 노드 이름과 일치합니다.
-
-
새 IP 주소를 기록합니다.
-
-
*설치 시작*을 선택합니다.
설치 과정이 StorageGRID 설치 프로그램 로드 단계에 도달하는 데 약 10분이 소요됩니다.
6~7분 후 브라우저가 복구 절차를 시작하도록 리디렉션됩니다.
-
기기의 시계가 정확한지 확인하십시오.
-
SSH를 사용하여 포트 8022에 연결합니다.
-
명령을 입력합니다:
ssh -p 8022 admin@grid_node_IP. -
루트 권한으로 전환:
su - -
입력
netapp1!.
-
-
기기의 시계가 현재 UTC 시간과 몇 분 이내의 오차 범위 내에 있는지 확인하십시오. 필요한 경우, 올바른 날짜와 시간을 설정하십시오.
date -s "DD Mon YYYY HH:MM:SS"
-
-
웹 브라우저로 돌아가서 *실패한 기본 관리 노드 복구*를 선택하십시오.
-
다운로드한 복구 패키지을(를) 업로드하세요.
-
프로비저닝 암호를 입력하고 *복구 시작*을 선택하십시오.
기본 관리 노드 복구 페이지가 사라졌다가 다시 나타납니다. *복구 시작*을 다시 선택하면
500: Internal Server Error`이 나타납니다. 복구가 시작되었지만 새 IP 주소를 사용하는 Grid Manager에 업데이트를 전송할 수 없기 때문입니다. 이 문제를 해결하려면 `/etc/hosts파일에서 기본 관리 노드의 IP 주소를 업데이트하십시오.-
SSH를 사용하여 포트 8022에 연결합니다.
-
명령을 입력합니다:
ssh -p 8022 admin@grid_node_IP. -
루트 권한으로 전환:
su - -
파일에 나열된 암호를
Passwords.txt입력합니다.
-
-
로그에 액세스합니다.
tail /var/local/log/install.log
다음과 같은 오류 메시지가 반복적으로 표시될 것입니다.
curl: (7) Failed to connect to <primary_Admin_Node_name> port9999: No route to host이는 예상된 동작입니다. StorageGRID는 기존의 기본 관리 노드 IP 주소를 사용하여 기본 관리 노드에 업데이트를 전송하려고 시도하고 있습니다.
-
컨테이너가 실행 중인지 확인하십시오.
storagegrid node status
storagegrid node enter <primary_Admin_Node_name>-
컨테이너 내부의
/etc/hosts파일에서 기존의 기본 관리 노드 IP 주소를 새 IP 주소로 교체합니다. -
파일을 저장하세요.
-
웹 브라우저로 돌아가세요. 몇 초 후 복구 진행률 표시줄이 나타납니다.
복구 프로세스가 완료되고 서비스가 시작될 때까지 6분에서 10분 정도 소요될 수 있습니다.
-
-
메시지가 표시되면 Grid Manager에 로그인하십시오.
-
복구 패키지를 업데이트합니다:
-
기본 관리자 노드에 로그인합니다.
-
다음 명령을 입력합니다.
ssh admin@primary_Admin_Node_IP -
루트 권한으로 전환:
su - -
다음 명령을 입력합니다.
change-ip
-
-
옵션 *3 – 관리자 네트워크 서브넷 목록 편집*을 선택한 다음 새 서브넷을 추가하십시오.
StorageGRID는 새로운 기본 관리 노드 IP 주소로 새 복구 패키지를 자동으로 생성합니다.
-
-
그리드 관리자에서 최신 복구 패키지를 다운로드하십시오.
2단계: 노드 복구 완료
복원 절차(감사 로그, 관리 노드 데이터베이스 및 Prometheus 메트릭)를 위해 기존의 비기본 관리 노드를 소스 관리 노드로 사용하십시오. 그리드에 비기본 관리 노드가 없는 경우, 복구된 기본 관리 노드와 다른 IP 주소에서 실행 중인 경우에 한해 교체되는 원래 VMware 노드를 사용할 수 있습니다.
-
새로운 기본 관리 노드가 올바르게 작동하는지 확인하십시오. 그런 다음 기존 VM 노드 또는 베어메탈 컨테이너를 즉시 삭제하십시오.