Recuperar de operações automáticas de failover de cluster ONTAP não planejadas
Uma operação automática de failover não planejado (AUFO) ocorre quando o cluster primário está inativo ou isolado. SnapMirror active sync detecta essas falhas e inicia um failover automático não planejado para o cluster secundário. O cluster secundário é convertido em primário (o cluster preferencial) e começa a atender clientes. Observe que a detecção de falhas e o processamento de failover só podem ser realizados com assistência do ONTAP Mediator.
|
|
Após uma falha automática não planejada, é importante verificar novamente os caminhos do host para que não haja perda de caminhos de E/S. |
Restabeleça o relacionamento de proteção após um failover não planejado
Assim que o cluster primário original, por exemplo, o Cluster A, se recuperar, SnapMirror active sync estabelecerá automaticamente a proteção na direção inversa. Se você quiser restaurar o estado original, tornando o Cluster A o cluster primário preferencial, pode realizar um failback manual iniciando uma operação de failover planejada usando o System Manager ou a ONTAP CLI.
|
|
Passos
Do ONTAP 9.8 até o ONTAP 9.14.1, SnapMirror active sync é denominado SnapMirror Business Continuity (SM-BC).
|
-
Navegue até Proteção > Relacionamentos e aguarde até que o estado do relacionamento mostre "InSync".
-
Para realizar um failback e retomar as operações no cluster de origem, clique
e selecione Failover.
Você pode monitorar o status do failover automático não planejado usando o snapmirror failover show comando.
Por exemplo:
ClusterB::> snapmirror failover show -instance
Start Time: 9/23/2020 22:03:29
Source Path: vs1:/cg/scg3
Destination Path: vs3:/cg/dcg3
Failover Status: completed
Error Reason:
End Time: 9/23/2020 22:03:30
Primary Data Cluster: cluster-2
Last Progress Update: -
Failover Type: unplanned
Error Reason codes: -
Você pode monitorar o status da relação de proteção reversa usando o comando snapmirror show no cluster primário original.
Por exemplo:
ClusterA::> snapmirror show
Progress
Source Destination Mirror Relationship Total Last
Path Type Path State Status Progress Healthy Updated
----------- ---- ------------ ------- -------------- --------- ------- --------
vs3:/cg/dcg3 XDP vs1:/cg/scg3 Snapmirrored InSync - true -
Você pode realizar um failback para o cluster primário original usando o comando snapmirror failover start.
Por exemplo:
ClusterA::> snapmirror failover start -destination-path vs1:/cg/scg3
Consulte "Referência da EMS"para obter informações sobre mensagens de eventos e sobre ações corretivas.
Retomar a proteção em uma configuração de fan-out após o failover
A partir do ONTAP 9.15.1, o SnapMirror active sync oferece suporte à reconfiguração automática no ramo de fan-out após um evento de failover em uma relação SAN. Em uma configuração NAS, você deve reconfigurar a relação de proteção manualmente após o failover do SnapMirror active sync. O ramo de fan-out assíncrono pode ser uma relação de grupo de consistência ou uma relação de volume independente. Para mais informações, consulte "configurações de fan-out".
Se você estiver usando o ONTAP 9.14,1 ou anterior e tiver um failover no cluster secundário na relação de sincronização ativa do SnapMirror, o destino assíncrono do SnapMirror não será saudável. Você deve restaurar manualmente a proteção excluindo e recriando a relação com o endpoint assíncrono do SnapMirror.
-
Verifique se o failover foi concluído com êxito:
snapmirror failover show -
No endpoint assíncrono do SnapMirror, exclua o endpoint de fan-out:
snapmirror delete -destination-path destination_path -
No terceiro site, crie relações assíncronas do SnapMirror entre o novo volume primário de sincronização ativa do SnapMirror e o volume de destino de saída de ventoinha assíncrona:
snapmirror create -source-path source_path -destination-path destination_path -policy MirrorAllSnapshots -schedule schedule -
Ressincronizar a relação:
snapmirror resync -destination-path destination_path -
Verifique o status e a saúde da relação:
snapmirror show