技术支持如何恢复 StorageGRID 站点
如果整个 StorageGRID 站点发生故障,或者多个存储节点发生故障,则必须联系技术支持。技术支持将评估您的情况,制定恢复计划,然后以符合您的业务目标的方式恢复故障的节点或站点,优化恢复时间,并防止不必要的数据丢失。
|
|
站点恢复只能由技术支持执行。 |
StorageGRID 系统对各种故障具有弹性,您可以自行成功执行许多恢复和维护过程。但是,很难创建简单、通用的站点恢复过程,因为详细步骤取决于特定于您的情况的因素。例如:
-
您的业务目标:在 StorageGRID 站点完全丢失后,您应该评估如何以最佳方式实现您的业务目标。例如,是否要就地重建丢失的站点?是否要在新位置替换丢失的 StorageGRID 站点?每个客户的情况都不同,您的恢复计划必须针对您的优先事项进行设计。
-
故障的确切性质:在开始站点恢复之前,确定故障站点上的任何节点是否完好无损,或者任何存储节点是否包含可恢复对象。如果重建包含有效数据的节点或存储卷,可能会发生不必要的数据丢失。
-
活动 ILM 策略:网格中对象副本的数量、类型和位置由活动 ILM 策略控制。ILM 策略的具体内容可能会影响可恢复数据的数量,以及恢复所需的特定技术。
如果某个站点包含对象的唯一副本,且该站点丢失,则该对象也将丢失。 -
存储桶(或容器)一致性:应用于存储桶(或容器)的一致性会影响 StorageGRID 是否在告知客户端对象载入成功之前将对象元数据完全复制到所有节点和站点。如果一致性值允许最终一致性,则某些对象元数据可能已在站点故障中丢失。这可能会影响可恢复数据的数量,并可能影响恢复过程的详细信息。
-
最近更改的历史记录:您的恢复程序的详细信息可能会受到以下因素的影响:故障发生时是否正在进行任何维护程序,或者最近是否对您的 ILM 策略进行了任何更改。技术支持必须在开始站点恢复之前评估您的网格的近期历史记录及其当前情况。
|
|
站点恢复只能由技术支持执行。 |
以下是技术支持用于恢复故障站点的过程的一般概述:
-
技术支持:
-
对故障进行详细评估。
-
与您一起审查业务目标。
-
制定适合您情况的恢复计划。
-
-
如果主管理节点出现故障,技术支持会恢复它。
-
技术支持按照以下大纲恢复所有存储节点:
-
根据需要替换存储节点硬件或虚拟机。
-
将对象元数据还原到失败的站点。
-
将对象数据还原至已恢复的存储节点。
如果使用单个发生故障的存储节点的恢复过程,将发生数据丢失。
当整个站点出现故障时,技术支持使用专门的命令成功还原对象和对象元数据。 -
-
技术支持恢复其他发生故障的节点。
恢复对象元数据和数据后,技术支持使用标准过程来恢复失败的网关节点或非主管理节点。