使用 StorageGRID 网格管理器还原对象数据
您可以使用 Grid Manager 还原故障存储卷或存储节点的对象数据。您还可以使用 Grid Manager 监控正在进行的还原过程并显示还原历史记录。
-
您已完成以下任一过程以格式化失败的卷:
-
您已确认要还原对象的存储节点在网格管理器中的*节点* > 概览*选项卡上的连接状态为*已连接
。 -
您已确认以下内容:
-
未进行网格扩展以添加存储节点。
-
存储节点停用未在进行中或未失败。
-
未进行故障存储卷的恢复。
-
未进行故障系统驱动器的存储节点恢复。
-
未进行EC再平衡作业。
-
设备节点克隆未在进行中。
-
更换驱动器并执行手动步骤以格式化卷后,Grid Manager 会将卷显示为*维护* > 卷恢复 > *要恢复的节点*选项卡上的候选恢复卷。
-
如果卷列在*维护* > 卷还原 > *要还原的节点*中,请按照以下步骤恢复对象数据。在以下情况下,将列出卷:
-
节点中的某些(但不是全部)存储卷出现故障
-
节点中的所有存储卷都出现故障,并被替换为相同数量或更多的卷
-
-
如果在网格管理器中未将卷列为要还原的候选卷,请按照使用 `repair-data`脚本还原对象数据的相应步骤进行操作:
-
修复数据脚本已弃用,将在未来版本中删除。
如果恢复的存储节点包含的卷少于其要替换的节点,则必须使用 `repair-data`脚本。
可以恢复两种类型的对象数据:
-
复制的数据对象从其他位置还原,前提是网格的 ILM 规则已配置为使对象副本可用。
-
如果将 ILM 规则配置为仅存储一个复制副本,并且该副本存在于出现故障的存储卷上,则将无法恢复该对象。
-
如果对象的唯一剩余副本位于云存储池中,StorageGRID 必须向云存储池端点发出多个请求以还原对象数据。
-
-
通过重新组装存储的片段来恢复纠删码 (EC) 数据对象。损坏或丢失的片段由纠删码算法根据剩余数据和奇偶校验片段重新创建。
在某些存储节点脱机时,可以开始修复擦除编码的数据。但是,如果无法核实所有擦除编码的数据,则无法完成修复。修复将在所有节点可用后完成。
|
|
卷还原取决于存储对象副本的资源可用性。卷还原的进度是非线性的,可能需要数天或数周才能完成。 |
启用自动还原模式
启用自动还原模式时,当卷准备好还原时,卷还原会自动启动。
-
在 Grid Manager 中,转到*维护* > 卷恢复。
-
选择*要还原的节点*选项卡,然后将*自动还原模式*的切换开关滑动到启用的位置。
-
当出现确认对话框时,请查看详细信息。
-
您将无法在任何节点上手动启动卷恢复作业。
-
只有在没有其他维护程序正在进行时,卷恢复才会自动开始。
-
您可以从进度监控页面监控作业的状态。
-
StorageGRID会自动重试无法启动的卷还原。
-
-
了解启用自动还原模式的结果后,在确认对话框中选择*是*。
您可以随时禁用自动还原模式。
手动还原失败的卷或节点
按照下面的步骤恢复出现故障的卷或节点。
-
在 Grid Manager 中,转到*维护* > 卷恢复。
-
选择*要还原的节点*选项卡,然后将*自动还原模式*的切换开关滑动到禁用位置。
选项卡上的数字表示需要恢复卷的节点数量。
-
展开每个节点以查看其中需要恢复的卷及其状态。
-
更正任何妨碍恢复每个卷的问题。当您选择 Waiting for manual steps 时(如果显示为卷状态),将显示相关问题。
-
选择要还原的节点,其中所有卷都指示"准备还原"状态。
一次只能恢复一个节点的卷。
节点中的每个卷都必须指示其已准备好还原。
-
选择*开始还原*。
-
解决可能出现的任何警告,或选择 Start anyway 忽略警告并开始恢复。
当还原开始时,节点将从*要还原的节点*选项卡移动到*还原进度*选项卡。
如果无法启动卷还原,则该节点将返回到*要还原的节点*选项卡。
查看还原进度
Restoration progress 选项卡显示卷恢复过程的状态以及有关正在恢复的节点的卷的信息。
所有卷中复制和纠删码对象的数据修复率是汇总所有正在进行的恢复操作的平均值,包括使用 `repair-data`脚本启动的恢复。还显示了这些卷中完好无损且不需要还原的对象的百分比。
|
|
复制数据恢复取决于存储复制副本的资源可用性。复制数据恢复的进度是非线性的,可能需要几天或几周才能完成。 |
Restoration jobs 部分显示有关从 Grid Manager 启动的卷还原的信息。
-
"还原作业"部分标题中的数字表示正在还原或排队等待还原的卷数量。
-
该表显示有关正在还原的节点中的每个卷及其进度的信息。
-
每个节点的进度显示每个作业的百分比。
-
展开"详细信息"列以显示还原开始时间和作业 ID。
-
-
如果卷还原失败:
-
此时,"状态"列会显示
failed (attempting retry),并将自动重试。 -
如果多个还原作业失败,将首先自动重试最近的作业。
-
如果重试继续失败,系统将触发 EC repair failure 警报。请按照警报中的步骤解决此问题。
-