Recupera de fallos en el nodo de almacenamiento StorageGRID
El procedimiento para recuperar un nodo de almacenamiento que ha fallado depende del tipo de fallo y del tipo de nodo de almacenamiento que ha fallado.
Utiliza esta tabla para seleccionar el procedimiento de recuperación para un nodo de almacenamiento fallido.
| Problema | Acción | Notas |
|---|---|---|
|
Ponte en contacto con el soporte técnico. |
La recuperación de más de un nodo de almacenamiento podría afectar la integridad de la base de datos de Cassandra, lo que puede causar la pérdida de datos. El soporte técnico puede determinar cuándo es seguro iniciar la recuperación de un segundo nodo de almacenamiento. Nota: Si en un sitio fallan varios nodos de almacenamiento que contienen el servicio ADC, pierdes cualquier solicitud de servicio de plataforma pendiente para ese sitio. |
Han fallado más de un nodo de almacenamiento en una sede o ha fallado toda la sede. |
Contacta al soporte técnico. Puede que sea necesario realizar un procedimiento de recuperación del sitio. |
El soporte técnico evaluará tu situación y elaborará un plan de recuperación. Consulta "Cómo el soporte técnico recupera un sitio". |
Ha fallado un nodo de almacenamiento de appliance. |
El procedimiento de recuperación para los nodos de almacenamiento de appliance es el mismo para todos los fallos. |
|
Uno o más volúmenes de almacenamiento han fallado, pero la unidad del sistema está intacta |
Este procedimiento se utiliza para los nodos de almacenamiento basados en software. |
|
La unidad del sistema ha fallado. |
El procedimiento de sustitución del nodo depende de la plataforma de implementación y de si también se ha producido algún fallo en los volúmenes de almacenamiento. |
|
|
Algunos procedimientos de recuperación de StorageGRID utilizan Reaper para gestionar las reparaciones de Cassandra. Las reparaciones se llevan a cabo automáticamente en cuanto se han iniciado los servicios relacionados o necesarios. Es posible que veas en la salida del script menciones a "reaper" o "reparación de Cassandra". Si aparece un mensaje de error que indica que la reparación ha fallado, ejecuta el comando que se indica en dicho mensaje. |