Skip to main content
Hay disponible una nueva versión de este producto.
Se proporciona el idioma español mediante traducción automática para su comodidad. En caso de alguna inconsistencia, el inglés precede al español.

Soluciona problemas en un sistema StorageGRID

Si tienes algún problema al utilizar un sistema StorageGRID, consulta los consejos y las directrices de esta sección para obtener ayuda a la hora de identificar y resolver el problema.

A menudo, puedes resolver problemas por tu cuenta; sin embargo, es posible que tengas que escalar algunas incidencias al soporte técnico.

Definir el problema

El primer paso para resolver un problema es definirlo con claridad.

En esta tabla se ofrecen ejemplos de los tipos de información que podrías recopilar para definir un problema:

Pregunta Ejemplo de respuesta

¿Qué está haciendo o dejando de hacer el sistema StorageGRID? ¿Cuáles son sus síntomas?

Las aplicaciones de los clientes indican que no es posible incorporar objetos a StorageGRID.

¿Cuándo empezó el problema?

La incorporación del objeto fue rechazada por primera vez alrededor de las 14:50 del 8 de enero de 2020.

¿Cómo notaste el problema por primera vez?

Notificado por la aplicación cliente. También recibiste notificaciones de alerta por correo electrónico.

¿El problema se produce siempre o solo de vez en cuando?

El problema sigue.

Si el problema ocurre regularmente, ¿qué pasos lo causan?

El problema ocurre cada vez que un cliente intenta ingerir un objeto.

Si el problema se produce de forma intermitente, ¿cuándo ocurre? Anota las horas de cada incidente del que tengas constancia.

El problema no es intermitente.

¿Has visto este problema antes? ¿Con qué frecuencia has tenido este problema en el pasado?

Es la primera vez que me encuentro con este problema.

Evalúa el riesgo y el impacto en el sistema

Una vez que hayas definido el problema, evalúa su riesgo e impacto en el sistema StorageGRID. Por ejemplo, la presencia de alertas críticas no significa necesariamente que el sistema no esté ofreciendo servicios principales.

Esta tabla resume el impacto que el problema de ejemplo está teniendo en el funcionamiento del sistema:

Pregunta Ejemplo de respuesta

¿Puede el sistema StorageGRID incorporar contenido?

No.

¿Pueden las aplicaciones cliente recuperar contenido?

Algunos objetos se pueden recuperar y otros no.

¿Están los datos en peligro?

No.

¿La capacidad para desarrollar la actividad empresarial está gravemente afectada?

Sí, porque las aplicaciones cliente no pueden almacenar objetos en el sistema StorageGRID y los datos no se pueden recuperar de forma coherente.

Recopilar datos

Una vez que hayas definido el problema y evaluado su riesgo e impacto, recopila datos para su análisis. El tipo de datos que resulta más útil recopilar depende de la naturaleza del problema.

Tipo de datos que se van a recopilar Por qué recopilamos estos datos Instrucciones

Crear una cronología de los cambios recientes

Los cambios en tu sistema StorageGRID, en su configuración o en su entorno pueden provocar un comportamiento nuevo.

Revisar alertas

Las alertas pueden ayudarte a determinar rápidamente la causa raíz de un problema al proporcionarte pistas importantes sobre los problemas subyacentes que podrían estar causándolo.

Consulta la lista de alertas actuales para ver si StorageGRID ha identificado la causa raíz de un problema por ti.

Revisa las alertas que se activaron en el pasado para obtener información adicional.

Establece puntos de referencia

Recopila información sobre los niveles normales de diversos valores operativos. Estos valores de referencia, y las desviaciones de estas líneas base, pueden proporcionar pistas valiosas.

Realiza pruebas de importación y recuperación

Para solucionar problemas de rendimiento relacionados con la importación y la recuperación, utiliza una estación de trabajo para almacenar y recuperar objetos. Compara los resultados con los obtenidos al utilizar la aplicación cliente.

Revisar los mensajes de auditoría

Revisa los mensajes de auditoría para realizar un seguimiento detallado de las operaciones de StorageGRID. La información detallada de los mensajes de auditoría puede ser útil para solucionar muchos tipos de problemas, incluidos los problemas de rendimiento.

Comprobar la ubicación de los objetos y la integridad del almacenamiento

Si tienes problemas de almacenamiento, verifica que los objetos se estén colocando donde esperas. Verifica la integridad de los datos de los objetos en un Storage Node.

Recopilar datos para el soporte técnico

Es posible que el soporte técnico te pida que recopiles datos o revises información concreta para ayudar a resolver problemas.

Crear una cronología de los cambios recientes

Cuando surja un problema, debes considerar qué ha cambiado recientemente y cuándo ocurrieron esos cambios.

  • Los cambios en tu sistema StorageGRID, en su configuración o en su entorno pueden provocar un comportamiento nuevo.

  • Una cronología de los cambios puede ayudarte a identificar qué cambios podrían ser los responsables de un problema y cómo cada cambio podría haber influido en su desarrollo.

Elabora una tabla con los cambios recientes realizados en tu sistema que incluya información sobre cuándo se produjo cada cambio y cualquier detalle relevante al respecto, como por ejemplo qué más estaba ocurriendo mientras se llevaba a cabo el cambio:

Tiempo de cambio Tipo de cambio Detalles

Por ejemplo:

  • ¿Cuándo iniciaste la recuperación del nodo?

  • ¿Cuándo se completó la actualización del software?

  • ¿Interrumpiste el proceso?

¿Qué ha pasado? ¿Qué has hecho?

Documenta cualquier detalle relevante sobre el cambio. Por ejemplo:

  • Detalles de los cambios en la red.

  • Qué corrección urgente se instaló.

  • Cómo han cambiado las cargas de trabajo de los clientes.

Asegúrate de anotar si se estaba realizando más de un cambio al mismo tiempo. Por ejemplo, ¿se hizo este cambio mientras había una actualización en curso?

Ejemplos de cambios recientes significativos

Aquí tienes algunos ejemplos de cambios que podrían ser significativos:

  • ¿Se ha instalado, ampliado o recuperado recientemente el sistema StorageGRID?

  • ¿Se ha actualizado el sistema recientemente? ¿Se aplicó una corrección urgente?

  • ¿Has reparado o cambiado algún componente de hardware recientemente?

  • ¿Se ha actualizado la política de ILM?

  • ¿Ha cambiado la carga de trabajo del cliente?

  • ¿Ha cambiado la aplicación cliente o su comportamiento?

  • ¿Has cambiado los equilibradores de carga o has añadido o eliminado un grupo de alta disponibilidad de Admin Nodes o Gateway Nodes?

  • ¿Has iniciado alguna tarea que pueda tardar mucho en completarse? Por ejemplo:

    • Recuperación de un nodo de almacenamiento que ha fallado

    • Decomisionamiento de Storage Node

  • ¿Has hecho algún cambio en la autenticación de usuarios, como añadir un tenant o modificar la configuración de LDAP?

  • ¿Se está llevando a cabo la migración de datos?

  • ¿Se habilitaron o cambiaron recientemente los servicios de plataforma?

  • ¿Activaste recientemente la función de cumplimiento normativo?

  • ¿Se han añadido o eliminado Cloud Storage Pools?

  • ¿Se han hecho cambios en la compresión o el cifrado del almacenamiento?

  • ¿Se ha producido algún cambio en la infraestructura de red? Por ejemplo, VLANs, routers o DNS.

  • ¿Has hecho algún cambio en las fuentes NTP?

  • ¿Has hecho algún cambio en las interfaces de red Grid, Admin o Client Network?

  • ¿Has hecho algún otro cambio en el sistema StorageGRID o en su entorno?

Establece puntos de referencia

Puedes establecer valores de referencia para tu sistema registrando los niveles normales de varios valores operativos. En el futuro, puedes comparar los valores actuales con estos valores de referencia para ayudar a detectar y resolver valores anómalos.

Propiedad Valor Cómo obtenerlo

Consumo medio de almacenamiento

GB consumidos al día

Porcentaje consumido al día

Accede al Grid Manager. En la página «Nodes», selecciona toda la grid o un sitio y ve a la pestaña «Storage».

En el gráfico Storage Used - Object Data, busca un periodo en el que la línea sea bastante estable. Coloca el cursor sobre el gráfico para estimar cuánto almacenamiento se consume cada día

Puedes recopilar esta información para todo el sistema o para un centro de datos específico.

Consumo medio de metadatos

GB consumidos al día

Porcentaje consumido al día

Accede al Grid Manager. En la página «Nodes», selecciona toda la grid o un sitio y ve a la pestaña «Storage».

En el gráfico «Almacenamiento utilizado: metadatos de objetos», busca un periodo en el que la línea se mantenga bastante estable. Coloca el cursor sobre el gráfico para calcular cuánto almacenamiento de metadatos se consume cada día.

Puedes recopilar esta información para todo el sistema o para un centro de datos específico.

Índice de operaciones de S3

Operaciones por segundo

En el panel de control de Grid Manager, selecciona Rendimiento > Operaciones S3 para Storage Nodes.

Para ver las tasas y los recuentos de ingesta y recuperación de un sitio o nodo específico, selecciona Nodos > sitio o nodo de almacenamiento > Objetos. Coloca el cursor sobre el gráfico de ingesta y recuperación de S3.

Tasa de evaluación del ILM

Objetos por segundo

En la página «Nodos», selecciona grid > ILM.

En el gráfico de la cola de ILM, busca un periodo en el que la línea sea bastante estable. Coloca el cursor sobre el gráfico para estimar un valor de referencia para la tasa de evaluación de tu sistema.

Velocidad de exploración del ILM

Objetos por segundo

Selecciona Nodos > grid > ILM.

En el gráfico ILM Queue, busca un periodo en el que la línea sea bastante estable. Coloca el cursor sobre el gráfico para estimar un valor de referencia para Scan rate en tu sistema.

Objetos en cola procedentes de operaciones del cliente

Objetos por segundo

Selecciona Nodos > grid > ILM.

En el gráfico «ILM Queue», busca un periodo en el que la línea se mantenga bastante estable. Coloca el cursor sobre el gráfico para calcular un valor de referencia para Objetos en cola (from client operations) en tu sistema.

Latencia media de las consultas

Milisegundos

Selecciona Nodes > Storage Node > Objects. En la tabla de consultas, consulta el valor de latencia media.

Analizar datos

Utiliza la información que recopiles para determinar la causa del problema y las posibles soluciones.

El análisis depende del problema, pero en general:

  • Localiza los puntos de fallo y los cuellos de botella usando las alertas.

  • Reconstruye el historial del problema utilizando el historial de alertas y los gráficos.

  • Utiliza los gráficos para detectar anomalías y comparar la situación problemática con el funcionamiento normal.

Lista de comprobación de la información de escalación

Si no puedes resolver el problema por tu cuenta, ponte en contacto con soporte técnico. Antes de ponerte en contacto con soporte técnico, recopila la información que se indica en la siguiente tabla para facilitar la resolución del problema.

marca de verificación Artículo Notas

Planteamiento del problema

¿Cuáles son los síntomas del problema? ¿Cuándo empezó el problema? ¿Ocurre de forma constante o intermitente? Si es intermitente, ¿en qué momentos ha ocurrido?

Evaluación de impacto

¿Cuál es la gravedad del problema? ¿Cuál es el impacto en la aplicación cliente?

  • ¿El cliente se ha conectado correctamente antes?

  • ¿Puede el cliente ingerir, recuperar y eliminar datos?

ID del sistema StorageGRID

Selecciona Mantenimiento > Sistema > Licencia. El ID del sistema de StorageGRID se muestra como parte de la licencia actual.

Versión del software

En la parte superior del Grid Manager, selecciona el icono de ayuda y selecciona Acerca de para ver la versión de StorageGRID.

Personalización

Resume cómo está configurado tu sistema StorageGRID. Por ejemplo, indica lo siguiente:

  • ¿La grid utiliza compresión de almacenamiento, cifrado de almacenamiento o cumplimiento?

  • ¿Crea ILM objetos replicados o con código de borrado? ¿Garantiza ILM la redundancia entre sitios? ¿Utilizan las reglas de ILM los comportamientos de ingesta «Equilibrado», «Estricto» o «Compromiso dual»?

Archivos de registro y datos del sistema

Recopila los archivos de registro y los datos del sistema para tu sistema. Selecciona Soporte > Herramientas > Recopilación de registros.

Puedes recopilar registros de toda la grid o de los nodos seleccionados.

Si solo vas a recopilar registros de determinados nodos, asegúrate de incluir al menos un nodo de almacenamiento que cuente con el servicio ADC. Los tres primeros nodos de almacenamiento instalados en una sede incluyen el servicio ADC.

Información inicial

Recopila información de referencia sobre las operaciones de ingesta, las operaciones de recuperación y el consumo de almacenamiento.

Cronología de los cambios recientes

Elabora una cronología que resuma los cambios recientes en el sistema o en su entorno.

Historial de las medidas adoptadas para diagnosticar el problema

Si has tomado medidas para diagnosticar o solucionar el problema por tu cuenta, asegúrate de anotar los pasos que has seguido y el resultado.