Skip to main content
Data Infrastructure Insights
Se proporciona el idioma español mediante traducción automática para su comodidad. En caso de alguna inconsistencia, el inglés precede al español.

Evaluar el estado del almacenamiento

Colaboradores netapp-alavoie

Utiliza esta receta para priorizar los problemas de almacenamiento combinando alertas activas, la intención de supervisión, las recomendaciones correctivas, los registros relevantes de la plataforma y el contexto de los objetos.

Nota El MCP de DII es una función de "Avance" y, por lo tanto, está sujeta a cambios.

Prerrequisitos

  • Un intervalo de tiempo de 30 días o menos.

  • Ámbito opcional de sistema de almacenamiento, clúster, grupo o volumen.

  • Acceso a herramientas de alertas, supervisión, registro y objetos.

Herramientas utilizadas

  • AlertsService_getMetadata

  • AlertsService_queryForAlerts

  • AlertsService_getAlertByName

  • MonitorsService_getMonitorById

  • LogService_getLogTypes

  • LogService_getLogTypeMetadata

  • LogService_queryLogEvents

  • ObjectService_getObjectTypes

  • ObjectService_getMetadataForObjectType

  • ObjectService_query

Mensaje inicial

Evalúa el estado del almacenamiento durante las últimas 24 horas. Identifica las alertas activas críticas y de advertencia para los sistemas de almacenamiento, los nodos, los pools y los volúmenes. En el caso de las alertas de mayor impacto, explica la condición del monitor y las recomendaciones correctivas; a continuación, revisa los registros pertinentes del EMS o de la plataforma de almacenamiento en torno a la hora en que se activó la alerta. Distingue entre las pruebas confirmadas y las causas probables.

Flujo de trabajo del agente

  1. Obtén los metadatos de la alerta.

  2. Identifica los campos válidos para gravedad, estado, monitor, objeto relacionado y hora de activación.

  3. Consulta las alertas activas relacionadas con el almacenamiento en el intervalo solicitado.

  4. Clasifica las alertas usando:

    • Gravedad

    • Tipo de objeto afectado

    • Número de objetos afectados

    • Actualidad y recurrencia

    • Impacto en la disponibilidad, la protección de datos, el rendimiento o la capacidad

  5. Consulta todos los detalles de las alertas de mayor prioridad.

  6. Recupera sus definiciones de monitores y las directrices correctivas.

  7. Enumera los tipos de registro y selecciona el flujo nativo de la plataforma correspondiente a cada alerta, como ONTAP EMS o eventos de StorageGRID.

  8. Recupera los metadatos del registro y, a continuación, consulta un intervalo reducido en torno a la alerta.

  9. Recupera los atributos o las métricas del objeto necesarios para confirmar su estado actual.

  10. Elabora un resumen del estado con evidencia, causa probable, impacto y la siguiente comprobación.

Interpretación

No consideres una sola señal como una evaluación completa del estado de salud:

  • Las alertas muestran las condiciones detectadas.

  • Los monitores explican la regla de detección y la acción correctiva prevista.

  • Los registros proporcionan el contexto de eventos nativo de la plataforma.

  • Los objetos y las métricas muestran el inventario actual o el estado medido.

Una alerta activa puede permanecer abierta después de que cambie la condición subyacente. Utiliza datos recientes de objetos y métricas siempre que sea posible.

Resultado sugerido

Para cada cuestión prioritaria:

  • Recurso afectado

  • Gravedad y estado de alerta

  • Hora de activación

  • Supervisar y acondicionar

  • Registros o métricas que lo corroboran

  • Pruebas confirmadas

  • Causa probable, indicada como una inferencia

  • Orientación correctiva

  • Confianza y falta de pruebas

Límites y privacidad

  • Mantente alerta y mantén las ventanas de registro por debajo de 30 días.

  • Utiliza ventanas de registro estrechas para reducir los eventos no relacionados.

  • Omite los UUID, las direcciones, las anotaciones y las cargas útiles sin procesar innecesarios.

  • Las orientaciones correctivas tienen carácter informativo; comprueba que los comandos se ajusten a la documentación pertinente del producto y al proceso de cambio.

Indicaciones de seguimiento

Para la alerta AL-123456, muestra la guía del monitor y los eventos de EMS relacionados dentro de los 30 minutos anteriores y posteriores a la activación.

Agrupa las alertas de almacenamiento activas por sistema afectado y área de impacto. ¿Qué sistema necesita atención primero y por qué?

Comprueba si la alerta de máxima prioridad sigue siendo compatible con las métricas actuales del objeto.