Configura la monitorización de latencia en Workload Factory para EDA
Establece límites de advertencia y críticos para la latencia de lectura y escritura para supervisar el rendimiento de los volúmenes de FSx for ONTAP. También puedes activar alertas por correo electrónico o Amazon SNS para recibir notificaciones en tiempo real cuando haya problemas de latencia.
Antes de empezar
Asegúrate de cumplir los siguientes requisitos antes de configurar la supervisión de latencia.
Credenciales y permisos de AWS
Debes añadir credenciales de AWS a Workload Factory con permisos de lectura/escritura. La función de supervisión de la latencia requiere acceso a las métricas de CloudWatch para todos los volúmenes de FSx para ONTAP asociados con tus credenciales de AWS.
los permisos de los modos Basic y Read-only no son compatibles con la monitorización de la latencia.
Si no has configurado las credenciales de AWS, consulta "Agregar credenciales AWS".
FSx para el sistema de archivos ONTAP
Necesitas al menos un sistema de archivos FSx para ONTAP con volúmenes desplegados en tu entorno de AWS.
Enlace a FSx para ONTAP
Para ver el desglose de componentes en el análisis básico, debes asociar un enlace al sistema de archivos FSx for ONTAP. Sin un enlace, igual puedes ver los gráficos de latencia, IOPS y rendimiento. Si aún no hay ningún enlace asociado, selecciona Asociar enlace en EDA, elige si quieres crear un nuevo enlace o asociar uno existente, y luego selecciona Continuar para ir automáticamente a la página de creación de enlaces en Storage workloads.
Para obtener instrucciones sobre cómo crear y asociar enlaces, consulta "Crear un enlace".
Modelo ARN de Amazon Bedrock (opcional)
(Opcional) Para utilizar el análisis de IA, introduce un ARN de modelo de Amazon Bedrock en la configuración de Workload Factory. Si no lo haces, puedes seguir usando la supervisión de la latencia y el análisis básico.
Para más detalles, consulta "Requisitos básicos de GenAI".
Configuración de notificaciones (opcional)
Para recibir notificaciones por correo electrónico o Amazon SNS cuando se detecten eventos de latencia, configura las preferencias de notificación en los ajustes de Workload Factory. Consulta Configura las notificaciones de latencia para más detalles.
Configura los umbrales de latencia
Establece límites de advertencia y críticos para la lectura y la escritura. El sistema comprueba estos límites de forma continua y envía una alerta cuando se alcanzan.
|
|
Establece el umbral de eventos críticos por encima del umbral de advertencia. De lo contrario, no podrás guardar la configuración. |
|
|
Los umbrales de latencia que configuras en EDA se aplican a toda tu cuenta por defecto. También puedes configurar umbrales de latencia para volúmenes individuales en cargas de trabajo de almacenamiento general, y esos ajustes de volumen tienen prioridad para ese volumen. Actualizar los umbrales a nivel de cuenta en EDA no cambia ningún ajuste a nivel de volumen. |
-
Inicie sesión utilizando uno de los "experiencias de consola".
-
Selecciona el menú
y luego selecciona EDA. -
Selecciona la pestaña Latencia.
-
En la página de configuración de latencia de EDA, configura los umbrales para:
-
Latencia de lectura (advertencia y crítica)
-
Latencia de escritura (advertencia y crítica)
-
Umbrales de IOPS para cada
-
Intervalos de tiempo para la evaluación
-
-
Selecciona Aplicar para guardar tu configuración.
Workload Factory recopila métricas de latencia de todos los volúmenes de FSx for ONTAP vinculados a tus credenciales de AWS. Recopila estas métricas al menos cada 20 minutos. Los volúmenes que superan tus umbrales aparecen en la tabla de eventos de latencia.
Configura las notificaciones de latencia
Configura notificaciones por correo electrónico o a través de Amazon SNS para recibir alertas cuando se detecte una latencia elevada. Puedes controlar la frecuencia de las notificaciones mediante dos opciones:
-
Recordármelo cada día (recomendado): Recibe una notificación cuando se produzca una nueva brecha en cualquier sistema de archivos. Después de enviar una notificación para un sistema de archivos, espera 24 horas antes de enviar otra notificación para el mismo sistema de archivos.
-
Notificar cualquier incumplimiento de latencia (cada 20 minutos): recibe una notificación cuando se detecte un incumplimiento, como máximo una vez cada 20 minutos.
Las notificaciones de latencia se envían por sistema de archivos. Cuando uno o varios volúmenes de un sistema de archivos superan los umbrales de latencia, recibes una única notificación con una lista de todos los volúmenes afectados.
|
|
Si hay más de 10 volúmenes afectados, el correo electrónico muestra los 10 primeros volúmenes e indica cuántos volúmenes adicionales se ven afectados. Puedes ver todos los volúmenes afectados en la consola de Workload Factory. |
Canales de notificación:
-
Correo electrónico: Enviado a las direcciones de correo electrónico configuradas en tus ajustes de notificación de Workload Factory
-
Amazon SNS: Publicado en tu tema SNS configurado para la integración con otros sistemas
Para activar las notificaciones, consulta "Configura la configuración de notificaciones".
Gestiona la configuración de latencia
Después de la configuración, puedes cambiar tus umbrales en cualquier momento.
-
En la página Latencia, selecciona Editar.
-
Modifica cualquiera de los valores de umbral según sea necesario.
Establece el umbral crítico por encima del umbral de advertencia. Si estableces el umbral crítico por debajo del umbral de advertencia, el sistema muestra un error. -
Selecciona Aplicar para guardar tus cambios.
Mejores prácticas
Ten en cuenta estas recomendaciones a la hora de configurar la supervisión de la latencia:
-
Establece umbrales realistas: Establece umbrales que se adapten a tu carga de trabajo. Los valores predeterminados son un punto de partida, pero es posible que tengas que ajustarlos a tu entorno.
-
Empieza por los umbrales de alerta: revisa primero las alertas para comprender cuál es el rendimiento normal y luego establece los límites críticos.
-
Considera bien los intervalos de tiempo: los intervalos cortos (5-10 minutos) detectan los problemas más rápido pero pueden generar más alertas. Los intervalos más largos (15-20 minutos) reducen las falsas alarmas pero pueden detectar los problemas más tarde.
-
Coordina los umbrales de IOPS y latencia: deben cumplirse ambas condiciones. Si el límite de IOPS se establece demasiado alto, es posible que el sistema no envíe una alerta aunque la latencia sea alta.
-
Revisa los eventos descartados: Revisa periódicamente por qué se descartaron los eventos para ver si deberías ajustar los umbrales o mejorar los sistemas.