Programación de Reglas de Alerta 🔔
El sistema de alertas inteligentes de API Monitor APM evalúa constantemente las métricas y eventos de telemetría reportados por tus aplicaciones para detectar de forma proactiva comportamientos anómalos o de falla y notificarlos antes de que afecten a tus usuarios finales.
⚙️ 1. Creación de una Regla de Alerta
Puedes configurar umbrales de seguridad lógicos y de rendimiento de manera interactiva:
- Parámetros configurables:
- Métrica (Metric): La métrica a evaluar (ej:
Duración de Peticiones,Tasa de Errores, o uso físico deCPU/Memoria RAM). - Operador lógico: Mayor que (
>), Menor que (<), o Igual (=). - Umbral de Disparo (Threshold): El valor límite que detona la alarma (ej:
500 msde latencia o5%de tasa de errores). - Umbral de Recuperación (Recovery Threshold): El valor de seguridad al que debe regresar la métrica para marcar el incidente como resuelto automáticamente (ej: latencia menor a
300 mso0%de errores). - Ventana de Tiempo (Window): El período de tiempo durante el cual se evalúa la métrica (ej: durante los últimos
5 minutos).
- Métrica (Metric): La métrica a evaluar (ej:
🔌 2. Integración y Configuración de Canales
Asocia tus alertas con tus canales de comunicación cotidianos para acelerar los tiempos de resolución del equipo técnico:
- Slack Webhook Integration: Pega la URL del webhook de tu canal de operaciones de Slack. El sistema enviará de inmediato un mensaje estructurado y muy visual con los detalles del servicio afectado, el valor anómalo y un botón con el link directo para auditar el fallo.
- Email Notifications: Agrega los correos electrónicos de los ingenieros de guardia. El sistema les enviará un correo detallado ante el disparo de la alerta y otro al normalizarse y resolverse el incidente.
🚨 3. El Consola Operativa de Alertas en Acción
La consola administrativa te brinda una visibilidad rápida sobre todas tus políticas activas, el entorno de ejecución asignado y el canal de mensajería configurado:
Puedes filtrar políticas por entorno (Producción vs Calidad/QA) de forma instantánea para auditar qué reglas aplican a cada segmento de tu arquitectura. Asimismo, puedes encender o apagar las notificaciones mediante interruptores rápidos o realizar ediciones de umbrales sobre la marcha.
📬 4. El Correo de Incidente Crítico (Disparo)
Cuando una métrica viola el umbral de disparo configurado bajo el estándar de OpenTelemetry, el sistema despacha una alerta de incidente crítico en tiempo real.
El correo está diseñado bajo una plantilla dual-theme adaptativa que luce fantástica tanto en modo claro como oscuro según el lector del destinatario:
- Características Clave del Correo de Alerta:
- Badge de Severidad: Identificación rápida del nivel de urgencia (
🚨 INCIDENTE CRÍTICO DETECTADO). - KPIs en Vivo: Caja destacada de volumen de peticiones, conteo de errores y latencias exactas del periodo de anomalía.
- Causa Raíz por IA (Root Cause Analysis): El Agente AI del APM analiza las trazas e identifica la línea de código, timeout de base de datos o llamada fallida de terceros que detonó el incidente.
- Logs de Error Relevantes: Un feed en consola que extrae las últimas 3 excepciones registradas para una rápida referencia sin cambiar de pantalla.
- Botón de Acción Directo: Link con token integrado que te lleva directamente al buscador de trazas del APM filtrado por ese microservicio específico.
- Badge de Severidad: Identificación rápida del nivel de urgencia (
✅ 5. El Correo de Incidente Resuelto (Cierre)
En el momento en que el tráfico regresa a niveles normales y la métrica desciende por debajo del Recovery Threshold, el sistema cierra el incidente de forma autónoma. El APM calcula el tiempo medio de resolución (MTTR) y despacha una notificación de recuperación limpia y coordinada:
- Cierre Automático de Alertas:
- Badge Verde de Éxito: Cambia instantáneamente a
[ ✅ INCIDENTE RESUELTO Y CERRADO ]. - Estado Conforme: Declara que el microservicio ha vuelto a niveles estables de rendimiento, liberando al equipo DevOps de alertas falsas o redundantes.
- Soporte de Inversión de Logos: En modo oscuro, el encabezado se vuelve negro carbón y los logotipos institucionales de New Inntech y New IA Tech se invierten automáticamente a color blanco, conservando un contraste perfecto de marca.
- Badge Verde de Éxito: Cambia instantáneamente a