Saltar al contenido principal

Gestión de Incidentes y Alertas 🚨

El panel de Incidentes recopila la bitácora de todas las desviaciones y eventos de error que han superado los límites de seguridad definidos en tus reglas de alerta, permitiendo mantener una trazabilidad rigurosa y auditar la resolución de fallos.

Active Incidents Log

🚨 Características de la Bitácora de Incidentes

Cada incidente registrado en el sistema cuenta con los siguientes metadatos auditable:

  1. Regla de Alerta (Rule): La regla de comportamiento que fue infringida (ej: Error Rate > 5%).
  2. Servicio Afectado (Service Name): El microservicio específico que detonó la alarma.
  3. Valor de Detonación (Trigger Value): El porcentaje de error o latencia que causó el disparo.
  4. Fecha de Disparo (Triggered At): Marca de tiempo exacta del inicio de la anomalía.
  5. Estado Activo (Status):
    • 🔴 TRIGGERED: El incidente está activo en este momento. La anomalía persiste en tu infraestructura.
    • 🟢 RESOLVED: El sistema detectó que la métrica regresó a los umbrales de seguridad definidos y marcó el incidente como resuelto automáticamente.
    • 📅 Fecha de Resolución (Resolved At): Marca de tiempo exacta en la que el sistema volvió a la normalidad.