Gestión de Incidentes y Alertas 🚨
El panel de Incidentes recopila la bitácora de todas las desviaciones y eventos de error que han superado los límites de seguridad definidos en tus reglas de alerta, permitiendo mantener una trazabilidad rigurosa y auditar la resolución de fallos.
🚨 Características de la Bitácora de Incidentes
Cada incidente registrado en el sistema cuenta con los siguientes metadatos auditable:
- Regla de Alerta (Rule): La regla de comportamiento que fue infringida (ej:
Error Rate > 5%). - Servicio Afectado (Service Name): El microservicio específico que detonó la alarma.
- Valor de Detonación (Trigger Value): El porcentaje de error o latencia que causó el disparo.
- Fecha de Disparo (Triggered At): Marca de tiempo exacta del inicio de la anomalía.
- Estado Activo (Status):
- 🔴 TRIGGERED: El incidente está activo en este momento. La anomalía persiste en tu infraestructura.
- 🟢 RESOLVED: El sistema detectó que la métrica regresó a los umbrales de seguridad definidos y marcó el incidente como resuelto automáticamente.
- 📅 Fecha de Resolución (Resolved At): Marca de tiempo exacta en la que el sistema volvió a la normalidad.