# Fatiga de alertas: menos avisos y más útiles

> Con 43 alertas por una caída, acabas ignorándolas. Cómo evitarlo con grupos, recuperaciones, resúmenes y horas de silencio, y una lista de claves de grupo.

Source: https://honk-me.app/es/guias/fatiga-de-alertas

La fatiga de alertas no nace de tener demasiados problemas, sino de recibir demasiados avisos por cada uno. Redis deja de responder durante siete minutos, la API de facturación reintenta cada diez segundos y el teléfono vibra 43 veces. A la tercera ya lo has entendido; a la vigésima ya has desactivado las notificaciones, y el siguiente problema de verdad llega a un teléfono mudo.

La solución está en unos pocos hábitos que sirven con cualquier herramienta. Cada sección explica uno y luego cómo se aplica en Honk.

## 1. Avisa del problema, no de cada intento

Un bucle de reintentos no son 43 problemas, sino uno que se ha repetido 43 veces. Decide qué significa «el mismo problema», dale un nombre estable y envía ese nombre con cada evento.

En Honk, ese nombre es la clave de grupo, `group_key`. Los eventos que comparten proyecto, entorno, origen, canal y `group_key` forman un grupo, y solo el primer evento de cada episodio nuevo envía una notificación.

```sh
# Before: one push per failed attempt, 43 in seven minutes
curl … -d '{"title":"Redis timeout","message":"attempt 17 failed"}'
```

```sh
# After: one group, one episode, one push, then calm updates
honk-me problem --group-key billing/redis --source billing-api \
  --title "Redis connection failed" --message "Billing API could not connect to Redis (timeout after 5 s)"
# …and when it works again:
honk-me recovery --group-key billing/redis --source billing-api \
  --title "Redis is back" --message "Connected after 7 minutes"
```

## 2. Repeticiones en voz baja; ruido, solo si empeora

Mientras dura el problema, quieres saber que sigue ahí, pero no 43 veces. Honk envía como mucho una actualización por cada pausa entre actualizaciones (5 minutos por defecto), con el recuento hasta ese momento. Si el nivel sube, por ejemplo de Bocinazo fuerte a Bocina sin parar, esa actualización se notifica al instante: que empeore es noticia.

## 3. Cierra el ciclo con una recuperación

Una alerta que nunca termina te deja con la duda. Cuando todo vuelva a funcionar, envía un evento `recovery` con el mismo `group_key`: Honk lo notifica, cierra el episodio y el incidente deja de reclamar tu atención. Envía recuperaciones solo después de un fallo; una tras cada comprobación correcta es solo más ruido.

Si nadie informa de la recuperación, el episodio queda inactivo tras un tiempo sin eventos (24 horas por defecto). Inactivo no quiere decir resuelto: el siguiente evento abre un episodio nuevo y vuelve a avisar.

## 4. Manda los eventos rutinarios al resumen

No todos los eventos merecen una notificación. Una importación terminada, una copia de seguridad correcta o un informe diario conviene verlos, pero no justifican una interrupción. Envíalos como Bocinazo suave o Bip-bip con prioridad normal o baja, y pon tu umbral de push en Alta: lo que quede por debajo se reúne en un resumen, cada 15 minutos por defecto, y nunca se envía un resumen vacío.

Una regla del proyecto consigue lo mismo sin tocar el código: por ejemplo, mandar al resumen todos los eventos de la categoría `deployments` con gravedad `success`.

## 5. Reserva la noche para lo que no puede esperar

Las horas de silencio retienen las notificaciones y, al terminar, envían un solo resumen. Decide de antemano qué puede saltárselas. En Honk, solo pasan los eventos con prioridad `urgent`, enviados desde una clave de ingesta autorizada para ello, y solo si tus horas de silencio dejan pasar los urgentes. Da ese permiso a una sola clave: la del único servicio que tiene derecho a despertarte.

## 6. Elige el nivel con honestidad

La escala Honk tiene cinco niveles, y solo sirven si significan algo. Usa **Bocina sin parar** para «algo está caído» y **Bocinazo largo** para «algo falló». Si todo es Bocina sin parar, nada lo es.

## Lista para revisar tus claves de grupo

- **Una clave por cada cosa que se arregla de una vez.** `billing/redis`, no `billing/redis/attempt-17`.
- **Sin marcas de tiempo, ids de solicitud ni valores aleatorios en la clave**, salvo que cada evento sea de verdad una historia aparte, como la solicitud de un cliente (`requests/4812`).
- **Incluye el lugar en la clave** cuando el mismo problema en dos máquinas son dos problemas: `disk/app-01/var`.
- **Usa la misma clave para el problema y su recuperación.** Así sabe Honk qué se recuperó.
- **Que sea corta y legible.** Aparece en la bandeja de entrada y las reglas pueden filtrar por ella.

## Cómo encaja Honk

Honk se diseñó en torno a estos hábitos. La agrupación y los episodios siguen reglas fijas en el servidor. La pausa entre actualizaciones y los resúmenes se ajustan por proyecto; las horas de silencio y los silencios, por persona. Y la IA del iPhone puede resumir un grupo, pero nunca ocultar ni retrasar una notificación. Encontrarás todas las reglas en [Cómo funciona](https://honk-me.app/es/como-funciona).
