Cómo te informamos o alertamos
Una interrupción solo vale la pena detectar si la persona correcta se entera. Enviamos a donde tu equipo ya mira, y a tus propios sistemas cuando una persona no es lo primero que debe reaccionar.
Los canales
Cada canal recibe el mismo mensaje: qué monitor, desde cuándo y por qué. Cada uno es una dirección que añades una vez y luego nombras en una regla.
-
Email Todos los planes
Un mensaje a cualquier dirección, confirmado una vez antes de enviarlo, para que una alerta no pueda dirigirse al buzón de otra persona.
-
Webhook (POST) Todos los planes
Un cuerpo JSON con todos los campos abajo, hacia una URL tuya. Para tu propia automatización: abrir un ticket, notificar a un turno, cambiar una luz de estado.
-
Webhook (GET) Todos los planes
Los mismos campos como parámetros de consulta, para un receptor que solo puede aceptar un GET.
-
PagerDuty Starter y superiores
Un incidente a través de la Events API v2, abierto en una interrupción y resuelto en la recuperación, para que la propia escalada de PagerDuty lo gestione desde ahí. Un chequeo lento o con pérdida llega como una advertencia, no como crítico.
-
Slack Pro y Business
Un mensaje en un canal, rojo para caído y verde para recuperado, a través de un webhook.
-
Microsoft Teams Pro y Business
El mismo mensaje en un canal de Teams, a través de un webhook.
-
Discord Pro y Business
El mismo mensaje en un canal de Discord, a través de un webhook del canal.
-
Telegram Pro y Business
El mismo mensaje en un chat, a través de tu propio bot.
Quién se entera de qué, y cuándo
Confirmado primero
Nada se envía por la opinión de una sola sonda. Una falla se convierte en una interrupción cuando sondas en otros dos continentes están de acuerdo, así que una alerta significa que el sitio está caído y no una red intermedia.
Reglas y escalación
Una regla dice quién se entera de qué monitores y cuánto tiempo después de que comience la interrupción. Pon el turno de guardia en un grupo de contactos con un retraso por miembro, y una regla se convierte en una escalada que se detiene en el momento en que el monitor se recupera.
Recuperado, dicho una vez
A todos los que se les informó sobre la interrupción se les dice cuándo termina, con cuánto tiempo duró. No te despertaremos para decirte que la interrupción terminó.
Prueba antes de necesitarlo
Cada dirección tiene un botón que envía una prueba por el mismo camino que toma una alerta real, redactada para que no pueda confundirse con una interrupción real.
El webhook, para tus propios sistemas
Una dirección de webhook es una URL tuya. La llamamos cuando se confirma una interrupción, cuando se recupera y cuando presionas probar. POST envía los campos como un cuerpo JSON; GET los envía como parámetros de consulta. La URL se almacena cifrada y nunca se muestra completa de nuevo, porque quien la tenga puede hacer publicaciones en ella.
| Campo | Lo que contiene |
|---|---|
| reason | down cuando se confirma una interrupción, recovery cuando termina, test cuando alguien presiona el botón |
| monitor | El nombre del monitor |
| monitor_id | Su id, el mismo que aparece en su dirección en el panel |
| target | Lo que verifica: la URL, el host o el nombre |
| type | El tipo de verificación, como un nombre corto como https, dns o ssl_cert |
| cause | Por qué falló, en pocas palabras, cuando lo sabemos |
| error_class | Lo mismo como un nombre corto que un programa puede usar, como timeout, connection o certificate_expired |
| started | Cuándo comenzó la interrupción, como una hora del día con su zona |
| confirmed_at | Cuándo se confirmó el fallo |
| confirmed_from | Los continentes que lo confirmaron, como una lista de nombres. Era un solo nombre hasta septiembre de 2026 |
| degraded | true cuando el monitor está lento o perdiendo paquetes en lugar de estar down |
| resolved | Cuándo terminó, como un timestamp ISO 8601, en una recuperación |
| duration | Cuánto duró, en palabras, en una recuperación |
| incident_id | El id del incidente, el mismo en la interrupción y su recuperación |
Un campo sin nada que decir es null en el JSON y se omite en un GET. Responde con cualquier estado por debajo de 400. Cualquier otra cosa cuenta como una entrega fallida y se intenta de nuevo después de 30 segundos, 2 minutos y 10 minutos, luego se abandona: una alerta que no ha llegado en un cuarto de hora es historia, no noticia.