Estado de los
servicios.
Uptime, latencia y presupuesto de error de los servicios que opero, medidos cada pocos minutos por mi propia infraestructura de monitoreo. Datos reales, sin maquillaje.
La base de datos que guarda el historial no está respondiendo, así que estos estados y latencias se acaban de medir ahora mismo, sondeando cada endpoint desde el servidor. Son reales y actuales. Lo que no se puede mostrar mientras tanto es el historial de 90 días ni el presupuesto de error, porque eso sí sale de la base.
Portada
Operativoúltimo check hace <1 minIngeniería
Operativoúltimo check hace <1 minNotas técnicas
Operativoúltimo check hace <1 minDocumentación
Operativoúltimo check hace <1 minHerramientas
Operativoúltimo check hace <1 minLog de ingeniería
Operativoúltimo check hace <1 minPortal de clientes
Caídoúltimo check hace <1 minEste chequeo consulta la base de datos y responde 503 cuando no está disponible, así que su estado refleja la misma incidencia que describe el aviso de arriba, no un fallo aparte.
Academia IA
Operativoúltimo check hace <1 minSin incidentes registrados en la ventana. 🎉
Security Operations
Intentos de intrusión detectados y bloqueados, desglose OWASP y SLOs del pipeline propio de seguridad.
Un cron externo sondea cada servicio cada pocos minutos: código HTTP esperado, contenido de la respuesta, latencia y certificado TLS. Un 200 con la página equivocada también cuenta como caída.
El SLO es 99.5% de disponibilidad en 30 días. El presupuesto de error es el tiempo de caída que ese objetivo permite; aquí se muestra cuánto queda. La latencia se reporta como media y p95 - el percentil que de verdad siente el usuario lento, nunca solo el promedio.
Todo el sistema - motor de checks, incidentes, SLOs y alertas - es una herramienta propia construida sobre este mismo sitio. Los datos se sirven tal cual se midieron.