Comprobado cada minuto, con 30 días de historial.
El estado en vivo se mide fuera de nuestra propia plataforma, en Cloudflare, para que siga respondiendo cuando nosotros no lo hacemos. Esta página describe qué monitorizamos, los objetivos que nos exigimos y cómo gestionamos el mantenimiento.
Lo que las sondas comprueban cada minuto, de extremo a extremo.
Dashboard web
app.logpulse.io: UI de búsqueda, dashboards, alertas
API
api.logpulse.io: REST + WebSocket
Ingesta de logs
Endpoints OTLP HTTP + JSON genérico
Motor de consultas
LPQL en ClickHouse Cloud
AI Investigator
Búsqueda en lenguaje natural + investigación
Objetivos de ingeniería que nos exigimos a nosotros mismos. Los SLA contractuales están disponibles con el plan Enterprise.
Disponibilidad de la plataforma
99.9%
Objetivo móvil de 30 días
Latencia de consulta (P95)
< 200ms
Nivel activo, consultas sencillas
Latencia de ingesta (P99)
< 500ms
De la API a consultable
RPO de copias de seguridad
< 1h
Recuperación a un punto en el tiempo
Reflejan los SLO publicados en la página de seguridad y cumplimiento. Todos los detalles de seguridad
Aspiramos a despliegues sin tiempo de inactividad, pero en ocasiones necesitamos pausar la ingesta o dejar ClickHouse fuera de línea para migraciones. Cuando lo hacemos:
Incidentes confirmados, con causa raíz y cronología de resolución.
El historial de incidentes está en la página de estado
Los incidentes en curso y su cronología se publican allí en el momento en que ocurren. Para cada incidente que afectó a usuarios publicamos aquí un post-mortem.
Abrir estado en vivoSuscríbete a las actualizaciones de estado y te enviaremos un correo cuando algún componente pase a estado degradado o de interrupción, además de antes de cualquier ventana de mantenimiento planificada.