Implementación de SLOs, SLIs y Presupuesto de Errores
Framework para definir e implementar objetivos de nivel de servicio (SLOs), indicadores (SLIs) y presupuestos de errores con alertas de burn rate usando Prometheus y Grafana. Ideal para equipos que adoptan prácticas SRE y necesitan medir la fiabilidad de sus servicios de forma cuantitativa.
Incluida en el Pase · para Prometheus, Grafana, Kubernetes
// qué_hace
Define y calcula SLIs, SLOs y presupuestos de errores con reglas de grabación y alertas para Prometheus.
// cómo_lo_hace
Proporciona consultas PromQL, configuraciones YAML de recording rules, alertas de burn rate rápido/lento y plantilla de dashboard Grafana listos para producción.
// ejemplo_de_uso
Úsala al definir la fiabilidad de un servicio nuevo con tu equipo de plataforma. Ej.: configura un SLO de disponibilidad del 99,9 % con alertas de burn rate en Prometheus en menos de una hora.
// plataformas
// opiniones_de_la_comunidad
Opiniones
Cargando opiniones…