SLI → SLO → Error Budget
Neuf neufs, ça n'existe pas. Un bon SLO, si.
Mauvaise fenêtre. Mauvais burn rate. Un filtre business hours oublié qui casse silencieusement vos alertes. Le wizard intègre les valeurs par défaut Google SRE dès le départ, pour éviter tout ça.
Démarrer le wizard →Pas une maquette — la vraie règle
Sortie réelle du wizard, annotée ci-dessous. Vérifiée par promtool check rules avant d'atterrir dans votre ZIP.
La bonne fenêtre. 30 jours, pas un ratio 5 minutes bruyant qui déclenche une alerte pour une heure de malchance.
Le piège hour(), résolu. Prometheus évalue hour() au moment de la requête — cette règle le fige dans un vrai recording, pas un piège en direct.
Le filtre oublié. Le filtrage aux heures ouvrées, généralement écrit une fois à la main, puis qui pourrit en silence.
Comment ça marche
Définir
Choisissez votre service et le type de SLI. Cinq presets de démarrage rapide couvrent les API REST, gRPC, Kafka, les pipelines et les sondes blackbox.
Fixer votre objectif
Choisissez un objectif et une fenêtre. Les valeurs par défaut des burn rates Google SRE sont pré-remplies — modifiez-les si votre équipe fonctionne différemment.
Télécharger
Un ZIP validé : recording rules, alertes, dashboard Grafana, runbooks — vérifié par promtool avant de vous parvenir.
Pourquoi nines
Burn rates 14.4×, 6×, 1× — les vrais chiffres du livre, non adaptés.
Chaque recording rule et alerte est vérifiée avant d'atterrir dans votre ZIP.
Filtrez vos SLI aux heures de bureau sans écrire vous-même le piège hour().