Instrumenter une app Prometheus : golden signals
Golden signals, méthode RED et histogramme plutôt que summary pour la latence : comment instrumenter une application Prometheus, avec les requêtes PromQL.
Savoir que ça casse avant vos utilisateurs : des SLO dimensionnés pour des équipes réduites, des métriques qui servent à décider, des alertes qu'on ne finit pas par couper. Chaque article part d'un système réellement instrumenté, ou d'un incident qui a montré ce qui manquait.
Ces sujets, je les traite aussi en mission : Fiabilité & observabilité.
Golden signals, méthode RED et histogramme plutôt que summary pour la latence : comment instrumenter une application Prometheus, avec les requêtes PromQL.
Why symptom-based Prometheus alerts beat cause-based ones, how the for clause and severity labels cut noise, plus a bad rule rewritten into a good one.
Golden signals and the RED method: why latency uses a histogram, not a summary, when instrumenting an app for Prometheus, with matching PromQL queries.
Pourquoi alerter sur les symptômes et non les causes, comment régler la clause for et le label severity, et une mauvaise règle Prometheus réécrite proprement.