← toutes les matières
disponibleintermediaire

Observabilité, métriques et journaux

Observer le comportement d'une plateforme, relier métriques, journaux et événements, puis construire des alertes exploitables.

Objectifs

  • Distinguer monitoring et observabilité
  • Exposer et collecter des métriques
  • Centraliser et interroger des journaux
  • Construire un tableau de bord utile
  • Définir une alerte actionnable
  • Utiliser les signaux pour diagnostiquer un incident

Notions abordées

  1. 01Métriques, logs, traces et événements
  2. 02Prometheus et exporters
  3. 03Grafana et tableaux de bord
  4. 04Loki et centralisation des journaux
  5. 05Alerting et niveaux de service
  6. 06Méthodes de diagnostic

Compétences

  • Instrumenter un service
  • Construire un tableau de bord
  • Diagnostiquer avec des signaux

Outils

PrometheusGrafanaLokiAlertmanager

Cours

Leçons de la matière

5 leçon(s) déjà reliée(s) à cette matière. Le contenu reste accessible librement, dans l’ordre proposé ou à la carte.

  1. 01

    Supervision (1/5) — Pourquoi superviser : les 3 piliers

    Quelque chose ralentit ou tombe à 3 h du matin : comment le sais-tu, et pourquoi ? On découvre l'observabilité et ses trois piliers — métriques, logs, alertes — indépendamment de tout outil.

  2. 02

    Supervision (2/5) — Prometheus & les métriques

    Le pilier fondateur. On déploie Prometheus sur le cluster et on découvre son modèle : il va lui-même chercher les métriques (pull), les stocke en séries temporelles, et les interroge avec PromQL.

  3. 03

    Supervision (3/5) — Grafana & les tableaux de bord

    Les chiffres bruts de Prometheus sont austères. Grafana les transforme en tableaux de bord clairs. On le branche comme datasource, on lit un dashboard, et on comprend la séparation entre qui stocke et qui affiche.

  4. 04

    Supervision (4/5) — Loki & les logs

    Les métriques disent qu'il y a un problème ; les logs disent lequel. On déploie Loki pour centraliser les logs de tout le cluster, et on les explore aux côtés des métriques, dans le même Grafana.

  5. 05

    Supervision (5/5) — Alertmanager & les alertes

    Le dernier maillon : ne plus regarder les écrans, mais être prévenu. On écrit une règle d'alerte dans Prometheus, on la route avec Alertmanager, et on boucle enfin le problème des 3 h du matin — puis on regarde le chemin parcouru.

Dans les formations