Pile d'Observabilité

Transformez les systèmes en boîte noire en une infrastructure observable. Vous déployerez Prometheus pour les métriques, Grafana pour la visualisation et Loki pour l'agrégation des logs afin d'obtenir des informations approfondies sur les performances du système.

DevOps EngineerDevOpsLinux

💡 Ce tutoriel est traduit par l'IA à partir de la version anglaise. Pour voir la version originale, vous pouvez cliquer ici

Introduction

Une chaîne d'observabilité transforme l'activité d'un hôte en métriques, logs interrogeables et états d'alerte exploitables. Ce projet fondé sur des défis construit cette chaîne localement avec Prometheus, Grafana, Loki, Promtail, Node Exporter et Alertmanager.

Vous relierez les composants par configuration et API réelles : collecte des métriques, provisionnement d'une source Grafana, envoi d'un log système actif vers Loki et déclenchement de InstanceDown par arrêt de Node Exporter. Le résultat est une pile mono-hôte dont le flux peut être vérifié de bout en bout.

Ce que vous apprendrez

  • Exécuter Node Exporter sur 9100 et configurer Prometheus sur 9090 pour le collecter comme cible saine
  • Provisionner une source Prometheus Grafana en YAML et la vérifier par l'API Grafana sur 8080
  • Démarrer Loki sur 3100 et configurer Promtail pour suivre un log système local actif
  • Confirmer l'ingestion par les API de labels Loki et distinguer collecte et stockage
  • Exécuter Alertmanager sur 9093 et le relier à Prometheus par la configuration alertmanagers
  • Définir InstanceDown pour up == 0, arrêter Node Exporter et vérifier l'état firing

À qui s’adresse ce cours

Ce projet s'adresse aux personnes apprenant DevOps et SRE prêtes à assembler une chaîne locale par configuration et contrôles de services.

Prérequis : Services et processus Linux, YAML, API HTTP, ports, collecte Prometheus, chemins de logs et curl ; projet d'évaluation.

Environnement d’apprentissage : Un hôte Linux à un nœud dans le navigateur avec sudo, Prometheus, Node Exporter, Grafana, binaires téléchargeables Loki, Promtail et Alertmanager, un log local actif et HTTP local ; aucun cloud requis.

Questions fréquentes

Vais-je créer des dashboards et panneaux Grafana ?

Non. Vous provisionnez et vérifiez uniquement une source Prometheus comme code. Dashboards, panneaux, variables et alertes Grafana sont hors périmètre.

Les logs proviennent-ils de plusieurs serveurs ?

Non. Promtail suit /var/log/syslog ou un autre log actif du même hôte et l'envoie au Loki local. Agents distribués, rétention et stockage objet ne sont pas configurés.

Alertmanager envoie-t-il des e-mails, messages Slack ou webhooks ?

Non. Prometheus achemine l'alerte vers Alertmanager local et vous vérifiez l'état firing via API ou UI. Aucun récepteur externe n'est configuré.

Comment le test de panne est-il exécuté et vérifié ?

Vous arrêtez Node Exporter pour produire up == 0. La validation confirme son arrêt et la présence de InstanceDown à l'état firing dans l'API Prometheus.

Enseignant

labby
Labby
Labby is the LabEx teacher.