Une chaîne d'observabilité transforme l'activité d'un hôte en métriques, logs interrogeables et états d'alerte exploitables. Ce projet fondé sur des défis construit cette chaîne localement avec Prometheus, Grafana, Loki, Promtail, Node Exporter et Alertmanager.
Vous relierez les composants par configuration et API réelles : collecte des métriques, provisionnement d'une source Grafana, envoi d'un log système actif vers Loki et déclenchement de InstanceDown par arrêt de Node Exporter. Le résultat est une pile mono-hôte dont le flux peut être vérifié de bout en bout.
Ce que vous apprendrez
- Exécuter Node Exporter sur
9100et configurer Prometheus sur9090pour le collecter comme cible saine - Provisionner une source Prometheus Grafana en YAML et la vérifier par l'API Grafana sur
8080 - Démarrer Loki sur
3100et configurer Promtail pour suivre un log système local actif - Confirmer l'ingestion par les API de labels Loki et distinguer collecte et stockage
- Exécuter Alertmanager sur
9093et le relier à Prometheus par la configurationalertmanagers - Définir
InstanceDownpourup == 0, arrêter Node Exporter et vérifier l'état firing
À qui s’adresse ce cours
Ce projet s'adresse aux personnes apprenant DevOps et SRE prêtes à assembler une chaîne locale par configuration et contrôles de services.
Prérequis : Services et processus Linux, YAML, API HTTP, ports, collecte Prometheus, chemins de logs et curl ; projet d'évaluation.
Environnement d’apprentissage : Un hôte Linux à un nœud dans le navigateur avec sudo, Prometheus, Node Exporter, Grafana, binaires téléchargeables Loki, Promtail et Alertmanager, un log local actif et HTTP local ; aucun cloud requis.
Questions fréquentes
Vais-je créer des dashboards et panneaux Grafana ?
Non. Vous provisionnez et vérifiez uniquement une source Prometheus comme code. Dashboards, panneaux, variables et alertes Grafana sont hors périmètre.
Les logs proviennent-ils de plusieurs serveurs ?
Non. Promtail suit /var/log/syslog ou un autre log actif du même hôte et l'envoie au Loki local. Agents distribués, rétention et stockage objet ne sont pas configurés.
Alertmanager envoie-t-il des e-mails, messages Slack ou webhooks ?
Non. Prometheus achemine l'alerte vers Alertmanager local et vous vérifiez l'état firing via API ou UI. Aucun récepteur externe n'est configuré.
Comment le test de panne est-il exécuté et vérifié ?
Vous arrêtez Node Exporter pour produire up == 0. La validation confirme son arrêt et la présence de InstanceDown à l'état firing dans l'API Prometheus.





