Surveillance Prometheus

Apprenez la surveillance avec Prometheus. Ce module couvre l'installation de Prometheus, la surveillance de Linux avec Node Exporter, les requêtes PromQL de base, la configuration des alertes et les bases d'Alertmanager. Vous maîtriserez ces compétences essentielles sous Linux grâce à des laboratoires pratiques et des défis concrets.

DevOps EngineerDevOpsLinux

💡 Ce tutoriel est traduit par l'IA à partir de la version anglaise. Pour voir la version originale, vous pouvez cliquer ici

Introduction

Prometheus transforme des métriques temporelles en une vue interrogeable et évalue des règles sur ces données. Ce cours pratique construit une petite chaîne locale, de l’installation et la collecte jusqu’à PromQL, aux alertes et au routage Alertmanager.

Vous collecterez les métriques de Prometheus et de Node Exporter, interrogerez mémoire et CPU, chargerez InstanceDown et enverrez une alerte de test. Le défi final configure les deux cibles et une règle HighCpuLoad, puis la vérifie par l’API.

Ce que vous apprendrez

  • Télécharger, configurer, démarrer et vérifier Prometheus
  • Exécuter Node Exporter et contrôler son endpoint sur le port 9100
  • Ajouter des cibles statiques et examiner leur état par l’API
  • Interroger mémoire, taux CPU et pourcentage calculé avec PromQL
  • Créer et charger un fichier de règles d’alerte
  • Relier Prometheus à Alertmanager et configurer un webhook local
  • Soumettre une alerte de test et examiner son état
  • Construire et vérifier une règle personnalisée de charge CPU

À qui s’adresse ce cours

Ce cours intermédiaire s’adresse aux administrateurs Linux, apprenants DevOps et ingénieurs d’exploitation qui souhaitent un premier flux pratique de collecte, requête et alerte avec Prometheus.

Prérequis : Shell Linux, YAML, processus en arrière-plan, curl, ports et notions élémentaires de CPU et mémoire. Aucune expérience Prometheus n’est requise.

Environnement d’apprentissage : Une machine Linux unique avec Prometheus, Node Exporter, Alertmanager et un webhook local. Les composants sont lancés comme processus de laboratoire, pas comme services persistants de production.

Questions fréquentes

Vais-je surveiller plusieurs serveurs distants ?

Non. Prometheus collecte ses propres métriques et celles d’un Node Exporter sur localhost. Découverte de services, fédération et stockage distribué sont hors périmètre.

Quel est le niveau de PromQL ?

Vous utilisez une métrique mémoire, rate() sur un compteur CPU et un calcul simple de pourcentage. Agrégations, jointures, recording rules et histogrammes ne sont pas enseignés.

Les alertes atteignent-elles un service externe ?

Non. Alertmanager route vers un webhook local. Le défi vérifie seulement le chargement de HighCpuLoad, sans générer de charge durable ni notification externe.

Enseignant

labby
Labby
Labby is the LabEx teacher.