Observability Stack

Verwandeln Sie Black-Box-Systeme in beobachtbare Infrastrukturen. Sie werden Prometheus für Metriken, Grafana für die Visualisierung und Loki für die Protokollaggregation bereitstellen, um tiefe Einblicke in die Systemleistung zu gewinnen.

DevOps EngineerDevOpsLinux

💡 Dieser Artikel wurde von AI-Assistenten übersetzt. Um die englische Version anzuzeigen, können Sie hier klicken

Einführung

Eine Observability-Pipeline verwandelt Hostaktivität in Metriken, durchsuchbare Logs und verwertbare Alarmzustände. Dieses Challenge-Projekt baut sie lokal mit Prometheus, Grafana, Loki, Promtail, Node Exporter und Alertmanager auf.

Du verbindest Komponenten über Konfiguration und echte APIs: Hostmetriken erfassen, eine Grafana-Datenquelle bereitstellen, ein aktives Systemlog an Loki senden und durch Stoppen von Node Exporter InstanceDown auslösen. So entsteht ein überprüfbarer Einzelhost-Stack.

Was du lernen wirst

  • Node Exporter auf 9100 ausführen und Prometheus auf 9090 für ein gesundes Scrape-Target konfigurieren
  • Eine Grafana-Prometheus-Datenquelle in YAML provisionieren und über die Grafana-API auf 8080 prüfen
  • Loki auf 3100 starten und Promtail zum Lesen eines aktiven lokalen Systemlogs konfigurieren
  • Logaufnahme über Loki-Label-APIs bestätigen und Sammler- von Speicheraufgaben unterscheiden
  • Alertmanager auf 9093 ausführen und über alertmanagers mit Prometheus verbinden
  • InstanceDown für up == 0 definieren, Node Exporter stoppen und den firing-Zustand prüfen

Für wen dieser Kurs geeignet ist

Dieses Projekt richtet sich an DevOps- und SRE-Lernende, die eine lokale Observability-Pipeline aus Konfiguration und Dienstprüfungen zusammensetzen möchten.

Voraussetzungen: Linux-Dienste und Prozesse, YAML, HTTP-APIs, Ports, Prometheus-Scraping, Logpfade und curl; Prüfprojekt.

Lernumgebung: Browserbasierter Einzelknoten-Linux-Host mit sudo, Prometheus, Node Exporter, Grafana, herunterladbaren Loki-, Promtail- und Alertmanager-Binaries, aktivem lokalen Log und HTTP-Zugriff; keine Cloud nötig.

Häufig gestellte Fragen

Erstelle ich Grafana-Dashboards und Panels?

Nein. Nur eine Prometheus-Datenquelle wird als Code bereitgestellt und geprüft. Dashboards, Panels, Variablen und Grafana-Alarmregeln fehlen.

Werden Logs von mehreren Servern gesammelt?

Nein. Promtail liest /var/log/syslog oder ein anderes aktives Log desselben Hosts und sendet es an lokales Loki. Verteilte Agenten, Aufbewahrung und Objektspeicher fehlen.

Sendet Alertmanager E-Mail, Slack oder Webhooks?

Nein. Prometheus leitet an lokalen Alertmanager weiter, und du prüfst firing per API oder UI. Externe Empfänger werden nicht eingerichtet.

Wie wird der Ausfall getestet und geprüft?

Du stoppst Node Exporter, sodass up == 0 gilt. Geprüft werden der gestoppte Exporter und InstanceDown im Zustand firing in der Prometheus-API.

Lehrer

labby
Labby
Labby is the LabEx teacher.