Eine Observability-Pipeline verwandelt Hostaktivität in Metriken, durchsuchbare Logs und verwertbare Alarmzustände. Dieses Challenge-Projekt baut sie lokal mit Prometheus, Grafana, Loki, Promtail, Node Exporter und Alertmanager auf.
Du verbindest Komponenten über Konfiguration und echte APIs: Hostmetriken erfassen, eine Grafana-Datenquelle bereitstellen, ein aktives Systemlog an Loki senden und durch Stoppen von Node Exporter InstanceDown auslösen. So entsteht ein überprüfbarer Einzelhost-Stack.
Was du lernen wirst
- Node Exporter auf
9100ausführen und Prometheus auf9090für ein gesundes Scrape-Target konfigurieren - Eine Grafana-Prometheus-Datenquelle in YAML provisionieren und über die Grafana-API auf
8080prüfen - Loki auf
3100starten und Promtail zum Lesen eines aktiven lokalen Systemlogs konfigurieren - Logaufnahme über Loki-Label-APIs bestätigen und Sammler- von Speicheraufgaben unterscheiden
- Alertmanager auf
9093ausführen und überalertmanagersmit Prometheus verbinden InstanceDownfürup == 0definieren, Node Exporter stoppen und den firing-Zustand prüfen
Für wen dieser Kurs geeignet ist
Dieses Projekt richtet sich an DevOps- und SRE-Lernende, die eine lokale Observability-Pipeline aus Konfiguration und Dienstprüfungen zusammensetzen möchten.
Voraussetzungen: Linux-Dienste und Prozesse, YAML, HTTP-APIs, Ports, Prometheus-Scraping, Logpfade und curl; Prüfprojekt.
Lernumgebung: Browserbasierter Einzelknoten-Linux-Host mit sudo, Prometheus, Node Exporter, Grafana, herunterladbaren Loki-, Promtail- und Alertmanager-Binaries, aktivem lokalen Log und HTTP-Zugriff; keine Cloud nötig.
Häufig gestellte Fragen
Erstelle ich Grafana-Dashboards und Panels?
Nein. Nur eine Prometheus-Datenquelle wird als Code bereitgestellt und geprüft. Dashboards, Panels, Variablen und Grafana-Alarmregeln fehlen.
Werden Logs von mehreren Servern gesammelt?
Nein. Promtail liest /var/log/syslog oder ein anderes aktives Log desselben Hosts und sendet es an lokales Loki. Verteilte Agenten, Aufbewahrung und Objektspeicher fehlen.
Sendet Alertmanager E-Mail, Slack oder Webhooks?
Nein. Prometheus leitet an lokalen Alertmanager weiter, und du prüfst firing per API oder UI. Externe Empfänger werden nicht eingerichtet.
Wie wird der Ausfall getestet und geprüft?
Du stoppst Node Exporter, sodass up == 0 gilt. Geprüft werden der gestoppte Exporter und InstanceDown im Zustand firing in der Prometheus-API.





