Observability Pipeline はホストの活動を Metric、検索可能な Log、対応可能な Alert 状態へ変換します。このチャレンジ形式のプロジェクトでは、Prometheus、Grafana、Loki、Promtail、Node Exporter、Alertmanager を使ってローカルに構築します。
設定ファイルと実際の API で各 Component を接続し、Host Metric の Scrape、Grafana Data Source の Provisioning、活動中の System Log の Loki 送信、Node Exporter 停止による InstanceDown 発火を行います。単一ホストでデータフローを端から端まで検証できます。
学習内容
- Node Exporter を
9100、Prometheus を9090で動かし、正常な Scrape Target として設定する - Grafana の Prometheus Data Source を YAML で Provisioning し、
8080の API で確認する - Loki を
3100で起動し、Promtail で活動中のローカル System Log を追跡する - Loki Label API で Log Ingestion を確認し、Collector と Storage の役割を区別する
- Alertmanager を
9093で起動し、alertmanagers設定で Prometheus と接続する up == 0のInstanceDownを定義し、Node Exporter を止めて firing 状態を確認する
このコースの対象者
設定とサービス確認からローカル Observability Pipeline を組み立てたい DevOps・SRE 学習者向けです。
前提知識: Linux サービスとプロセス、YAML、HTTP API、ポート、Prometheus Scrape、Log Path、curl。評価型プロジェクトです。
学習環境: sudo、Prometheus、Node Exporter、Grafana、ダウンロード可能な Loki・Promtail・Alertmanager、活動中のローカル Log、HTTP アクセスを備えたブラウザー対応単一ノード Linux。クラウド不要です。
よくある質問
Grafana Dashboard や Panel を作りますか?
いいえ。Prometheus Data Source をコードで設定・検証するだけです。Dashboard、Panel、Variable、Grafana Alert Rule は対象外です。
複数サーバーから Log を集めますか?
いいえ。同じホストの /var/log/syslog または別の活動中 Log を Promtail がローカル Loki へ送ります。分散 Agent、Retention、Object Storage は設定しません。
Alertmanager はメール、Slack、Webhook を送りますか?
いいえ。Prometheus からローカル Alertmanager へルーティングし、API または UI で firing を確認します。外部 Receiver はありません。
障害はどのように実行・検証しますか?
Node Exporter を停止して up == 0 にします。Exporter の停止と Prometheus API の InstanceDown が firing であることを確認します。





