オブザーバビリティ・スタック

ブラックボックス化されたシステムを、観測可能なインフラストラクチャへと変革します。メトリクス収集のために Prometheus、可視化のために Grafana、ログ集約のために Loki をデプロイし、システムパフォーマンスに関する深い洞察を得ます。

DevOps EngineerDevOpsLinux

💡 このチュートリアルは英語版からAIによって翻訳されています。原文を確認するには、 ここをクリックしてください

はじめに

Observability Pipeline はホストの活動を Metric、検索可能な Log、対応可能な Alert 状態へ変換します。このチャレンジ形式のプロジェクトでは、Prometheus、Grafana、Loki、Promtail、Node Exporter、Alertmanager を使ってローカルに構築します。

設定ファイルと実際の API で各 Component を接続し、Host Metric の Scrape、Grafana Data Source の Provisioning、活動中の System Log の Loki 送信、Node Exporter 停止による InstanceDown 発火を行います。単一ホストでデータフローを端から端まで検証できます。

学習内容

  • Node Exporter を 9100、Prometheus を 9090 で動かし、正常な Scrape Target として設定する
  • Grafana の Prometheus Data Source を YAML で Provisioning し、8080 の API で確認する
  • Loki を 3100 で起動し、Promtail で活動中のローカル System Log を追跡する
  • Loki Label API で Log Ingestion を確認し、Collector と Storage の役割を区別する
  • Alertmanager を 9093 で起動し、alertmanagers 設定で Prometheus と接続する
  • up == 0 の InstanceDown を定義し、Node Exporter を止めて firing 状態を確認する

このコースの対象者

設定とサービス確認からローカル Observability Pipeline を組み立てたい DevOps・SRE 学習者向けです。

前提知識: Linux サービスとプロセス、YAML、HTTP API、ポート、Prometheus Scrape、Log Path、curl。評価型プロジェクトです。

学習環境: sudo、Prometheus、Node Exporter、Grafana、ダウンロード可能な Loki・Promtail・Alertmanager、活動中のローカル Log、HTTP アクセスを備えたブラウザー対応単一ノード Linux。クラウド不要です。

よくある質問

Grafana Dashboard や Panel を作りますか?

いいえ。Prometheus Data Source をコードで設定・検証するだけです。Dashboard、Panel、Variable、Grafana Alert Rule は対象外です。

複数サーバーから Log を集めますか?

いいえ。同じホストの /var/log/syslog または別の活動中 Log を Promtail がローカル Loki へ送ります。分散 Agent、Retention、Object Storage は設定しません。

Alertmanager はメール、Slack、Webhook を送りますか?

いいえ。Prometheus からローカル Alertmanager へルーティングし、API または UI で firing を確認します。外部 Receiver はありません。

障害はどのように実行・検証しますか?

Node Exporter を停止して up == 0 にします。Exporter の停止と Prometheus API の InstanceDown が firing であることを確認します。

講師

labby
Labby
Labby is the LabEx teacher.