Prometheus は時系列メトリクスを検索可能にし、そのデータに対してルールを評価します。この実践コースでは、導入と収集から PromQL、アラートルール、Alertmanager のルーティングまで、小さなローカル監視経路を構築します。
Prometheus 自身と Node Exporter を収集し、メモリと CPU を照会し、InstanceDown を読み込み、テストアラートを送ります。最後のチャレンジでは二つの対象と HighCpuLoad ルールを設定し、API で確認します。
学習内容
- Prometheus をダウンロード、設定、起動、検証する
- Node Exporter を実行し、ポート 9100 の endpoint を確認する
- 静的 scrape job を追加し、API で対象状態を調べる
- PromQL でメモリ、CPU rate、計算した使用率を照会する
- アラートルールファイルを作成して読み込む
- Prometheus と Alertmanager を接続しローカル webhook を設定する
- テストアラートを送信して状態を確認する
- 独自の CPU 負荷ルールを作成して検証する
このコースの対象者
この中級コースは、Prometheus による収集、照会、アラートの初歩を実践したい Linux 管理者、DevOps 学習者、運用エンジニア向けです。
前提知識: Linux シェル、YAML、バックグラウンドプロセス、curl、ポート、CPU とメモリの基礎。Prometheus 経験は不要です。
学習環境: Prometheus、Node Exporter、Alertmanager、ローカル webhook を動かす単一 Linux マシンです。永続的な本番サービスではなくラボプロセスとして起動します。
よくある質問
複数のリモートサーバーを監視しますか?
いいえ。Prometheus 自身と localhost の Node Exporter 一つを収集します。サービスディスカバリ、Federation、分散ストレージは扱いません。
PromQL はどこまで学びますか?
メモリ指標、CPU counter の rate()、単純な使用率計算です。集約、join、recording rule、histogram は扱いません。
外部サービスへ通知しますか?
いいえ。Alertmanager はローカル webhook へ送ります。チャレンジは HighCpuLoad の読み込みだけを確認し、持続負荷や外部通知は検証しません。





