初心者のための AWS 監視と監査

失敗したリクエストを説明し、アプリケーションの健全性を測定し、アラームを観察してリソースの変更を特定します。CloudWatch Logs、CloudWatch メトリクス、CloudTrail を使って、小さな運用インシデントを調査します。

AWS

💡 このチュートリアルは英語版からAIによって翻訳されています。原文を確認するには、 ここをクリックしてください

はじめに

失敗したリクエストを説明し、アプリケーションの健全性を測定し、アラームを観察してリソースの変更を特定します。CloudWatch Logs、CloudWatch メトリクス、CloudTrail を使って、小さな運用インシデントを調査します。

5 つのガイド付きラボで各シグナルを学び、その後、アラームを修復する自主課題に取り組みます。アプリケーションの補助コードは提供されるため、観察と診断に集中できます。

学習する内容

  • リクエスト ID を使ってログ内の失敗したリクエストを見つける
  • リクエスト数、エラー数、測定したハンドラーのレイテンシーを公開する
  • アプリケーションを区別するメトリクスのディメンションを選ぶ
  • 実際のリクエスト結果によるアラームの発生と回復を観察する
  • 管理操作を実行者、リソース、時刻に結びつける
  • ログとメトリクスを組み合わせてインシデントを診断する
  • 誤ったアプリケーションを監視しているアラームを修復する

このコースの対象者

アプリケーションの観察と監査の証拠について実践的な入門を求める AWS 初学者、開発者、運用を学ぶ方が対象です。

前提知識: AWS Foundations for Beginners の Get Started with AWS on LabEx から始めてください。監査ラボでは、基礎コースの呼び出し元の識別と Parameter Store の知識が必要です。各ラボでログ、メトリクス、アラームの前提知識を示します。

学習環境: すべての演習は、ブラウザーから利用できる LabEx の Linux 環境で行います。AWS CLI のコマンドには Terminal を使い、その隣の AWS View で同じリソースとアプリケーションの状態を確認します。ツールと接続は準備済みで、個人の AWS アカウントやアクセスキーは不要です。各ラボは新しい VM で独立して開始します。

よくある質問

ログ、メトリクス、アラーム、監査履歴はどう違いますか?

ログはイベントを記述し、メトリクスは時間に沿った測定値を集計し、アラームは選択したメトリクスをポリシーに基づいて評価します。管理履歴は、コントロールプレーン操作の実行者、操作、リソース、時刻を記録します。これらを組み合わせてインシデントを説明します。

アラームが OK ならアプリケーションは正常ですか?

必ずしもそうではありません。欠損データの扱いによって OK になることがあります。実際のリクエストと目的のディメンションを確認してください。Sum は件数に適し、Average は測定したハンドラーの平均レイテンシーであり、パーセンタイルではありません。時間窓の合計には以前の失敗が残るため、新しいリクエスト ID で回復を確認します。

短いアラーム周期は本番環境向けの推奨設定ですか?

いいえ。高解像度の 10 秒周期は、演習中に状態遷移を観察しやすくするためのものです。保持期間、解像度、周期、欠損データの扱いは動作と費用に影響します。CloudWatch の概念とアラームの評価を参照してください。

クリーンアップすると過去の証拠もすべて消えますか?

いいえ。リソースの削除は監査記録を消しません。また、既存のメトリクスデータポイントを個別に削除する API はありません。公開を停止し、自分のリソースを正確に削除して一覧を確認してから、認証情報を取り除きます。

Lambda の前にコース全体を終える必要がありますか?

最初のリクエストログのラボが、Lambda に必要なログの基礎を提供します。SNS 配信、X-Ray トレース、完全な本番向け可観測性基盤は範囲外です。

講師

labby
Labby
Labby is the LabEx teacher.