Lerne, fehlgeschlagene Anfragen zu erklären, den Anwendungszustand zu messen, Alarme zu beobachten und Ressourcenänderungen zu identifizieren. Mit CloudWatch Logs, CloudWatch-Metriken und CloudTrail untersuchst du kleine Betriebsvorfälle.
Fünf angeleitete Labs führen die Signale ein, bevor eine eigenständige Aufgabe zur Alarmreparatur folgt. Bereitgestellte Anwendungskomponenten ermöglichen dir, dich auf Beobachtung und Diagnose zu konzentrieren.
Was du lernen wirst
- Eine fehlgeschlagene Anfrage anhand ihrer Anfrage-ID in Logs finden
- Anfrage- und Fehleranzahlen sowie gemessene Handler-Latenz veröffentlichen
- Metrikdimensionen auswählen, die Anwendungen unterscheiden
- Auslösung und Erholung eines Alarms anhand tatsächlicher Anfrageergebnisse beobachten
- Eine Verwaltungsaktion ihrem Akteur, ihrer Ressource und ihrem Zeitpunkt zuordnen
- Logs und Metriken kombinieren, um einen Vorfall zu diagnostizieren
- Einen Alarm reparieren, der die falsche Anwendung überwacht
Für wen dieser Kurs geeignet ist
Dieser Kurs richtet sich an AWS-Anfänger, Entwickler und angehende Betriebsspezialisten, die einen praktischen Einstieg in Anwendungsbeobachtung und Audit-Nachweise wünschen.
Voraussetzungen: Beginne mit Get Started with AWS on LabEx in AWS Foundations for Beginners. Für das Audit-Lab brauchst du die Grundlagen zu Aufruferidentität und Parameter Store. Die Labs nennen ihre jeweiligen Voraussetzungen zu Logs, Metriken und Alarmen.
Lernumgebung: Alle Aktivitäten finden in einer bereitgestellten Linux-Umgebung von LabEx im Browser statt. Verwende Terminal für AWS-CLI-Befehle und AWS View neben Terminal, um denselben Ressourcen- und Anwendungszustand zu prüfen. Werkzeuge und Verbindung sind vorbereitet; du benötigst weder ein persönliches AWS-Konto noch Zugriffsschlüssel. Jedes Lab beginnt unabhängig in einer neuen VM.
Häufig gestellte Fragen
Was unterscheidet Logs, Metriken, Alarme und Audit-Verlauf?
Logs beschreiben Ereignisse; Metriken fassen gemessene Größen im Zeitverlauf zusammen; Alarme bewerten eine ausgewählte Metrik anhand einer Richtlinie. Der Verwaltungsverlauf erfasst Akteur, Aktion, Ressource und Zeitpunkt einer Operation auf der Steuerungsebene. Kombiniere diese Signale, um einen Vorfall zu erklären.
Beweist ein Alarm im Zustand OK, dass die Anwendung gesund ist?
Nein. Die Behandlung fehlender Daten kann OK ergeben. Prüfe tatsächliche Anfragen und die vorgesehenen Metrikdimensionen. Sum eignet sich für Anzahlen; Average beschreibt die gemessene Handler-Latenz, keine Perzentillatenz. Frühere Fehler bleiben in den Summen des Zeitfensters enthalten. Verwende deshalb eine neue Anfrage-ID, um die Erholung zu bestätigen.
Sind die kurzen Alarmperioden eine Empfehlung für die Produktion?
Nein. Hochauflösende Perioden von 10 Sekunden machen Übergänge in diesen Übungen beobachtbar. Aufbewahrung, Auflösung, Perioden und die Behandlung fehlender Daten beeinflussen Verhalten und Kosten. Siehe CloudWatch-Konzepte und Alarmauswertung.
Löscht die Bereinigung alle historischen Nachweise?
Nein. Das Löschen einer Ressource entfernt ihren Audit-Eintrag nicht, und für bestehende Metrikdatenpunkte gibt es keine API zum einzelnen Löschen. Stoppe die Veröffentlichung, entferne genau die eigenen Ressourcen, bestätige das Inventar und entferne anschließend die Zugangsdaten.
Benötige ich vor Lambda den gesamten Kurs?
Das erste Lab zu Anfrage-Logs vermittelt die Protokollierungsgrundlagen für Lambda. SNS-Zustellung, X-Ray-Tracing und eine vollständige Observability-Plattform für die Produktion liegen außerhalb dieses Kurses.





