Aprende a explicar solicitudes fallidas, medir la salud de una aplicación, observar alarmas e identificar cambios en los recursos. Usarás CloudWatch Logs, métricas de CloudWatch y CloudTrail para investigar pequeños incidentes operativos.
Cinco laboratorios guiados presentan las señales antes de un reto independiente de reparación de alarmas. Los componentes de aplicación proporcionados permiten centrarse en la observación y el diagnóstico.
Qué aprenderás
- Encontrar una solicitud fallida en los registros mediante su identificador
- Publicar recuentos de solicitudes y errores y la latencia medida del controlador
- Seleccionar dimensiones de métricas que separen aplicaciones
- Observar la activación y recuperación de una alarma a partir de resultados de solicitudes reales
- Relacionar una acción de administración con su autor, recurso y momento
- Combinar registros y métricas para diagnosticar un incidente
- Reparar una alarma que vigila la aplicación equivocada
A quién va dirigido este curso
Este curso está dirigido a principiantes de AWS, desarrolladores y futuros profesionales de operaciones que quieren una introducción práctica a la observación de aplicaciones y las pruebas de auditoría.
Requisitos previos: Empieza con Get Started with AWS on LabEx en AWS Foundations for Beginners. Para el laboratorio de auditoría, aprende antes la identidad del llamador y Parameter Store. Cada laboratorio indica sus requisitos de logs, métricas y alarmas.
Entorno de aprendizaje: Todas las actividades se realizan en un entorno Linux de LabEx proporcionado y accesible desde el navegador. Usa Terminal para ejecutar comandos de AWS CLI y AWS View, junto a Terminal, para consultar el mismo estado de los recursos y las aplicaciones. Las herramientas y la conexión están preparadas; no necesitas una cuenta personal de AWS ni claves de acceso. Cada laboratorio empieza de forma independiente en una VM nueva.
Preguntas frecuentes
¿En qué se diferencian registros, métricas, alarmas e historial de auditoría?
Los registros describen eventos; las métricas resumen cantidades medidas a lo largo del tiempo; las alarmas evalúan una métrica seleccionada según una política. El historial de administración registra el autor, la acción, el recurso y el momento de una operación del plano de control. Combina las señales para explicar un incidente.
¿Una alarma OK demuestra que la aplicación está sana?
No. El tratamiento de datos ausentes puede producir OK. Comprueba las solicitudes reales y las dimensiones de métricas previstas. Sum ayuda con los recuentos; Average describe la latencia medida del controlador, no una latencia por percentiles. Los fallos anteriores permanecen en los totales de la ventana, así que usa un identificador de solicitud nuevo para confirmar la recuperación.
¿Los periodos cortos de alarma son una recomendación para producción?
No. Los periodos de alta resolución de 10 segundos permiten observar las transiciones en estos ejercicios. La retención, la resolución, los periodos y el tratamiento de datos ausentes afectan al comportamiento y al coste. Consulta los conceptos de CloudWatch y la evaluación de alarmas.
¿La limpieza borra todas las pruebas históricas?
No. Eliminar un recurso no borra su registro de auditoría, y no existe una API para eliminar individualmente los puntos de métricas existentes. Detén la publicación, elimina exactamente los recursos que te pertenecen, confirma el inventario y después retira las credenciales.
¿Necesito todo el curso antes de Lambda?
El primer laboratorio de registros de solicitudes proporciona la base de registros necesaria para Lambda. La entrega SNS, el rastreo X-Ray y una plataforma completa de observabilidad de producción quedan fuera de este curso.





