Una canalización de observabilidad convierte la actividad del host en métricas, logs consultables y estados de alerta accionables. Este proyecto basado en desafíos construye esa canalización localmente con Prometheus, Grafana, Loki, Promtail, Node Exporter y Alertmanager.
Conectarás componentes mediante configuración y APIs reales: recopilarás métricas, aprovisionarás una fuente Grafana, enviarás un log activo a Loki y dispararás InstanceDown deteniendo Node Exporter. El resultado es una pila de un host cuyo flujo puedes verificar de extremo a extremo.
Lo que aprenderás
- Ejecutar Node Exporter en
9100y configurar Prometheus en9090para recopilarlo como target saludable - Aprovisionar una fuente Prometheus de Grafana en YAML y verificarla mediante la API en
8080 - Iniciar Loki en
3100y configurar Promtail para seguir un log local activo - Confirmar la ingesta con APIs de etiquetas Loki y distinguir responsabilidades de recopilación y almacenamiento
- Ejecutar Alertmanager en
9093y conectarlo a Prometheus mediantealertmanagers - Definir
InstanceDownparaup == 0, detener Node Exporter y verificar el estado firing
A quién va dirigido este curso
Este proyecto está dirigido a estudiantes de DevOps y SRE preparados para ensamblar una canalización local mediante configuración y comprobaciones.
Requisitos previos: Familiaridad con servicios y procesos Linux, YAML, APIs HTTP, puertos, scraping Prometheus, rutas de logs y curl; proyecto de evaluación.
Entorno de aprendizaje: Un host Linux de un nodo en navegador con sudo, Prometheus, Node Exporter, Grafana, binarios descargables de Loki, Promtail y Alertmanager, un log activo y HTTP local; no requiere nube.
Preguntas frecuentes
¿Construiré dashboards y paneles de Grafana?
No. Solo aprovisionas y verificas una fuente Prometheus como código. Dashboards, paneles, variables y alertas Grafana quedan fuera.
¿Se recopilan logs de varios servidores?
No. Promtail sigue /var/log/syslog u otro log activo del mismo host y lo envía al Loki local. No se configuran agentes distribuidos, retención ni almacenamiento de objetos.
¿Alertmanager envía correo, Slack o webhooks?
No. Prometheus enruta la alerta al Alertmanager local y verificas el estado firing por API o UI. No hay receptores externos.
¿Cómo se ejecuta y verifica el fallo?
Detienes Node Exporter para producir up == 0. La validación confirma que está detenido y que la API de alertas contiene InstanceDown como firing.





