Pila de Observabilidad

Transforme sistemas de caja negra en infraestructura observable. Desplegará Prometheus para métricas, Grafana para visualización y Loki para agregación de logs, obteniendo información profunda sobre el rendimiento del sistema.

DevOps EngineerDevOpsLinux

💡 Este tutorial está traducido por IA desde la versión en inglés. Para ver la versión original, puedes hacer clic aquí

Introducción

Una canalización de observabilidad convierte la actividad del host en métricas, logs consultables y estados de alerta accionables. Este proyecto basado en desafíos construye esa canalización localmente con Prometheus, Grafana, Loki, Promtail, Node Exporter y Alertmanager.

Conectarás componentes mediante configuración y APIs reales: recopilarás métricas, aprovisionarás una fuente Grafana, enviarás un log activo a Loki y dispararás InstanceDown deteniendo Node Exporter. El resultado es una pila de un host cuyo flujo puedes verificar de extremo a extremo.

Lo que aprenderás

  • Ejecutar Node Exporter en 9100 y configurar Prometheus en 9090 para recopilarlo como target saludable
  • Aprovisionar una fuente Prometheus de Grafana en YAML y verificarla mediante la API en 8080
  • Iniciar Loki en 3100 y configurar Promtail para seguir un log local activo
  • Confirmar la ingesta con APIs de etiquetas Loki y distinguir responsabilidades de recopilación y almacenamiento
  • Ejecutar Alertmanager en 9093 y conectarlo a Prometheus mediante alertmanagers
  • Definir InstanceDown para up == 0, detener Node Exporter y verificar el estado firing

A quién va dirigido este curso

Este proyecto está dirigido a estudiantes de DevOps y SRE preparados para ensamblar una canalización local mediante configuración y comprobaciones.

Requisitos previos: Familiaridad con servicios y procesos Linux, YAML, APIs HTTP, puertos, scraping Prometheus, rutas de logs y curl; proyecto de evaluación.

Entorno de aprendizaje: Un host Linux de un nodo en navegador con sudo, Prometheus, Node Exporter, Grafana, binarios descargables de Loki, Promtail y Alertmanager, un log activo y HTTP local; no requiere nube.

Preguntas frecuentes

¿Construiré dashboards y paneles de Grafana?

No. Solo aprovisionas y verificas una fuente Prometheus como código. Dashboards, paneles, variables y alertas Grafana quedan fuera.

¿Se recopilan logs de varios servidores?

No. Promtail sigue /var/log/syslog u otro log activo del mismo host y lo envía al Loki local. No se configuran agentes distribuidos, retención ni almacenamiento de objetos.

¿Alertmanager envía correo, Slack o webhooks?

No. Prometheus enruta la alerta al Alertmanager local y verificas el estado firing por API o UI. No hay receptores externos.

¿Cómo se ejecuta y verifica el fallo?

Detienes Node Exporter para producir up == 0. La validación confirma que está detenido y que la API de alertas contiene InstanceDown como firing.

Profesor

labby
Labby
Labby is the LabEx teacher.