Stack de Observabilidade

Transforme sistemas de caixa-preta em infraestrutura observável. Você implantará o Prometheus para métricas, o Grafana para visualização e o Loki para agregação de logs, a fim de obter insights profundos sobre o desempenho do sistema.

DevOps EngineerDevOpsLinux

💡 Este tutorial foi traduzido do inglês com assistência de IA. Para ver o original, você pode mudar para a versão em inglês

Introdução

Uma pipeline de observabilidade transforma atividade do host em métricas, logs pesquisáveis e estados de alerta acionáveis. Neste projeto, você a constrói localmente com Prometheus, Grafana, Loki, Promtail, Node Exporter e Alertmanager.

Você conectará componentes por configuração e APIs: coletará métricas, provisionará fonte Grafana, enviará log ativo ao Loki e disparará InstanceDown parando Node Exporter. O fluxo de nó único pode ser verificado de ponta a ponta.

O que você aprenderá

  • Executar Node Exporter em 9100 e configurar Prometheus em 9090 para coletá-lo como target saudável
  • Provisionar fonte Prometheus do Grafana em YAML e verificar pela API em 8080
  • Iniciar Loki em 3100 e configurar Promtail para seguir log local ativo
  • Confirmar ingestão pelas APIs de labels Loki e distinguir coleta de armazenamento
  • Executar Alertmanager em 9093 e ligá-lo ao Prometheus por alertmanagers
  • Definir InstanceDown para up == 0, parar Node Exporter e verificar estado firing

Para quem é este curso

Este projeto é indicado para estudantes de DevOps e SRE prontos para montar pipeline local por configuração e verificações.

Pré-requisitos: Serviços e processos Linux, YAML, APIs HTTP, portas, scrape Prometheus, caminhos de logs e curl; projeto de avaliação.

Ambiente de aprendizagem: Host Linux de nó único no navegador com sudo, Prometheus, Node Exporter, Grafana, binários Loki, Promtail e Alertmanager, log ativo e HTTP local; não exige nuvem.

Perguntas frequentes

Vou criar dashboards e painéis Grafana?

Não. Apenas provisiona e verifica fonte Prometheus como código. Dashboards, painéis, variáveis e alertas Grafana ficam fora.

Logs são coletados de vários servidores?

Não. Promtail segue /var/log/syslog ou outro log ativo do mesmo host e envia ao Loki local. Agentes distribuídos, retenção e object storage não são configurados.

Alertmanager envia email, Slack ou webhooks?

Não. Prometheus encaminha ao Alertmanager local e você verifica firing por API ou UI. Não há receptores externos.

Como a falha é executada e validada?

Você para Node Exporter para obter up == 0. A validação confirma sua parada e InstanceDown como firing na API Prometheus.

Professor

labby
Labby
Labby is the LabEx teacher.