Prometheus는 시계열 메트릭을 조회 가능한 상태로 만들고 해당 데이터에 규칙을 평가합니다. 이 실습 과정은 설치와 수집부터 PromQL, 알림 규칙, Alertmanager 라우팅까지 작은 로컬 모니터링 경로를 구축합니다.
Prometheus와 Node Exporter 메트릭을 수집하고 메모리와 CPU를 조회하며 InstanceDown을 로드하고 시험 알림을 보냅니다. 마지막 챌린지는 두 대상과 HighCpuLoad 규칙을 구성해 API로 확인합니다.
학습 내용
- Prometheus 다운로드, 구성, 시작, 검증하기
- Node Exporter를 실행하고 9100 포트 확인하기
- 정적 scrape job을 추가하고 API로 대상 상태 검사하기
- PromQL로 메모리, CPU rate, 계산된 비율 조회하기
- 알림 규칙 파일을 만들고 로드하기
- Alertmanager를 연결하고 로컬 webhook 구성하기
- 시험 알림을 제출하고 상태 확인하기
- 사용자 CPU 부하 규칙을 만들고 검증하기
추천 대상
이 중급 과정은 Prometheus 메트릭 수집, 조회, 알림을 처음 실습하려는 Linux 관리자, DevOps 학습자, 운영 엔지니어를 위한 과정입니다.
선수 지식: Linux 셸, YAML, 백그라운드 프로세스, curl, 포트, CPU와 메모리 기초. Prometheus 경험은 필요하지 않습니다.
학습 환경: Prometheus, Node Exporter, Alertmanager, 로컬 webhook을 실행하는 단일 Linux 머신입니다. 구성 요소는 영구 운영 서비스가 아닌 실습 프로세스로 실행합니다.
자주 묻는 질문
여러 원격 서버를 모니터링하나요?
아닙니다. Prometheus 자체와 localhost의 Node Exporter 하나를 수집합니다. 서비스 디스커버리, federation, 분산 스토리지는 다루지 않습니다.
PromQL은 얼마나 깊게 다루나요?
메모리 메트릭, CPU counter의 rate(), 단순 사용률 계산을 다룹니다. 집계, join, recording rule, histogram은 포함하지 않습니다.
외부 서비스로 알림을 보내나요?
아닙니다. Alertmanager는 로컬 webhook으로 라우팅합니다. 챌린지는 HighCpuLoad 로드만 확인하며 지속 부하나 외부 전달은 검증하지 않습니다.





