자주 묻는 질문

자주 묻는 질문 (FAQ)

Prometheus에 대해 자주 묻는 질문과 답변을 모은 문서예요. Prometheus가 어떤 문제를 해결하는지, 언제 풀/푸시를 쓰는지, 데이터 보존, 고가용성, 확장성, 쿼리 성능, 그리고 일반적인 오해 등 넓은 범위를 다룹니다.

첫 프로젝트 도입이나 운영 중 막히는 지점에서 이 FAQ를 먼저 확인하면 빠르게 답을 얻을 수 있어요. 아래는 문서에서 다루는 주요 질문들을 정리한 요약입니다.

출처: 문서

본문

FAQ 문서는 다음을 포함한 여러 질문에 답합니다(주의: 아래는 주요 질문의 요약이며, 원문은 더 상세하고 상태가 최신이 아닐 수 있습니다).

모니터링과 Prometheus

  • Prometheus는 무엇인가? — 오픈소스 시스템 모니터링·알림 도구. 메트릭을 수집·저장하고 PromQL로 조회하며, 알림 규칙에 따라 알림을 발생시킵니다.

풀 과 푸시

  • 풀 방식을 쓰는 이유는? — 대상을 능동적으로 스크레이프하면 추가가 쉽고, 대상이 죽었는지 실시간으로 확인할 수 있습니다. 네트워크 경계·짧은 배치 작업은 Pushgateway로 푸시합니다.

데이터 보존과 저장

  • 데이터 보존 기간은?--storage.tsdb.retention.* 플래그로 설정합니다. 로컬 디스크에 저장되며, 장기 보존은 원격 스토리지(remote storage)를 사용합니다.
  • 용량·성능은? — 압축과 블록 저장(TSDB)으로 단일 서버에서 많은 시계열을 처리합니다. 샘플률·시계열 수·쿼리 복잡도가 성능에 영향을 줍니다.

고가용성과 확장

  • 고가용성은 어떻게? — alertmanager는 클러스터링을 지원하며, Prometheus 자체는 여러 복제본을 두고 같은 데이터를 수집해 페일오버에 대비합니다. 데이터 정합성보다 가용성("fail open") 중심.
  • 수평 확장은? — Prometheus는 기본적으로 단일 서버지만, 샤딩이 아닌 페더레이션(federation)과 원격 기록으로 확장·집계합니다.

쿼리와 성능

  • 쿼리가 느리면? — 낮은 해상도로 시계열을 줄이거나, 기록 규칙(recording rules)으로 사전 집계하거나, 필요한 라벨만 유지하는 등 최적화를 합니다.
  • up 메트릭 — 대상이 스크레이프되었는지(1) 아닌지(0)를 나타내는 내장 메트릭.

일반적인 오해

  • FAQ는 Prometheus가 "모든 것을 즉시 해결해주는" 도구가 아니라, 메트릭 기반 모니터링에 특화된 도구임을 강조합니다. 로그 수집이나 트레이싱은 별도 도구(예: Loki, Jaeger)와 함께 씁니다.

참고: 문서 내용은 버전에 따라 갱신됩니다. 항상 최신 FAQ 원문을 함께 확인하세요.

더 알아보기 (Learn more)