사용량 메트릭 (Usage Metrics)
APM의 수집 및 인덱싱 볼륨을 설정하고 모니터링하는 데 사용할 수 있는 메트릭들에 대해 알아봐요.
출처: 문서
본문
개요 (Overview)
다음 인앱 구성 페이지에서 APM의 수집·인덱싱 볼륨을 설정할 수 있어요:
- Ingestion Control 페이지로 수집된 스팬 볼륨을 제어하세요.
- Retention Filters 페이지로 인덱싱된 스팬 수를 제어하세요.
두 페이지 모두 사용량 메트릭(usage metrics) 을 기반으로 해요.
계정에서 사용 가능한 메트릭은 다음과 같아요:
datadog.estimated_usage.apm.ingested_bytes(청구 대상 차원)datadog.estimated_usage.apm.ingested_spansdatadog.estimated_usage.apm.ingested_tracesdatadog.estimated_usage.apm.indexed_spans(청구 대상 차원)
이 메트릭들을 대시보드와 몬니터에서 활용해 사용량을 시각화하고 제어하세요. 이 메트릭으로 만들어진 바로 사용 가능한(out-of-the-box) 대시보드가 두 개 있어요. 이 대시보드는 APM 사용량과 수집·인덱싱된 스팬 볼륨을 모니터링하는 데 도움이 돼요.
Datadog APM 플랜에는 인덱싱·수집된 스팬이 포함돼 있어요. 자세한 내용은 가격 페이지나 몇 가지 가격 예시 시나리오를 참고하세요.
수집된 스팬 볼륨 (Ingested spans volume)
수집된 스팬 사용량과 관련된 메트릭은 다음과 같아요:
datadog.estimated_usage.apm.ingested_bytesdatadog.estimated_usage.apm.ingested_spansdatadog.estimated_usage.apm.ingested_traces
사용량을 제어하려면 datadog.estimated_usage.apm.ingested_bytes를 사용하세요. 수집은 스팬 수나 트레이스 수가 아니라 볼륨으로 측정돼요. 이 메트릭은 env, service, sampling_service로 태깅돼요. 이 태그들은 수집 볼륨에 기여하는 환경과 서비스를 파악하는 데 도움이 돼요. sampling_service 차원에 대한 자세한 내용은 샘플링 서비스가 무엇인가요?를 참고하세요.
이 메트릭은 어떤 수집 메커니즘이 Datadog로 스팬을 보내는 데 책임이 있는지 반영하는 ingestion_reason으로도 태깅돼요. 이 메커니즘은 Datadog Agent의 SDK에 내장돼 있어요. 이 차원에 대한 자세한 내용은 Ingestion Reasons 대시보드를 참고하세요.
datadog.estimated_usage.apm.ingested_traces 메트릭은 초당 샘플링된 요청 수를 측정하며 헤드 기반 샘플링으로 샘플링된 트레이스만 카운트해요. 이 메트릭도 env와 service로 태깅되어 어떤 서비스가 가장 많은 트레이스를 시작하는지 파악할 수 있어요.
샘플링 서비스란 무엇인가요? (What is the sampling service?)
datadog.estimated_usage.apm.ingested_bytes의 sampling_service 차원은 수집된 바이트를 스팬을 방출한 서비스가 아닌 샘플링 결정을 내린 서비스에 할당해요.
sampling_service로 메트릭을 그룹핑해 전체 수집 볼륨에 가장 크게 기여하는 서비스를 파악하세요. 예를 들어 서비스 A가 트레이스를 시작하고 서비스 B, C를 호출하기 전에 헤드 기반 샘플링 결정을 내린다면 서비스 A, B, C의 모든 바이트가 sampling_service:A로 귀속돼요.
인덱싱된 스팬 (Indexed spans)
datadog.estimated_usage.apm.indexed_spans 메트릭으로 태그 기반 보존 필터로 인덱싱된 스팬 수를 제어하세요.
이 메트릭은 env와 service로 태깅되어 인덱싱 사용량에 기여하는 환경과 서비스를 파악할 수 있어요.
APM Traces Estimated Usage 대시보드 (APM Traces Estimated Usage dashboard)
APM Traces Usage 대시보드에는 상위 수준 KPI와 추가 사용량 정보를 표시하는 여러 위젯 그룹이 들어 있어요.
이 대시보드에서 다음 정보를 찾을 수 있어요:
- 전역 사용량 메트릭
- 호스트, Fargate, AWS Lambda를 포함한 APM 활성화 인프라
service,env,ingestion_reason별로 구분된 수집 볼륨service,env별로 구분된 인덱싱 볼륨
APM Ingestion Reasons 대시보드 (APM Ingestion Reasons dashboard)
APM Ingestion Reasons 대시보드는 수집 볼륨의 각 출처에 대한 인사이트를 제공해요. 각 수집 사용량 메트릭은 ingestion_reason 차원으로 태깅되어 어떤 구성 옵션(Datadog Agent 구성 또는 SDK 구성)과 제품(RUM, Synthetic Testing 등)이 가장 많은 APM 데이터를 생성하는지 확인할 수 있어요.
각 수집 이유에 대해 전반적 볼륨에 가장 크게 기여하는 환경과 서비스를 알 수 있어요.