본문 바로가기
WIKI 기술 지식 베이스

통합 모니터

원문 보기 위키 갱신

Integration 모니터를 사용하면 설치된 integration이 실행 중인지 확인할 수 있어요. 더 세부적인 모니터링이 필요하다면 메트릭 모니터를 사용해 특정 통합 정보를 측정할 수도 있지요.

출처: 문서

본문

개요

설치된 integration이 실행 중인지 확인하려면 integration 모니터를 사용하세요. 더 세부적인 모니터링의 경우, 메트릭 모니터를 사용해 통합에 대한 특정 정보를 측정할 수 있어요.

모니터 생성

Datadog에서 integration monitor를 만들려면:

  1. 메인 네비게이션을 사용하세요: Monitors –> New Monitor –> Integration.
  2. 통합 항목을 검색하거나 목록 또는 이미지에서 선택하세요.

통합 메트릭

metric monitor 문서의 지침을 따라 integration metric 모니터를 만들 수 있어요. Integration metric 모니터 유형을 사용하면 Manage Monitors 페이지의 integration monitor type facet으로 모니터를 선택할 수 있어요.

참고: Integration 모니터를 구성하려면 통합 항목이 메트릭 또는 서비스 점검을 제출하는지 확인하세요.

점검 선택

통합에 대한 점검이 하나뿐이라면 선택이 필요 없어요. 그렇지 않으면 모니터용 점검을 선택하세요.

모니터 범위 선택

호스트 이름, 태그를 선택하거나 All Monitored Hosts를 선택해 모니터링할 범위를 선택하세요. 특정 호스트를 제외해야 한다면 두 번째 필드를 사용해 이름이나 태그를 나열하세요.

  • include 필드는 AND 로직을 사용해요. 나열된 모든 호스트 이름과 태그가 호스트에 존재해야 그 호스트가 포함돼요.
  • exclude 필드는 OR 로직을 사용해요. 나열된 호스트 이름이나 태그가 있는 호스트는 모두 제외돼요.

알림 조건 설정

이 섹션에서 Check Alert 또는 Cluster Alert 중 하나를 선택하세요.

{% tab title="Check Alert" %} Check alert는 각 점검 그룹별로 제출된 연속 상태를 추적하고 임계값과 비교해요.

Check alert를 설정하세요:

  1. 점검을 보고하는 각 <GROUP>에 대해 별도의 알림을 트리거해요.

점검 그룹화는 알려진 그룹화 목록에서 지정하거나 사용자가 지정해요. Integration 모니터의 경우 점검별 그룹화가 명시적으로 알려져 있어요. 예를 들어 Postgres 통합은 db, host, port로 태그됩니다.

  1. 선택한 연속 실패 이후에 알림을 트리거하세요: <NUMBER>

각 점검 실행은 OK, WARN, CRITICAL, 또는 UNKNOWN의 단일 상태를 제출해요. CRITICAL 상태를 가진 연속 실행이 몇 번이면 알림을 트리거할지 선택하세요. 예를 들어 데이터베이스에 연결이 실패하는 단발성 문제(blip)가 있을 수 있어요. 이 값을 > 1로 설정하면 blip는 무시되지만, 연속 실패가 두 번 이상인 문제는 알림을 트리거해요.

  1. 통합 점검이 UNKNOWN 상태를 보고하면, Do not notify 또는 Notify for Unknown status를 선택하세요.

활성화되면 UNKNOWN으로의 상태 전이가 알림을 트리거해요. monitor status page에서 UNKNOWN 상태 그룹의 상태 표시줄은 NODATA 회색을 사용해요. 모니터의 전체 상태는 OK로 유지돼요.

  1. 선택한 연속 성공 이후에 알림을 해제하세요: <NUMBER>

OK 상태를 가진 연속 실행이 몇 번이면 알림을 해제할지 선택하세요.

{% /tab %}

{% tab title="Cluster Alert" %} Cluster alert는 주어진 상태에 있는 점검의 백분율을 계산하고 임계값과 비교해요.

Cluster alert를 설정하세요:

  1. 태그에 따라 점검을 그룹화할지 여부를 결정하세요. Ungrouped는 모든 소스에 걸쳐 상태 백분율을 계산해요. Grouped는 그룹별로 상태 백분율을 계산해요.

  2. 알림 임계값의 백분율을 선택하세요.

각각 다른 태그 조합으로 태그된 각 점검은 클러스터에서 별개의 점검으로 간주돼요. 각 태그 조합의 마지막 점검 상태만 클러스터 백분율 계산에 고려돼요.

{% image source="https://docs.dd-static.net/images/monitors/monitor_types/process_check/cluster_check_thresholds.a0293f2a3b0165cff25f7207d86b781f.png?auto=format&fit=max&w=850 1x, https://docs.dd-static.net/images/monitors/monitor_types/process_check/cluster_check_thresholds.a0293f2a3b0165cff25f7207d86b781f.png?auto=format&fit=max&w=850&dpr=2 2x" alt="Cluster Check Thresholds" /%}

예를 들어 환경으로 그룹화된 cluster check 모니터는 어떤 환경에서든 점검의 70% 이상이 CRITICAL 상태를 제출하면 알림을 보내고, 어떤 환경에서든 점검의 50% 이상이 WARN 상태를 제출하면 경고할 수 있어요. {% /tab %}

고급 알림 조건

No data, Auto resolve, New group delay 옵션에 대한 정보는 Monitor configuration 문서를 참고하세요.

알림

Configure notifications and automations 섹션에 대한 자세한 지침은 Notifications 페이지를 참고하세요.

더 알아보기 (Learn more)

추가로 도움이 되는 문서, 링크, 아티클: