본문 바로가기
WIKI 기술 지식 베이스

프로세스 점검 모니터

원문 보기 위키 갱신

Process check 모니터는 Agent 점검 process.up이 생성하는 상태를 관찰해요. Agent 수준에서 일치하는 프로세스 수를 기반으로 점검 임계값을 구성할 수 있지요.

출처: 문서

본문

개요

Process check 모니터는 Agent 점검 process.up이 생성하는 상태를 관찰해요. Agent 수준에서 일치하는 프로세스 수를 기반으로 점검 임계값을 구성할 수 있어요.

모니터 생성

Datadog에서 process check monitor를 만들려면 메인 네비게이션을 사용하세요: Monitors –> New Monitor –> Process Check.

프로세스 선택

드롭다운 목록에서 모니터링할 프로세스를 선택하세요. 검색 기준을 입력해 목록을 필터링할 수 있어요.

모니터 범위 선택

호스트 이름, 태그를 선택하거나 All Monitored Hosts를 선택해 모니터링할 호스트를 선택하세요. 선택한 프로세스에 대한 상태를 보고하는 호스트 또는 태그만 표시돼요. 특정 호스트를 제외해야 한다면 두 번째 필드를 사용해 이름이나 태그를 나열하세요.

  • include 필드는 AND 로직을 사용해요. 나열된 모든 호스트 이름과 태그가 호스트에 존재해야 그 호스트가 포함돼요.
  • exclude 필드는 OR 로직을 사용해요. 나열된 이름이나 태그가 있는 호스트는 모두 제외돼요.

알림 조건 설정

{% tab title="Check Alert" %} Check alert는 각 점검 그룹별로 제출된 연속 상태를 추적하고 임계값과 비교해요. Process check 모니터의 경우 그룹은 정적이에요: host와 process.

Check alert를 설정하세요:

  1. 선택한 연속 실패 이후에 알림을 트리거하세요: <NUMBER>

각 점검 실행은 OK, WARN, 또는 CRITICAL의 단일 상태를 제출해요. WARN 및 CRITICAL 상태를 가진 연속 실행이 몇 번이면 알림을 트리거할지 선택하세요. 예를 들어 프로세스에 연결이 실패하는 단발성 문제(blip)가 있을 수 있어요. 이 값을 > 1로 설정하면 blip는 무시되지만, 연속 실패가 두 번 이상인 문제는 알림을 트리거해요.

  1. 선택한 연속 성공 이후에 알림을 해제하세요: <NUMBER>

OK 상태를 가진 연속 실행이 몇 번이면 알림을 해제할지 선택하세요.

{% /tab %}

{% tab title="Cluster Alert" %} Cluster alert는 주어진 상태에 있는 프로세스 점검의 백분율을 계산하고 임계값과 비교해요.

Cluster alert를 설정하세요:

  1. 태그에 따라 프로세스 점검을 그룹화할지 여부를 결정하세요. Ungrouped는 모든 소스에 걸쳐 상태 백분율을 계산해요. Grouped는 그룹별로 상태 백분율을 계산해요.

  2. alert 및 warn 임계값의 백분율을 선택하세요. 하나의 설정(alert 또는 warn)만 필요해요.

각각 다른 태그 조합으로 태그된 각 점검은 클러스터에서 별개의 점검으로 간주돼요. 각 태그 조합의 마지막 점검 상태만 클러스터 백분율 계산에 고려돼요.

{% image source="https://docs.dd-static.net/images/monitors/monitor_types/process_check/cluster_check_thresholds.a0293f2a3b0165cff25f7207d86b781f.png?auto=format&fit=max&w=850 1x, https://docs.dd-static.net/images/monitors/monitor_types/process_check/cluster_check_thresholds.a0293f2a3b0165cff25f7207d86b781f.png?auto=format&fit=max&w=850&dpr=2 2x" alt="Cluster Check Thresholds" /%}

예를 들어 환경으로 그룹화된 cluster check 모니터는 어떤 환경에서든 점검의 70% 이상이 CRITICAL 상태를 제출하면 알림을 보내고, 어떤 환경에서든 점검의 70% 이상이 WARN 상태를 제출하면 경고할 수 있어요. {% /tab %}

고급 알림 조건

No data, Auto resolve, New group delay 옵션에 대한 정보는 Monitor configuration 문서를 참고하세요.

알림

Configure notifications and automations 섹션에 대한 자세한 지침은 Notifications 페이지를 참고하세요.

더 알아보기 (Learn more)

추가로 도움이 되는 문서, 링크, 아티클: