Amazon ECS 모니터링

Amazon ECS 모니터링

모니터링은 Amazon ECS와 AWS 솔루션의 신뢰성, 가용성, 성능을 유지하는 중요한 부분이에요. AWS 솔루션의 모든 부분에서 모니터링 데이터를 수집해야, 다중 지점 장애(multi-point failure)가 발생했을 때 더 쉽게 디버깅할 수 있습니다.

출처: 문서

본문

Amazon ECS 모니터링을 시작하기 전에 다음 질문에 대한 답을 담은 모니터링 계획을 만드세요:

  • 모니터링 목표는 무엇인가요?
  • 어떤 리소스를 모니터링할 건가요?
  • 이 리소스를 얼마나 자주 모니터링할 건가요?
  • 어떤 모니터링 도구를 사용할 건가요?
  • 누가 모니터링 작업을 수행할 건가요?
  • 문제가 발생하면 누구에게 알려야 하나요?

제공되는 지표는 클러스터에 있는 태스크와 서비스의 컴퓨팅 옵션에 따라 달라져요. 서비스에 Fargate를 사용한다면 서비스를 모니터링하는 데 도움이 되도록 CPU와 메모리 사용률 지표가 제공됩니다. EC2의 경우 기본 인프라를 구성하는 EC2 인스턴스를 소유하고 있으므로 직접 모니터링해야 해요. 추가적인 CPU와 메모리 예약·사용률 지표가 클러스터, 서비스, 태스크 수준에서 제공됩니다.

다음 단계는 여러 시점과 다양한 부하 조건에서 성능을 측정해 환경의 정상적인 Amazon ECS 성능에 대한 기준(baseline)을 설정하는 거예요. Amazon ECS를 모니터링하면서 과거 모니터링 데이터를 저장해 현재 성능 데이터와 비교하고, 정상 성능 패턴과 성능 이상을 식별하며, 문제를 해결할 방법을 고안하세요.

기준을 설정하려면 최소한 다음 항목을 모니터링해야 해요:

  • Amazon ECS 클러스터의 CPU 및 메모리 예약·사용률 지표
  • Amazon ECS 서비스의 CPU 및 메모리 사용률 지표

자세한 내용은 Amazon ECS 지표 보기(Viewing Amazon ECS metrics)를 참고하세요.