통합 스토리지 Autopilot

통합 스토리지 Autopilot

Vault 통합 스토리지(Raft)의 Autopilot은 Raft 클러스터의 노드 자동 관리 기능입니다. Autopilot은 죽은(dead) 노드의 자동 제거, 노드 상태(health) 점검, 클러스터 확장·복구 자동화 등을 처리해 통합 스토리지 클러스터의 운영을 단순화합니다.

출처: 문서

본문

Autopilot이란

Raft 기반 통합 스토리지는 노드가 추가·제거될 때, 죽은 노드를 계속 따라가며 상태를 관리하고, 장애가 발생한 노드를 수동으로 정리해야 한다면 운영 부담이 큽니다. Autopilot은 이런 작업을 자동화합니다.

주요 기능

  • 비정상 노드 감지·제거 — 일정 시간 동안 리더와 통신하지 못한(비정상) 노드를 자동으로 감지하고 클러스터에서 제거합니다.
  • 상태 점검 — 각 노드의 건강 상태(healthy, unhealthy)와 역할(leader, follower)을 지속적으로 점검합니다.
  • 자동 복구 — 클러스터가 정상 상태를 유지하도록 복구를 자동화합니다.

설정

Autopilot 관련 설정은 Vault 통합 스토리지 설정에서 구성할 수 있습니다. 예를 들어 죽은 노드 제거 임계값(dead server cleanup)을 설정할 수 있습니다.

storage "raft" {
  path    = "/vault/data"
  node_id = "node1"
}

raft_autopilot "default" {
  dead_server_last_contact_threshold = "24h"
  min_quorum                         = 3
}

상태 확인 명령

클러스터 상태와 Autopilot 구성을 조회합니다.

$ vault operator raft autopilot state
$ vault operator raft autopilot get-config
$ vault operator raft autopilot set-config -dead-server-last-contact-threshold=24h

주의사항

  • Autopilot이 비정상 노드를 자동 제거하도록 구성하려면 최소 쿼럼(quorum) 개념을 이해하고, 노드 수를 신중히 배치해야 합니다.
  • 자동 제거 임계값을 너무 짧게 두면 일시적 네트워크 이상에도 노드가 제거될 수 있습니다.
  • 표준(community) 에디션과 Enterprise에서 제공하는 Autopilot 동작이 다를 수 있습니다.

참고: Autopilot의 정확한 설정 옵션과 기본값은 버전에 따라 다를 수 있으니 공식 문서를 확인하세요.

더 알아보기 (Learn more)