아카이브 검색 옵션 이해

아카이브 검색 옵션 이해

Amazon S3에는 S3 Glacier Instant Retrieval, S3 Glacier Flexible Retrieval, S3 Glacier Deep Archive라는 세 가지 아카이브 스토리지 클래스가 있어요. S3 Glacier Instant Retrieval 스토리지 클래스에 저장된 객체는 GET으로 바로 사용할 수 있지만, S3 Glacier Flexible Retrieval이나 S3 Glacier Deep Archive 스토리지 클래스에 저장된 데이터에 접근하려면 먼저 RestoreObject REST API로 데이터를 검색해야 해요. 수천만 개의 객체나 수백 테라바이트의 데이터로 구성된 데이터 세트를 복원하는 것은 일반적인 복원 시간보다 오래 걸릴 수 있고 특별한 고려가 필요해요. 자세한 내용은 "대규모 데이터 세트 복원"을 참고하세요.

원하는 검색 속도에 따라 아카이브된 객체를 복원할 때 Expedited, Standard, Bulk라는 세 가지 검색 접근 옵션 중에서 고를 수 있어요.

  • Expedited retrieval – S3 Glacier Flexible Retrieval 스토리지 클래스나 S3 Intelligent-Tiering Archive Access 계층에 저장된 데이터를 빠르게 접근해요. 최대 수백 개의 객체에 대한 가끔 있는 긴급 요청에 이 옵션을 쓸 수 있어요. 250MB 미만의 객체는 보통 1~5분 안에 사용할 수 있고, 250MB 이상의 객체는 보통 초당 최대 300MB의 검색 처리량으로 검색돼요. 또한 Expedited 검색을 위해 프로비저닝된 용량(Provisioned Capacity)을 구매할 수도 있어요. 프로비저닝된 용량은 필요할 때 Expedited 검색 용량을 확보하는 데 도움을 줘요. 자세한 내용은 "프로비저닝된 용량"을 참고하세요.

    참고: Expedited 검색은 프리미엄 기능이며 Expedited 요청·검색 요율로 청구돼요. Amazon S3 요금에 대한 자세한 내용은 Amazon S3 Pricing을 참고하세요.

  • Standard retrieval – 몇 시간 안에 데이터에 접근해요. Standard는 검색 옵션을 지정하지 않은 요청의 기본 옵션이에요. Standard 검색은 S3 Glacier Flexible Retrieval 스토리지 클래스나 S3 Intelligent-Tiering Archive Access 계층의 경우 보통 3~5시간 안에 끝나요. S3 Glacier Deep Archive 스토리지 클래스나 S3 Intelligent-Tiering Deep Archive Access 계층의 경우 보통 12시간 안에 끝나요. S3 Intelligent-Tiering 스토리지 클래스에 저장된 객체의 Standard 검색은 무료예요.

    참고: S3 Glacier Flexible Retrieval 스토리지 클래스나 S3 Intelligent-Tiering Archive Access 계층에 저장된 객체의 경우, S3 Batch Operations 복원 작업으로 시작한 Standard 검색은 보통 몇 분 안에 시작되고 하루 최대 12페타바이트의 처리량으로 35시간 안에 완료돼요. S3 Glacier Deep Archive 스토리지 클래스나 S3 Intelligent-Tiering Deep Archive Access 계층의 객체는 Batch Operations로 시작한 Standard 검색이 보통 9시간 안에 시작·완료되며 하루 최대 1~2페타바이트의 처리량을 제공해요.

  • Bulk retrieval – S3 Glacier 스토리지 클래스에서 가장 저렴한 검색 옵션으로 데이터에 접근해요. Bulk 검색으로 대량의 데이터를 저렴하게 검색할 수 있어요. S3 Glacier Flexible Retrieval 스토리지 클래스나 S3 Intelligent-Tiering Archive Access 계층의 객체는 Bulk 검색이 보통 5~12시간 안에 끝나요. S3 Glacier Deep Archive 스토리지 클래스나 S3 Intelligent-Tiering Deep Archive Access 계층의 객체는 보통 48시간 안에 끝나요. S3 Glacier Flexible Retrieval이나 S3 Intelligent-Tiering 스토리지 클래스에 저장된 객체의 Bulk 검색은 무료예요.

다음 표는 아카이브 검색 옵션을 요약한 것이에요. 요금 정보는 Amazon S3 pricing을 참고하세요.

스토리지 클래스 또는 계층 Expedited Standard (Batch Operations 사용) Standard (Batch Operations 미사용) Bulk
S3 Glacier Flexible Retrieval 또는 S3 Intelligent-Tiering Archive Access 1~5분 몇 분~5시간 3~5시간 5~12시간
S3 Glacier Deep Archive 또는 S3 Intelligent-Tiering Deep Archive Access 사용 불가 9~12시간 12시간 이내 48시간 이내

Expedited, Standard, Bulk 검색을 하려면 RestoreObject REST API 작업 요청의 Tier 요청 요소를 원하는 옵션으로 설정하거나, AWS Command Line Interface(AWS CLI)나 AWS SDK의 해당 옵션을 설정하세요. 프로비저닝된 용량을 구매했다면 모든 Expedited 검색이 자동으로 프로비저닝된 용량을 통해 처리돼요.

출처: 문서

본문

대규모 데이터 세트 복원

수천만 개의 객체나 수백 테라바이트의 데이터로 구성된 데이터 세트를 복원하는 것은 검색 제한 때문에 어떤 검색 계층에서도 일반적인 복원 시간보다 오래 걸릴 수 있어요.

S3 Glacier Flexible Retrieval, S3 Glacier Deep Archive, S3 Intelligent-Tiering 스토리지 클래스에 저장된 객체에 대한 복원 요청을 시작하면 AWS 계정에 검색 요청 할당량이 적용돼요. S3 Glacier는 초당 1,000건의 트랜잭션 비율로 복원 요청을 지원해요. 이 비율을 초과하면 그 외에는 유효한 요청도 스로틀링되거나 거부되며 Amazon S3가 ThrottlingException 오류를 반환해요. S3 Batch Operations로 단일 요청으로 많은 객체를 검색하면 계정에서 사용 가능한 복원 요청 비율을 완전히 활용할 수 있어요. 자세한 내용은 "Batch Operations로 객체 작업 일괄 수행"을 참고하세요.

복원 요청을 시작한 후 S3 Glacier는 고객 계정당 하루 최대 1~2페타바이트의 처리량으로 대규모 데이터 세트 복원을 지원해요. 어떤 검색 옵션에서든 5테라바이트보다 큰 객체는 초당 최대 300MB의 검색 처리량으로 복원하는 데 더 오래 걸려요. 예를 들어 50테라바이트 S3 Glacier Flexible Retrieval 객체는 완료하는 데 최대 48시간이 걸릴 수 있어요. 복원 한도를 늘려야 한다면 AWS Support에 문의할 수 있어요.

프로비저닝된 용량

프로비저닝된 용량은 필요할 때 S3 Glacier Flexible Retrieval의 Expedited 검색 용량을 확보하는 데 도움을 줘요. 용량 1개 단위는 5분마다 최소 3건의 Expedited 검색을 수행할 수 있게 해 주고, 초당 최대 300MB의 검색 처리량을 제공해요.

프로비저닝된 용량이 없으면 수요가 높은 기간에는 Expedited 검색이 수락되지 않을 수 있어요. 더 많은 데이터에 예측 가능하고 빠른 접근이 필요하다면 S3 Glacier Instant Retrieval 스토리지 클래스를 고려해 보세요.

프로비저닝된 용량 단위는 AWS 계정에 할당돼요. 따라서 Expedited 데이터 검색 요청자가 버킷 소유자가 아니라 프로비저닝된 용량 단위를 구매해야 해요.

Amazon S3 콘솔, Amazon Glacier 콘솔, Purchase Provisioned Capacity REST API 작업, AWS SDK 또는 AWS CLI로 프로비저닝된 용량을 구매할 수 있어요. 프로비저닝된 용량 요금 정보는 Amazon S3 pricing을 참고하세요.

더 알아보기 (Learn more)