벡터 버킷
벡터 버킷 (Vector buckets)
벡터 버킷이 무엇이고 어떤 특징을 갖는지 설명하는 개요 문서예요. 벡터 버킷은 벡터 데이터를 저장하고 질의하도록 특별히 설계된 Amazon S3 버킷의 한 종류예요.
출처: Vector buckets
본문
벡터 버킷은 벡터 데이터를 저장하고 질의하도록 특별히 설계된 Amazon S3 버킷의 한 종류예요. 벡터 버킷은 전용 API를 사용해 벡터 데이터를 효율적으로 관리하고, 벡터 임베딩의 업로드·저장·질의 비용을 줄여줘요. 벡터 버킷은 벡터 데이터를 인덱스로 조직화하는 기반을 제공해서, Amazon S3의 가용성, 내구성, 확장성, 비용 효율성의 이점을 누리면서 대규모 데이터셋에서 유사도 검색을 수행할 수 있게 해요.
벡터 버킷은 서브초 검색 시간을 갖춘 장기 벡터 저장에 최적화되어 있어요. 벡터 데이터에 대해 유사도 질의를 수행할 수 있고, 선택적으로 메타데이터를 붙여 날짜, 카테고리, 사용자 선호도 같은 특정 조건으로 질의를 필터링할 수 있어요.
각 벡터 버킷에는 고유한 Amazon Resource Name(ARN)과 리소스 정책이 연결돼 있어요. 벡터 버킷의 ARN 형식은 다음과 같아요.
arn:aws:s3vectors:
Region
:
OwnerAccountID
:bucket/
bucket-name
벡터 버킷 안에서 벡터 인덱스를 만들어 데이터를 저장하고 질의해요. 각 벡터 버킷은 특정 AWS 리전에 존재하고, 벡터 버킷 안에는 여러 벡터 인덱스를 만들 수 있어요. 벡터 버킷은 IAM 아이덴티티 기반 정책과 버킷 정책을 포함한 보안·접근 제어 메커니즘을 지원해요. 버킷 정책을 사용해 벡터 버킷 안의 특정 인덱스에 대한 접근을 허용하거나 제한할 수 있어요.
벡터 버킷의 주요 특징은 다음과 같아요.
- 벡터 저장과 유사도 검색 작업에 특화되어 만들어졌어요.
- 강력한 일관성(strongly consistent) 쓰기 덕분에 벡터 데이터에 즉시 접근할 수 있어요.
- 데이터셋이 커질수록 최상의 가격·성능을 내도록 벡터 데이터를 자동 최적화해요.
버킷당 벡터 인덱스 제한과 기타 제한 사항은 Limitations and restrictions을 참고해 주세요.