Qdrant Cloud 인퍼런스
Qdrant Cloud 인퍼런스 (cloud-inference)
인퍼런스(Inference)는 머신러닝 모델을 이용해 텍스트, 이미지, 기타 데이터 유형으로부터 벡터 임베딩을 생성하는 과정이에요. 이 임베딩 인퍼런스 인프라를 직접 구축하고 유지하는 건 꽤 번거롭죠. Qdrant Managed Cloud에서는 클라우드에서 직접 인퍼런스를 사용할 수 있어요. Qdrant Cloud에 호스팅된 임베딩 모델을 쓰거나, 외부에 호스팅된 모델을 사용할 수 있어요.
인퍼런스는 EU 지역의 Qdrant 클러스터에서는 EU 내에서 실행되고, 다른 모든 지역의 클러스터에서는 미국(US)에서 실행돼요. 무료 모델은 US 지역에만 호스팅돼요.
인퍼런스 활성화/비활성화 (Enabling/Disabling Inference)
인퍼런스는 2025년 7월 7일 이후 생성된 모든 새 클러스터에서 기본적으로 활성화돼요. 기존 클러스터에서는 Qdrant Cloud Console의 Cluster Detail 페이지에 있는 Inference 탭에서 활성화할 수 있어요. 인퍼런스를 활성화하면 새 구성을 적용하기 위해 클러스터가 재시작돼요.
인퍼런스 사용하기 (Using Inference)
인퍼런스는 포인트를 업서트(upsert)할 때와 데이터베이스를 쿼리할 때 Qdrant SDK와 REST 또는 gRPC API를 통해 쉽게 사용할 수 있어요. 자세한 내용은 Inference 문서를 참고하세요.
Cloud Inference
Qdrant Managed Cloud의 클러스터는 Qdrant Cloud에 호스팅된 임베딩 모델에 접근할 수 있어요. 지원되는 모델 목록은 Qdrant Cloud Console의 Cluster Detail 페이지 Inference 탭에서 확인할 수 있어요. 목록에는 텍스트용(밀집 dense 벡터와 희소 sparse 벡터를 모두 생성) 모델과 이미지용 멀티모달 모델이 포함돼요.
무료 임베딩 모델 (Free Embedding Models)
몇몇 임베딩 모델은 Qdrant Cloud Inference와 함께 무료로 사용할 수 있어요. Qdrant Cloud 무료 티어(free tier) 클러스터와 조합해서도 쓸 수 있죠. 무료 모델은 Cluster Detail 페이지의 Inference 탭에서 "Cost: Free" 라벨로 식별할 수 있어요.
요금 (Billing)
유료 임베딩 모델의 사용량은 모델이 처리한 토큰 수를 기준으로 청구돼요. 비용은 토큰 1,000,000개당 계산되며, 가격은 모델마다 달라요. 정확한 가격은 Cluster Detail 페이지의 Inference 탭에서 확인할 수 있고, 각 모델의 현재 사용량도 그곳에서 볼 수 있어요.
외부 모델 사용하기 (Use External Models)
Qdrant Cloud는 다음 외부 임베딩 제공업체에 대한 프록시 역할을 할 수 있어요.
- OpenAI
- Cohere
- Jina AI
- OpenRouter
이렇게 하면 Qdrant API를 통해 이 제공업체들이 제공하는 어떤 임베딩 모델이든 접근할 수 있어요.
요금 (Billing)
외부 제공업체의 임베딩 모델을 사용하려면 그 제공업체의 API 키가 필요해요. 요금은 API 키 사용량 기준으로 외부 제공업체가 직접 관리해요. 가격 정보는 각 임베딩 모델 제공업체의 웹사이트를 참고하세요.
더 알아보기 (Learn more)
- Cloud Inference — 클라우드 임베딩 모델 상세
- Inference API — 인퍼런스 API 사용법
- External Inference Providers — 외부 제공업체 연동