속도 제한
속도 제한 (Rate limits)
속도 제한은 주어진 시간 안에 Gemini API에 보낼 수 있는 요청 수를 규제해요. 공정한 사용을 유지하고 남용을 방지하며 모든 사용자를 위한 시스템 성능을 지키는 데 도움을 줘요.
출처: 원문
본문
속도 제한은 주어진 시간 안에 Gemini API에 보낼 수 있는 요청 수를 규제해요. 이 한도는 공정한 사용을 유지하고 남용을 방지하며 모든 사용자를 위한 시스템 성능을 유지하는 데 도움을 줘요.
속도 제한의 동작 방식
속도 제한은 보통 세 가지 차원으로 측정돼요:
- 분당 요청 수 (RPM)
- 분당 토큰 수 (입력) (TPM)
- 일일 요청 수 (RPD)
각 한도에 대해 사용량을 평가하며, 어느 하나라도 초과하면 속도 제한 오류가 발생해요. 예를 들어 RPM 한도가 20이라면 1분 안에 21개 요청을 하면 TPM이나 다른 한도를 초과하지 않았더라도 오류가 나요.
속도 제한은 API 키가 아니라 프로젝트 단위로 적용돼요. 일일 요청 수(RPD) 할당량은 태평양 시간 자정에 초기화돼요.
한도는 사용 중인 특정 모델에 따라 달라지며, 일부 한도는 특정 모델에만 적용돼요. 예를 들어 분당 이미지 수(IPM)는 이미지를 생성할 수 있는 모델(Nano Banana)에만 계산되지만, 개념적으로는 TPM과 비슷해요. 다른 모델에는 일일 토큰 한도(TPD)가 있을 수 있어요.
속도 제한은 실험·프리뷰 모델에서 더 제한적이에요.
지출 기반 속도 제한
분당 요청 수(RPM)와 분당 토큰 수(TPM) 한도 외에도, Gemini API는 예상치 못한 비용을 방지하기 위해 지출 기반 속도 제한을 적용해요. 이 한도가 계정에 적용되는지는 결제 이력과 사용 티어에 따라 달라져요.
아래 표는 각 사용 티어의 지출 기반 속도 제한을 보여줘요. 이 한도는 10분 단위의 이동 시간 창으로 평가돼요.
| 사용 티어 | 지출 속도 제한 (10분당) |
|---|---|
| Free | N/A |
| Tier 1 | $10 |
| Tier 2 | $50 |
| Tier 3 | $200 |
지출 기반 속도 제한에 걸리면 API가 429 RESOURCE_EXHAUSTED 오류를 반환해요. 해결하려면:
- 잠시 기다렸다가 재시도하세요.
- 더 작은 컨텍스트 창이나 더 짧은 출력을 사용하는 등 비싼 요청의 비율을 줄이세요.
- 정상 사용 중에 이 한도에 계속 걸린다면 속도 제한 증가를 요청하세요.
사용 티어
속도 제한은 프로젝트의 사용 티어에 연결돼요. API 사용량과 지출이 늘어나면 더 높은 티어로 자동 업그레이드되면서 속도 제한도 늘어나요.
Tier 2와 Tier 3의 자격은 프로젝트에 연결된 결제 계정의 Google Cloud 서비스(Gemini API 포함, 그 외 포함)에 대한 총 누적 지출을 기준으로 해요.
| 사용 티어 | 자격 | 결제 티어 상한 |
|---|---|---|
| Free | 활성 프로젝트 또는 무료 체험 | N/A |
| Tier 1 | 활성 결제 계정 설정·연결 | $250 |
| Tier 2 | $100 결제 + 첫 결제 성공 후 3일 | $2,000 |
| Tier 3 | $1,000 결제 + 첫 결제 성공 후 30일 | $20,000 - $100,000+ |
명시된 자격 기준을 충족하면 일반적으로 승인되지만, 드물게 검토 과정에서 식별된 다른 요인으로 업그레이드 요청이 거부될 수도 있어요.
이 시스템은 모든 사용자를 위해 Gemini API 플랫폼의 보안과 무결성을 유지하는 데 도움을 줘요.
Gemini API 속도 제한
속도 제한은 사용 티어 등 다양한 요인에 따라 달라지며 Google AI Studio에서 확인할 수 있어요. 티어와 계정 상태가 시간에 따라 변하면 속도 제한도 자동으로 업데이트돼요.
명시된 속도 제한은 보장되지 않으며 실제 용량은 달라질 수 있어요.
Priority 추론 속도 제한
Priority 소비는 소비가 전체 대화형 트래픽 속도 제한에 계산되더라도 자체 속도 제한을 가져요. 기본 속도 제한은 각 모델과 티어에 대해 표준 속도 제한의 0.3배예요.
Batch API 속도 제한
Batch API 요청은 비배치 API 호출과 별도로 자체 속도 제한이 적용돼요.
- 동시 배치 요청: 100
- 입력 파일 크기 제한: 2GB
- 파일 저장 제한: 20GB
- 모델별 큐 등록 토큰: Batch enqueued tokens 표는 특정 모델에 대해 모든 활성 배치 작업에서 큐에 등록할 수 있는 최대 토큰 수를 나열해요.
Tier 1
| 모델 | Batch enqueued tokens |
|---|---|
| 텍스트 출력 모델 | |
| Gemini 3.1 Pro Preview | 5,000,000 |
| Gemini 3.5 Flash-Lite | 10,000,000 |
| Gemini 3.8 Flash | 3,000,000 |
| Gemini 3.7 Flash | 3,000,000 |
| Gemini 3.1 Flash Lite | 10,000,000 |
| Gemini 3.1 Flash Lite Preview | 10,000,000 |
| Gemini 3.6 Flash | 3,000,000 |
| Gemini 3.5 Flash | 3,000,000 |
| Gemini 2.5 Pro | 5,000,000 |
| Gemini 2.5 Pro TTS | 25,000 |
| Gemini 2.5 Flash | 3,000,000 |
| Gemini 2.5 Flash Preview | 3,000,000 |
| Gemini 2.5 Flash Image Preview | 3,000,000 |
| Gemini 2.5 Flash TTS | 100,000 |
| Gemini 2.5 Flash Lite | 10,000,000 |
| Gemini 2.5 Flash Lite Preview | 10,000,000 |
| Gemini 2.0 Flash | 10,000,000 |
| Gemini 2.0 Flash Image | 3,000,000 |
| Gemini 2.0 Flash Lite | 10,000,000 |
| 멀티모달 생성 모델 | |
| Gemini 3.1 Flash Image Preview 🍌 | 1,000,000 |
| Gemini 3.1 Flash Lite Image 🍌 | 2,000,000 |
| Gemini 3 Pro Image Preview 🍌 | 2,000,000 |
| 임베딩 모델 | |
| Gemini Embedding | 500,000 |
Tier 2
| 모델 | Batch enqueued tokens |
|---|---|
| 텍스트 출력 모델 | |
| Gemini 3.1 Pro Preview | 500,000,000 |
| Gemini 3.5 Flash-Lite | 500,000,000 |
| Gemini 3.1 Flash Lite | 500,000,000 |
| Gemini 3.1 Flash Lite Preview | 500,000,000 |
| Gemini 3.8 Flash | 400,000,000 |
| Gemini 3.7 Flash | 400,000,000 |
| Gemini 3.6 Flash | 400,000,000 |
| Gemini 3.5 Flash | 400,000,000 |
| Gemini 2.5 Pro | 500,000,000 |
| Gemini 2.5 Pro TTS | 100,000 |
| Gemini 2.5 Flash | 400,000,000 |
| Gemini 2.5 Flash Preview | 400,000,000 |
| Gemini 2.5 Flash Image Preview | 400,000,000 |
| Gemini 2.5 Flash TTS | 100,000 |
| Gemini 2.5 Flash Lite | 500,000,000 |
| Gemini 2.5 Flash Lite Preview | 500,000,000 |
| Gemini 2.0 Flash | 1,000,000,000 |
| Gemini 2.0 Flash Image | 400,000,000 |
| Gemini 2.0 Flash Lite | 1,000,000,000 |
| 멀티모달 생성 모델 | |
| Gemini 3.1 Flash Image Preview 🍌 | 250,000,000 |
| Gemini 3.1 Flash Lite Image 🍌 | 270,000,000 |
| Gemini 3 Pro Image Preview 🍌 | 270,000,000 |
| 임베딩 모델 | |
| Gemini Embedding | 5,000,000 |
Tier 3
| 모델 | Batch enqueued tokens |
|---|---|
| 텍스트 출력 모델 | |
| Gemini 3.1 Pro Preview | 1,000,000,000 |
| Gemini 3.5 Flash-Lite | 1,000,000,000 |
| Gemini 3.1 Flash Lite | 1,000,000,000 |
| Gemini 3.1 Flash Lite Preview | 1,000,000,000 |
| Gemini 3.8 Flash | 1,000,000,000 |
| Gemini 3.7 Flash | 1,000,000,000 |
| Gemini 3.6 Flash | 1,000,000,000 |
| Gemini 3.5 Flash | 1,000,000,000 |
| Gemini 2.5 Pro | 1,000,000,000 |
| Gemini 2.5 Pro TTS | 1,000,000 |
| Gemini 2.5 Flash | 1,000,000,000 |
| Gemini 2.5 Flash Preview | 1,000,000,000 |
| Gemini 2.5 Flash Image Preview | 1,000,000,000 |
| Gemini 2.5 Flash TTS | 4,000,000 |
| Gemini 2.5 Flash Lite | 1,000,000,000 |
| Gemini 2.5 Flash Lite Preview | 1,000,000,000 |
| Gemini 2.0 Flash | 5,000,000,000 |
| Gemini 2.0 Flash Image | 1,000,000,000 |
| Gemini 2.0 Flash Lite | 5,000,000,000 |
| 멀티모달 생성 모델 | |
| Gemini 3.1 Flash Image Preview 🍌 | 750,000,000 |
| Gemini 3.1 Flash Lite Image 🍌 | 1,000,000,000 |
| Gemini 3 Pro Image Preview 🍌 | 1,000,000,000 |
| 임베딩 모델 | |
| Gemini Embedding | 10,000,000 |
다음 티어로 업그레이드하는 방법
Free 티어에서 유료 티어로 전환하려면 먼저 AI Studio에서 결제를 설정해야 해요.
프로젝트가 명시된 기준을 충족하면 자동으로 다음 티어로 업그레이드돼요. Free에서 Tier 1으로의 업그레이드는 보통 즉시 적용되고, 이후 티어 업그레이드는 10분 이내에 적용돼요. AI Studio의 프로젝트 페이지에서 티어를 확인할 수 있어요.
속도 제한 증가 요청
각 모델 변형에는 관련 속도 제한(분당 요청 수, RPM)이 있어요. 자세한 내용은 AI Studio Rate Limit 페이지를 참고하세요.
속도 제한 증가를 보장할 수는 없지만, 최선을 다해 요청을 검토할게요.