요금 (Pricing)
요금 (Pricing)
이 문서는 Anthropic 모델과 기능의 요금 구조를 정리한 내용이에요. 모든 가격은 USD 기준입니다.
가장 최신 요금 정보는 claude.com/pricing 에서 확인할 수 있어요.
모델 요금
아래 표는 모든 Claude 모델의 요금을 보여줍니다.
| 모델 | 기본 입력 토큰 | 5분 캐시 쓰기 | 1시간 캐시 쓰기 | 캐시 히트 및 리프레시 | 출력 토큰 |
|---|---|---|---|---|---|
| Claude Fable 5.1 | $10 / MTok | $12.50 / MTok | $20 / MTok | $0.25 / MTok¹ | $50 / MTok |
| Claude Mythos 5.1 (제한적 제공) | $10 / MTok | $12.50 / MTok | $20 / MTok | $0.25 / MTok¹ | $50 / MTok |
| Claude Fable 5 | $10 / MTok | $12.50 / MTok | $20 / MTok | $1 / MTok | $50 / MTok |
| Claude Mythos 5 (제한적 제공) | $10 / MTok | $12.50 / MTok | $20 / MTok | $1 / MTok | $50 / MTok |
| Claude Opus 5 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.8 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.7 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.6 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.5 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.1 (단종, Bedrock과 Google Cloud 제외) | $15 / MTok | $18.75 / MTok | $30 / MTok | $1.50 / MTok | $75 / MTok |
| Claude Opus 4 (단종, Google Cloud 제외) | $15 / MTok | $18.75 / MTok | $30 / MTok | $1.50 / MTok | $75 / MTok |
| Claude Sonnet 5 | $2 / MTok | $2.50 / MTok | $4 / MTok | $0.20 / MTok | $10 / MTok |
| Claude Sonnet 4.6 | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Sonnet 4.5 | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Sonnet 4 (단종, Bedrock과 Google Cloud 제외) | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Haiku 4.5 | $1 / MTok | $1.25 / MTok | $2 / MTok | $0.10 / MTok | $5 / MTok |
| Claude Haiku 3.5 (단종, Bedrock과 Google Cloud 제외) | $0.80 / MTok | $1 / MTok | $1.60 / MTok | $0.08 / MTok | $4 / MTok |
*¹ Claude Fable 5.1과 Claude Mythos 5.1의 캐시 히트 및 리프레시는 기본 입력 가격의 0.025배로 책정됩니다. 다른 모든 모델은 표준 0.1배 승수를 사용합니다.*
Claude Sonnet 5 가격 안내 Claude Sonnet 5의 백만 토큰당 입력/출력 가격 $2/$10은 출시 당시 2026년 8월 31일까지 적용되는 도입 가격(introductory pricing)으로 발표되었는데, 이제 표준 가격이 되었어요. 2026년 9월 1일부터 $3/$15로 인상될 예정이었던 일정은 더 이상 진행되지 않습니다.
표 읽는 법 MTok = Million tokens(백만 토큰)을 뜻해요. "기본 입력 토큰" 열은 표준 입력 가격이고, "5분 캐시 쓰기", "1시간 캐시 쓰기", "캐시 히트 및 리프레시" 열은 프롬프트 캐싱과 관련된 내용이며, "출력 토큰"은 출력 가격을 보여줍니다. 캐시 열과 가격 승수에 대한 설명은 프롬프트 캐싱 요금에서 확인할 수 있어요.
토크나이저 안내 Claude 4.7 이후 모델과 Claude Mythos Preview는 더 새로운 토크나이저를 사용해서 다양한 작업에서 성능이 개선되었어요. 이 토크나이저는 같은 텍스트에 대해 대략 30% 더 많은 토큰을 만들어냅니다. 증가 폭은 콘텐츠와 워크로드 형태에 따라 달라져요. Claude Sonnet 4.6과 이전 모델은 이전 토크나이저를 사용합니다.
AWS의 Claude Platform 요금은 Claude Platform on AWS 요금을 참고하세요.
클라우드 플랫폼 요금
이 섹션은 파트너가 운영하는 클라우드 플랫폼을 다루며, 클라우드 제공자가 청구서를 발행합니다. Anthropic이 운영하고 마켓플레이스를 통해 청구되는 클라우드 플랫폼은 Claude Platform on AWS 요금과 Microsoft Foundry의 Claude 요금을 참고하세요.
Claude 모델은 Amazon Bedrock과 Google Cloud에서 사용할 수 있어요. 공식 요금은 다음에서 확인하세요.
Claude 4.5 모델 이상의 리전 및 멀티리전 엔드포인트 요금
Claude Sonnet 4.5, Haiku 4.5, Opus 4.5부터 적용됩니다.
- Bedrock은 전역 엔드포인트(최대 가용성을 위한 동적 라우팅)와 리전 엔드포인트(특정 지리적 리전을 통한 보장된 데이터 라우팅) 두 가지 엔드포인트 유형을 제공해요.
- Google Cloud는 전역 엔드포인트, 멀티리전 엔드포인트(지리적 영역 내 동적 라우팅), 리전 엔드포인트 세 가지 유형을 제공합니다.
리전 및 멀티리전 엔드포인트는 전역 엔드포인트보다 10%의 프리미엄이 붙어요. Claude API(퍼스트파티)는 기본적으로 전역입니다. 퍼스트파티 데이터 레지던시 옵션과 가격은 데이터 레지던시 요금을 참고하세요.
적용 범위: 이 요금 구조는 Claude Sonnet 4.5, Haiku 4.5, Opus 4.5 및 이후의 모든 모델에 적용됩니다. 이전 모델(Claude Opus 4.1 및 이전 릴리스)은 기존 요금을 유지해요.
구현 세부 사항과 코드 예시는 다음을 참고하세요.
- Opus 4.7, Haiku 4.5 및 이후 모델용 Amazon Bedrock 전역 vs 리전 엔드포인트, 또는 Bedrock의 다른 모든 모델용 레거시 통합
- Google Cloud 전역, 멀티리전, 리전 엔드포인트
Claude Platform on AWS 요금
Claude Platform on AWS는 AWS Marketplace를 통해 Claude Consumption Unit(CCU)으로 청구됩니다. Anthropic은 토큰 사용량을 표준 모델별·기능별 요율로 USD로 산정하고, 협상된 할인을 적용한 뒤 결과를 CCU당 $0.01로 환산하여 매시간 AWS Marketplace에 보고해요. AWS 청구서에는 하나의 CCU 라인 항목으로 표시됩니다.
| 개념 | 세부 사항 |
|---|---|
| 청구 단위 | Claude Consumption Unit (CCU) |
| CCU 가격 | CCU당 $0.01 (고정; 할인은 토큰-CCU 환산 시 적용되며 CCU 가격에는 적용되지 않음) |
| 환산 | 표준 모델별·기능별 요율(Claude API 요금과 동일)로 USD로 산정한 뒤, CCU당 $0.01로 환산 |
| 청구 주기 | AWS Marketplace에 시간 단위로 측정; 월별 인보이스 |
| 결제 모델 | 선불 크레딧 없이 사후 결제(postpaid)만 가능 |
Claude Consumption Unit 고객이 특정 마켓플레이스 플랫폼(예: Claude Platform on AWS)을 통해 서비스에 접근하면 사용량이 MTok 단위가 아니라 Claude Consumption Unit(CCU)으로 청구됩니다. CCU는 마켓플레이스 플랫폼 청구에만 사용되는 측정 단위예요. CCU 100개는 할인 적용 후 claude.com/pricing#api의 적용 가격으로 계산된 서비스 비용 $1.00 USD에 해당합니다.
추론 지리(Inference geography)
Claude 4.6 이후 모델에서 inference_geo: "us"를 사용하면 1.1배 가격 승수가 적용됩니다. inference_geo: "global"(기본값)은 표준 가격을 사용해요. 자세한 내용은 데이터 레지던시를 참고하세요.
프라이빗 오퍼
AWS 콘솔의 Claude Platform on AWS 서비스 페이지에서 가입하면 AWS 콘솔이 계정과 연결된 프라이빗 오퍼를 찾아 AWS Marketplace에서 수락할 것을 제안합니다. 프라이빗 오퍼 조건은 Anthropic 계정 담당자에게 문의하세요.
기존에 Amazon Bedrock 프라이빗 오퍼가 있다면, Claude Platform on AWS를 시작하기 전에 Anthropic 또는 AWS 계정 담당자에게 연락해서 할인이 올바르게 적용되도록 하세요. 할인은 프라이빗 오퍼가 수락되기 전에 발생한 사용량에는 소급 적용되지 않습니다.
Microsoft Foundry의 Claude 요금
Microsoft Foundry의 Claude는 Azure Marketplace를 통해 Claude Consumption Unit(CCU)으로 청구됩니다. Anthropic은 토큰 사용량을 표준 모델별·기능별 요율로 USD로 산정하고, 협상된 할인을 적용한 뒤 결과를 CCU당 $0.01로 환산하여 매시간 Azure Marketplace에 보고해요. Azure 청구서에는 하나의 CCU 라인 항목으로 표시됩니다.
| 개념 | 세부 사항 |
|---|---|
| 청구 단위 | Claude Consumption Unit (CCU) |
| CCU 가격 | CCU당 $0.01 (고정; 할인은 토큰-CCU 환산 시 적용되며 CCU 가격에는 적용되지 않음) |
| 환산 | 표준 모델별·기능별 요율(Claude API 요금과 동일)로 USD로 산정한 뒤, CCU당 $0.01로 환산 |
| 청구 주기 | Azure Marketplace에 시간 단위로 측정; 월별 인보이스 |
| 결제 모델 | 선불 크레딧 없이 사후 결제(postpaid)만 가능 |
| 할인 | 더 적은 CCU로 측정되어 적용 |
| 세금 | 세전 측정; Azure Marketplace가 세금 처리 |
| 비용 가시성 | Azure Cost Management가 집계된 CCU 표시 |
Claude Consumption Unit 고객이 특정 마켓플레이스 플랫폼(예: Claude Platform on AWS, Microsoft Foundry의 Claude)을 통해 서비스에 접근하면 사용량이 MTok 단위가 아니라 Claude Consumption Unit(CCU)으로 청구됩니다. CCU는 마켓플레이스 플랫폼 청구에만 사용되는 측정 단위예요. CCU 100개는 할인 적용 후 claude.com/pricing#api의 적용 가격으로 계산된 서비스 비용 $1.00 USD에 해당합니다.
추론 지리(Inference geography)
Azure에 호스팅된 배포는 US Data Zone Standard 배포 유형을 사용할 수 있으며, 이는 추론을 미국 내에서 유지합니다. 이는 Claude API의 inference_geo: "us"와 동일하며 동일한 1.1배 가격 승수가 적용돼요. 자세한 내용은 데이터 레지던시를 참고하세요.
기능별 요금
프롬프트 캐싱(Prompt caching)
프롬프트 캐싱은 API 호출 간에 이전에 처리한 프롬프트 부분을 재사용해서 비용과 지연 시간을 줄여줍니다. 매 요청마다 같은 대형 시스템 프롬프트, 문서, 대화 기록을 다시 처리하는 대신, API가 표준 입력 가격의 일부만으로 캐시에서 읽어와요.
프롬프트 캐싱을 활성화하는 방법은 두 가지가 있습니다.
- 자동 캐싱: 요청의 최상위 레벨에
cache_control필드 하나를 추가하면 됩니다. 대화가 커짐에 따라 시스템이 캐시 중단점을 자동으로 관리해요. 대부분의 사용 사례에서 권장되는 시작점입니다. - 명시적 캐시 중단점: 개별 콘텐츠 블록에
cache_control을 직접 배치해서 무엇을 캐시할지 세밀하게 제어할 수 있어요.
프롬프트 캐싱은 기본 입력 토큰 요율 대비 다음 가격 승수를 사용합니다.
| 캐시 작업 | 승수 | 기간 |
|---|---|---|
| 5분 캐시 쓰기 | 기본 입력 가격의 1.25배 | 캐시 5분 유효 |
| 1시간 캐시 쓰기 | 기본 입력 가격의 2배 | 캐시 1시간 유효 |
| 캐시 읽기(히트) | 기본 입력 가격의 0.1배 (Claude Fable 5.1, Claude Mythos 5.1은 0.025배) | 앞선 쓰기와 동일한 기간 |
캐시 쓰기 토큰은 콘텐츠가 처음 저장될 때 청구되고, 캐시 읽기 토큰은 이후 요청이 캐시된 콘텐츠를 가져올 때 청구돼요. 캐시 히트는 표준 입력 가격의 10%이므로, 5분 캐시(1.25배 쓰기)는 캐시를 한 번 읽으면 비용이 절감되고, 1시간 캐시(2배 쓰기)는 두 번 읽으면 절감됩니다. Claude Fable 5.1과 Claude Mythos 5.1에서는 캐시 히트가 표준 입력 가격의 2.5%(백만 토큰당 $0.25 USD)입니다.
이 승수는 Batch API 할인과 데이터 레지던시를 포함한 다른 가격 조정과 함께 누적 적용됩니다.
구현 세부 사항, 지원 모델, 코드 예시는 프롬프트 캐싱을 참고하세요.
데이터 레지던시 요금
Claude 4.6 이후 모델에서 inference_geo 파라미터로 미국 전용 추론을 지정하면 입력 토큰, 출력 토큰, 캐시 쓰기, 캐시 읽기를 포함한 모든 토큰 가격 범주에 1.1배 승수가 적용됩니다. 전역 라우팅(기본값)은 표준 가격을 사용해요.
이것은 Claude API(퍼스트파티)와 Claude Platform on AWS에 적용됩니다. Microsoft Foundry의 Claude에서는 동일한 1.1배 승수가 US Data Zone Standard 배포 유형을 사용하는 배포에 적용돼요. 파트너 운영 플랫폼(Bedrock과 Google Cloud)은 독립적인 리전별 가격을 가지며, 자세한 내용은 Bedrock과 Google Cloud를 참고하세요. 이전 모델은 inference_geo 파라미터를 지원하지 않아 항상 표준 가격을 사용하며, 이 모델에 해당 파라미터가 포함된 요청은 400 오류를 반환합니다.
자세한 내용은 데이터 레지던시를 참고하세요.
패스트 모드(Fast mode) 요금
패스트 모드는 연구 프리뷰 단계로, Claude Opus 5와 Claude Opus 4.8에서 프리미엄 가격으로 훨씬 빠른 출력을 제공합니다. 패스트 모드 가격은 200k 입력 토큰을 초과하는 요청을 포함해 전체 컨텍스트 윈도우에 적용돼요. 패스트 모드는 Claude API(퍼스트파티)에서만 사용할 수 있으며, Claude Platform on AWS나 파트너 운영 클라우드 플랫폼에서는 사용할 수 없습니다.
| 모델 | 입력 | 출력 |
|---|---|---|
| Claude Opus 5 / Claude Opus 4.8 | $10 / MTok | $50 / MTok |
패스트 모드는 Claude Opus 4.7(speed: "fast" 요청 시 오류 반환)이나 Claude Opus 4.6(요청이 표준 속도로 실행되고 표준 요율로 청구)에서는 사용할 수 없어요. 자세한 내용은 패스트 모드를 참고하세요.
패스트 모드 가격은 다른 가격 조정과 함께 누적됩니다.
- 프롬프트 캐싱 승수가 패스트 모드 가격 위에 적용
- 데이터 레지던시 승수가 패스트 모드 가격 위에 적용
패스트 모드는 Batch API와 함께 사용할 수 없습니다.
자세한 내용은 패스트 모드를 참고하세요.
배치 처리(Batch processing)
Batch API는 대량의 요청을 비동기로 처리하며 입력·출력 토큰 모두에 50% 할인을 제공합니다.
| 모델 | 배치 입력 | 배치 출력 |
|---|---|---|
| Claude Fable 5.1 | $5 / MTok | $25 / MTok |
| Claude Mythos 5.1 (제한적 제공) | $5 / MTok | $25 / MTok |
| Claude Fable 5 | $5 / MTok | $25 / MTok |
| Claude Mythos 5 (제한적 제공) | $5 / MTok | $25 / MTok |
| Claude Opus 5 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.8 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.7 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.6 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.5 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.1 (단종, Bedrock과 Google Cloud 제외) | $7.50 / MTok | $37.50 / MTok |
| Claude Opus 4 (단종, Google Cloud 제외) | $7.50 / MTok | $37.50 / MTok |
| Claude Sonnet 5 | $1 / MTok | $5 / MTok |
| Claude Sonnet 4.6 | $1.50 / MTok | $7.50 / MTok |
| Claude Sonnet 4.5 | $1.50 / MTok | $7.50 / MTok |
| Claude Sonnet 4 (단종, Bedrock과 Google Cloud 제외) | $1.50 / MTok | $7.50 / MTok |
| Claude Haiku 4.5 | $0.50 / MTok | $2.50 / MTok |
| Claude Haiku 3.5 (단종, Bedrock과 Google Cloud 제외) | $0.40 / MTok | $2 / MTok |
배치 처리에 대한 자세한 내용은 배치 처리를 참고하세요.
긴 컨텍스트(Long context) 요금
Claude 4.6 이후 모델과 Claude Mythos Preview는 표준 가격으로 전체 1M 토큰 컨텍스트 윈도우를 포함합니다. (900k 토큰 요청도 9k 토큰 요청과 동일한 토큰당 요율로 청구돼요.) 프롬프트 캐싱과 배치 처리 할인도 전체 컨텍스트 윈도우에 걸쳐 표준 요율로 적용됩니다.
도구 사용(Tool use) 요금
도구 사용 요청은 다음 기준으로 가격이 책정됩니다.
- 모델로 보낸 총 입력 토큰 수(
tools파라미터 포함) - 생성된 출력 토큰 수
- 서버 측 도구의 경우 추가 사용량 기반 가격(예: 웹 검색은 검색 1회당 요금)
클라이언트 측 도구는 다른 Claude API 요청과 동일하게 가격이 책정되지만, 서버 측 도구는 특정 사용량에 따라 추가 요금이 발생할 수 있어요.
도구 사용으로 인한 추가 토큰은 다음에서 발생합니다.
- API 요청의
tools파라미터(도구 이름, 설명, 스키마) - API 요청과 응답의
tool_use콘텐츠 블록 - API 요청의
tool_result콘텐츠 블록
tools를 사용하면 API가 도구 사용을 가능하게 하는 특별한 시스템 프롬프트를 모델에 자동으로 포함시켜요. 각 모델에 필요한 도구 사용 토큰 수는 다음 표에 나와 있습니다(앞서 나열한 추가 토큰은 제외). 이 표는 도구를 최소 1개 제공한다고 가정합니다. tools를 제공하지 않으면 none 도구 선택은 추가 시스템 프롬프트 토큰을 0개 사용합니다.
| 모델 | 도구 선택 | 도구 사용 시스템 프롬프트 토큰 수 |
|---|---|---|
| Claude Opus 5 | auto, none / any, tool |
286 토큰 / 406 토큰 |
| Claude Opus 4.8 | auto, none / any, tool |
290 토큰 / 410 토큰 |
| Claude Opus 4.7 | auto, none / any, tool |
675 토큰 / 804 토큰 |
| Claude Opus 4.6 | auto, none / any, tool |
497 토큰 / 589 토큰 |
| Claude Opus 4.5 | auto, none / any, tool |
496 토큰 / 588 토큰 |
| Claude Opus 4.1 (단종, Bedrock과 Google Cloud 제외) | auto, none / any, tool |
313 토큰 / 315 토큰 |
| Claude Opus 4 (단종, Google Cloud 제외) | auto, none / any, tool |
313 토큰 / 315 토큰 |
| Claude Sonnet 5 | auto, none / any, tool |
354 토큰 / 474 토큰 |
| Claude Sonnet 4.6 | auto, none / any, tool |
497 토큰 / 589 토큰 |
| Claude Sonnet 4.5 | auto, none / any, tool |
496 토큰 / 588 토큰 |
| Claude Sonnet 4 (단종, Bedrock과 Google Cloud 제외) | auto, none / any, tool |
313 토큰 / 315 토큰 |
| Claude Haiku 4.5 | auto, none / any, tool |
496 토큰 / 588 토큰 |
| Claude Haiku 3.5 (단종, Bedrock과 Google Cloud 제외) | auto, none / any, tool |
264 토큰 / 355 토큰 |
이 토큰 수는 요청의 총 비용을 계산할 때 일반 입력·출력 토큰에 더해집니다.
모델별 최신 가격은 모델 요금 섹션을 참고하세요.
도구 사용 구현과 모범 사례에 대한 자세한 내용은 도구 사용을 참고하세요.
특정 도구 요금
Bash 도구
bash 도구 정의는 요청에 다음 입력 토큰을 추가합니다. 이는 도구가 있을 때마다 적용되는 모델별 도구 사용 시스템 프롬프트에 더해지는 추가분이에요.
| 모델 | 추가 입력 토큰 |
|---|---|
| Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7 | 325 토큰 |
| Claude Opus 4.6, Claude Sonnet 4.6 및 이전 | 244 토큰 |
추가 토큰은 다음 항목에서 소비됩니다.
- 명령 출력(stdout/stderr)
- 오류 메시지
- 대용량 파일 내용
전체 요금 세부 사항은 도구 사용 요금을 참고하세요.
코드 실행 도구
코드 실행은 웹 검색 또는 웹 페치와 함께 사용하면 무료입니다. API 요청에 web_search_20260209(또는 이후)나 web_fetch_20260209(또는 이후)가 포함되면 코드 실행 도구 호출에는 표준 입력·출력 토큰 비용 외에 추가 요금이 없어요.
이런 도구 없이 사용하면 코드 실행은 토큰 사용량과 별개로 실행 시간으로 청구됩니다.
- 실행 시간은 최소 5분입니다.
- 각 조직은 월별로 1,550 무료 시간을 받습니다.
- 1,550시간을 초과하는 추가 사용량은 컨테이너당 시간당 $0.05 USD로 청구됩니다.
- 요청에 파일이 포함되면 도구가 호출되지 않더라도 실행 시간이 청구됩니다. 파일이 컨테이너에 미리 로드되기 때문입니다.
코드 실행 사용량은 응답에서 추적됩니다.
{
"usage": {
"input_tokens": 105,
"output_tokens": 239,
"server_tool_use": {
"code_execution_requests": 1
}
}
}
텍스트 편집기 도구
텍스트 편집기 도구는 Claude에서 사용하는 다른 도구와 동일한 요금 구조를 사용합니다. 사용 중인 Claude 모델에 따른 표준 입력·출력 토큰 가격을 따릅니다.
기본 토큰 외에 텍스트 편집기 도구에는 다음 추가 입력 토큰이 필요해요.
| 도구 | 추가 입력 토큰 |
|---|---|
text_editor_20250429(Claude 4.x) |
700 토큰 |
전체 요금 세부 사항은 도구 사용 요금을 참고하세요.
웹 검색 도구
웹 검색 사용량은 토큰 사용량에 더해 별도로 청구됩니다.
{
"usage": {
"input_tokens": 105,
"output_tokens": 6039,
"cache_read_input_tokens": 7123,
"cache_creation_input_tokens": 7345,
"server_tool_use": {
"web_search_requests": 1
}
}
}
웹 검색은 Claude API에서 검색 1,000회당 $10에 제공되며, 검색으로 생성된 콘텐츠에는 표준 토큰 비용이 더해집니다. 대화 전반에 걸쳐 검색된 웹 검색 결과는 입력 토큰으로 계산되며, 한 턴 동안 실행된 검색 반복과 이후 대화 턴 모두에 해당합니다.
각 웹 검색은 반환된 결과 수와 관계없이 1회 사용으로 계산됩니다. 웹 검색 중 오류가 발생하면 웹 검색은 청구되지 않아요.
웹 페치 도구
웹 페치 사용량에는 표준 토큰 비용 외에 추가 요금이 없습니다.
{
"usage": {
"input_tokens": 25039,
"output_tokens": 931,
"cache_read_input_tokens": 0,
"cache_creation_input_tokens": 0,
"server_tool_use": {
"web_fetch_requests": 1
}
}
}
웹 페치 도구는 Claude API에서 추가 비용 없이 제공됩니다. 대화 컨텍스트의 일부가 되는 페치된 콘텐츠에 대해서만 표준 토큰 비용을 지불하면 돼요.
과도한 토큰을 소비할 수 있는 대용량 콘텐츠를 실수로 페치하지 않도록, max_content_tokens 파라미터를 사용해 사용 사례와 예산에 맞는 적절한 한도를 설정하세요.
일반적인 콘텐츠의 예시 토큰 사용량은 다음과 같습니다.
- 평균 웹 페이지(10kB): 약 2,500 토큰
- 대형 문서 페이지(100kB): 약 25,000 토큰
- 연구 논문 PDF(500kB): 약 125,000 토큰
컴퓨터 사용(Computer use) 도구
컴퓨터 사용은 표준 도구 사용 요금을 따릅니다. 컴퓨터 사용 도구를 사용할 때:
도구 세트 정의 오버헤드: computer_toolset_20260801을 기본 멤버로 선언하면 요청에 약 4,500 입력 토큰이 추가됩니다(Claude Fable 5, Claude Mythos 5, Claude Opus 5, Claude Opus 4.8에서는 약 4,520, Claude Sonnet 5에서는 약 4,590). 이는 멤버 도구 정의와 도구 사용 시스템 프롬프트를 포함합니다. configs로 zoom을 비활성화하면 그중 약 410 토큰이 제거돼요. 요청의 정확한 수는 응답 usage에 보고되며, 토큰 계산 엔드포인트로 미리 추정할 수 있습니다.
이전 도구 버전: 다음 수치는 computer_toolset_20260801이 아니라 computer_20251124와 computer_20250124 도구 버전에 적용됩니다.
- 시스템 프롬프트 오버헤드: 시스템 프롬프트에 466~499 토큰 추가
- 도구 정의: 도구 정의당 약 735 입력 토큰(
computer_20250124로 측정)
추가 토큰 소비:
- 도구 결과로 반환된 스크린샷과 줌 이미지는 이미지 입력으로 청구됩니다(비전 요금 참고)
- Claude에 반환된 도구 실행 결과
컴퓨터 사용과 함께 bash나 텍스트 편집기 도구도 사용한다면 해당 도구는 각각의 문서에 명시된 자체 토큰 비용이 있습니다.
브라우저 사용(Browser use) 도구
브라우저 사용은 표준 도구 사용 요금을 따릅니다. 브라우저 사용 도구를 사용할 때:
도구 세트 정의 오버헤드: browser_toolset_20260801을 기본 멤버로 선언하면 요청에 약 6,600 입력 토큰이 추가됩니다(Claude Fable 5, Claude Mythos 5, Claude Opus 5, Claude Opus 4.8에서는 약 6,610, Claude Sonnet 5에서는 약 6,670). 이는 멤버 도구 정의와 도구 사용 시스템 프롬프트를 포함합니다. 4개의 선택 멤버를 모두 활성화하면 약 880 토큰이 추가되고, configs로 멤버를 비활성화하면 수가 줄어들어요. 요청의 정확한 수는 응답 usage에 보고되며, 토큰 계산 엔드포인트로 미리 추정할 수 있습니다.
추가 토큰 소비:
- 도구 결과로 반환된 스크린샷과 줌 이미지는 이미지 입력으로 청구됩니다(비전 요금 참고)
- Claude에 반환된 텍스트 도구 결과(접근성 트리, 페이지 텍스트, 콘솔이나 네트워크 항목 등)
브라우저 사용과 함께 컴퓨터 사용 도구, bash 도구, 텍스트 편집기 도구, 또는 자체 도구를 함께 사용한다면 해당 도구는 각각의 페이지에 명시된 자체 토큰 비용이 있습니다.
Claude Managed Agents 요금
Claude Managed Agents는 토큰과 세션 런타임 두 가지 차원으로 청구됩니다.
토큰
Claude Managed Agents 세션에서 소비되는 모든 토큰은 모델 요금에 표시된 요율로 청구돼요. 프롬프트 캐싱 승수도 동일하게 적용됩니다. 세션 내에서 트리거된 웹 검색은 표준 검색 1,000회당 $10이 적용됩니다. Claude Platform on AWS에서는 세션 토큰과 런타임 요금이 표준 요율로 Claude Consumption Unit으로 환산됩니다. 에이전트의 model.speed가 "fast"로 설정되면 패스트 모드 프리미엄 가격이 적용됩니다.
데이터 레지던시 승수도 적용됩니다. 에이전트의 model.inference_geo가 "us"로 고정되면 해당 에이전트를 실행하는 세션이 소비한 토큰은 표준 요율의 1.1배로 청구되며, 이는 Messages API의 미국 전용 추론에 적용되는 승수와 동일합니다.
다음 Messages API 조정은 Claude Managed Agents 세션에는 적용되지 않습니다.
| 조정 | 적용되지 않는 이유 |
|---|---|
| Batch API 할인 | 세션은 상태 유지형이고 대화형입니다. 배치 모드가 없어요. |
| 클라우드 플랫폼 요금 | 파트너 운영 클라우드 플랫폼에서는 사용할 수 없습니다. |
세션 런타임
| SKU | 요율 | 측정 |
|---|---|---|
| 세션 런타임 | 세션 시간당 $0.08 | running 상태 기간 |
런타임은 밀리초 단위로 측정되며 세션 상태가 running인 동안에만 발생합니다. idle(다음 메시지나 도구 확인을 기다리는 시간), rescheduling, terminated로 보낸 시간은 런타임에 포함되지 않아요.
세션 런타임은 Claude Managed Agents 사용 시 코드 실행 컨테이너 시간당 청구 모델을 대체합니다. 세션 런타임 위에 컨테이너 시간을 별도로 청구하지 않습니다.
계산 예시
Claude Opus 5를 사용하는 1시간 코딩 세션이 50,000 입력 토큰과 15,000 출력 토큰을 소비한 경우:
| 항목 | 계산 | 비용 |
|---|---|---|
| 입력 토큰 | 50,000 × $5 / 1,000,000 | $0.25 |
| 출력 토큰 | 15,000 × $25 / 1,000,000 | $0.375 |
| 세션 런타임 | 1.0시간 × $0.08 | $0.08 |
| 합계 | $0.705 |
프롬프트 캐싱이 활성화되어 입력 토큰 중 40,000개가 캐시 읽기인 경우:
| 항목 | 계산 | 비용 |
|---|---|---|
| 캐시되지 않은 입력 토큰 | 10,000 × $5 / 1,000,000 | $0.05 |
| 캐시 읽기 토큰 | 40,000 × $5 × 0.1 / 1,000,000 | $0.02 |
| 출력 토큰 | 15,000 × $25 / 1,000,000 | $0.375 |
| 세션 런타임 | 1.0시간 × $0.08 | $0.08 |
| 합계 | $0.525 |
고객 지원 티켓 10,000개 처리 계산 예시:
- 대화당 평균 약 3,700 토큰
- 입력 $1/MTok, 출력 $5/MTok인 Claude Haiku 4.5 사용
- 티켓 10,000개당 총 비용: 약 $37.00
이 계산의 자세한 안내는 고객 지원 에이전트 가이드를 참고하세요.
추가 요금 고려 사항
비용 최적화 전략
Claude로 에이전트를 만들 때:
- 적절한 모델 사용: 간단한 작업에는 Haiku를, 대부분의 프로덕션 워크로드에는 Sonnet을, 가장 복잡한 추론에는 Opus를 선택하세요.
- 프롬프트 캐싱 구현: 반복되는 컨텍스트의 비용을 줄입니다.
- 배치 작업: 시간에 민감하지 않은 작업에는 Batch API를 사용하세요.
- 사용 패턴 모니터링: 토큰 소비를 추적해서 최적화 기회를 찾습니다.
대량 에이전트 애플리케이션은 엔터프라이즈 영업팀에 맞춤 요금을 문의하세요.
속도 제한(Rate limits)
속도 제한은 사용 등급에 따라 다르며 몇 가지 요청을 만들 수 있는지에 영향을 줍니다.
- Start 등급: 시작 단계용 진입 수준 제한
- Build 등급: 성장하는 애플리케이션을 위한 증가된 제한
- Scale 등급: 프로덕션 워크로드를 위한 가장 높은 표준 제한
자세한 속도 제한 정보는 속도 제한을 참고하세요.
Scale 등급을 초과하는 제한이나 맞춤 요금이 필요하면 영업팀에 문의하세요.
볼륨 할인
고용량 사용자에게는 볼륨 할인이 제공될 수 있습니다. 이는 건별로 협상됩니다.
엔터프라이즈 요금
특정 요구 사항이 있는 엔터프라이즈 고객을 위해:
- 맞춤 속도 제한
- 볼륨 할인
- 전용 지원
- 맞춤 조건
엔터프라이즈 요금 옵션을 논의하려면 [email protected] 또는 Claude Console을 통해 영업팀에 문의하세요.
결제
- 결제는 실제 월간 사용량을 기준으로 합니다.
- 모든 결제는 USD로 이루어져요.
- 신용카드 및 인보이스 결제 옵션이 있습니다.
- Claude Console에서 사용량을 추적할 수 있습니다.
자주 묻는 질문
토큰 사용량은 어떻게 계산되나요?
토큰은 모델이 처리하는 텍스트 조각입니다. 대략적으로 1토큰은 영어 기준 약 4자 또는 0.75단어에 해당합니다. 정확한 수는 언어와 콘텐츠 유형에 따라 달라져요.
무료 등급이나 체험판이 있나요?
신규 사용자는 API를 테스트할 수 있는 소량의 무료 크레딧을 받습니다. 엔터프라이즈 평가를 위한 연장 체험판은 영업팀에 문의하세요.
할인은 어떻게 누적되나요?
Batch API와 프롬프트 캐싱 할인은 결합할 수 있습니다. 예를 들어 두 기능을 함께 사용하면 표준 API 호출에 비해 상당한 비용 절감 효과가 있어요. 승수가 어떻게 상호작용하는지는 프롬프트 캐싱 요금을 참고하세요.
어떤 결제 수단을 지원하나요?
표준 계정은 주요 신용카드를 지원합니다. 엔터프라이즈 고객은 인보이스 및 기타 결제 수단을 마련할 수 있어요.
요금에 대한 추가 질문은 [email protected]으로 문의하세요.