가격
가격 (Pricing)
이 페이지에서는 Anthropic 모델과 기능의 상세 가격 정보를 다뤄요. 모든 가격은 USD 기준이에요. 가장 최신 가격 정보는 claude.com/pricing에서 확인할 수 있어요. 표가 많아서 처음엔 좀 빡세 보일 수 있는데, 기본 입력·출력 토큰 가격에 캐시 쓰기/읽기 같은 기능별 배수가 어떻게 붙는지만 파악하면 어렵지 않아요.
출처: 문서
본문
모델 가격 (Model pricing)
다음 표는 모든 클로드 모델의 가격을 보여줘요:
| 모델 | 기본 입력 토큰 | 5m 캐시 쓰기 | 1h 캐시 쓰기 | 캐시 적중·새로고침 | 출력 토큰 |
|---|---|---|---|---|---|
| Claude Fable 5.1 | $10 / MTok | $12.50 / MTok | $20 / MTok | $0.25 / MTok1 | $50 / MTok |
| Claude Mythos 5.1 (제한 제공) | $10 / MTok | $12.50 / MTok | $20 / MTok | $0.25 / MTok1 | $50 / MTok |
| Claude Fable 5 | $10 / MTok | $12.50 / MTok | $20 / MTok | $1 / MTok | $50 / MTok |
| Claude Mythos 5 (제한 제공) | $10 / MTok | $12.50 / MTok | $20 / MTok | $1 / MTok | $50 / MTok |
| Claude Opus 5.5 | $4 / MTok | $5 / MTok | $8 / MTok | $0.20 / MTok2 | $20 / MTok |
| Claude Opus 5 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.8 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.7 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.6 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.5 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.1 (은퇴, Bedrock과 Google Cloud 제외) | $15 / MTok | $18.75 / MTok | $30 / MTok | $1.50 / MTok | $75 / MTok |
| Claude Opus 4 (은퇴, Google Cloud 제외) | $15 / MTok | $18.75 / MTok | $30 / MTok | $1.50 / MTok | $75 / MTok |
| Claude Sonnet 5 | $2 / MTok3 | $2.50 / MTok | $4 / MTok | $0.20 / MTok | $10 / MTok3 |
| Claude Sonnet 4.6 | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Sonnet 4.5 | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Sonnet 4 (은퇴, Bedrock과 Google Cloud 제외) | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Haiku 4.5 | $1 / MTok | $1.25 / MTok | $2 / MTok | $0.10 / MTok | $5 / MTok |
| Claude Haiku 3.5 (은퇴, Bedrock과 Google Cloud 제외) | $0.80 / MTok | $1 / MTok | $1.60 / MTok | $0.08 / MTok | $4 / MTok |
1 Claude Fable 5.1과 Claude Mythos 5.1의 캐시 적중·새로고침은 기본 입력 가격의 0.025배로 책정됩니다.
2 Claude Opus 5.5의 캐시 적중·새로고침은 기본 입력 가격의 0.05배로 책정됩니다.
그 외 모든 모델은 표준 0.1x 배수를 사용합니다.
3 출시 당시 2026년 8월 31일까지의 소개 가격으로 발표된 Claude Sonnet 5의 백만 입력/출력 토큰당 $2/$10 가격은 이제 표준 가격입니다. 이전에 예정되었던 2026년 9월 1일의 백만 입력/출력 토큰당 $3/$15 인상은 발생하지 않습니다.
- MTok: 백만 토큰(Million tokens). $5 / MTok은 백만 토큰마다 $5라는 뜻이에요.
- 5m 캐시 쓰기: 프롬프트 프리픽스를 5분 프롬프트 캐시에 쓰는 것.
- 1h 캐시 쓰기: 프롬프트 프리픽스를 1시간 프롬프트 캐시에 쓰는 것.
- 캐시 적중·새로고침: 프롬프트 캐시에서 프롬프트 프리픽스를 읽는 것, 동시에 새로고침도 됨.
- 제한 제공: Project Glasswing의 일부로 초청을 통해서만 별도 제공돼요. 접근하려면 Anthropic, AWS 또는 Google Cloud 계정 팀에 문의하세요.
- 은퇴: 다른 클라우드 플랫폼에서는 계속 제공될 수 있어요. 자세한 내용은 모델 폐지를 참고하세요.
Claude 4.7 이상 모델과 Claude Mythos Preview는 더 새로운 토크나이저를 사용하며, 이는 다양한 작업에서 향상된 성능에 기여해요. 이 토크나이저는 같은 텍스트에 대해 약 30% 더 많은 토큰을 만들어 내요. 정확한 증가량은 콘텐츠와 워크로드 형태에 따라 달라져요. Claude Sonnet 4.6 이하 모델은 이전 토크나이저를 사용해요.
클라우드 플랫폼 가격 (Cloud platform pricing)
이 섹션은 클라우드 제공업체가 청구하는 파트너 운영 클라우드 플랫폼을 다뤄요. 마켓플레이스를 통해 청구되는 Anthropic 운영 클라우드 플랫폼은 Claude Platform on AWS 가격과 Claude in Microsoft Foundry 가격을 참고하세요.
클로드 모델은 Amazon Bedrock과 Google Cloud에서 사용할 수 있어요. 공식 가격은 다음을 방문하세요:
Claude Sonnet 4.5, Haiku 4.5, Opus 4.5부터:
- Bedrock은 두 가지 엔드포인트 유형을 제공해요: 글로벌 엔드포인트(최대 가용성을 위한 동적 라우팅)와 리전 엔드포인트(특정 지리적 리전을 통한 보장된 데이터 라우팅).
- Google Cloud는 세 가지 엔드포인트 유형을 제공해요: 글로벌 엔드포인트, 멀티 리전 엔드포인트(지리적 영역 내 동적 라우팅), 리전 엔드포인트.
리전 및 멀티 리전 엔드포인트에는 글로벌 엔드포인트 대비 10% 프리미엄이 포함돼요. Claude API(자사)는 기본적으로 글로벌이에요. 자사 데이터 레지던시 옵션과 가격은 데이터 레지던시 가격을 참고하세요.
범위: 이 가격 구조는 Claude Sonnet 4.5, Haiku 4.5, Opus 4.5와 모든 향후 모델에 적용돼요. 이전 모델(Claude Opus 4.1 및 이전 릴리스)은 기존 가격을 유지해요.
구현 세부 사항과 코드 예시는:
- Amazon Bedrock 글로벌 vs 리전 엔드포인트 — Opus 4.7, Haiku 4.5 이상, 또는 Bedrock의 다른 모든 모델은 레거시 통합
- Google Cloud 글로벌, 멀티 리전, 리전 엔드포인트
Claude Platform on AWS 가격
Claude Platform on AWS는 Claude Consumption Units(CCU)로 AWS Marketplace를 통해 청구돼요. Anthropic은 토큰 사용량을 표준 모델별·기능별 요율로 USD로 환산하고, 협상된 할인을 적용한 뒤 결과를 CCU당 $0.01로 CCU로 변환해 시간 단위로 AWS Marketplace에 보고해요. AWS 청구서에는 단일 CCU 라인 항목이 표시돼요.
| 개념 | 세부 사항 |
|---|---|
| 청구 단위 | Claude Consumption Unit (CCU) |
| CCU 가격 | CCU당 $0.01(고정, 할인은 토큰-CCU 변환 시 적용되며 CCU 가격에는 미적용) |
| 변환 | 토큰 사용량을 표준 모델별·기능별 요율(Claude API 가격과 동일)로 USD 환산 후 CCU당 $0.01로 CCU 변환 |
| 청구 주기 | AWS Marketplace로 시간 단위 계량, 월 단위 인보이스 |
| 결제 모델 | 후불(사후 결제)만 지원, 선불 크레딧 없음 |
| 할인 | 계량된 CCU 수가 줄어드는 방식으로 적용 |
| 세금 | 세전 계량, 세금은 AWS Marketplace가 처리 |
| 비용 표시 | Claude Console에서 실시간 세부 내역(AWS Console 통해 접근), AWS Cost Explorer는 집계된 CCU 표시 |
CCU: Claude Consumption Unit. CCU는 마켓플레이스 플랫폼 인보이싱에만 사용되는 측정 단위예요. 고객이 특정 마켓플레이스 플랫폼(예: Claude Platform on AWS)을 통해 서비스를 이용하면, 사용량은 MTok당이 아니라 Claude Consumption Units("CCU")로 인보이스 처리돼요. 100 CCU는 claude.com/pricing#api의 해당 가격에 할인 적용 후 계산된 서비스 요금 $1.00 USD를 나타내요.
추론 지리 (Inference geography)
Claude 4.6 이상 모델에서 inference_geo: "us"를 사용하면 1.1x 가격 배수가 적용돼요. inference_geo: "global"(기본값)은 표준 가격을 사용해요. 자세한 내용은 데이터 레지던시를 참고하세요.
프라이빗 오퍼 (Private offers)
AWS Console Claude Platform on AWS 서비스 페이지에서 가입하면 AWS Console이 계정과 연결된 프라이빗 오퍼를 조회하고 AWS Marketplace에서 수락하라는 안내를 보여줘요. 프라이빗 오퍼 조건은 Anthropic 계정 담당자에게 문의하세요.
Claude in Microsoft Foundry 가격
Claude in Microsoft Foundry는 Claude Consumption Units(CCU)로 Azure Marketplace를 통해 청구돼요. Anthropic은 토큰 사용량을 표준 모델별·기능별 요율로 USD로 환산하고, 협상된 할인을 적용한 뒤 결과를 CCU당 $0.01로 CCU로 변환해 시간 단위로 Azure Marketplace에 보고해요. Azure 청구서에는 단일 CCU 라인 항목이 표시돼요.
| 개념 | 세부 사항 |
|---|---|
| 청구 단위 | Claude Consumption Unit (CCU) |
| CCU 가격 | CCU당 $0.01(고정, 할인은 토큰-CCU 변환 시 적용되며 CCU 가격에는 미적용) |
| 변환 | 토큰 사용량을 표준 모델별·기능별 요율(Claude API 가격과 동일)로 USD 환산 후 CCU당 $0.01로 CCU 변환 |
| 청구 주기 | Azure Marketplace로 시간 단위 계량, 월 단위 인보이스 |
| 결제 모델 | 후불(사후 결제)만 지원, 선불 크레딧 없음 |
| 할인 | 계량된 CCU 수가 줄어드는 방식으로 적용 |
| 세금 | 세전 계량, 세금은 Azure Marketplace가 처리 |
| 비용 표시 | Azure Cost Management가 집계된 CCU 표시 |
CCU: Claude Consumption Unit. CCU는 마켓플레이스 플랫폼 인보이싱에만 사용되는 측정 단위예요. 고객이 특정 마켓플레이스 플랫폼(예: Claude Platform on AWS, Claude in Microsoft Foundry)을 통해 서비스를 이용하면, 사용량은 MTok당이 아니라 Claude Consumption Units("CCU")로 인보이스 처리돼요. 100 CCU는 claude.com/pricing#api의 해당 가격에 할인 적용 후 계산된 서비스 요금 $1.00 USD를 나타내요.
추론 지리 (Inference geography)
Azure에 호스팅된 배포는 추론을 미국 내로 유지하는 US Data Zone Standard 배포 유형을 사용할 수 있어요. 이는 Claude API의 inference_geo: "us"와 동일하며 같은 1.1x 가격 배수가 적용돼요. 자세한 내용은 데이터 레지던시를 참고하세요.
기능별 가격 (Feature-specific pricing)
프롬프트 캐싱 (Prompt caching)
프롬프트 캐싱은 API 호출 전반에 걸쳐 이전에 처리된 프롬프트 부분을 재사용해 비용과 지연 시간을 줄여요. 같은 큰 시스템 프롬프트, 문서, 대화 이력을 요청마다 재처리하는 대신, API가 표준 입력 가격의 일부만으로 캐시에서 읽어요.
프롬프트 캐싱을 활성화하는 방법은 두 가지가 있어요:
- 자동 캐싱: 요청의 최상위에 단일
cache_control필드를 추가해요. 대화가 커짐에 따라 시스템이 캐시 브레이크포인트를 자동으로 관리해요. 대부분의 유스 케이스에서 권장되는 시작점이에요. - 명시적 캐시 브레이크포인트: 개별 콘텐츠 블록에
cache_control을 직접 배치해 정확히 무엇이 캐시되는지 세밀하게 제어해요.
프롬프트 캐싱은 기본 입력 토큰 요율 대비 다음 가격 배수를 사용해요:
| 캐시 작업 | 배수 | 지속 시간 |
|---|---|---|
| 5분 캐시 쓰기 | 기본 입력 가격의 1.25배 | 5분 동안 캐시 유효 |
| 1시간 캐시 쓰기 | 기본 입력 가격의 2배 | 1시간 동안 캐시 유효 |
| 캐시 읽기(적중) | 기본 입력 가격의 0.1배(Claude Fable 5.1과 Claude Mythos 5.1에서는 0.025배, Claude Opus 5.5에서는 0.05배) | 이전 쓰기와 동일한 지속 시간 |
캐시 쓰기 토큰은 콘텐츠가 처음 저장될 때 청구돼요. 캐시 읽기 토큰은 이후 요청이 캐시된 콘텐츠를 검색할 때 청구돼요. 캐시 적중은 표준 입력 가격의 10%가 들므로, 5분 지속 시간(1.25x 쓰기)에서는 캐시 읽기 한 번 후, 1시간 지속 시간(2x 쓰기)에서는 캐시 읽기 두 번 후에 캐싱이 효과가 있음을 의미해요. Claude Fable 5.1과 Claude Mythos 5.1에서는 캐시 적중이 표준 입력 가격의 2.5%(백만 토큰당 $0.25 USD)가 들어요. Claude Opus 5.5에서는 캐시 적중이 표준 입력 가격의 5%(백만 토큰당 $0.20 USD)가 들어요.
이 배수들은 Batch API 할인과 데이터 레지던시를 포함한 다른 가격 수정자와 함께 쌓여요(stack).
구현 세부 사항, 지원 모델, 코드 예시는 프롬프트 캐싱을 참고하세요.
데이터 레지던시 가격 (Data residency pricing)
Claude 4.6 이상 모델에서 inference_geo 파라미터를 통해 미국 전용 추론을 지정하면 입력 토큰, 출력 토큰, 캐시 쓰기, 캐시 읽기를 포함한 모든 토큰 가격 범주에 1.1x 배수가 적용돼요. 글로벌 라우팅(기본값)은 표준 가격을 사용해요.
이는 Claude API(자사)와 Claude Platform on AWS에 적용돼요. Claude in Microsoft Foundry에서는 US Data Zone Standard 배포 유형을 사용하는 배포에 같은 1.1x 배수가 적용돼요(추론 지리 참고). 파트너 운영 플랫폼(Bedrock과 Google Cloud)은 독립적인 리전 가격이 있어요. 자세한 내용은 Bedrock과 Google Cloud를 참고하세요. 이전 모델은 inference_geo 파라미터를 지원하지 않으며 항상 표준 가격을 사용해요. 이 모델에 이 파라미터를 포함한 요청은 400 오류를 반환해요.
자세한 내용은 데이터 레지던시를 참고하세요.
패스트 모드 가격 (Fast mode pricing)
연구 프리뷰인 패스트 모드는 Claude Opus 5.5, Claude Opus 5, Claude Opus 4.8에 대해 프리미엄 가격으로 훨씬 빠른 출력을 제공해요. 패스트 모드 가격은 200k 입력 토큰이 넘는 요청을 포함해 전체 컨텍스트 창에 걸쳐 적용돼요. 패스트 모드는 Claude API(자사)에서만 사용할 수 있으며 Claude Platform on AWS나 파트너 운영 클라우드 플랫폼에서는 사용할 수 없어요.
| 모델 | 입력 | 출력 |
|---|---|---|
| Claude Opus 5.5 | $8 / MTok | $40 / MTok |
| Claude Opus 5 / Claude Opus 4.8 | $10 / MTok | $50 / MTok |
패스트 모드는 Claude Opus 4.7(speed: "fast" 요청은 오류 반환)이나 Claude Opus 4.6(요청은 표준 속도·표준 요율로 실행)에서는 사용할 수 없어요. 패스트 모드를 참고하세요.
패스트 모드 가격은 다른 가격 수정자와 함께 쌓여요:
- 프롬프트 캐싱 배수가 패스트 모드 가격 위에 적용돼요
- 데이터 레지던시 배수가 패스트 모드 가격 위에 적용돼요
패스트 모드는 Batch API에서는 사용할 수 없어요.
자세한 내용은 패스트 모드를 참고하세요.
배치 처리 (Batch processing)
Batch API는 대량 요청의 비동기 처리를 허용하며 입력·출력 토큰 모두에 50% 할인이 적용돼요.
| 모델 | 배치 입력 | 배치 출력 |
|---|---|---|
| Claude Fable 5.1 | $5 / MTok | $25 / MTok |
| Claude Mythos 5.1 (제한 제공) | $5 / MTok | $25 / MTok |
| Claude Fable 5 | $5 / MTok | $25 / MTok |
| Claude Mythos 5 (제한 제공) | $5 / MTok | $25 / MTok |
| Claude Opus 5.5 | $2 / MTok | $10 / MTok |
| Claude Opus 5 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.8 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.7 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.6 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.5 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.1 (은퇴, Bedrock과 Google Cloud 제외) | $7.50 / MTok | $37.50 / MTok |
| Claude Opus 4 (은퇴, Google Cloud 제외) | $7.50 / MTok | $37.50 / MTok |
| Claude Sonnet 5 | $1 / MTok | $5 / MTok |
| Claude Sonnet 4.6 | $1.50 / MTok | $7.50 / MTok |
| Claude Sonnet 4.5 | $1.50 / MTok | $7.50 / MTok |
| Claude Sonnet 4 (은퇴, Bedrock과 Google Cloud 제외) | $1.50 / MTok | $7.50 / MTok |
| Claude Haiku 4.5 | $0.50 / MTok | $2.50 / MTok |
| Claude Haiku 3.5 (은퇴, Bedrock과 Google Cloud 제외) | $0.40 / MTok | $2 / MTok |
- MTok: 백만 토큰. $5 / MTok은 백만 토큰마다 $5라는 뜻이에요.
- 제한 제공: Project Glasswing의 일부로 초청을 통해서만 별도 제공돼요. 접근하려면 Anthropic, AWS 또는 Google Cloud 계정 팀에 문의하세요.
- 은퇴: 다른 클라우드 플랫폼에서는 계속 제공될 수 있어요. 자세한 내용은 모델 폐지를 참고하세요.
배치 처리에 대한 자세한 내용은 배치 처리를 참고하세요.
긴 컨텍스트 가격 (Long context pricing)
Claude 4.6 이상 모델과 Claude Mythos Preview는 표준 가격으로 전체 1M 토큰 컨텍스트 창을 포함해요. (900k 토큰 요청은 9k 토큰 요청과 같은 토큰당 요율로 청구돼요.) 프롬프트 캐싱과 배치 처리 할인은 전체 컨텍스트 창에 걸쳐 표준 요율로 적용돼요.
도구 사용 가격 (Tool use pricing)
도구 사용 요청은 다음을 기준으로 가격이 매겨져요:
- 모델로 보낸 총 입력 토큰 수(
tools파라미터 포함) - 생성된 출력 토큰 수
- 서버 측 도구의 경우 추가 사용량 기반 가격(예: 웹 검색은 검색당 요금 부과)
클라이언트 측 도구는 다른 클로드 API 요청과 동일하게 가격이 매겨지지만, 서버 측 도구는 특정 사용량에 따라 추가 요금이 발생할 수 있어요.
도구 사용에서 나오는 추가 토큰은 다음과 같아요:
- API 요청의
tools파라미터(도구 이름, 설명, 스키마) - API 요청과 응답의
tool_use콘텐츠 블록 - API 요청의
tool_result콘텐츠 블록
tools를 사용하면 API가 도구 사용을 가능하게 하는 특수 시스템 프롬프트를 모델에 자동으로 포함해요. 각 모델에 필요한 도구 사용 토큰 수는 다음 표에 나와 있어요(앞서 나열한 추가 토큰 제외). 표는 도구가 최소 1개 제공된다고 가정해요. tools가 제공되지 않으면 none 도구 선택은 추가 시스템 프롬프트 토큰 0개를 사용해요.
| 모델 | 도구 사용 시스템 프롬프트 토큰: auto, none | 도구 사용 시스템 프롬프트 토큰: any, tool |
|---|---|---|
| Claude Opus 5.5 | 286 토큰 | |
| Claude Opus 5 | 286 토큰 | 406 토큰 |
| Claude Opus 4.8 | 290 토큰 | 410 토큰 |
| Claude Opus 4.7 | 675 토큰 | 804 토큰 |
| Claude Opus 4.6 | 497 토큰 | 589 토큰 |
| Claude Opus 4.5 | 496 토큰 | 588 토큰 |
| Claude Opus 4.1 (은퇴, Bedrock과 Google Cloud 제외) | 313 토큰 | 315 토큰 |
| Claude Opus 4 (은퇴, Google Cloud 제외) | 313 토큰 | 315 토큰 |
| Claude Sonnet 5 | 354 토큰 | 474 토큰 |
| Claude Sonnet 4.6 | 497 토큰 | 589 토큰 |
| Claude Sonnet 4.5 | 496 토큰 | 588 토큰 |
| Claude Sonnet 4 (은퇴, Bedrock과 Google Cloud 제외) | 313 토큰 | 315 토큰 |
| Claude Haiku 4.5 | 496 토큰 | 588 토큰 |
| Claude Haiku 3.5 (은퇴, Bedrock과 Google Cloud 제외) | 264 토큰 | 355 토큰 |
- auto, none: tool_choice가 auto 또는 none일 때의 개수.
- any, tool: tool_choice가 any 또는 tool일 때의 개수.
- 은퇴: 다른 클라우드 플랫폼에서는 계속 제공될 수 있어요. 자세한 내용은 모델 폐지를 참고하세요.
이 토큰 개수는 요청의 총 비용을 계산할 때 일반 입력·출력 토큰에 더해져요.
현재 모델별 가격은 모델 가격 섹션을 참고하세요.
도구 사용 구현과 모범 사례는 도구 사용을 참고하세요.
특정 도구 가격 (Specific tool pricing)
Bash 도구
bash 도구 정의는 요청에 다음 입력 토큰을 추가해요. 이는 도구가 있을 때마다 적용되는 모델별 도구 사용 시스템 프롬프트에 더해지는 것이에요.
| 모델 | 추가 입력 토큰 |
|---|---|
| Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7 | 325 토큰 |
| Claude Opus 4.6, Claude Sonnet 4.6 이하 | 244 토큰 |
추가 토큰은 다음이 소비해요:
- 명령 출력(stdout/stderr)
- 오류 메시지
- 큰 파일 내용
전체 가격 세부 사항은 도구 사용 가격을 참고하세요.
코드 실행 도구 (Code execution tool)
코드 실행은 웹 검색이나 웹 가져오기와 함께 쓰면 무료예요. API 요청에 web_search_20260209(이상) 또는 web_fetch_20260209(이상)가 포함되면 표준 입력·출력 토큰 비용 외에 코드 실행 도구 호출에 대한 추가 요금이 없어요.
이 도구들 없이 사용할 때는 코드 실행이 토큰 사용량과 별도로 추적되는 실행 시간으로 청구돼요:
- 실행 시간 최소 5분
- 각 조직은 월 1,550시간 무료 사용
- 1,550시간을 넘는 추가 사용은 컨테이너당 시간당 $0.05 USD로 청구
- 요청에 파일이 포함되면 도구가 호출되지 않아도 실행 시간이 청구돼요. 파일이 컨테이너에 미리 로드되기 때문이에요.
코드 실행 사용량은 응답에서 추적돼요:
{
"usage": {
"input_tokens": 105,
"output_tokens": 239,
"server_tool_use": {
"code_execution_requests": 1
}
}
}
텍스트 편집기 도구 (Text editor tool)
텍스트 편집기 도구는 클로드와 함께 쓰는 다른 도구와 동일한 가격 구조를 사용해요. 사용하는 클로드 모델에 따른 표준 입력·출력 토큰 가격을 따라요.
기본 토큰에 더해, 텍스트 편집기 도구에는 다음 추가 입력 토큰이 필요해요:
| 도구 | 추가 입력 토큰 |
|---|---|
text_editor_20250429 (Claude 4.x) |
700 토큰 |
전체 가격 세부 사항은 도구 사용 가격을 참고하세요.
웹 검색 도구 (Web search tool)
웹 검색 사용량은 토큰 사용량에 더해 청구돼요:
{
"usage": {
"input_tokens": 105,
"output_tokens": 6039,
"cache_read_input_tokens": 7123,
"cache_creation_input_tokens": 7345,
"server_tool_use": {
"web_search_requests": 1
}
}
}
웹 검색은 검색 1,000회당 $10에, 검색 생성 콘텐츠에 대한 표준 토큰 비용을 더해 Claude API에서 사용할 수 있어요. 대화 전반에 걸쳐 검색된 웹 검색 결과는 단일 턴 내 검색 반복과 이후 대화 턴 모두에서 입력 토큰으로 집계돼요.
각 웹 검색은 반환된 결과 수와 무관하게 한 번의 사용으로 계산돼요. 웹 검색 중 오류가 발생하면 웹 검색은 청구되지 않아요.
웹 가져오기 도구 (Web fetch tool)
웹 가져오기 사용량에는 표준 토큰 비용 외에 추가 요금이 없어요:
{
"usage": {
"input_tokens": 25039,
"output_tokens": 931,
"cache_read_input_tokens": 0,
"cache_creation_input_tokens": 0,
"server_tool_use": {
"web_fetch_requests": 1
}
}
}
웹 가져오기 도구는 추가 비용 없이 Claude API에서 사용할 수 있어요. 대화 컨텍스트의 일부가 되는 가져온 콘텐츠에 대해서만 표준 토큰 비용을 내요.
과도한 토큰을 소비하는 큰 콘텐츠를 실수로 가져오는 것을 방지하려면 max_content_tokens 파라미터로 유스 케이스와 예산 상황에 맞는 적절한 상한을 설정하세요.
일반 콘텐츠의 예시 토큰 사용량:
- 평균 웹 페이지(10 kB): 약 2,500 토큰
- 큰 문서화 페이지(100 kB): 약 25,000 토큰
- 연구 논문 PDF(500 kB): 약 125,000 토큰
컴퓨터 사용 도구 (Computer use tool)
컴퓨터 사용은 표준 도구 사용 가격을 따르지요. 컴퓨터 사용 도구를 사용할 때:
도구 세트 정의 오버헤드: computer_toolset_20260801을 기본 멤버와 함께 선언하면 요청에 약 4,500 입력 토큰이 추가돼요.(Claude Fable 5, Claude Mythos 5, Claude Opus 5, Claude Opus 4.8에서는 약 4,520, Claude Sonnet 5에서는 약 4,590) 이는 멤버 도구 정의와 도구 사용 시스템 프롬프트를 포함해요. configs로 zoom을 비활성화하면 그 토큰 중 약 410개가 제거돼요. 요청의 정확한 개수는 응답 usage에 보고되며, 토큰 개수 엔드포인트로 미리 추정할 수 있어요.
이전 도구 버전: 다음 수치는 computer_20251124와 computer_20250124 도구 버전에 적용되며 computer_toolset_20260801에는 적용되지 않아요:
- 시스템 프롬프트 오버헤드: 시스템 프롬프트에 추가되는 466–499 토큰
- 도구 정의: 도구 정의당 약 735 입력 토큰(
computer_20250124로 측정)
추가 토큰 소비:
- 도구 결과로 반환되는 스크린샷과 줌 이미지, 이미지 입력으로 청구(비전 가격 참고)
- 클로드에 반환되는 도구 실행 결과
브라우저 사용 도구 (Browser use tool)
브라우저 사용은 표준 도구 사용 가격을 따라요. 브라우저 사용 도구를 사용할 때:
도구 세트 정의 오버헤드: browser_toolset_20260801을 기본 멤버와 함께 선언하면 요청에 약 6,600 입력 토큰이 추가돼요.(Claude Fable 5, Claude Mythos 5, Claude Opus 5, Claude Opus 4.8에서는 약 6,610, Claude Sonnet 5에서는 약 6,670) 이는 멤버 도구 정의와 도구 사용 시스템 프롬프트를 포함해요. 네 개의 선택적 멤버를 모두 켜면 약 880 토큰이 추가되고, configs로 멤버를 비활성화하면 개수가 줄어요. 요청의 정확한 개수는 응답 usage에 보고되며, 토큰 개수 엔드포인트로 미리 추정할 수 있어요.
추가 토큰 소비:
- 도구 결과로 반환되는 스크린샷과 줌 이미지, 이미지 입력으로 청구(비전 가격 참고)
- 접근성 트리, 페이지 텍스트, 콘솔·네트워크 항목처럼 클로드에 반환되는 텍스트 도구 결과
Claude Managed Agents 가격
Claude Managed Agents는 토큰과 세션 런타임이라는 두 가지 차원으로 청구돼요.
토큰 (Tokens)
Claude Managed Agents 세션이 소비하는 모든 토큰은 모델 가격에 표시된 요율로 청구돼요. 프롬프트 캐싱 배수도 동일하게 적용돼요. 세션 내에서 촉발된 웹 검색은 표준 검색 1,000회당 $10이 발생해요. Claude Platform on AWS에서는 세션 토큰과 런타임 비용이 표준 요율로 Claude Consumption Units로 전환돼요. 에이전트의 model.speed가 "fast"로 설정되면 패스트 모드 프리미엄 가격이 적용돼요.
데이터 레지던시 배수도 적용돼요. 에이전트의 model.inference_geo가 "us"로 고정되면 그 에이전트를 실행하는 세션의 토큰이 표준 요율의 1.1x로 청구되며, 이는 Messages API의 미국 전용 추론에 적용되는 배수와 같아요.
다음 Messages API 수정자들은 Claude Managed Agents 세션에 적용되지 않아요:
| 수정자 | 적용되지 않는 이유 |
|---|---|
| Batch API 할인 | 세션은 상태를 가지며 인터랙티브해요. 배치 모드가 없어요. |
| 클라우드 플랫폼 가격 | 파트너 운영 클라우드 플랫폼에서는 사용할 수 없어요. |
세션 런타임 (Session runtime)
| SKU | 요율 | 계량 |
|---|---|---|
| 세션 런타임 | 세션-시간당 $0.08 | running 상태 지속 시간 |
런타임은 밀리초 단위로 측정되며 세션 상태가 running인 동안에만 누적돼요. idle(다음 메시지나 도구 확인을 기다리는), rescheduling, terminated로 보내는 시간은 런타임에 포함되지 않아요.
계산 예시 (Worked example)
Claude Opus 5를 사용하고 50,000 입력 토큰과 15,000 출력 토큰을 소비하는 1시간 코딩 세션:
| 라인 항목 | 계산 | 비용 |
|---|---|---|
| 입력 토큰 | 50,000 × $5 / 1,000,000 | $0.25 |
| 출력 토큰 | 15,000 × $25 / 1,000,000 | $0.375 |
| 세션 런타임 | 1.0시간 × $0.08 | $0.08 |
| 합계 | $0.705 |
프롬프트 캐싱이 활성화되어 있고 입력 토큰 중 40,000이 캐시 읽기라면:
| 라인 항목 | 계산 | 비용 |
|---|---|---|
| 캐시되지 않은 입력 토큰 | 10,000 × $5 / 1,000,000 | $0.05 |
| 캐시 읽기 토큰 | 40,000 × $5 × 0.1 / 1,000,000 | $0.02 |
| 출력 토큰 | 15,000 × $25 / 1,000,000 | $0.375 |
| 세션 런타임 | 1.0시간 × $0.08 | $0.08 |
| 합계 | $0.525 |
- 대화당 평균 약 3,700 토큰
- Claude Haiku 4.5 사용, 입력 $1/MTok, 출력 $5/MTok
- 총 비용: 티켓 10,000개당 약 $37.00
이 계산에 대한 자세한 워크스루는 고객 지원 에이전트 가이드를 참고하세요.
추가 가격 고려 사항 (Additional pricing considerations)
비용 최적화 전략 (Cost optimization strategies)
클로드로 에이전트를 만들 때:
- 적절한 모델 사용: 단순 작업에는 Haiku, 대부분의 프로덕션 워크로드에는 Sonnet, 가장 복잡한 추론에는 Opus를 선택하세요
- 프롬프트 캐싱 구현: 반복 컨텍스트의 비용을 줄이세요
- 배치 작업: 시간에 민감하지 않은 작업에는 Batch API를 사용하세요
- 사용 패턴 모니터링: 최적화 기회를 찾기 위해 토큰 소비를 추적하세요
요율 한도 (Rate limits)
요율 한도는 사용 티어에 따라 다르며 얼마나 많은 요청을 할 수 있는지에 영향을 줘요:
- Start 티어: 시작하기 위한 입문 수준 한도
- Build 티어: 성장 중인 애플리케이션을 위한 증가된 한도
- Scale 티어: 프로덕션 워크로드를 위한 최고 표준 한도
자세한 요율 한도 정보는 요율 한도를 참고하세요.
Scale 티어를 넘는 한도나 맞춤 가격 계약이 필요하면 영업 팀에 문의하세요.
볼륨 할인 (Volume discounts)
대량 사용자에게는 볼륨 할인이 제공될 수 있어요. 이는 사례별로 협상돼요.
엔터프라이즈 가격 (Enterprise pricing)
특정 요구를 가진 엔터프라이즈 고객을 위해:
- 맞춤 요율 한도
- 볼륨 할인
- 전담 지원
- 맞춤 조건
영업팀 또는 Claude Console을 통해 연락해 엔터프라이즈 가격 옵션을 논의하세요.
청구 및 결제 (Billing and payment)
- 청구는 실제 월 사용량을 기준으로 해요
- 모든 결제는 USD로 이뤄져요
- 신용카드와 인보이스 옵션 제공
- 사용량 추적은 Claude Console에서 가능해요
자주 묻는 질문 (Frequently asked questions)
토큰 사용량은 어떻게 계산되나요?
토큰은 모델이 처리하는 텍스트 조각이에요. 대략적으로 1토큰은 영어로 약 4자 또는 0.75단어예요. 정확한 개수는 언어와 콘텐츠 유형에 따라 달라져요.
무료 티어나 평가판이 있나요?
신규 사용자는 API를 테스트할 수 있는 소액의 무료 크레딧을 받아요. 엔터프라이즈 평가를 위한 연장 평가판 정보는 영업팀에 문의하세요.
할인은 어떻게 쌓이나요?
Batch API와 프롬프트 캐싱 할인은 결합할 수 있어요. 예를 들어 두 기능을 함께 사용하면 표준 API 호출에 비해 상당한 비용 절감을 제공해요. 배수들이 어떻게 상호작용하는지는 프롬프트 캐싱 가격을 참고하세요.
어떤 결제 방법이 지원되나요?
표준 계정에서는 주요 신용카드를 허용해요. 엔터프라이즈 고객은 인보이스와 기타 결제 방법을 마련할 수 있어요.
가격에 대한 추가 질문은 [email protected]에 문의하세요.