Claude Haiku 4.5
Claude Haiku 4.5
최신(Latest). 2025년 10월 15일 출시.
프론티어에 가까운 지능을 가진 가장 빠른 모델
모델 ID: claude-haiku-4-5-20251001
컨텍스트 창: 200K 토큰 · 최대 출력: 64K 토큰 · 입력 가격: $1 / MTok · 출력 가격: $5 / MTok
발표 · 마이그레이션 가이드
출처: 문서
본문
최신(Latest). 2025년 10월 15일 출시.
프론티어에 가까운 지능을 가진 가장 빠른 모델
모델 ID: claude-haiku-4-5-20251001
컨텍스트 창: 200K 토큰 · 최대 출력: 64K 토큰 · 입력 가격: $1 / MTok · 출력 가격: $5 / MTok
발표 · 마이그레이션 가이드
비교 (How it compares)
| 모델 (Model) | 컨텍스트 | 최대 출력 | 가격 / MTok | 지연 | Thinking | 기본 effort | 지식 컷오프 |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high |
Jun 2026 |
| Claude Opus 5.5 | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium |
Jun 2026 |
| Claude Sonnet 5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high |
Jan 2026 |
| Claude Haiku 4.5 (이 모델) | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
- 컨텍스트: 1M 토큰은 현재 토크나이저에서 대략 555k 단어 또는 2.5M 유니코드 문자(Claude Opus 4.7과 함께 도입). 그 이전 모델은 1M 토큰에 약 750k 단어가 들어가요. 200k 토큰은 대략 150k 단어.
- 최대 출력: 동기 Messages API 한도. Message Batches API에서 Claude Opus 5.5, Claude Opus 5, Claude Sonnet 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Sonnet 4.6은
output-300k-2026-03-24beta 헤더로 최대 300k 출력 토큰을 지원해요. - 가격 / MTok: 입력 / 출력, 백만 토큰당 기본 가격. Batch API 요청은 50% 할인되고, 프롬프트 캐시 읽기는 기본 입력 가격의 10% 비용(Claude Fable 5.1·Claude Mythos 5.1은 2.5%, Claude Opus 5.5는 5%). 전체 목록은 Pricing 참고.
- 지연(Latency): models overview에 게시된 현재 라인업 대비 비교 지연. 실제 지연은 프롬프트 길이, 출력 길이, thinking effort에 달려요.
- Thinking: 적응형(adaptive) thinking은 모델이 effort로 조정되며 얼마나 생각할지 결정하게 해요. 확장(extended) thinking은 이전 모델의 수동
budget_tokens모드. - 기본 effort: Claude API에서 effort 파라미터의 기본값. 값이 없는 모델은 파라미터를 지원하지 않아요.
- 지식 컷오프: 신뢰할 수 있는 지식 컷오프: 모델의 지식이 가장 광범위하고 신뢰할 수 있는 날짜.
사양 (Specifications)
모델 ID (Model IDs)
| 플랫폼 (Platform) | 모델 ID (Model ID) |
|---|---|
| Claude API | claude-haiku-4-5-20251001 |
| Claude API 별칭 | claude-haiku-4-5 |
| Amazon Bedrock | anthropic.claude-haiku-4-5 |
| Amazon Bedrock (InvokeModel) | anthropic.claude-haiku-4-5-20251001-v1:0 |
| Google Cloud | claude-haiku-4-5@20251001 |
| Microsoft Foundry | claude-haiku-4-5 |
| Claude Platform on AWS | claude-haiku-4-5 |
가격 (Pricing)
| 기능 (Feature) | 값 (Value) |
|---|---|
| 입력 (Input) | $1 / MTok |
| 출력 (Output) | $5 / MTok |
| 5m 캐시 쓰기 | $1.25 / MTok |
| 1h 캐시 쓰기 | $2 / MTok |
| 캐시 읽기 | $0.10 / MTok |
| Batch API | 입력과 출력 50% 할인 |
기능 (Capabilities)
| 기능 (Feature) | 값 (Value) |
|---|---|
| 컨텍스트 창 | 200K 토큰 |
| 최대 출력 | 64K 토큰 |
| Thinking | Extended |
| 기본 effort | 지원 안 됨 |
| 비교 지연 | Fastest |
| 입력 → 출력 | 텍스트와 이미지 → 텍스트 |
| 신뢰할 수 있는 지식 컷오프 | Feb 2025 |
| 훈련 데이터 컷오프 | Jul 2025 |
가용성 (Availability)
| 기능 (Feature) | 값 (Value) |
|---|---|
| 상태 | Active (latest) |
| 출시 | 2025년 10월 15일 |
| 은퇴(Retirement) | 2026년 10월 15일 이전은 아님 |
| 플랫폼 | Claude API, Amazon Bedrock, Amazon Bedrock (InvokeModel), Google Cloud, Microsoft Foundry, Claude Platform on AWS |
알아두면 좋은 점 (Good to know)
claude-haiku-4-5는 고정 스냅샷claude-haiku-4-5-20251001로 해석되는 편의 별칭이에요. 모델 ID와 버전 관리 참고.- Claude Haiku 4.5는 적응형이 아닌 수동 확장 thinking(
thinking.type: "enabled")을 사용해요. - Models API로 쿼리 한도와 기능을 프로그래밍 방식으로 조회하세요.
리소스 (Resources)
참조 (Reference)
더 알아보기 (Learn more)
- 확장 thinking — 수동 thinking 모드
- 마이그레이션 가이드 — 이전 모델에서 이동
- 지연 줄이기 — 가장 빠른 모델 최적화