모델 개요
모델 개요 (Models overview)
Claude는 Anthropic이 개발한 최첨단 대규모 언어 모델(LLM) 제품군이에요. 이 가이드에서는 현재 제공되는 모델들을 소개하고 각각의 성능을 비교해 드려요. 어떤 모델을 써야 할지 고민될 때 참고하기 좋은 출발점이랍니다.
출처: 문서
본문
Claude는 Anthropic이 개발한 최첨단 대규모 언어 모델 제품군이에요. 현재 라인업을 비교해 보고, 모든 플랫폼에서 사용할 모델 ID를 찾아보며, 전체 사양과 리소스는 각 모델의 페이지에서 확인할 수 있어요.
모델 비교
어떤 모델을 사용할지 확실하지 않다면, 대부분의 워크로드에서 Claude Opus 5.5부터 시작해 보세요. 고난도 추론과 장기간에 걸친 에이전트(agentic) 작업이 필요하거나, Claude Opus 5.5를 더 높은 effort로 평가했을 때 목표에 미치지 못할 때는 Claude Fable 5.1을 사용하세요. 모든 현재 모델은 텍스트 및 이미지 입력, 텍스트 출력, 다국어 지원, 비전, 도구 사용(tool use)을 지원해요. 각 모델의 페이지에서 해당 모델이 제공되는 플랫폼을 확인할 수 있어요.
| 기능 | Claude Fable 5.1 | Claude Opus 5.5 | Claude Sonnet 5 | Claude Haiku 4.5 |
|---|---|---|---|---|
| 설명 | 고난도 추론과 장기 에이전트 작업용 | 장기 실행 에이전트 코딩과 지식 작업용 | 속도와 지능의 최상의 조합 | 프런티어에 근접한 지능을 갖춘 가장 빠른 모델 |
| 모델 페이지 | Claude Fable 5.1 | Claude Opus 5.5 | Claude Sonnet 5 | Claude Haiku 4.5 |
| 상대적 지연 시간 | 느림 | 보통 | 빠름 | 가장 빠름 |
| 가격 | $10 / 입력 MTok, $50 / 출력 MTok | $4 / 입력 MTok, $20 / 출력 MTok | $2 / 입력 MTok, $10 / 출력 MTok | $1 / 입력 MTok, $5 / 출력 MTok |
| Claude API ID | claude-fable-5-1 |
claude-opus-5-5 |
claude-sonnet-5 |
claude-haiku-4-5-20251001 |
| Thinking | Adaptive (항상 켜짐) | Adaptive (항상 켜짐) | Adaptive | Extended |
| 기본 effort | high |
medium |
high |
지원 안 함 |
| 컨텍스트 창 | 1M 토큰 | 1M 토큰 | 1M 토큰 | 200K 토큰 |
| 최대 출력 | 128K 토큰 | 128K 토큰 | 128K 토큰 | 64K 토큰 |
| 신뢰 가능한 지식 기준일 | 2026년 6월 | 2026년 6월 | 2026년 1월 | 2025년 2월 |
| 학습 데이터 기준일 | 2026년 6월 | 2026년 6월 | 2026년 1월 | 2025년 7월 |
| 폐기 예정일 | 2027년 9월 1일 이전은 아님 | 2027년 9월 22일 이전은 아님 | 2027년 6월 30일 이전은 아님 | 2026년 10월 15일 이전은 아님 |
| Claude API 별칭 | claude-fable-5-1 |
claude-opus-5-5 |
claude-sonnet-5 |
claude-haiku-4-5 |
| Amazon Bedrock ID | anthropic.claude-fable-5-1 |
anthropic.claude-opus-5-5 |
anthropic.claude-sonnet-5 |
anthropic.claude-haiku-4-5 |
| Google Cloud ID | claude-fable-5-1 |
claude-opus-5-5 |
claude-sonnet-5 |
claude-haiku-4-5@20251001 |
| Microsoft Foundry ID | claude-fable-5-1 |
claude-opus-5-5 |
claude-sonnet-5 |
claude-haiku-4-5 |
| AWS 위의 Claude Platform ID | claude-fable-5-1 |
claude-opus-5-5 |
claude-sonnet-5 |
claude-haiku-4-5 |
- 상대적 지연 시간: 현재 라인업 기준 상대값이에요. 실제 지연 시간은 프롬프트 길이, 출력 길이, thinking effort에 따라 달라져요.
- 가격: 백만 토큰당 기본 가격이에요. 배치 API 요청은 50% 할인되고, 프롬프트 캐시 읽기는 기본 입력 가격의 10%(Claude Fable 5.1·Claude Mythos 5.1은 2.5%, Claude Opus 5.5는 5%)예요. 캐시 쓰기, 롱 컨텍스트, 플랫폼별 가격은 가격 페이지에서 확인하세요.
- Claude API ID: 모든 Claude 모델 ID는 고정된 스냅샷이에요. 4.6 세대부터 쓰이는 날짜 없는 ID도 포함해요.
- Thinking: Adaptive thinking은 effort로 조종되며 모델이 얼마나 생각할지 스스로 정하게 해요. Extended thinking은 이전 모델에서 수동으로 thinking.type "enabled" + budget_tokens를 쓰는 방식이며, Claude Opus 4.6과 Claude Sonnet 4.6에서는 더 이상 사용되지 않고 후속 모델에서는 허용되지 않아요.
- 기본 effort: Claude API에서 effort 파라미터의 기본값이에요. 다른 수준을 쓰려면 effort를 명시적으로 설정하세요.
- 컨텍스트 창: 1M 토큰은 현재 토크나이저 기준 대략 55만 단어 또는 250만 유니코드 문자(Claude Opus 4.7에서 도입)예요. 그 이전 모델은 1M 토큰에 약 75만 단어가 들어가요. 200k 토큰은 대략 15만 단어예요.
- 최대 출력: 동기식 Messages API 한도예요. Message Batches API에서는 Claude Opus 5.5, Claude Opus 5, Claude Sonnet 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Sonnet 4.6이
output-300k-2026-03-24베타 헤더로 최대 300k 출력 토큰을 지원해요. - 신뢰 가능한 지식 기준일: 모델 지식이 가장 광범위하고 신뢰할 수 있는 시점이에요. 학습 데이터 기준일(추가 세부 정보 항목)은 실제 사용된 더 넓은 데이터 범위를 뜻해요. 자세한 내용은 Anthropic의 Transparency Hub를 참조하세요.
- 폐기 예정일: Anthropic이 Anthropic 운영 플랫폼(Claude API, AWS 위의 Claude Platform, Microsoft Foundry)에 약속한 기한이에요. Amazon Bedrock과 Google Cloud는 자체 날짜를 정해요.
- Claude API 별칭: 4.6 세대 이전 모델의 경우 별칭은 날짜가 있는 ID로 연결되는 편의 포인터예요. 날짜 없는 ID는 그 자체가 고정된 스냅샷이며, 별칭 행은 그대로 반복돼요.
- Amazon Bedrock ID: Bedrock의 Messages-API 엔드포인트에서 사용하는 ID(Claude Opus 4.7 이후 및 Claude Haiku 4.5)예요. Bedrock의 InvokeModel 통합으로만 제공되는 모델은 대신 그 ID를 보여줘요. Bedrock은 Claude Sonnet 4.5 이후 모델에 대해 글로벌 엔드포인트(동적 라우팅)와 리전별 엔드포인트(보장된 데이터 라우팅)를 제공하며 자체 수명주기 날짜를 정해요.
- Google Cloud ID: Google Cloud는 글로벌, 멀티 리전, 리전별 엔드포인트를 제공하고 자체 수명주기 날짜를 정해요.
- Microsoft Foundry ID: Foundry 배포는 기본적으로 Claude API 모델 ID(별칭이 있다면 그 별칭)를 사용해요. 전송하는 것은 배포 이름이에요. Foundry는 Claude API 수명주기 일정을 따릅니다.
- AWS 위의 Claude Platform ID: AWS 위의 Claude Platform은 Claude API 모델 ID(Claude API에 별칭이 있는 경우 날짜 없는 형태)를 사용하며 Bedrock 방식 ID가 아니에요. Anthropic의 1st-party 모델 수명주기를 따릅니다.
모델 ID 및 버전 관리와 가격 문서를 참고하세요.
레거시 모델(여전히 사용 가능): Claude Fable 5, Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Opus 4.5, Claude Sonnet 4.6, Claude Sonnet 4.5.
모델을 골랐다면 첫 API 호출을 만드는 방법을 알아보세요. 모델 ID, 별칭, 스냅샷이 어떻게 동작하는지 이해하려면 모델 ID 및 버전 관리를, 각 모델의 신뢰 가능한 지식 및 학습 데이터 기준일은 Anthropic의 Transparency Hub에서 확인하세요.
Models API 사용하기
Models API로 모델의 기능과 토큰 한도를 프로그래밍 방식으로 조회할 수 있어요. 응답에는 사용 가능한 모든 모델에 대한 max_input_tokens, max_tokens, capabilities 객체가 포함됩니다.
프롬프트 및 출력 성능
현재 Claude 모델은 다음 분야에서 뛰어나요:
- 성능: 추론, 코딩, 다국어 작업, 롱 컨텍스트 처리, 정직성, 이미지 처리에서 최상위 결과를 보여줘요. 일반 및 모델별 프롬프팅 지침은 프롬프팅 모범 사례를 참고하세요.
- 몰입형 응답: Claude 모델은 풍부하고 인간적인 상호작용이 필요한 애플리케이션에 이상적이에요. 더 간결한 응답을 원한다면 프롬프트를 조정해 모델이 원하는 출력 길이를 향하도록 안내하세요. 자세한 내용은 프롬프트 엔지니어링 가이드를 참조하세요.
- 출력 품질: 이전 모델 세대에서 마이그레이션할 때 전반적인 성능의 큰 개선을 느낄 수 있어요. Claude Opus 5 이하를 사용 중이라면 Claude Opus 5.5로 마이그레이션 문서를 참고하세요.
Claude 시작하기
Claude가 여러분을 위해 어떤 일을 할 수 있는지 탐색할 준비가 되었다면, 바로 시작해 보세요! 앱에 Claude를 통합하려는 개발자든, AI의 힘을 직접 경험하고 싶은 사용자든 아래 리소스가 도움이 될 거예요.
Claude와 대화하고 싶으신가요? claude.ai를 방문해 보세요. 궁금한 점이 있다면 지원팀이나 Discord 커뮤니티에 문의하세요.