모델 (Models)

모델 (Models)

Claude는 Anthropic이 개발한 최첨단 대규모 언어 모델(LLM) 제품군이에요. 현재 라인업을 비교하고, 각 플랫폼에서 쓸 모델 ID를 찾고, 각 모델의 페이지로 들어가 상세 사양과 리소스를 확인해 볼 수 있어요.

모델 비교

어떤 모델을 쓸지 고민된다면 대부분의 작업은 Claude Opus 5부터 시작하는 걸 추천해요. 까다로운 추론과 긴 호라이즌의 에이전트 작업이 필요하거나, 높은 effort에서 Claude Opus 5 평가가 여전히 부족할 때는 Claude Fable 5.1을 쓰면 돼요. 현재 모델은 모두 텍스트·이미지 입력, 텍스트 출력, 다국어, 비전, 도구 사용을 지원해요. 각 모델 페이지에는 해당 모델이 제공되는 플랫폼이 나와 있어요.

기능 Claude Fable 5.1 Claude Opus 5 Claude Sonnet 5 Claude Haiku 4.5
설명 까다로운 추론과 긴 호라이즌 에이전트 작업용 복잡한 에이전트 코딩과 엔터프라이즈 작업용 속도와 지능의 최상의 조합 최첨단에 가까운 지능을 가진 가장 빠른 모델
모델 페이지 Claude Fable 5.1 Claude Opus 5 Claude Sonnet 5 Claude Haiku 4.5
상대적 지연 시간 느림 보통 빠름 가장 빠름
가격 입력 $10/MTok, 출력 $50/MTok 입력 $5/MTok, 출력 $25/MTok 입력 $2/MTok, 출력 $10/MTok 입력 $1/MTok, 출력 $5/MTok
Claude API ID claude-fable-5-1 claude-opus-5 claude-sonnet-5 claude-haiku-4-5-20251001
Thinking Adaptive (always on) Adaptive Adaptive Extended
기본 effort high high high 지원 안 함
컨텍스트 윈도우 1M 토큰 1M 토큰 1M 토큰 200K 토큰
최대 출력 128K 토큰 128K 토큰 128K 토큰 64K 토큰
신뢰 가능 지식 컷오프 2026년 6월 2026년 5월 2026년 1월 2025년 2월
학습 데이터 컷오프 2026년 6월 2026년 5월 2026년 1월 2025년 7월
Retirement 2027년 9월 1일 이전에는 아님 2027년 7월 24일 이전에는 아님 2027년 6월 30일 이전에는 아님 2026년 10월 15일 이전에는 아님
Claude API 별칭 claude-fable-5-1 claude-opus-5 claude-sonnet-5 claude-haiku-4-5
Amazon Bedrock ID anthropic.claude-fable-5-1 anthropic.claude-opus-5 anthropic.claude-sonnet-5 anthropic.claude-haiku-4-5
Google Cloud ID claude-fable-5-1 claude-opus-5 claude-sonnet-5 claude-haiku-4-5@20251001
Microsoft Foundry ID claude-fable-5-1 claude-opus-5 claude-sonnet-5 claude-haiku-4-5
Claude Platform on AWS ID claude-fable-5-1 claude-sonnet-5 claude-haiku-4-5
  • 상대적 지연 시간: 현재 라인업 기준 상대적인 수치예요. 실제 지연 시간은 프롬프트 길이, 출력 길이, thinking effort에 따라 달라져요.

  • 가격: 백만 토큰당 기본 가격이에요. Batch API 요청은 50% 할인되고, 프롬프트 캐시 읽기는 기본 입력 가격의 10%(Claude Fable 5.1과 Claude Mythos 5.1에서는 2.5%)예요. 캐시 쓰기, 긴 컨텍스트, 플랫폼별 가격은 Pricing 문서를 참고하세요.

  • Claude API ID: 모든 Claude 모델 ID는 고정된 스냅샷(pinned snapshot)이에요. 여기에는 4.6 세대부터 도입된 날짜 없는(dateless) ID도 포함돼요.

  • Thinking: Adaptive thinking은 effort에 따라 모델이 얼마나 생각할지 스스로 정하게 해요. Extended thinking은 이전 모델에서 thinking.type을 "enabled"로 하고 budget_tokens을 설정하는 수동 방식으로, Claude Opus 4.6과 Claude Sonnet 4.6에서는 더 이상 사용하지 않으며(deprecated) 이후 모델에서는 받지 않아요.

  • 기본 effort: Claude API에서 effort 파라미터의 기본값이에요. 다른 레벨을 쓰려면 effort를 명시적으로 설정하면 돼요.

  • 컨텍스트 윈도우: 1M 토큰은 현재 토크나이저 기준 대략 555k 단어 또는 2.5M 유니코드 문자에 해당해요(Claude Opus 4.7에서 도입). 그 이전 모델은 1M 토큰에 약 750k 단어가 들어가요. 200K 토큰은 대략 150k 단어예요.

  • 최대 출력: 동기 Messages API 제한이에요. Message Batches API에서는 Claude Opus 5, Claude Sonnet 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Sonnet 4.6이 output-300k-2026-03-24 베타 헤더로 최대 300k 출력 토큰을 지원해요.

  • 신뢰 가능 지식 컷오프: 모델의 지식이 가장 광범위하고 신뢰할 수 있는 시점이에요. 학습 데이터 컷오프(Show all details 아래)는 사용된 데이터의 더 넓은 범위예요. 자세한 내용은 Anthropic의 Transparency Hub를 참고하세요.

  • Retirement: Anthropic 운영 플랫폼(Claude API, Claude Platform on AWS, Microsoft Foundry)에 대한 Anthropic의 약속이에요. Amazon Bedrock과 Google Cloud는 자체 날짜를 정해요.

  • Claude API 별칭: 4.6 세대 이전 모델의 별칭은 날짜가 있는 ID를 가리키는 편의 포인터예요. 날짜 없는 ID는 그 자체가 고정된 스냅샷이라, 별칭 행에도 같은 값이 반복돼요.

  • Amazon Bedrock ID: Bedrock의 Messages-API 엔드포인트에서 쓰는 ID예요(Claude Opus 4.7 이상과 Claude Haiku 4.5). Bedrock의 InvokeModel 통합으로만 제공되는 모델은 그 ID가 대신 표시돼요. Bedrock은 Claude Sonnet 4.5 이후에 전역 엔드포인트(동적 라우팅)와 리전 엔드포인트(보장된 데이터 라우팅)를 제공하고, 자체 라이프사이클 날짜를 정해요.

  • Google Cloud ID: Google Cloud는 전역, 멀티리전, 리전 엔드포인트를 제공하고 자체 라이프사이클 날짜를 정해요.

  • Microsoft Foundry ID: Foundry 배포는 기본적으로 Claude API 모델 ID(별칭이 있으면 별칭)를 사용해요. 보내는 것은 배포 이름이에요. Foundry는 Claude API 라이프사이클 일정을 따르지 않아요.

  • Claude Platform on AWS ID: Claude Platform on AWS는 Bedrock식 ID가 아니라 Claude API 모델 ID(Claude API에 별칭이 있을 땐 날짜 없는 형태)를 사용하고, Anthropic의 퍼스트파티 모델 라이프사이클을 따라요.

자세한 내용은 Model IDs and versioningPricing을 참고하세요.

레거시 모델(여전히 사용 가능): Claude Fable 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Opus 4.5, Claude Sonnet 4.6, Claude Sonnet 4.5.

모델을 골랐다면 첫 API 호출 알아보기로 넘어가 보세요. 모델 ID, 별칭, 스냅샷이 어떻게 동작하는지 보려면 Model IDs and versioning을, 각 모델의 신뢰 가능 지식·학습 데이터 컷오프를 보려면 Anthropic의 Transparency Hub를 참고하세요.

Models API 사용하기

Models API로 모델의 능력과 토큰 제한을 프로그래밍 방식으로 조회할 수 있어요. 응답에는 사용 가능한 모든 모델의 max_input_tokens, max_tokens, capabilities 객체가 포함돼요.

프롬프트 및 출력 성능

현재 Claude 모델은 다음 분야에서 뛰어나요.

  • 성능: 추론, 코딩, 다국어 작업, 긴 컨텍스트 처리, 정직성, 이미지 처리에서 최상위 결과를 냈어요. 일반·모델별 프롬프팅 지침은 Prompting best practices를 참고하세요.
  • 몰입감 있는 응답: Claude 모델은 풍부하고 인간다운 상호작용이 필요한 애플리케이션에 이상적이에요. 더 간결한 응답을 원하면 프롬프트로 원하는 출력 길이를 유도하면 돼요. 자세한 내용은 프롬프트 엔지니어링 가이드를 참고하세요.
  • 출력 품질: 이전 모델 세대에서 마이그레이션하면 전반적인 성능이 더 크게 개선된 것을 느낄 수 있어요. Claude Opus 4.8 이하를 쓰고 있다면 Claude Opus 5로 마이그레이션 문서를 참고하세요.

Claude 시작하기

Claude가 할 수 있는 일을 탐색할 준비가 되었다면 바로 시작해 보세요. 애플리케이션에 Claude를 통합하려는 개발자든, AI의 힘을 직접 경험해 보고 싶은 사용자든 아래 리소스가 도움이 돼요.

  • Claude 소개 (intro) — Claude의 기능과 개발 흐름을 살펴봐요.
  • 퀵스타트 (get-started) — 몇 분 안에 첫 API 호출을 만들어 봐요.
  • 모델 선택 (choosing-a-model) — 기준을 세우고 사용 사례에 맞는 모델을 골라 봐요.
  • 가격 (pricing) — 배치 할인과 프롬프트 캐싱 요율을 포함한 전체 가격표예요.
  • 모델 지원 종료 (model-deprecations) — 모든 모델의 라이프사이클 상태와 지원 종료 약속이에요.
  • Claude Console (console) — 브라우저에서 바로 프롬프트를 만들고 테스트해 봐요.

Claude와 직접 대화하고 싶다면 claude.ai를 방문하세요. 질문이 있으면 지원 팀이나 Discord 커뮤니티에 문의할 수 있어요.