Claude Sonnet 5의 새로운 기능

Claude Sonnet 5의 새로운 기능 (What's new in Claude Sonnet 5)

Claude Sonnet 5는 Anthropic Sonnet 모델 제품군의 차세대 모델이에요. 세 가지 동작 변경과 함께 Claude Sonnet 4.6의 드롭인 업그레이드예요: adaptive thinking이 기본값으로 켜져 있고, 수동 extended thinking은 이제 400 오류를 반환하며(Claude Sonnet 4.6에서 더 이상 사용되지 않음), 샘플링 파라미터(temperature, top_p, top_k)를 비기본값으로 설정하면 400 오류를 반환해요. 이 페이지는 새 토크나이저를 포함해 출시 시점의 모든 새로운 내용을 요약해 드려요.

출처: 문서

본문

Claude Sonnet 5는 Anthropic Sonnet 모델 제품군의 차세대 모델이에요. 세 가지 동작 변경과 함께 Claude Sonnet 4.6의 드롭인 업그레이드예요: adaptive thinking이 기본값으로 켜져 있고, 수동 extended thinking은 이제 400 오류를 반환하며(Claude Sonnet 4.6에서 더 이상 사용되지 않음), 샘플링 파라미터(temperature, top_p, top_k)를 비기본값으로 설정하면 400 오류를 반환해요. 이 페이지는 새 토크나이저를 포함해 출시 시점의 모든 새로운 내용을 요약해 드려요.

새 모델

모델 API 모델 ID 설명
Claude Sonnet 5 claude-sonnet-5 속도와 지능의 최상의 조합

Claude Sonnet 5는 기본값으로 1M 토큰 컨텍스트 창을 지원하며(1M 토큰이 기본값이자 최댓값이고, 더 작은 컨텍스트 변형은 없어요), 128k 최대 출력 토큰, adaptive thinking, 그리고 Claude Sonnet 5에서는 제공되지 않는 Priority Tier를 제외하고 Claude Sonnet 4.6과 동일한 도구 및 플랫폼 기능 세트를 지원해요. Claude API와 Google Cloud에서 Claude Sonnet 5는 브라우저 사용 도구컴퓨터 사용 도구의 안정 버전 computer_toolset_20260801도 지원하는데, 둘 다 Claude Sonnet 4.6은 지원하지 않아요. 이전 computer_20251124 버전은 두 모델 모두에서 계속 허용돼요. 기존 통합을 업그레이드하려면 computer_20251124에서 마이그레이션을 참고하세요.

전체 가격과 사양은 모델 개요를 참고하세요.

동작 변경

Adaptive thinking 기본값 켜짐

Claude Sonnet 4.6에서는 thinking 필드가 없는 요청이 thinking 없이 실행돼요. Claude Sonnet 5에서는 같은 요청이 adaptive thinking으로 실행돼요. thinking을 끄려면 thinking: {type: "disabled"}를 전달하세요. max_tokens은 총 출력(thinking + 응답 텍스트)의 하드 한도이므로, Claude Sonnet 4.6에서 thinking 없이 실행되던 워크로드는 이를 다시 검토하세요.

샘플링 파라미터 허용 안 함

temperature, top_p, top_k를 비기본값으로 설정하면 400 오류가 반환돼요. 마이그레이션 시 이 파라미터들을 제거하세요. 기본값(또는 파라미터 생략)은 허용돼요. 모델 동작을 안내하려면 시스템 프롬프트 지시를 사용하세요. 이것은 Sonnet 계열 모델에 새로 도입된 것으로, 같은 제약이 이전에 Claude Opus 4.7에 먼저 도입되었어요.

수동 extended thinking 제거됨

수동 extended thinking(thinking: {type: "enabled", budget_tokens: N})은 Claude Sonnet 4.6에서 더 이상 사용되지 않았고, Claude Sonnet 5에서는 제거되어 400 오류를 반환해요. Claude Opus 4.8과 Claude Opus 4.7과 동일해요. 대신 effort 파라미터와 함께 adaptive thinking을 사용하세요.

```python Python # Not supported on Claude Sonnet 5 (returns 400) thinking = {"type": "enabled", "budget_tokens": 32000}

Use this instead

thinking = {"type": "adaptive"}


```typescript TypeScript
// Not supported on Claude Sonnet 5 (returns 400)
const legacyThinking = { type: "enabled", budget_tokens: 32000 };

// Use this instead
const thinking = { type: "adaptive" };
// Not supported on Claude Sonnet 5 (returns 400)
var legacyThinking = new ThinkingConfigEnabled(budgetTokens: 32000);

// Use this instead
var thinking = new ThinkingConfigAdaptive();
// Not supported on Claude Sonnet 5 (returns 400)
legacyThinking := anthropic.ThinkingConfigParamUnion{
	OfEnabled: &anthropic.ThinkingConfigEnabledParam{BudgetTokens: 32000},
}

// Use this instead
thinking := anthropic.ThinkingConfigParamUnion{
	OfAdaptive: &anthropic.ThinkingConfigAdaptiveParam{},
}
// Not supported on Claude Sonnet 5 (returns 400)
var legacyThinking = ThinkingConfigEnabled.builder().budgetTokens(32_000L).build();

// Use this instead
var thinking = ThinkingConfigAdaptive.builder().build();
// Not supported on Claude Sonnet 5 (returns 400)
$thinking = ['type' => 'enabled', 'budget_tokens' => 32000];

// Use this instead
$thinking = ['type' => 'adaptive'];
# Not supported on Claude Sonnet 5 (returns 400)
legacy_thinking = {type: "enabled", budget_tokens: 32_000}

# Use this instead
thinking = {type: "adaptive"}

새 토크나이저

Claude Sonnet 5는 새 토크나이저를 사용해요. 같은 입력 텍스트는 Claude Sonnet 4.6보다 약 30% 더 많은 토큰을 생성해요. 정확한 증가량은 콘텐츠에 따라 달라져요. 이것은 API 변경이 아니에요. 요청, 응답, 스트리밍 이벤트는 동일한 형태를 유지하며 코드 변경이 필요하지 않아요.

이 변경은 토큰으로 측정하거나 예산을 세우는 모든 것에 영향을 미쳐요:

  • 토큰 수: 같은 텍스트에 대한 usage 필드와 토큰 계산 결과가 Claude Sonnet 4.6보다 높아요. 이전 모델로 측정한 수치를 재사용하지 말고 Claude Sonnet 5 기준으로 다시 계산하세요.
  • 텍스트 기준 컨텍스트 창 용량: 컨텍스트 창은 1M 토큰이지만 각 토큰이 평균적으로 더 적은 텍스트를 덮으므로, 같은 창이 Claude Sonnet 4.6보다 더 적은 텍스트를 담아요.
  • max_tokens 예산: Claude Sonnet 4.6에 맞춰 조정된 출력 한도는 Claude Sonnet 5에서 동등한 출력을 잘라낼 수 있어요. 예상 출력 길이에 가깝게 조정된 한도를 다시 검토하세요.
  • 요청당 비용: 토큰당 가격은 Claude Sonnet 4.6보다 낮지만(가격 참고), 같은 텍스트가 더 많은 토큰을 생성하므로 동등한 요청의 비용은 직접적으로 비례해 내려가지 않아요.

Claude Sonnet 4.6에서 물려받은 API 제약

이 제약은 Claude Sonnet 4.6과 동일하게 유지돼요. 세 가지 [동작 변경](https://platform.claude.com/docs/en/models/sonnet-5/whats-new-sonnet-5#behavior-changes)([마이그레이션 가이드](https://platform.claude.com/docs/en/models/sonnet-5/whats-new-sonnet-5#migration-guide) 참고)을 제외하고, Claude Sonnet 4.6에서 이미 실행 중인 코드는 다른 변경이 필요하지 않아요.

Assistant 메시지 프리필 미지원

assistant 메시지 프리필은 Claude Sonnet 4.6과 동일하게 400 오류를 반환해요. 대신 구조화된 출력, 시스템 프롬프트 지시, 또는 output_config.format을 사용하세요.

기능 개선

Claude Sonnet 5는 더 낮은 가격에 Claude Sonnet 4.6보다 높은 기능을 제공하는 업그레이드예요. 또한 Opus 계열 모델로 이동하지 않고 Claude Sonnet 4.6보다 더 많은 기능이 필요한 워크로드의 옵션이기도 해요.

Claude Sonnet 4.6 대비 가장 큰 향상은 코딩과 에이전트 작업에서 나타나요. 벤치마크 결과는 Anthropic의 Transparency Hub를 참고하세요.

사이버 보안 안전장치

Claude Sonnet 5는 실시간 사이버 보안 안전장치를 갖춘 첫 Sonnet 등급 모델이에요. 금지되거나 고위험 사이버 보안 주제가 포함된 요청은 거절될 수 있어요. 거절은 오류가 아닌 stop_reason: "refusal"을 가진 성공적인 HTTP 200 응답으로 반환돼요. 안전장치가 차단하는 내용과 합법적인 보안 작업이 Cyber Verification Program에 어떻게 적용될 수 있는지는 Claude Opus 및 Sonnet의 실시간 사이버 안전장치를 참고하세요.

가격

Claude Sonnet 5는 입력 백만 토큰당 $2, 출력 백만 토큰당 $10으로 책정되어, Claude Sonnet 4.6의 $3/$15보다 토큰당 가격이 낮아요. 새 토크나이저가 같은 텍스트에 대해 약 30% 더 많은 토큰을 생성하므로, Claude Sonnet 4.6과 비교할 때 동등한 요청의 비용은 토큰당 가격에 직접 비례해 내려가지 않아요. 정확한 차이는 콘텐츠와 워크로드 형태에 따라 달라져요.

배치 처리와 프롬프트 캐시 요율을 포함한 전체 가격은 가격을 참고하세요.

제공 (Availability)

출시 시점에 Claude Sonnet 5는 다음에서 제공돼요:

Claude Sonnet 5는 ZDR 계약을 맺은 조직을 위한 zero data retention을 지원해요.

마이그레이션 가이드

Claude Sonnet 5는 Claude Sonnet 4.6의 드롭인 대체재예요. 모델 ID를 업데이트하세요:

```python Python model = "claude-sonnet-4-6" # Before model = "claude-sonnet-5" # After ```
const legacyModel = "claude-sonnet-4-6"; // Before
const model = "claude-sonnet-5"; // After
var legacyModel = Model.ClaudeSonnet4_6; // Before
var model = Model.ClaudeSonnet5; // After
// Before
legacyModel := anthropic.ModelClaudeSonnet4_6
// After
model := anthropic.ModelClaudeSonnet5
var legacyModel = Model.CLAUDE_SONNET_4_6; // Before
var model = Model.CLAUDE_SONNET_5; // After
$model = 'claude-sonnet-4-6'; // Before
$model = 'claude-sonnet-5'; // After
legacy_model = "claude-sonnet-4-6" # Before
model = "claude-sonnet-5" # After

그런 다음 다음을 검토하세요:

  1. 토큰 예산과 수: 새 토크나이저가 같은 텍스트에 대해 약 30% 더 많은 토큰을 생성해요. 정확한 증가량은 콘텐츠와 워크로드 형태에 따라 달라져요. 토큰 계산으로 프롬프트를 다시 계산하고, 예상 출력 길이에 가깝게 조정된 max_tokens 한도를 다시 검토하세요.
  2. Extended thinking: 여전히 budget_tokens을 설정한다면 adaptive thinking으로 마이그레이션하세요. 수동 extended thinking(thinking: {type: "enabled"})은 지원되지 않으며 400 오류를 반환해요.
  3. 샘플링 파라미터: 샘플링 파라미터(temperature, top_p, top_k)를 비기본값으로 설정하는 요청은 400 오류를 반환해요. 마이그레이션 시 제거하세요. 도구 정의와 응답 형태는 변함없고, assistant 메시지 프리필은 Claude Sonnet 4.6에서 이미 지원되지 않았어요.

자세한 내용은 Claude Sonnet 4.6에서 Claude Sonnet 5로 마이그레이션을 참고하세요.

다음 단계

모든 현재 Claude 모델의 전체 사양과 가격. 마이그레이션 전에 새 토크나이저로 프롬프트를 측정하세요. Claude Sonnet 5에서 권장되는 thinking 모드. 1M 토큰 컨텍스트 창이 어떻게 동작하는지. 배치 처리와 프롬프트 캐시 요율을 포함한 전체 가격.

더 알아보기 (Learn more)