올바른 모델 선택하기
올바른 모델 선택하기 (Choosing the right model)
클로드 모델을 고를 때는 성능(capabilities), 속도, 비용 사이의 균형을 잘 맞추는 게 중요해요. 이번 가이드에서는 모델을 선택하기 전에 체크해 볼 핵심 항목과, 첫 모델을 고르는 두 가지 방법, 그리고 선택한 모델을 테스트하는 방법을 차근차근 설명해 드릴게요. 처음부터 완벽한 모델을 고르려 하기보다, 명확한 기준을 세우고 여러 모델을 직접 비교해 보는 습관이 가장 좋아요.
출처: 문서
본문
핵심 기준 세우기 (Establish key criteria)
클로드 모델을 선택할 때는 먼저 다음 요소를 평가해 보는 것을 권장해요:
- 성능(Capabilities): 요구 사항을 충족하려면 모델에 어떤 특정 기능이나 성능이 필요한가요?
- 속도(Speed): 애플리케이션에서 모델이 얼마나 빨리 응답해야 하나요? Claude Opus 5.5, Claude Opus 5, Claude Opus 4.8은 프리미엄 요금으로 최대 2.5배 높은 출력 속도를 제공하는 패스트 모드(fast mode)(연구 프리뷰)를 지원해요.
- 비용(Cost): 개발 및 프로덕션 사용을 위한 예산은 어느 정도인가요?
- 노력(Effort): 여러 클로드 모델이 단일 모델 내에서 지능과 지연 시간, 비용을 맞바꾸는 effort 파라미터를 지원해요. effort를 조정하는 것이 모델을 바꾸는 것보다 더 좋은 방법인 경우가 많아요. Claude Fable 5.1과 Claude Opus 5에서는 기본값(
high)으로 시작해서 평가 결과에 따라 올리거나 내리세요. Claude Opus 5.5에서는 기본값이medium이니 거기서 시작해 같은 방식으로 조정하세요. Claude Opus 4.8과 Claude Opus 4.7에서는high와max사이에 있는xhigh노력 수준이 대부분의 코딩 및 에이전트 유스 케이스에 가장 적합한 설정이에요.
시작하기 좋은 최적의 모델 선택하기
어떤 클로드 모델이 내 요구에 가장 잘 맞는지 테스트하기 위해 쓸 수 있는 일반적인 접근 방식 두 가지가 있어요.
옵션 1: 효율성 우선으로 시작
많은 애플리케이션에서 Claude Haiku 4.5처럼 더 빠르고 비용 효율적인 모델로 시작하는 것이 최적의 접근이 될 수 있어요:
- Claude Haiku 4.5로 구현을 시작해요.
- 유스 케이스를 철저히 테스트해요.
- 성능이 요구 사항을 충족하는지 평가해요.
- 특정 성능 격차가 필요한 경우에만 업그레이드해요.
이 접근 방식은 빠른 반복과 낮은 개발 비용을 가능하게 하며, 흔한 애플리케이션 대부분에 충분한 경우가 많아요. 이 방식은 다음에 적합해요:
- 초기 프로토타이핑과 개발
- 지연 시간 요구가 까다로운 애플리케이션
- 비용에 민감한 구현
- 대량의 단순한 작업
옵션 2: 성능 우선으로 시작
복잡한 작업처럼 지능과 고급 성능이 가장 중요한 경우에는 성능 우선으로 시작할 수 있어요. 즉 작업에 가장 강력한 시작점으로 구현한 뒤, 나중에 더 효율적인 모델로 최적화하는 방식이에요:
- Claude Opus 5.5로 구현해요.
- 이 모델에 맞게 프롬프트를 최적화해요.
- 성능이 요구 사항을 충족하는지 평가해요.
- 워크플로우 최적화를 더하면서 시간이 지남에 따라 effort를 낮추거나 모델을 다운그레이드해 효율성을 높이는 것을 고려해요.
xhigh나maxeffort에서의 평가가 까다로운 추론이나 장기 에이전트 작업에서 여전히 부족하다면, Claude Fable 5.1로 이동해요.
이 방식은 다음에 적합해요:
- 복잡한 추론 작업
- 과학적 또는 수학적 애플리케이션
- 미묘한 이해가 필요한 작업
- 정확성이 비용 고려보다 우선하는 애플리케이션
- 고급 코딩과 높은 자율성의 에이전트 작업
Claude Opus 5.5(claude-opus-5-5)는 장시간 실행되는 에이전트 코딩과 지식 작업을 위해 만들어졌으며, 적응형 사고(adaptive thinking)가 항상 켜져 있어요. 통합이 도구 사용을 강제하거나(tool_choice가 any 또는 tool 유형), 사고를 끄거나, computer_20251124 컴퓨터 사용 도구를 사용한다면, 전환하기 전에 Breaking changes를 확인하세요.
Claude Fable 5.1(claude-fable-5-1)은 Anthropic이 널리 공개한 모델 중 가장 뛰어난 성능을 가진 모델이에요. Claude Fable 5를 확장해 장시간 실행되는 에이전트 코딩, 지식 작업, 연구를 더 강력하게 제공하며 입력·출력 가격은 동일하고 캐시 읽기는 4분의 1 비용이에요. Claude Mythos 5.1(claude-mythos-5-1)은 Project Glasswing 참가자에게만 동일한 성능을 제공해요. 두 모델 모두 항상 켜져 있는 적응형 사고를 사용해요. 자세한 내용은 Claude Fable 5.1의 새로운 기능을 참고하세요.
컨텍스트 창, 출력 한도, 가격에 대해서는 모델 비교 표를 참고하세요.
모델 선택 매트릭스 (Model selection matrix)
대부분의 워크로드는 Claude Opus 5.5로 시작해요.
| 이런 게 필요할 때... | 다음으로 시작해 보세요... | 예시 유스 케이스 |
|---|---|---|
| 가장 높은 수준의 성능 | Claude Fable 5.1 | 수 시간 동안 실행되는 에이전트 세션, 다단계 심층 연구, 완성된 문서·스프레드시트·덱까지 이어지는 분석 |
| 복잡한 에이전트 코딩과 엔터프라이즈 작업 | Claude Opus 5.5 | 다중 시간 자율 코딩 에이전트, 대규모 리팩토링, 복잡한 시스템 엔지니어링, 비전 중심 워크플로우, 컴퓨터 사용 |
| 일상적인 코딩, 에이전트, 엔터프라이즈 워크로드를 위한 속도와 성능 | Claude Sonnet 5 | 코드 생성, 데이터 분석, 콘텐츠 제작, 시각적 이해, 에이전트 도구 사용 |
| 확장된 사고와 함께 가장 낮은 지연 시간과 가격 | Claude Haiku 4.5 | 실시간 애플리케이션, 대량 지능 처리, 강력한 추론이 필요한 비용 민감 배포, 하위 에이전트 작업 |
업그레이드하거나 모델을 바꿀지 결정하기
업그레이드하거나 모델을 바꿔야 하는지 판단하려면 다음을 하세요:
-
유스 케이스에 특화된 벤치마크 테스트를 만들어요 — 좋은 평가 세트를 갖추는 것이 이 과정에서 가장 중요한 단계예요.
-
실제 프롬프트와 데이터로 테스트해요.
-
다음 항목에 대해 모델 간 성능을 비교해요:
- 응답의 정확성
- 응답 품질
- 엣지 케이스 처리
-
성능과 비용의 트레이드오프를 따져 봐요.
모델 조합하기 (Combine models)
다중 모델 전략은 낮은 비용의 모델과 프런티어 모델을 짝지어 대부분의 토큰이 낮은 요율로 청구되도록 해요. 흔한 두 가지 패턴은, 어려운 결정을 어드바이저(advisor)에게 에스컬레이션하는 실행자(executor)와, 대량 작업을 저비용 워커에게 위임하는 오케스트레이터(orchestrator)예요. 두 전략, 측정된 예시, 구현 옵션 모두 비용과 지능 최적화에서 확인할 수 있어요.