Llama 4 Scout — 17Bx16E, 10M 컨텍스트
Llama 4 Scout — 17Bx16E, 10M 컨텍스트
Llama 4 Scout은 17B 활성 파라미터, 16개 전문가를 가진 소형이면서 성능이 뛰어난 MoE 모델이에요. 총 파라미터는 109B이고, 10M 토큰 컨텍스트를 지원해요. 긴 문서를 통째로 넣어야 하는 작업에 특히 유리하죠.
주요 스펙
| 항목 | 값 |
|---|---|
| 활성 파라미터 | 17B |
| 총 파라미터 | 109B |
| 전문가 | 16 Expert (MoE) |
| 입력 모달리티 | 다국어 텍스트 + 이미지 |
| 컨텍스트 길이 | 10M |
| 토큰 수(훈련) | ~40T |
| 지식 컷오프 | 2024년 8월 |
벤치마크
- Pre-trained: MMLU 79.6, MATH 50.3, MBPP 67.8, ChartQA 83.4, DocVQA 89.4
- Instruction-tuned: MMLU Pro 74.3, DocVQA(test) 94.4, MGSM 90.6, ChartQA 88.8
양자화
Scout은 BF16 가중치로 공개되며, on-the-fly int4 양자화로 단일 H100 GPU에 들어갈 수 있어요.
지원 언어
사전훈련은 200개 언어를 아우르지만, 공식 지원 언어는 12개(아랍어·영어·프랑스어·독일어·힌디어·인도네시아어·이탈리아어·포르투갈어·스페인어·타갈로그어·태국어·베트남어)예요.