Gemma 3 27B — google/gemma-3-27b-it 모델 카드
Gemma 3 27B — google/gemma-3-27b-it 모델 카드
gemma-3-27b-it는 Gemma 3 패밀리 중 가장 큰 27B 지시 튜닝 모델이에요. 텍스트와 이미지를 입력받아 텍스트를 생성하는 멀티모달 모델이고, 128K 토큰 컨텍스트를 지원해요.
입력·출력
- 입력: 텍스트 문자열(질문·프롬프트·문서) + 이미지(896x896로 정규화, 각 256 토큰으로 인코딩)
- 입력 컨텍스트: 4B·12B·27B는 128K 토큰, 1B는 32K
- 출력: 생성 텍스트, 총 출력 컨텍스트 8192 토큰
훈련 데이터
27B 모델은 14T 토큰으로 훈련했어요(12B=12T, 4B=4T, 1B=2T). 140개 이상 언어의 웹 문서, 코드, 수학, 이미지 데이터를 골고루 섞어 썼어요. 훈련은 TPUv4p·TPUv5p·TPUv5e 하드웨어에서 JAX와 ML Pathways로 진행했어요.
예제 — pipeline API
from transformers import pipeline
import torch
pipe = pipeline(
"image-text-to-text",
model="google/gemma-3-27b-it",
device="cuda",
torch_dtype=torch.bfloat16,
)
벤치마크 (IT 27B, reasoning)
- GPQA Diamond: 42.4, FACTS Grounding: 74.9, BIG-Bench Hard: 87.6, IFEval: 90.4
- MMMU (val): 64.9, DocVQA: 86.6, ChartQA: 78.0
- Global-MMLU-Lite: 75.1