GLM-4-32B-0414 — 32B 에이전트 모델과 GLM-Z1
GLM-4-32B-0414 — 32B 에이전트 모델과 GLM-Z1
GLM-4-0414 시리즈는 32B 파라미터를 가진 모델군이에요. 성능이 OpenAI GPT 시리즈·DeepSeek V3/R1 시리즈에 견줄 만하다고 소개되며, 로컬 배포가 매우 쉽다는 게 특징이에요.
시리즈 구성
- GLM-4-32B-Base-0414: 15T의 고품질 데이터로 사전훈련. 상당량의 추론형 합성 데이터를 포함하고, 후속 강화학습의 기반이 돼요.
- GLM-4-32B-0414: 채팅 모델. 거부 샘플링·강화학습으로 명령 따르기, 엔지니어링 코드, 함수 호출을 강화했어요. 에이전트 태스크에 필요한 원자적 능력에 초점을 뒀죠.
- GLM-Z1-32B-0414: 추론 모델. 콜드 스타트 + 확장된 강화학습으로 수학·코드·논리에서 큰 개선을 얻었어요.
- GLM-Z1-Rumination-32B-0414: Deep Research에 대응하는 '심화 사고(rumination)' 모델로, 지면 검색 도구를 쓰며 더 깊고 긴 사고를 해요.
- GLM-Z1-9B-0414: 같은 기법을 9B 소형 모델에도 적용한 '깜짝' 모델. 같은 크기 오픈소스 중 최상위 성능을 보여줘요.
추론·에이전트 벤치마크
| 모델 | IFEval | BFCL-v3 (Overall) | SimpleQA |
|---|---|---|---|
| Qwen2.5-Max | 85.6 | 50.9 | 79.0 |
| GPT-4o-1120 | 81.9 | 69.6 | 82.8 |
| GLM-4-32B-0414 | 87.6 | 69.6 | 88.1 |
SWE-bench Verified에서도 Moatless 프레임워크로 33.8, OpenHands로 27.2를 기록했어요.