GLM-4-9B — 범용 대화 모델
GLM-4-9B — 범용 대화 모델
GLM-4-9B는 9B 규모의 경량 대화 모델이에요. 리소스가 제한된 환경에서도 실행할 수 있어서 소규모 배포나 번역처럼 대규모 배치(batch) 작업에 자주 쓰여요. 큰 모델과 달리 에이전트 능력 강화보다는 안정적인 일괄 처리에 초점을 맞춘 모델이죠.
변형
- GLM-4-9B (Base): 8K 시퀀스 길이의 기본 모델
- GLM-4-9B-Chat-HF: 128K 시퀀스 길이의 채팅 모델
- 이후 GLM-4-9B-0414: 32K -> 128K 시퀀스 길이로 개선
어떤 용도에 좋나요
model capacity가 작아서 에이전트급 능력 강화는 따로 적용하지 않았지만, 대신 번역 태스크처럼 대규모 배치로 돌리는 작업에 최적화돼요. 작은 크기라 GPU 메모리 부담이 적고, 여러 인스턴스를 띄워 병렬 처리하기도 좋아요.