Gemma 모델 개요
Gemma 모델 개요
Gemma는 연구와 개발 모두를 염두에 둔 개방형 모델 제품군이에요. 나만의 애플리케이션을 만들 때 클라우드가 아니라도, 로컬 하드웨어에서 직접 모델을 돌려보고 싶은 상황을 상상해 보세요. Gemma는 그런 경우에 가볍고 성능 좋은 선택지가 돼 줘요.
Gemma는 구글 딥마인드가 Gemini 모델을 만들면서 쌓은 연구와 기술을 바탕으로 만든 오픈소스 경량 모델 제품군이에요. 모델이 가볍고 개방적이라서 데스크톱 컴퓨터, 노트북, 심지어 모바일 기기에서도 직접 실행할 수 있는 게 핵심이에요. 규모가 2B(20억)부터 27B(270억) 파라미터까지 다양하게 준비돼 있어서, 쓰는 환경에 맞춰 고를 수 있죠.
텍스트뿐 아니라 이미지까지 함께 이해하는 멀티모달 모델이 많고, 140개 이상의 언어를 지원해요. 또 한 번에 처리하는 문맥 길이도 커서 긴 문서나 대화를 다루기 좋아요. 무엇보다 JAX, PyTorch, Keras NLP 같은 주요 프레임워크에서 바로 돌릴 수 있고, Hugging Face Transformers 라이브러리로도 쉽게 불러와서 파인튜닝할 수 있어요.
가볍다는 건 성능을 포기한다는 뜻은 아니에요. 연구자들은 파인튜닝과 증류(distillation) 같은 기법으로 더 작은 모델을 만들어 같은 작업을 처리하기도 하죠. Gemma는 이런 '작지만 강한' 모델을 직접 만들어 보고 싶은 개발자에게 좋은 출발점이 돼 줘요.