Qwen2.5-Coder 32B Instruct 모델 카드
Qwen2.5-Coder 32B Instruct 모델 카드
여유 있는 GPU 가 있다면 Qwen2.5-Coder 32B Instruct 를 붙잡아도 좋아요. 이 시리즈의 플래그십 모델로, 오픈소스 코드 모델 중에서 최상위 성능을 자랑해요. 특히 코드 생성·수리·추론 세 영역에서 두루 강해요.
성능 하이라이트
- 코드 생성: EvalPlus, LiveCodeBench, BigCodeBench 등 주요 벤치마크에서 오픈소스 최고 성능
- 코드 수리: Aider 벤치마크 73.7 점 — GPT-4o와 비슷한 수준
- 코드 추론: 코드 실행 과정을 학습, 강력한 코드 추론 능력
시작하기 (transformers)
from transformers import AutoTokenizer, AutoModelForCausalLM
model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen2.5-Coder-32B-Instruct")
tokenizer = AutoTokenizer.from_pretrained("Qwen/Qwen2.5-Coder-32B-Instruct")
32B 모델이라 추론 시 GPU 메모리를 넉넉히 잡아야 해요. 도커나 vLLM 으로 서빙할 수도 있고, Ollama 에서는 ollama run qwen2.5-coder:32b 로 간단히 실행할 수 있어요.
어떤 용도에 좋을까요
코드 에이전트, 대규모 코드 리팩토링, 리포지토리 수준 작업처럼 정확도가 우선인 작업에 잘 맞아요.
더 알아보기
- 모델 시리즈: github.com/QwenLM/Qwen2.5-Coder
- 7B 모델 카드: huggingface.co/Qwen/Qwen2.5-Coder-7B-Instruct