Qwen2.5-Coder 32B Instruct 모델 카드

Qwen2.5-Coder 32B Instruct 모델 카드

여유 있는 GPU 가 있다면 Qwen2.5-Coder 32B Instruct 를 붙잡아도 좋아요. 이 시리즈의 플래그십 모델로, 오픈소스 코드 모델 중에서 최상위 성능을 자랑해요. 특히 코드 생성·수리·추론 세 영역에서 두루 강해요.

출처: https://huggingface.co/Qwen/Qwen2.5-Coder-32B-Instruct

성능 하이라이트

  • 코드 생성: EvalPlus, LiveCodeBench, BigCodeBench 등 주요 벤치마크에서 오픈소스 최고 성능
  • 코드 수리: Aider 벤치마크 73.7 점 — GPT-4o와 비슷한 수준
  • 코드 추론: 코드 실행 과정을 학습, 강력한 코드 추론 능력

시작하기 (transformers)

from transformers import AutoTokenizer, AutoModelForCausalLM

model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen2.5-Coder-32B-Instruct")
tokenizer = AutoTokenizer.from_pretrained("Qwen/Qwen2.5-Coder-32B-Instruct")

32B 모델이라 추론 시 GPU 메모리를 넉넉히 잡아야 해요. 도커나 vLLM 으로 서빙할 수도 있고, Ollama 에서는 ollama run qwen2.5-coder:32b 로 간단히 실행할 수 있어요.

어떤 용도에 좋을까요

코드 에이전트, 대규모 코드 리팩토링, 리포지토리 수준 작업처럼 정확도가 우선인 작업에 잘 맞아요.

더 알아보기