Qwen 문서에 오신 것을 환영합니다!
Qwen 문서에 오신 것을 환영합니다!
Qwen은 알리바바 그룹 Qwen 팀이 만든 대규모 언어 모델(LLM)과 대규모 멀티모달 모델(LMM) 시리즈예요. 언어 모델과 멀티모달 모델 모두 대규모 다국어·멀티모달 데이터로 사전 학습되고, 사용자 선호에 맞추기 위해 고품질 데이터로 사후 학습됩니다. Qwen은 자연어 이해, 텍스트 생성, 시각 이해, 오디오 이해, 도구 사용, 롤플레이, AI 에이전트 역할 등 다양한 능력을 갖추고 있어요.
출처: 문서
본문
Qwen3-2507
커뮤니티의 피드백과 추가 연구 결과를 반영하여, Instruct 전용 모델과 Thinking 전용 모델이 다시 돌아왔어요! 그 결과물이 바로 Qwen3-2507입니다.
Qwen3-Instruct-2507의 특징은 다음과 같아요:
- 지시 따르기, 논리적 추론, 텍스트 이해, 수학, 과학, 코딩, 도구 사용 등 일반 능력이 크게 향상되었어요.
- 여러 언어에 걸친 롱테일(long-tail) 지식의 커버리지가 크게 늘었어요.
- 주관적이고 개방형인 과제에서 사용자 선호와의 정렬이 훨씬 좋아져, 더 도움이 되는 답변과 더 높은 품질의 텍스트를 생성해요.
- 256K 장문 맥락 이해 능력이 강화되었고, 1M까지 확장할 수 있어요.
Qwen3-Thinking-2507의 특징은 다음과 같아요:
- 논리적 추론, 수학, 과학, 코딩 등 전문가 수준의 학술 벤치마크에서 추론 성능이 크게 향상되어, 오픈소스 추론 모델 중에서도 최첨단(state-of-the-art) 결과를 달성했어요.
- 지시 따르기, 도구 사용, 텍스트 생성, 인간 선호 정렬 등 일반 능력이 현저히 좋아졌어요.
- 256K 장문 맥락 이해 능력이 강화되었고, 1M까지 확장할 수 있어요.
Qwen3
Qwen3(일명 Qwen3-2504)의 특징은 다음과 같아요:
- Dense 및 Mixture-of-Experts(MoE) 모델로, 0.6B, 1.7B, 4B, 8B, 14B, 32B, 그리고 30B-A3B, 235B-A22B 크기로 제공돼요.
- 하나의 모델 안에서 thinking 모드(복잡한 논리 추론·수학·코딩용)와 non-thinking 모드(효율적인 범용 채팅용)를 매끄럽게 전환할 수 있어 다양한 시나리오에서 최적의 성능을 내요.
- 수학, 코드 생성, 상식적 논리 추론에서 이전 QwQ(thinking 모드)와 Qwen2.5 instruct 모델(비-thinking 모드)을 뛰어넘는 추론 능력이 크게 향상되었어요.
- 창의적 글쓰기, 롤플레이, 다중 턴 대화, 지시 따르기에서 뛰어난 인간 선호 정렬로 더 자연스럽고 몰입감 있는 대화 경험을 제공해요.
- thinking 모드와 non-thinking 모드 모두에서 외부 도구와 정밀하게 통합되는 에이전트 능력이 뛰어나며, 복잡한 에이전트 기반 과제에서 오픈소스 모델 중 최고 수준의 성능을 보여줘요.
- 100개 이상의 언어와 방언을 지원하며, 다국어 지시 따르기와 번역에 강력한 능력을 갖추고 있어요.
리소스 및 링크
더 자세한 정보는 다음을 방문해 보세요:
- Qwen 홈페이지
- Qwen과 채팅하기 (Deep Research 및 Web Dev 기능 포함)
- 블로그
- GitHub
- Hugging Face
- ModelScope
- Qwen3 컬렉션
커뮤니티에 참여하고 싶다면 Discord와 WeChat 그룹에 가입해 보세요. 거기서 여러분을 만나길 기대할게요!