DeepSeek-R1 (추론 특화 LLM)
DeepSeek-R1 (추론 특화 LLM)
DeepSeek 의 첫 세대 추론(reasoning) 모델을 다루는 카테고리예요. 대규모 강화학습(RL)으로 훈련돼서 수학·코딩 같은 복잡한 문제를 "생각을 보여주며" 풀어요. 여기서는 R1 시리즈 구조와 thinking mode API, 라이선스·가격 변화를 살펴볼게요.
이 카테고리의 문서
- DeepSeek-R1 모델 둘러보기: R1-Zero, R1, distill 6종과 구조
- thinking mode API:
deepseek-reasoner와 추론 과정 - R1 릴리스 소식: MIT 라이선스와 API 가격