NVIDIA Nemotron (LLM 패밀리)

NVIDIA Nemotron (LLM 패밀리)

NVIDIA Nemotron™은 NVIDIA가 만든 오픈 모델 LLM 패밀리예요. 오픈 가중치(open weights), 훈련 데이터, 레시피까지 공개해서, 특화된 AI 에이전트를 만드는 데 높은 효율과 정확도를 제공해요.

최신 Nemotron 3 패밀리는 하이브리드 Mamba-Transformer MoE 구조로 가장 효율적인 멀티모달 모델을 제공하며, 1M 토큰 컨텍스트를 지원해 복잡한 고처리량 에이전트 AI에 뛰어나요. vLLM, SGLang, Ollama, llama.cpp 같은 오픈 프레임워크로 NVIDIA GPU 어디서든 쉽게 배포할 수 있고, NVIDIA NIM™ 마이크로서비스로도 엔드포인트를 쓸 수 있어요.

핵심 개념

  • 오픈 모델 패밀리 — 가중치·훈련 데이터·레시피 공개
  • 하이브리드 MoE — Mamba-Transformer MoE로 높은 효율·처리량
  • 1M 토큰 컨텍스트 — 복잡한 에이전트 워크플로 지원
  • NIM 마이크로서비스 — build.nvidia.com에서 사용·배포

이 카테고리의 문서

  • 개요: Nemotron 패밀리와 에이전트 AI 워크로드
  • 모델 카탈로그: Nano·Super·Ultra 등 제품군과 사양
  • 배포·사용법: NIM·오픈 프레임워크 배포

출처: https://developer.nvidia.com/topics/ai/nemotron