개요 (에이전트 AI를 위한 모델 패밀리)

개요 (에이전트 AI를 위한 모델 패밀리)

Nemotron은 에이전틱 AI(agentic AI) 태스크를 더 빠르게 완료하도록 최적화된 NVIDIA의 오픈 모델 패밀리예요. 고도의 추론·수학·코딩·지시 따르기·툴 호출에서 우수한 성능을 보여요.

에이전트 워크로드에 특화

Nemotron은 에이전트가 실제로 수행하는 태스크에 초점을 맞춰요.

  • 추론(Reasoning) — 논리적 추론을 요구하는 에이전트 태스크
  • 멀티모달 비전 — 비디오·오디오·이미지·텍스트 이해 (컴퓨터 사용 에이전트, 문서 인텔리전스, 비디오·오디오 이해 등 서브에이전트에 최적화)
  • 음성(Speech) — 고처리량·초저지연의 자동 음성 인식(ASR), 음성 합성(TTS), 신경 기계 번역(NMT)
  • 검색 증강 생성(RAG) — Nemotron Retriever 시리즈로 문서에서 멀티모달 구조 정보 추출, 고품질 임베딩 생성, 관련 문서 랭킹
  • 안전(Safety) — 유해 콘텐츠·주제 이탈·탈옥(jailbreak)에 대한 실시간 보호

효율성과 정확성

NVIDIA에 따르면 Nemotron 모델은 가장 높은 처리량을 제공하고 하이브리드 MoE 아키텍처로 에이전트 태스크를 빠르게 완료해요. NIM 마이크로서비스로 제공되며 배포 유연성, 보안, 프라이버시, 이식성을 갖춥니다.

배포 방식

NVIDIA GPU 상에서 오픈 프레임워크인 vLLM, SGLang, Ollama, llama.cpp로 쉽게 배포할 수 있어요. 또한 NVIDIA NIM 마이크로서비스로 엔드포인트를 사용할 수 있고, 실제 모델을 build.nvidia.com에서 체험·배포할 수 있어요.

더 알아보기