모델 카탈로그 (Nano·Super·Ultra·Retriever)

모델 카탈로그 (Nano·Super·Ultra·Retriever)

Nemotron 3 패밀리는 모델 크기·용도에 따라 여러 제품군으로 나뉘어요. 각각의 특징을 정리할게요.

Nemotron 3 Nano 30B A3B

  • 하이브리드 Mixture of Experts(MoE) — Mamba-2 + Transformer 구조
  • 총 30B 파라미터 중 활성 3.5B(A3B), 128개 전문가 + 1개 공유 전문가, 토큰당 6개 전문가 활성화
  • 최대 I/O 토큰 2048
  • Nemotron 2 Nano 대비 4배 빠른 처리량
  • 코딩·추론·수학·긴 컨텍스트 정확도 우수 — 정확도와 효율이 모두 필요한 타겟형 에이전트에 적합
  • 지원 언어: 영어, 독일어, 스페인어, 프랑스어, 이탈리아어, 일본어

Nemotron 3 Super 120B A12B

  • MoE 아키텍처, 총 120B 중 활성 12B(A12B)
  • 최대 I/O 토큰 4096
  • 최고 수준의 효율과 정확도 — 멀티에이전트 환경의 복잡한 태스크에 적합

Nemotron 3 Ultra 550B A55B

  • 단일 모델로 비디오·오디오·이미지·텍스트 이해
  • 컴퓨터 사용 에이전트, 문서 인텔리전스, 비디오·오디오 이해 등 멀티모달 추론 서브에이전트용
  • 최고 수준의 효율과 저렴한 비용

Nemotron Retriever

  • 문서 인텔리전스, 질문 답변, 구절 검색에서 최고 수준의 정확도
  • ViDoRe V1·V2와 MTEB·MMTEB 리더보드 선두권

Nemotron Parse / Speech

  • Parse: 문서 의미 이해, 텍스트·표 요소를 공간적 근거와 함께 추출, 다중 컬럼 레이아웃·LaTeX 표 추출·마크다운 포맷·읽기 순서 재구성 지원 (전통 OCR 한계 극복)
  • Speech: ASR·TTS·NMT

더 알아보기