모델 카탈로그 (Nano·Super·Ultra·Retriever)
모델 카탈로그 (Nano·Super·Ultra·Retriever)
Nemotron 3 패밀리는 모델 크기·용도에 따라 여러 제품군으로 나뉘어요. 각각의 특징을 정리할게요.
Nemotron 3 Nano 30B A3B
- 하이브리드 Mixture of Experts(MoE) — Mamba-2 + Transformer 구조
- 총 30B 파라미터 중 활성 3.5B(A3B), 128개 전문가 + 1개 공유 전문가, 토큰당 6개 전문가 활성화
- 최대 I/O 토큰 2048
- Nemotron 2 Nano 대비 4배 빠른 처리량
- 코딩·추론·수학·긴 컨텍스트 정확도 우수 — 정확도와 효율이 모두 필요한 타겟형 에이전트에 적합
- 지원 언어: 영어, 독일어, 스페인어, 프랑스어, 이탈리아어, 일본어
Nemotron 3 Super 120B A12B
- MoE 아키텍처, 총 120B 중 활성 12B(A12B)
- 최대 I/O 토큰 4096
- 최고 수준의 효율과 정확도 — 멀티에이전트 환경의 복잡한 태스크에 적합
Nemotron 3 Ultra 550B A55B
- 단일 모델로 비디오·오디오·이미지·텍스트 이해
- 컴퓨터 사용 에이전트, 문서 인텔리전스, 비디오·오디오 이해 등 멀티모달 추론 서브에이전트용
- 최고 수준의 효율과 저렴한 비용
Nemotron Retriever
- 문서 인텔리전스, 질문 답변, 구절 검색에서 최고 수준의 정확도
- ViDoRe V1·V2와 MTEB·MMTEB 리더보드 선두권
Nemotron Parse / Speech
- Parse: 문서 의미 이해, 텍스트·표 요소를 공간적 근거와 함께 추출, 다중 컬럼 레이아웃·LaTeX 표 추출·마크다운 포맷·읽기 순서 재구성 지원 (전통 OCR 한계 극복)
- Speech: ASR·TTS·NMT