gpt-oss 모델 — 120b와 20b 사양 비교

gpt-oss 모델

OpenAI가 공개한 gpt-oss 시리즈는 두 가지 오픈웨이트 모델로 구성돼요.

  • gpt-oss-120b — 프로덕션·일반 목적·고추론 사례용. 117B 파라미터에 5.1B 활성 파라미터로, NVIDIA H100이나 AMD MI300X 같은 단일 80GB GPU에 들어가요.
  • gpt-oss-20b — 낮은 레이턴시, 로컬·특수 사례용. 21B 파라미터에 3.6B 활성 파라미터로 16GB 메모리 안에서 동작해요.

두 모델 모두 Harmony 응답 포맷으로 훈련됐어요. 따라서 이 포맷으로만 사용해야 정상 동작해요.

주요 특징

  • 허용적 Apache 2.0 라이선스 — 카피레프트 제약이나 특허 리스크 없이 실험·커스터마이즈·상업 배포 가능
  • 조절 가능한 추론 노력 — low / medium / high로 레이턴시와 추론 깊이를 상황에 맞게 설정
  • 완전한 체인오브소트 — 모델의 추론 과정 전체에 접근 가능(엔드유저에게는 보여주지 않는 것이 권장)
  • 파인튜닝 가능 — 파라미터 파인튜닝으로 특정 사용 사례에 맞춤
  • 에이전트 기능 — 함수 호출, 웹 브라우징, Python 코드 실행, Structured Outputs
  • MXFP4 양자화 — MoE 가중치를 MXFP4로 포스트 트레이닝해 단일 GPU 실행을 가능하게 함

더 알아보기