Triton 소개 — 파이썬 GPU 커널 언어·컴파일러

Triton 소개

Triton(Triton is a language and compiler for parallel programming)은 병렬 프로그래밍을 위한 언어이자 컴파일러예요. 목표는 Python 기반 환경에서 최신 GPU 하드웨어의 최대 처리량으로 도는 커스텀 DNN 커널을 생산적으로 작성하는 거예요.

출처: https://triton-lang.org/main/index.html

왜 Triton인가

CUDA를 직접 쓰면 성능은 좋지만 작성·디버깅이 까다로워요. Triton은 그 중간 지점을 노려요. 커널 로직을 파이썬으로 쓰고, 메모리 접근 패턴·병렬 스케줄링 같은 낮은 수준의 결정은 컴파일러가 처리하게 해서, 성능과 생산성을 함께 잡아요.

API 구성

  • triton — 메인 API
  • triton.language — 커널 내부에서 쓰는 tl 연산
  • triton.testing — 벤치마크·검증 유틸리티
  • Triton semantics — 문법/의미 정의

Gluon

Triton에는 Gluon이라는 더 낮은 수준의 프로그래밍 모델도 있어요. Gluon 개요·튜토리얼·API 레퍼런스로 자세히 살펴볼 수 있어요.

더 알아보기