Triton 소개 — 파이썬 GPU 커널 언어·컴파일러
Triton 소개
Triton(Triton is a language and compiler for parallel programming)은 병렬 프로그래밍을 위한 언어이자 컴파일러예요. 목표는 Python 기반 환경에서 최신 GPU 하드웨어의 최대 처리량으로 도는 커스텀 DNN 커널을 생산적으로 작성하는 거예요.
왜 Triton인가
CUDA를 직접 쓰면 성능은 좋지만 작성·디버깅이 까다로워요. Triton은 그 중간 지점을 노려요. 커널 로직을 파이썬으로 쓰고, 메모리 접근 패턴·병렬 스케줄링 같은 낮은 수준의 결정은 컴파일러가 처리하게 해서, 성능과 생산성을 함께 잡아요.
API 구성
triton— 메인 APItriton.language— 커널 내부에서 쓰는tl연산triton.testing— 벤치마크·검증 유틸리티- Triton semantics — 문법/의미 정의
Gluon
Triton에는 Gluon이라는 더 낮은 수준의 프로그래밍 모델도 있어요. Gluon 개요·튜토리얼·API 레퍼런스로 자세히 살펴볼 수 있어요.