Triton — GPU 커널을 파이썬으로
Triton
GPU에서 최대 성능을 내는 커스텀 DNN 커널을 파이썬으로 작성하고 싶다면 Triton이 정답에 가까워요. Triton은 병렬 프로그래밍을 위한 언어이자 컴파일러로, Python 기반 환경에서 CUDA 커널을 생산적으로 작성할 수 있게 해줘요. @triton.jit 데코레이터로 커널을 정의하면, 그리드/블록 개념을 그대로 쓰되 메모리 접근·스케줄링은 컴파일러가 최적화해요. Flash Attention 같은 고성능 커널 구현의 기반으로 널리 쓰여요.
이 카테고리의 문서
- 소개: 파이썬 GPU 커널 언어·컴파일러
- 언어 API:
triton.language연산 - 실전: 벡터 덧셈 커널 만들기