Triton — GPU 커널을 파이썬으로

Triton

GPU에서 최대 성능을 내는 커스텀 DNN 커널을 파이썬으로 작성하고 싶다면 Triton이 정답에 가까워요. Triton은 병렬 프로그래밍을 위한 언어이자 컴파일러로, Python 기반 환경에서 CUDA 커널을 생산적으로 작성할 수 있게 해줘요. @triton.jit 데코레이터로 커널을 정의하면, 그리드/블록 개념을 그대로 쓰되 메모리 접근·스케줄링은 컴파일러가 최적화해요. Flash Attention 같은 고성능 커널 구현의 기반으로 널리 쓰여요.

이 카테고리의 문서

  • 소개: 파이썬 GPU 커널 언어·컴파일러
  • 언어 API: triton.language 연산
  • 실전: 벡터 덧셈 커널 만들기

출처: https://triton-lang.org/main/index.html