Apache TVM 문서 — 컴파일러 스택 한눈에 보기
Apache TVM 문서
Apache TVM은 "어디서나 모두를 위한 고성능 머신러닝에 접근을 가능하게 하는" 딥러닝 컴파일러예요. 하드웨어 벤더, 컴파일러 엔지니어, ML 연구자가 한데 모여 통합·프로그래밍 가능한 소프트웨어 스택을 만들고 있어요. 커뮤니티 주도 ML 기반 최적화로 연구·개발의 한계를 밀고, 전체 ML 성능을 올리며 비용을 낮추는 게 목표예요.
시작하기
모델 가져오기·최적화
- Importing Models from ML Frameworks
- End-to-End Optimize Model
- Customize Optimization
- Optimize Large Language Model
- Cross Compilation and RPC
설계·아키텍처
스택은 tvm/support, tvm/runtime, tvm/node, tvm/ir, tvm/script(TVMScript), tvm/target, tvm/relax, tvm/tirx, tvm/arith, tvm/te·tvm/topi 등으로 나뉘어요. 딥 다이브 문서로는 TensorIR(텐서 프로그램 추상화, MetaSchedule 자동 튜닝), Relax(ML 모델 그래프 추상화, DPL), TIRx(CUDA C++/PTX 네이티브 레벨)가 있어요.