TensorFlow Lite — 스마트폰·IoT까지 가는 온디바이스 ML 런타임
TensorFlow Lite
TensorFlow Lite(LiteRT)는 세계에서 가장 널리 배포된 온디바이스(장치 내) 머신러닝 런타임이에요. 훈련된 모델을 .tflite 형식으로 변환·양자화해 스마트폰, 임베디드, IoT 기기에서 낮은 지연과 높은 프라이버시로 실행하게 해줘요. CPU·GPU·NPU 가속을 자동으로 고르고, 현대 표준인 CompiledModel API로 최고 성능의 추론을 제공해요.
이 카테고리의 문서
- 소개: LiteRT/TFLite가 무엇이고 어디에 쓰는지
- 추론: CompiledModel API와 CPU·GPU·NPU 가속
- 배포: 모델 변환·양자화·플랫폼 배포