MediaPipe Tasks 시작하기
MediaPipe Tasks 시작하기
MediaPipe Tasks는 준비된 저코드(low-code) 솔루션 API예요. 비전·텍스트·오디오 영역의 일반적인 AI 태스크를 플랫폼별로 동일한 방식으로 호출할 수 있게 해 줘요.
MediaPipe Tasks는 비전(segmentation, classification, detection, recognition, body landmarks), 텍스트(언어·감정 분석), 오디오(음성·감정) 등 여러 태스크를 커버하는 ready-made 솔루션이에요. 각 태스크마다 문서와 코드 샘플이 함께 제공돼요.
생성형 AI 태스크도 지원해요. MediaPipe generative AI tasks를 쓰면 LLM과 디퓨전 모델을 엣지(온디바이스)에서 실행할 수 있죠. 예를 들어 llm_inference 태스크로 로컬 LLM 추론을 돌려볼 수 있어요.
시작하는 방법은 간단해요. 대상 태스크를 고른 뒤, 개발 환경을 세팅하고 태스크를 초기화한 다음 데이터를 넣어 결과를 받아보면 돼요. Android, 웹, Python 각각의 setup guide가 따로 준비돼 있어서 환경에 맞게 따라가면 돼요.
프라이버시 관점에서도 중요한 점이 있어요. MediaPipe Tasks는 입력 데이터(이미지, 영상, 텍스트)를 **기기 내부(on-device)**에서 처리해요. 데이터가 기기를 떠나 구글 서버로 전송되지 않으므로, 민감한 데이터를 처리해야 하는 앱에도 안심하고 쓸 수 있어요. 다만 API 성능·사용 통계는 구글로 전송될 수 있다는 점은 참고하세요.