멀티모달 입출력
멀티모달 입출력 (Multimodal I/O)
비전, 오디오, PDF, 이미지 생성, 비디오 생성까지 LiteLLM에서 멀티모달 데이터를 주고받는 방법을 정리한 가이드 묶음이에요.
출처: 문서
본문
📄️ Using Vision Models (비전 모델 사용하기)
이미지를 입력으로 받는 비전(Vision) 모델을 사용하는 방법을 다뤄요. Quick Start 예시를 따라 바로 시작할 수 있어요.
📄️ Using Audio Models (오디오 모델 사용하기)
/chat/completions 엔드포인트에서 오디오를 주고받는 방법을 다뤄요.
📄️ Using PDF Input (PDF 입력 사용하기)
/chat/completions 엔드포인트에서 PDF(및 기타 문서 타입)를 주고받는 방법을 다뤄요.
📄️ Image Generation in Chat Completions, Responses API (Chat Completions/Responses API에서 이미지 생성)
chat/completions에서 이미지를 생성하는 방법을 다뤄요. Responses API에서 이 기능을 쓰고 싶다면 Feature Request를 올려 주세요.
📄️ Veo Video Generation with Google AI Studio (Google AI Studio로 Veo 비디오 생성)
LiteLLM의 pass-through 엔드포인트를 통해 Google의 Veo 모델로 비디오를 생성하는 방법을 다뤄요.