Gemini API의 비디오 생성
Gemini API의 비디오 생성
Gemini API는 비디오 생성에 두 가지 모델을 제공해요. 바로 Gemini Omni Flash와 Veo인데, 각각 서로 다른 워크플로에 맞춰 설계됐죠.
비디오 생성의 기본 모델로는 Gemini Omni Flash를 사용하는 걸 권장해요. 이 모델은 뛰어난 비디오 정합성, 다중 입력 추론(텍스트·이미지·오디오·비디오 입력을 동시에 지원), 캐릭터 일관성, 사실 정확도, 그리고 다중 턴 대화식 편집(예: 요소 교체나 관점 변경)을 제공하거든요. Veo 3.1은 장면 확장(scene extension), 마지막 프레임 제어, 기존 파이프라인과의 통합 같은 특정 기능이 필요할 때 사용하면 돼요.
출처: 원문
본문
Gemini Omni Flash
Gemini Omni Flash는 비디오 생성과 대화식 비디오 편집을 위한 빠른 멀티모달 모델이에요. 텍스트 프롬프트와 이미지를 짧은 비디오로 빠르게 바꾸는 데 탁월하며, Interactions API를 통해 여러 턴에 걸쳐 결과를 다듬을 수 있어요.
Veo 3.1
Veo 3.1은 네이티브 오디오가 포함된 비디오를 생성하는 모델이에요. 비디오 확장, 프레임별 생성, 이미지 기반 방향 지정 같은 기능을 generateContent API로 지원해요.
비디오 이해 (Video understanding)
새로운 비디오를 생성하는 대신 기존 비디오 콘텐츠를 입력받아 분석해야 한다면, 비디오 이해 가이드를 참고해 보세요.
더 알아보기 (Learn more)
- Gemini Omni Flash — 기본 비디오 생성 모델 시작하기.
- Veo — 네이티브 오디오 비디오 생성 모델 시작하기.
- 비디오 이해 — 기존 비디오를 분석하는 방법.