Gemini API의 비디오 생성

Gemini API의 비디오 생성

Gemini API는 비디오 생성에 두 가지 모델을 제공해요. 바로 Gemini Omni Flash와 Veo인데, 각각 서로 다른 워크플로에 맞춰 설계됐죠.

비디오 생성의 기본 모델로는 Gemini Omni Flash를 사용하는 걸 권장해요. 이 모델은 뛰어난 비디오 정합성, 다중 입력 추론(텍스트·이미지·오디오·비디오 입력을 동시에 지원), 캐릭터 일관성, 사실 정확도, 그리고 다중 턴 대화식 편집(예: 요소 교체나 관점 변경)을 제공하거든요. Veo 3.1은 장면 확장(scene extension), 마지막 프레임 제어, 기존 파이프라인과의 통합 같은 특정 기능이 필요할 때 사용하면 돼요.

출처: 원문

본문

Gemini Omni Flash

Gemini Omni Flash는 비디오 생성과 대화식 비디오 편집을 위한 빠른 멀티모달 모델이에요. 텍스트 프롬프트와 이미지를 짧은 비디오로 빠르게 바꾸는 데 탁월하며, Interactions API를 통해 여러 턴에 걸쳐 결과를 다듬을 수 있어요.

Gemini Omni Flash 시작하기 →

Veo 3.1

Veo 3.1은 네이티브 오디오가 포함된 비디오를 생성하는 모델이에요. 비디오 확장, 프레임별 생성, 이미지 기반 방향 지정 같은 기능을 generateContent API로 지원해요.

Veo 3.1 시작하기 →

비디오 이해 (Video understanding)

새로운 비디오를 생성하는 대신 기존 비디오 콘텐츠를 입력받아 분석해야 한다면, 비디오 이해 가이드를 참고해 보세요.

더 알아보기 (Learn more)

  • Gemini Omni Flash — 기본 비디오 생성 모델 시작하기.
  • Veo — 네이티브 오디오 비디오 생성 모델 시작하기.
  • 비디오 이해 — 기존 비디오를 분석하는 방법.