Gemini 3.1 Flash live preview

Gemini 3.1 Flash live preview

Gemini 3.1 Flash Live Preview는 실시간 대화와 음성 우선 AI 애플리케이션을 위한 레거시 프리뷰 모델이에요.

참고: 대부분의 저지연 음성 에이전트 경험에는 Gemini 3.8 Live로 업데이트할 것을 권장해요. 마이그레이션 가이드를 참고하세요.

출처: 원문

본문

Live API 가이드에서 기능과 성능의 전체 내용을 확인할 수 있어요.

gemini-3.1-flash-live-preview

속성 설명
모델 코드 gemini-3.1-flash-live-preview
지원 데이터 유형 입력 텍스트, 이미지, 오디오, 비디오 출력 텍스트와 오디오
토큰 한도[*] 입력 토큰 한도 131,072 출력 토큰 한도 65,536
능력 오디오 생성 지원 캐싱 미지원 코드 실행 미지원 파일 검색 미지원 함수 호출 지원 Google Maps 접지 미지원 이미지 생성 미지원 Live API 지원 Search 접지 지원 구조화 출력 미지원 Thinking 지원 URL 컨텍스트 미지원
소비 옵션 Batch API 미지원
버전 모델 버전 패턴 참고. Preview: gemini-3.1-flash-live-preview
최신 업데이트 2026년 3월
모델 카드 Model card

Gemini 2.5 Flash Live에서 마이그레이션하기

Gemini 3.1 Flash Live Preview는 저지연 실시간 대화에 최적화되어 있어요. gemini-2.5-flash-native-audio-preview-12-2025에서 마이그레이션할 때 다음을 고려하세요.

  • 모델 문자열: 모델 문자열을 gemini-2.5-flash-native-audio-preview-12-2025에서 gemini-3.1-flash-live-preview로 바꿔요.

  • Thinking 구성: Gemini 3.1은 thinkingBudget 대신 thinkingLevel(minimal, low, medium, high 같은 설정)을 사용해요. 기본값은 최저 지연을 위해 minimal이에요. Thinking 수준과 예산 참고.

  • 서버 이벤트: 하나의 BidiGenerateContentServerContent 이벤트가 이제 여러 콘텐츠 파트를 동시에 담을 수 있어요(예: 오디오 청크와 스크립트). 콘텐츠 누락을 피하려면 각 이벤트의 모든 파트를 처리하도록 코드를 업데이트하세요.

  • 클라이언트 콘텐츠: 세션 전체 수명 주기에서 명시적 역할(user 또는 model)과 함께 send_client_content를 지원해요. turn_complete=true를 설정하면 조건 없이 진행 중인 모델 생성이 중단돼요. 증분 콘텐츠 업데이트 참고.

  • 턴 커버리지: 기본값이 TURN_INCLUDES_ONLY_ACTIVITY 대신 TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEO로 바뀌었어요. 모델의 턴은 이제 감지된 오디오 활동과 모든 비디오 프레임을 포함해요. 앱이 지속적으로 비디오 프레임을 보내고 있다면, 추가 비용을 피하려면 오디오 활동이 있을 때만 보내도록 업데이트하세요.

  • 비동기 함수 호출: 아직 지원되지 않아요. 함수 호출은 동기 전용이에요. 도구 응답을 보내기 전까지 모델은 응답을 시작하지 않아요. 비동기 함수 호출 참고.

  • 프로액티브 오디오와 정서적 대화: 이 기능들은 Gemini 3.1 Flash Live에서 아직 지원되지 않아요. 이 기능에 대한 설정을 코드에서 모두 제거하세요. 프로액티브 오디오와 정서적 대화 참고.

자세한 기능 비교는 기능 가이드의 Model comparison 표를 확인하세요.

더 알아보기 (Learn more)