Gemini 3.8 Live

Gemini 3.8 Live

Gemini 3.8 Live는 대부분의 저지연 음성 에이전트 경험과 추론 유발 지연 없이 실시간 대화를 원할 때 기본으로 쓰는 옵션이에요. 인터리브 추론, 비동기 함수 호출, 세션 전체 클라이언트 콘텐츠 업데이트, 내장 오디오 스트리밍을 지원해요.

출처: 원문

본문

Live API 가이드에서 기능과 성능의 전체 내용을 확인할 수 있어요.

gemini-3.8-live

속성 설명
모델 코드 gemini-3.8-live
지원 데이터 유형 입력 텍스트, 이미지, 오디오, 비디오 출력 텍스트와 오디오
토큰 한도[*] 입력 토큰 한도 131,072 출력 토큰 한도 65,536
능력 오디오 생성 지원 캐싱 미지원 코드 실행 미지원 파일 검색 미지원 함수 호출 지원 Google Maps 접지 미지원 이미지 생성 미지원 Live API 지원 Search 접지 지원 구조화 출력 미지원 Thinking 지원(인터리브 추론) URL 컨텍스트 미지원
소비 옵션 Batch API 미지원
버전 모델 버전 패턴 참고. Stable: gemini-3.8-live
최신 업데이트 2026년 9월
모델 카드 Model card

Gemini 3.1 Flash Live에서 마이그레이션하기

Gemini 3.8 Live는 초저지연 오디오-투-오디오 상호작용을 제공하고 비동기 워크플로 지원을 확장해요. gemini-3.1-flash-live-preview에서 마이그레이션할 때 다음 업데이트를 확인하세요.

  • 모델 문자열: 모델 문자열을 gemini-3.1-flash-live-preview에서 gemini-3.8-live로 바꿔요.

  • Thinking 수준: gemini-3.8-live는 thinking_level을 지원하지 않아요. 세션 설정에서 thinking_level(또는 thinking_config)을 생략하세요.

  • 비동기 함수 호출: 비동기 실행(behavior: NON_BLOCKING)이 이제 기본 함수 호출 모드예요. 도구 선언에 behavior: BLOCKING을 설정하면 하위 호환을 위해 동기 블로킹 모드를 계속 쓸 수 있어요. 함수 스케줄링(SILENT, WHEN_IDLE, INTERRUPTED)이 지원돼요.

  • 클라이언트 콘텐츠 업데이트: 세션 전체 수명 주기에서 명시적 역할(user 또는 model)과 함께 send_client_content를 지원해요. turn_complete=true를 설정하면 조건 없이 진행 중인 모델 생성이 중단돼요. turn_complete 없이 콘텐츠를 보내면 서버는 응답하기 전에 이후 메시지를 기다려요.

  • 프로액티브 오디오: 프로액티브 오디오는 이제 영구적으로 활성화돼요. proactive_audio: false를 설정하면 오류가 나요.

  • 정서적 대화(Affective dialogue): 정서적 대화는 API에서 제거됐어요. 코드에서 enable_affective_dialog 설정을 모두 제거하세요.

  • 턴 커버리지: 기본값은 TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEO예요. 비디오 프레임이 기본적으로 모델에 전송되므로, 컨텍스트와 비용을 관리하려면 필요할 때만 프레임을 보내요.

  • 응답 양식: 오디오가 지원되는 응답 양식이에요. 텍스트 스크립트가 필요하면 출력 오디오 전사(transcription)를 활성화하세요.

모든 Live API 모델의 기능 비교는 Model comparison 표를 확인하세요.

더 알아보기 (Learn more)