Gemini 3.8 Live Extended Thinking

Gemini 3.8 Live Extended Thinking

Gemini 3.8 Live Extended Thinking은 고수준 추론을 제공하는 오디오-투-오디오 모델로, 실시간 음성 상호작용 중 복잡한 다단계 문제 해결에 더 높은 백그라운드 추론이 필요할 때 권장돼요. 연속 오디오 응답을 스트리밍하면서 백그라운드 추론과 비동기 도구 호출을 처리해요. Google AI Studio에서 사용해 볼 수 있어요.

출처: 원문

본문

문서(Documentation)

기능과 능력의 전체 내용은 Live API 가이드를 참고하세요.

gemini-3.8-live-extended-thinking

속성 설명
모델 코드 gemini-3.8-live-extended-thinking
지원 데이터 유형 입력 — 텍스트, 이미지, 오디오, 비디오 / 출력 — 텍스트 및 오디오
토큰 한도[*] 입력 토큰 한도 — 131,072 / 출력 토큰 한도 — 65,536
기능 오디오 생성 지원 / Caching 미지원 / 코드 실행 미지원 / 파일 검색 미지원 / 함수 호출 지원(비동기 전용) / Google Maps Grounding 미지원 / 이미지 생성 미지원 / Live API 지원 / Search grounding 지원 / 구조화 출력 미지원 / Thinking 지원 / URL context 미지원
소비 옵션 Batch API 미지원
버전 자세한 내용은 모델 버전 패턴을 참고하세요. Stable: gemini-3.8-live-extended-thinking
최신 업데이트 2026년 9월
모델 카드 모델 카드

Gemini 3.8 Live Extended Thinking으로 업그레이드

Gemini 3.8 Live Extended Thinking은 라이브 오디오 세션 중에 백그라운드 추론을 도입해요. 이 모델을 통합할 때는 비동기 추론 신호를 처리하도록 클라이언트 상태 관리를 업데이트해야 해요:

  • 비동기 추론 프로토콜: 비동기 추론을 사용하는 모델과 상호작용할 때 turnComplete: true는 더 이상 모델이 유휴 상태임을 나타내지 않아요. 서버는 백그라운드 추론이나 도구 호출을 계속 처리할 수 있어요. 클라이언트는 turnComplete: true가 도착한 후에도 후속 서버 메시지(도구 호출 또는 오디오 프레임 등)를 계속 리슨해야 해요.
  • interaction_status 모니터링: 들어오는 서버 메시지의 interaction_status 필드를 사용해 현재 서버 상태를 파악해요:

IN_PROGRESS: 서버가 사용자 입력을 활발히 처리하거나, 백그라운드 추론을 실행하거나, 비동기 도구 호출에 대한 응답을 기다리고 있어요. 추가 모델 출력이나 도구 호출이 뒤따를 수 있어요.

IDLE: 서버가 모든 처리, 추론, 도구 호출을 마쳤어요. 세션이 유휴 상태이며 사용자 입력을 기다리고 있어요.

  • 비동기 함수 호출: 비동기 비차단 실행(behavior: NON_BLOCKING)만 지원돼요. 동기 차단 모드는 지원되지 않으며 하드 오류를 반환해요. 함수 스케줄링 구성은 지원되지 않아요.
  • Thinking 구성: 설정 구성의 thinking_config를 사용해 백그라운드 추론을 구성해요(thinking_level: low, medium, high). MINIMAL은 지원되지 않아요.
  • 클라이언트 콘텐츠 업데이트: send_client_content는 명시적 역할(user 또는 model)로 전체 세션 수명 주기 동안 지원돼요. turn_complete=true를 설정하면 활성 생성이 즉시 중단돼요.
  • Proactive audio: 영구적으로 활성화돼 있어요. proactive_audio: false를 설정하면 오류가 반환돼요.

모든 Live API 모델의 기능 비교는 모델 비교 표를 참고하세요.

더 알아보기 (Learn more)