Gemini 3.8 Live Extended Thinking
Gemini 3.8 Live Extended Thinking
Gemini 3.8 Live Extended Thinking은 고수준 추론을 제공하는 오디오-투-오디오 모델로, 실시간 음성 상호작용 중 복잡한 다단계 문제 해결에 더 높은 백그라운드 추론이 필요할 때 권장돼요. 연속 오디오 응답을 스트리밍하면서 백그라운드 추론과 비동기 도구 호출을 처리해요. Google AI Studio에서 사용해 볼 수 있어요.
출처: 원문
본문
문서(Documentation)
기능과 능력의 전체 내용은 Live API 가이드를 참고하세요.
gemini-3.8-live-extended-thinking
| 속성 | 설명 |
|---|---|
| 모델 코드 | gemini-3.8-live-extended-thinking |
| 지원 데이터 유형 | 입력 — 텍스트, 이미지, 오디오, 비디오 / 출력 — 텍스트 및 오디오 |
| 토큰 한도[*] | 입력 토큰 한도 — 131,072 / 출력 토큰 한도 — 65,536 |
| 기능 | 오디오 생성 지원 / Caching 미지원 / 코드 실행 미지원 / 파일 검색 미지원 / 함수 호출 지원(비동기 전용) / Google Maps Grounding 미지원 / 이미지 생성 미지원 / Live API 지원 / Search grounding 지원 / 구조화 출력 미지원 / Thinking 지원 / URL context 미지원 |
| 소비 옵션 | Batch API 미지원 |
| 버전 | 자세한 내용은 모델 버전 패턴을 참고하세요. Stable: gemini-3.8-live-extended-thinking |
| 최신 업데이트 | 2026년 9월 |
| 모델 카드 | 모델 카드 |
Gemini 3.8 Live Extended Thinking으로 업그레이드
Gemini 3.8 Live Extended Thinking은 라이브 오디오 세션 중에 백그라운드 추론을 도입해요. 이 모델을 통합할 때는 비동기 추론 신호를 처리하도록 클라이언트 상태 관리를 업데이트해야 해요:
- 비동기 추론 프로토콜: 비동기 추론을 사용하는 모델과 상호작용할 때
turnComplete: true는 더 이상 모델이 유휴 상태임을 나타내지 않아요. 서버는 백그라운드 추론이나 도구 호출을 계속 처리할 수 있어요. 클라이언트는turnComplete: true가 도착한 후에도 후속 서버 메시지(도구 호출 또는 오디오 프레임 등)를 계속 리슨해야 해요. interaction_status모니터링: 들어오는 서버 메시지의interaction_status필드를 사용해 현재 서버 상태를 파악해요:
IN_PROGRESS: 서버가 사용자 입력을 활발히 처리하거나, 백그라운드 추론을 실행하거나, 비동기 도구 호출에 대한 응답을 기다리고 있어요. 추가 모델 출력이나 도구 호출이 뒤따를 수 있어요.
IDLE: 서버가 모든 처리, 추론, 도구 호출을 마쳤어요. 세션이 유휴 상태이며 사용자 입력을 기다리고 있어요.
- 비동기 함수 호출: 비동기 비차단 실행(
behavior: NON_BLOCKING)만 지원돼요. 동기 차단 모드는 지원되지 않으며 하드 오류를 반환해요. 함수 스케줄링 구성은 지원되지 않아요. - Thinking 구성: 설정 구성의
thinking_config를 사용해 백그라운드 추론을 구성해요(thinking_level:low,medium,high).MINIMAL은 지원되지 않아요. - 클라이언트 콘텐츠 업데이트:
send_client_content는 명시적 역할(user또는model)로 전체 세션 수명 주기 동안 지원돼요.turn_complete=true를 설정하면 활성 생성이 즉시 중단돼요. - Proactive audio: 영구적으로 활성화돼 있어요.
proactive_audio: false를 설정하면 오류가 반환돼요.
모든 Live API 모델의 기능 비교는 모델 비교 표를 참고하세요.