Gemini 3.8 Flash의 새로운 기능

Gemini 3.8 Flash의 새로운 기능 (What's new in Gemini 3.8 Flash)

모든 모델 보기

Gemini 3.8 Flash(gemini-3.8-flash)는 정식 출시(GA)되어 프로덕션 사용이 가능해요. 장기적인(long-horizon) 소프트웨어 엔지니어링, 자율 에이전트, 복잡한 엔터프라이즈 워크플로우를 위해 설계된 가장 지능적인 Flash 모델이에요.

이 가이드는 Gemini 3.8 Flash의 새로운 기능, API 변경 사항, 코드 예시, 그리고 마이그레이션 지침을 설명할게요.

출처: 원문

본문

새 모델 (New model)

모델 모델 ID 기본 thinking 수준 가격 설명
Gemini 3.8 Flash gemini-3.8-flash medium 3.8 Flash는 연말까지 소개 가격인 입력 토큰 100만 개당 $0.75, 출력 토큰 100만 개당 $3.75로 제공돼요. 자세한 내용은 가격을 참고하세요. 장기적인 소프트웨어 엔지니어링, 자율 에이전트, 복잡한 엔터프라이즈 워크플로우를 위해 설계된 가장 지능적인 Flash 모델이에요.

Gemini 3.8 Flash는 1M 토큰 컨텍스트 윈도우, 최대 64k 출력 토큰, 조정 가능한 thinking 수준(low, medium, high), 그리고 동일한 내장 도구 모음을 지원해요.

전체 사양은 Gemini 3.8 Flash 모델 페이지를 참고하세요. 소개 가격에 대한 자세한 내용은 아래 가격 섹션 또는 가격 페이지를 참고해 주세요.

퀵스타트 (Quickstart)

Gemini 3.8 Flash의 새로운 기능

  • 장기적인 소프트웨어 엔지니어링: 실제 코딩 벤치마크, 복잡한 다중 파일 리팩토링, 결정론적 도구 실행에서 강력한 결과를 제공해요. 자세한 내용은 평가 방법론을 참고하세요.
  • 자율 에이전트: 복원력 있는 다단계 계획 및 도구 오케스트레이션 워크플로우를 구축할 수 있어, 실패 루프와 오류를 크게 줄여요.
  • 복잡한 엔터프라이즈 워크플로우: 까다로운 도메인 작업과 대규모 데이터 파이프라인 전반에서 뛰어난 정확성, 깊은 추론, 높은 사실적 엄밀성을 제공해요.
  • Managed Agents의 기본 모델: Managed Agents의 기본 에이전트인 Antigravity 에이전트가 이제 Gemini 3.8 Flash를 사용해요. Antigravity SDK도 기본적으로 Gemini 3.8 Flash를 사용해요.
  • 소개 가격: Gemini 3.8 Flash는 2026년 12월 31일까지 입력 토큰 100만 개당 $0.75, 출력 토큰 100만 개당 $3.75의 소개 요금으로 제공돼요. 표준 가격인 입력 토큰 100만 개당 $1.50, 출력 토큰 100만 개당 $7.50은 2027년 1월 1일부터 적용돼요.

Gemini 3.8 Flash는 설계상 더 길거나 복잡한 작업에서 더 많은 토큰을 사용할 수 있어요. 어렵고 다단계인 목표에서 더 높은 품질의 결과를 제공하기 위해 모델이 더 작은 추론 단계를 거치고, 도구를 반복적으로 호출하며, 작업을 진행하면서 검증해요. 모든 워크플로우가 이런 수준의 검증을 필요로 하지는 않아요. 일상적인 작업에서는 추론 노력을 낮추어 토큰 소비를 줄일 수 있어요. 또는 Gemini 3.7 Flash가 완전히 지원되므로 그대로 사용할 수도 있어요.

추론 수준 이해하기 (Understanding reasoning levels)

Gemini 3.8 Flash는 모델의 thinking 수준을 조정해 지연 시간과 지능을 유연하게 제어할 수 있게 해줘요.

  • 낮은 thinking 노력: 인시던트 대응 파이프라인, 실시간 채팅, 초안 작성, 빠른 데이터 분석 같은 지연 시간이 중요한 작업에서 응답 시간을 단축해요.
  • 중간(기본값): 대부분의 작업에서 최고의 품질을 제공해요. 복잡한 코드 및 에이전틱 사용 사례에 권장되며 더 높은 첫 통과 정확도를 제공해요.
  • 높은 thinking 노력: 모델의 추론 및 도구 오케스트레이션 역량을 최대화해요. 깊은 추론, 수학, 어려운 다단계 작업에 가장 적합해요.

참고: Gemini 3.8 Flash에서는 minimal thinking 수준을 지원하지 않으며 오류를 반환해요.

다음 예시는 복잡한 코드 분석 요청에 대해 thinking_level을 medium으로 설정해요.

업데이트된 Antigravity 에이전트

참고: 이 기능은 Interactions API를 필요로 해요. Gemini Managed Agents의 Antigravity 에이전트는 이제 기본적으로 Gemini 3.8 Flash로 구축돼요. 사용 세부 사항과 코드 샘플은 Interactions API 개요를 참고하세요.

마이그레이션 체크리스트 (Migration checklist)

**참고:**코딩 에이전트로 이 마이그레이션을 자동화하세요. 스킬을 지원하는 코딩 에이전트(예: Antigravity)를 사용한다면 gemini-api-dev 스킬을 설치하고 다음을 실행해 주세요.

/gemini-api-dev migrate my app to Gemini 3.8 Flash`

gemini-3.8-flash로 마이그레이션하기

  • 모델 ID 업데이트: 대상 모델 문자열을 gemini-3.8-flash로 변경해요.
  • 사용 중단된 샘플링 파라미터 제거: generation configs에서 temperature, top_p, top_k를 제거해요. thinking_budget을 문자열 열거형 thinking_level로 교체해요. minimal은 3.8 Flash에서 지원되지 않아요. candidate_count를 제거해요 (Gemini 3 이상에서 미지원).
  • generation configs에서 temperature, top_p, top_k를 제거해요.
  • thinking_budget을 문자열 열거형 thinking_level로 교체해요. minimal은 3.8 Flash에서 지원되지 않아요.
  • candidate_count를 제거해요 (Gemini 3 이상에서 미지원).
  • 턴 검증 규칙 적용: 미리 채워진(prefilled) 모델 턴을 제거해요. 마지막 사용자 턴에 비어 있지 않은 텍스트가 포함되도록 보장해요.
  • 미리 채워진 모델 턴을 제거해요.
  • 마지막 사용자 턴에 비어 있지 않은 텍스트가 포함되도록 보장해요.
  • 함수 호출 감사: 멀티모달 자산을 응답 페이로드 안에 배치해요. 인라인 지침을 \n\n을 사용해 형식화해요. 도구 전 텍스트와 관련된 Malformed_Function_Call 오류가 보이면 도구 전 텍스트 요구 사항 해결 방법을 참고하세요. generateContent API를 사용하는 경우에만: 모든 FunctionResponse 객체에 call_id와 name이 포함되도록 보장해요.
  • 멀티모달 자산을 응답 페이로드 안에 배치해요.
  • 인라인 지침을 \n\n을 사용해 형식화해요.
  • 도구 전 텍스트와 관련된 Malformed_Function_Call 오류가 보이면 도구 전 텍스트 요구 사항 해결 방법을 참고하세요.
  • generateContent API를 사용하는 경우에만: 모든 FunctionResponse 객체에 call_id와 name이 포함되도록 보장해요.
  • 기본 Gemini 3 요구 사항: SDK 업데이트 및 사고 서명 보존에 대해서는 Gemini 3.5 마이그레이션 체크리스트를 참고하세요.

가격 (Pricing)

Gemini 3.8 Flash, Gemini 3.7 Flash, Gemini 3.6 Flash에 대해 Google AI Studio와 Gemini Enterprise Agent Platform 전반에서 2026년 12월 31일까지 소개 가격을 활용하세요. 표준 가격은 2027년 1월 1일부터 적용돼요. 전체 가격 등급은 가격 페이지를 참고하세요.

다음 단계 (Next steps)

더 알아보기 (Learn more)