Gemini API 릴리스 노트

Gemini API 릴리스 노트 (Release notes)

이 페이지는 Gemini API의 업데이트를 기록한 문서예요. 모델 출시, GA(일반 제공) 전환, 폐기(deprecation) 공지, API 변경 사항을 날짜별로 정리했어요.

출처: 문서

본문

2026년 9월 22일

  • Gemini 3.8 Flash TTS와 Gemini 3.8 Flash-Lite TTS 일반 제공(GA): 차세대 텍스트-음성(text-to-speech, TTS) 오디오 모델과 Gemini API Voices 엔드포인트(/v1beta/voices)를 출시했어요.
    • Gemini 3.8 Flash TTS(gemini-3.8-flash-tts): 스튜디오급 음성 충실도, 섬세한 연기, 지역 방언, 장문 멀티 턴 안정성을 위해 설계된 플래그십 크리에이티브 TTS 모델이에요.
    • Gemini 3.8 Flash-Lite TTS(gemini-3.8-flash-lite-tts): gemini-3.1-flash-tts-preview를 대체하기 위해 만들어진 빠르고 비용 효율적인 TTS 모델이에요. 높은 처리량의 프로덕션과 실시간 음성 에이전트 캐스케이드에 적합해요.
    • Voice design, Voice replication, Extended Voice Library: 텍스트 프롬프트로 지속적인 커스텀 보이스 페르소나를 만들고, 동의 확인으로 음성을 복제하고, 150개 이상의 사전 구축·커스텀 음성을 조회할 수 있어요.
    • 시작하려면 Text-to-speech 가이드를 참고하세요.

2026년 9월 18일

  • Gemini 2.5 모델 접근 업데이트: 모두에게 안정적인 성능을 보장하기 위해 2.5 모델 접근을 과거에 실제로 사용해 본 사용자로 제한하고 있어요. 이 모델들은 폐기되지 않으며, 후속 공지가 있을 때까지 API를 통해 계속 제공돼요. 새 프로젝트에서는 최신 모델인 3.5 Flash-Lite 또는 3.8 Flash를 사용하세요. 이렇게 하면 기존 레거시 워크플로와 새 애플리케이션 모두를 위한 충분한 용량을 유지할 수 있어요.

2026년 9월 17일

  • Antigravity Agent 09-2026: antigravity-preview-05-2026를 대체하고 폐기하는 antigravity-preview-09-2026을 출시했어요.
    • 원격 샌드박스(environment: "remote")에서 실행하고 output_text나 model_output 스텝만 읽는다면, 에이전트 문자열만 갱신하면 되고 다른 것은 바뀌지 않아요.
    • 로컬에서 도구(local_environment)를 실행하거나 function_call 스텝을 파싱한다면, 내장 도구가 변경됐어요. 파라미터가 snake_case 대신 PascalCase를 사용하고, 파일 편집이 전체 다시 쓰기 대신 줄 범위(line-range) 교체를 사용해요.
기능 05-2026 09-2026
파일 생성 write_file(path, content) write_to_file(TargetFile, CodeContent, Overwrite, Description)
파일 편집 write_file(path, content), 전체 다시 쓰기 replace_file_content(TargetFile, StartLine, EndLine, TargetContent, ReplacementContent)
파일 읽기 read_file(path, offset, limit), 바이트 오프셋 view_file(AbsolutePath, StartLine, EndLine, ContentOffset)
디렉터리 나열 list_files(path) list_dir(DirectoryPath)
파일·코드 검색 없음, 에이전트가 셸 명령어 사용 find_by_name(SearchDirectory, Pattern, MaxDepth) 및 grep_search(SearchPath, Query, IsRegex)
셸 실행 code_execution(command, timeout_seconds) 변경 없음
웹 검색 google_search(queries) 변경 없음

Antigravity Agent 가이드를 참고하세요. antigravity-preview-05-2026은 2026년 10월 5일에 종료되며, deprecations 페이지에서 추적돼요.

2026년 9월 15일

  • Gemini 3.8 Live와 Gemini 3.8 Live Extended Thinking 일반 제공(GA): Live API를 사용하는 실시간 음성 애플리케이션을 위한 두 개의 새 오디오-투-오디오 모델을 출시했어요.
    • Gemini 3.8 Live(gemini-3.8-live): 추론 지연 없이 대부분의 저지연 음성 에이전트 경험과 실시간 대화를 위한 기본 옵션이에요. 인터리브 추론, 기본 비동기 함수 호출, 전체 세션 클라이언트 콘텐츠 업데이트를 제공해요.
    • Gemini 3.8 Live Extended Thinking(gemini-3.8-live-extended-thinking): 라이브 오디오 상호작용 중 배경 추론을 지원하는 고추론 오디오-투-오디오 모델로, 더 높은 배경 추론이 필요할 때 권장돼요.
    • 시작하려면 Live API 가이드, Capabilities 가이드, Thinking 가이드를 참고하세요.

2026년 9월 3일

  • Lyria 3.5 일반 제공(GA): Google 음악 생성 모델의 차세대 버전을 출시했어요.
    • lyria-3.5: 개선된 음악적 일관성, 자연스러운 보컬, 세밀한 길이·구조 제어를 갖춘 전체 길이 노래 생성.
    • 모델은 텍스트와 이미지 입력을 지원하고 고충실도 44.1 kHz 스테레오 오디오를 생성해요. 자세한 내용과 코드 샘플은 Music generation 가이드를 참고하세요.

2026년 9월 2일

  • Gemini 3.8 Flash 일반 제공(GA): 장기 호라이즌 소프트웨어 엔지니어링, 자율 에이전트, 복잡한 엔터프라이즈 워크플로우를 위해 설계된 가장 지능적인 Flash 모델인 gemini-3.8-flash를 출시했어요. 시작하려면 Gemini 3.8 Flash 모델 페이지와 Latest model 가이드를 참고하세요.

2026년 9월 1일

  • 에이전트식 비디오 이해(Agentic video understanding): Gemini 3.7 Flash, 3.6 Flash, 3.5 Flash-Lite에 대해 Interactions 및 GenerateContent API 전반에 걸쳐 에이전트식 비디오 이해를 출시했어요. 모델이 비디오 타임라인을 동적으로 탐색하며 필요할 때 트랜스크립트, 프레임, 오디오 트랙을 요청해요. 이 접근 방식은 정적 처리에 비해 장문 콘텐츠에서 토큰을 최대 88% 덜 사용해요. 시작하려면 Agentic video understanding 가이드를 참고하세요.

2026년 8월 27일

  • Gemini Omni Flash 일반 제공(GA): 빠르고 대화형인 비디오 생성·편집 모델의 GA 버전인 gemini-omni-1.1-flash를 출시했어요. 이번 릴리스에는 중요한 새 기능들이 포함돼 있어요.
    • 비디오 확장(Video extension): extend 태스크나 프롬프트를 직접 사용해 클립 끝에 이어지는 연속 장면을 생성해 기존 비디오를 매끄럽게 확장해요.
    • 보간(Interpolation, 첫+마지막 프레임): image_to_video 태스크로 최대 2개 이미지를 사용해 두 이미지 사이를 전환하는 비디오를 생성해요.
    • 해상도 제어(Resolution control): video_config의 새 resolution 파라미터가 360p, 720p(기본), 1080p, 4k 출력을 지원해요. 1080p와 4K 출력은 업스케일링으로 생성돼요.
    • 기존 gemini-omni-flash-preview 엔드포인트는 2026년 9월 30일에 폐기돼요. 시작하려면 Gemini Omni Flash 모델 페이지와 omni 가이드를 참고하세요.

2026년 8월 26일

  • Gemini 3.5 Transcribe 일반 제공(GA): Gemini의 오디오 이해에 기반한 두 개의 전용 음성-텍스트 모델을 출시했어요.
    • Gemini 3.5 Transcribe(gemini-3.5-transcribe): 85개 이상 언어에 걸친 발화 기반 언어 감지, 화자 분리(diarization), 단어 수준 타임스탬프, 커스텀 어휘 바이어싱(최대 1,000개 용어)을 갖춘 고정확도·저지연 비스트리밍 음성-텍스트 모델이에요.
    • Gemini 3.5 Transcribe Live(gemini-3.5-transcribe-live): Live API를 사용해 WebSockets로 저지연 양방향 스트리밍 음성-텍스트를 제공해요. 중간·최종 트랜스크립션 이벤트, Smart transcription 모드, 여러 Voice Activity Detection(VAD) 전략을 지원해요.
    • 시작하려면 Audio transcription 가이드, Live transcription 가이드, Gemini 3.5 Transcribe 모델 페이지를 참고하세요.

2026년 8월 13일

  • Gemini 3.7 Flash 일반 제공(GA): 코딩과 에이전트용 최고의 다재다능한 모델을 출시했어요.
    • Gemini 3.7 Flash(gemini-3.7-flash): 소프트웨어 엔지니어링, 웹 개발, 에이전트 워크플로 전반에 걸친 큰 개선 사항으로, 2026년 12월 31일까지 소개 가격으로 제공돼요.
    • 시작하려면 Gemini 3.7 Flash 모델 페이지와 Latest model 가이드를 참고하세요.

2026년 7월 30일

  • Gemini Robotics ER 2 공개 프리뷰: 로보틱스를 위한 두 개의 새 임베디드 추론(embodied reasoning) 모델 엔드포인트를 출시했어요.
    • gemini-robotics-er-2-preview: 고급 공간 추론, 에이전트식 코드 실행, 다단계 도구 오케스트레이션, 비디오 순간 찾기, 진행 분류, 다중 로봇 협조.
    • gemini-robotics-er-2-streaming-preview: 양방향 오디오·비디오 입력으로 저지연 로봇 에이전트를 가능하게 하는 Live API의 실시간 텍스트 스트리밍에 최적화.
    • 두 모델 엔드포인트 모두 텍스트, 이미지, 비디오, 오디오 입력을 받아들이고, 물리적 로봇 동작에 대한 블로킹 동작을 가진 function calling을 지원해요. 시작하려면 Gemini Robotics ER overview를 참고하세요. 실시간 스트리밍 용례는 Robotics with streaming을 참고하세요.
  • 폐기 공지: gemini-robotics-er-1.6-preview 모델은 2026년 8월 31일에 종료될 예정이에요.

2026년 7월 21일

  • Gemini 3.6 Flash와 Gemini 3.5 Flash-Lite 일반 제공(GA): 최신 3.x Flash 모델의 안정적인 프로덕션 버전을 출시했어요.
    • Gemini 3.6 Flash(gemini-3.6-flash): 3.5 Flash보다 낮은 가격대에서 개선된 토큰 효율과 코드/에이전트 계획 능력을 제공해 출력 장황성에 대한 개발자 피드백을 해결했어요.
    • Gemini 3.5 Flash-Lite(gemini-3.5-flash-lite): 고볼륨 자동화를 위해 설계된 저지연, 비용 효율적인 서브에이전트 옵션이에요.
    • 자세한 내용은 Latest Gemini model 가이드를 참고하세요.
  • 폐기된 파라미터: 샘플링 파라미터 temperature, top_p, top_k가 이제 폐기됐어요. 자세한 내용은 Latest Gemini Model을 참고하세요.

2026년 7월 6일

2026년 6월 30일

  • Gemini Omni Flash 공개 프리뷰: 고속 비디오 생성과 대화형 비디오 편집을 위해 설계된 고성능 멀티모달 모델인 gemini-omni-flash-preview를 출시했어요. Interactions API를 사용해 텍스트 설명에서 720p 3~10초 비디오를 생성하거나 정지 이미지를 애니메이션화한 뒤, 대화형으로 편집·정제할 수 있어요. 시작하려면 Gemini Omni Flash 가이드와 모델 카드를 참고하세요.
  • gemini-3.1-flash-lite-image(Nano Banana 2 Lite)를 일반 제공(GA)으로 출시했어요. 극초저지연과 비용 효율적인 이미지 생성·편집에 최적화된 내장 멀티모달 모델이에요. Gemini 3.1 Flash Lite Image 모델 카드와 Image generation 가이드를 참고하세요.

2026년 6월 24일

  • Computer Use: Gemini 3.5 Flash에서 Computer Use 도구의 공개 프리뷰 지원을 시작했어요. 의도를 가진 단순화된 액션, 브라우저·모바일·데스크톱 환경에 대한 내장 지원, 구성 가능한 안전 정책, 고급 프롬프트 인젝션 탐지가 포함돼요.

2026년 6월 17일

  • 음성 생성 스트리밍 지원: gemini-3.1-flash-tts-preview 모델에서 streamGenerateContent(및 Interactions API의 stream: true)를 통한 스트리밍을 지원해요. 자세한 내용은 Text-to-Speech 가이드를 참고하세요.

2026년 6월 15일

  • 폐기 공지: 다음 이미지 생성 모델이 폐기되며 2026년 8월 17일에 종료돼요.
    • Imagen 4 및 Gemini 3 Image 모델: imagen-4.0-generate-001, imagen-4.0-ultra-generate-001, imagen-4.0-fast-generate-001.
    • 코드를 최신 안정 또는 프리뷰 엔드포인트로 마이그레이션하려면 Gemini deprecations 페이지를 참고하세요.
  • 폐기 공지: 다음 비디오 생성 모델이 폐기되며 2026년 6월 30일에 종료돼요.
    • Veo 모델: veo-2.0-generate-001, veo-3.0-generate-001, veo-3.0-fast-generate-001.
    • 서비스 중단을 피하려면 Veo 3.1 프리뷰 모델 ID(veo-3.1-generate-preview, veo-3.1-fast-generate-preview)나 Gemini Enterprise Agent Platform을 통해 제공되는 3.1 GA 모델을 사용하도록 통합을 갱신하세요.
  • 폐기 공지: 실험적 GMP Contextual View 도구(Google Maps 기반 접지 출력을 위한 고정 인터페이스)가 2026년 6월 15일에 종료돼요.

2026년 6월 1일

  • 다음 Gemini 2.0 모델이 이제 종료됐어요: gemini-2.0-flash, gemini-2.0-flash-001, gemini-2.0-flash-lite, gemini-2.0-flash-lite-001. 대신 gemini-3.5-flash 또는 gemini-3.1-flash-lite를 사용하세요.

2026년 5월 28일

  • 네이티브 비주얼 모델의 GA 버전인 gemini-3.1-flash-image(Nano Banana 2)와 gemini-3-pro-image(Nano Banana Pro)를 출시했어요. Gemini 3.1 Flash Image와 Gemini 3 Pro Image를 참고하세요.
  • 비디오-투-이미지 생성 지원: 텍스트 프롬프트와 함께 비디오 파일(직접 업로드 또는 공개 YouTube URL)을 멀티모달 컨텍스트로 전달해 고품질 썸네일, 시네마틱 영화 포스터, 요약 인포그래픽을 생성할 수 있어요. 이 기능은 gemini-3.1-flash-image 모델에서만 지원돼요. 자세한 내용은 Video-to-image generation 가이드를 참고하세요.
  • 폐기 공지: gemini-3.1-flash-image-preview와 gemini-3-pro-image-preview 모델이 폐기되며 2026년 6월 25일에 종료돼요.

2026년 5월 25일

2026년 5월 19일

  • 에이전트 및 코딩 작업에서 지속적인 프론티어 성능을 위한 가장 지능적인 모델인 Gemini 3.5 Flash의 GA 버전인 gemini-3.5-flash를 출시했어요. 이제 gemini-flash-latest의 기반 모델이에요.
  • **Gemini API의 관리형 에이전트(Managed Agents)**를 공개 프리뷰로 시작했어요. 보안·격리된 Google 호스팅 Linux 샌드박스 환경에서 실행되는 자율적이고 상태가 있는 에이전트를 구축·배포할 수 있어요. 자세한 내용은 Agents overview 페이지와 Quickstart를 참고하세요.
  • 범용 관리형 에이전트인 Antigravity Agent([antigravity-preview-05-2026])를 공개 프리뷰로 출시했어요. Antigravity 에이전트는 샌드박스 컨테이너 안에서 자율적으로 계획하고, 추론하고, 코드를 작성·실행하고, 파일을 관리하고, 웹을 탐색할 수 있어요. 코드 샘플과 사양은 Antigravity Agent 가이드를 참고하세요.

2026년 5월 7일

  • 속도, 규모, 비용 효율에 최적화된 Gemini 3.1 Flash-Lite의 GA 버전인 gemini-3.1-flash-lite를 출시했어요.
  • 폐기 공지: gemini-3.1-flash-lite-preview 모델은 5/11/26에 폐기되고 2026년 5월 25일에 종료돼요.

2026년 5월 6일

  • 예정된 브레이킹 체인지: Interactions API의 요청·응답 스키마(outputs → steps)와 출력 형식 설정(response_format)이 변경돼요. 새 스키마는 5월 26일부터 기본값이 되고 레거시 스키마는 6월 8일에 제거돼요. 자세한 내용은 마이그레이션 가이드를 참고하세요.

2026년 5월 5일

  • File Search를 멀티모달 검색을 지원하도록 업데이트했어요. 이제 gemini-embedding-2 모델로 이미지를 네이티브하게 임베딩하고 검색할 수 있어요. 접지 메타데이터에 시각적 인용을 위한 media_id와 정보가 있는 위치를 나타내는 page_numbers가 추가됐어요. 자세한 내용은 File Search 가이드를 참고하세요.

2026년 5월 4일

  • Batch API와 장기 실행 작업의 폴링 워크플로를 대체하기 위해 Gemini API에서 이벤트 기반 Webhooks 지원을 시작했어요.

2026년 4월 30일

2026년 4월 22일

  • gemini-embedding-2를 일반 제공(GA)으로 출시했어요. 자세한 내용은 Embeddings 페이지를 참고하세요.

2026년 4월 21일

2026년 4월 15일

2026년 4월 14일

  • 업데이트된 로보틱스 모델인 gemini-robotics-er-1.6-preview를 출시했어요. 계기판 판독 같은 새 기능과 개선된 공간·물리 추론 능력을 갖추고 있어요. 자세한 내용은 Gemini Robotics ER 페이지와 블로그를 참고하세요.
  • 폐기 공지: gemini-robotics-er-1.5-preview 모델이 2026년 4월 30일 오전 9시 PST에 종료돼요.

2026년 4월 2일

  • Gemma 4 출시의 일부로 AI Studio와 Gemini API에서 사용 가능한 gemma-4-26b-a4b-it와 gemma-4-31b-it를 출시했어요.

2026년 4월 1일

  • 비용 또는 지연 시간 최적화를 위한 더 많은 옵션을 제공하는 새 Flex 및 Priority 추론 티어를 도입했어요.

2026년 3월 31일

2026년 3월 26일

  • 실시간 대화와 음성 우선 AI 애플리케이션을 위해 설계된 최신 오디오-투-오디오(A2A) 모델인 gemini-3.1-flash-live-preview를 출시했어요. 시작하려면 Live API 문서를 읽어 보세요.

2026년 3월 25일

2026년 3월 23일

2026년 3월 18일

2026년 3월 16일

2026년 3월 12일

2026년 3월 10일

  • 첫 멀티모달 임베딩 모델인 gemini-embedding-2-preview를 출시했어요. 텍스트, 이미지, 비디오, 오디오, PDF 입력을 지원하며 모든 모달리티를 통합 임베딩 공간으로 매핑해요. 자세한 내용은 Embeddings 참고.
  • 폐기 공지: gemini-2.5-flash-lite-preview-09-2025 모델이 2026년 3월 31일에 종료돼요.

2026년 3월 9일

2026년 3월 3일

  • Gemini 3 시리즈의 첫 Flash-Lite 모델인 Gemini 3.1 Flash-Lite Preview를 출시했어요. 사양, 구체적인 업데이트, 개발자 안내는 모델 페이지를 참고하세요.

2026년 2월 26일

  • 속도와 고볼륨 용례에 최적화된 고효율 모델인 Nano Banana 2(Gemini 3.1 Flash Image Preview)를 출시했어요.
  • 폐기 공지: Gemini 3 Pro Preview(gemini-3-pro-preview)가 2026년 3월 9일에 종료돼요.

2026년 2월 19일

  • 새 Gemini 3 시리즈의 최신 반복 버전인 Gemini 3.1 Pro Preview를 출시했어요.
  • bash와 도구를 혼합해 사용하는 사용자를 위해 커스텀 도구 우선 처리가 더 좋은 별도 엔드포인트 gemini-3.1-pro-preview-customtools를 출시했어요.

2026년 2월 18일

  • 폐기 공지: 다음 모델이 2026년 6월 1일에 종료돼요: gemini-2.0-flash, gemini-2.0-flash-001, gemini-2.0-flash-lite, gemini-2.0-flash-lite-001.

2026년 2월 17일

  • 다음 모델이 종료됐어요: gemini-2.5-flash-preview-09-25, imagen-4.0-generate-preview-06-06, imagen-4.0-ultra-generate-preview-06-06.

2026년 1월 29일

  • gemini-3-pro-preview와 gemini-3-flash-preview에서 Computer Use 도구 지원을 출시했어요.

2026년 1월 21일

  • latest 별칭을 변경했어요: gemini-pro-latest가 gemini-3-pro-preview로, gemini-flash-latest가 gemini-3-flash-preview로 전환됐어요.

2026년 1월 15일

  • 폐기 공지: 다음 모델이 2026년 2월 17일에 종료돼요: gemini-2.5-flash-preview-09-25, imagen-4.0-generate-preview-06-06, imagen-4.0-ultra-generate-preview-06-06.
  • gemini-2.5-flash-image-preview 모델이 종료됐어요.

2026년 1월 14일

  • text-embedding-004 모델이 종료됐어요.

2026년 1월 13일

  • Veo에 4k 출력 해상도를 추가하고, 모든 해상도에서 세로 비디오 지원을 더 추가했어요.

2026년 1월 12일

  • 모델 수명 주기(lifecycle) 기능을 출시했어요. 일부 모델은 이제 수명 주기 단계와 폐기 타임라인을 명시해요. 자세한 내용은 Model stages 문서를 참고하세요.

2026년 1월 8일

  • Gemini API 데이터 입력 소스로 Cloud Storage 버킷과 모든 공개·비공개 DB pre-signed URL을 지원하기 시작했어요. 파일 크기 제한도 20MB에서 100MB로 늘어났어요. 자세한 내용은 File input methods 가이드를 참고하세요.

2025년 12월 19일

  • v1beta의 Interactions API에 브레이킹 체인지를 도입했어요. total_reasoning_tokens 필드가 thinking 모델의 "생각(thoughts)" 개념에 더 잘 맞도록 total_thought_tokens로 이름이 바뀌었어요.

2025년 12월 17일

  • 더 큰 모델에 맞먹는 성능을 비용의 일부로 제공하는 빠른 프론티어급 모델인 Gemini 3 Flash Preview(gemini-3-flash-preview)를 출시했어요. 업그레이드된 시각·공간 추론과 에이전트식 코딩 능력을 갖췄어요. 몇 가지 새 기능에 대한 문서를 읽어 보세요:

2025년 12월 12일

  • Live API용 새 네이티브 오디오 모델인 gemini-2.5-flash-native-audio-preview-12-2025를 출시했어요. 이 업데이트는 복잡한 워크플로를 처리하는 모델의 능력을 개선해요. 자세한 내용은 Live API 가이드와 Gemini 2.5 Flash Native Audio를 참고하세요.

2025년 12월 11일

  • Gemini 모델과 에이전트와 상호작용하기 위한 통합 인터페이스를 제공하는 Interactions API를 출시했어요. 자세한 내용은 Interactions API 가이드를 참고하세요.
  • Gemini Deep Research 에이전트를 프리뷰로 출시했어요. 다단계 연구 작업을 자율적으로 계획·실행·종합할 수 있어요. 자세한 내용은 Deep Research 가이드를 참고하세요.

2025년 12월 10일

  • 텍스트-음성 모델의 개선 기능을 출시했어요. Gemini 2.5 Flash TTS preview(저지연 최적화)와 Gemini 2.5 Pro TTS preview(품질 최적화)로, 향상된 표현력, 정밀한 페이싱, 매끄러운 대화가 포함돼요.

2025년 12월 9일

  • 다음 Gemini Live API 모델이 이제 종료됐어요: gemini-2.0-flash-live-001, gemini-live-2.5-flash-preview.

2025년 12월 5일

2025년 12월 4일

  • 폐기 공지: gemini-2.5-flash-image-preview 모델이 2026년 1월 15일에 종료돼요.

2025년 12월 3일

  • 폐기 공지: text-embedding-004 모델이 2026년 1월 14일에 종료돼요.

2025년 11월 20일

  • Nano Banana 모델의 다음 반복 버전인 Gemini 3 Pro Image Preview(gemini-3-pro-image-preview)를 출시했어요. 더 자세한 내용은 Image generation 페이지를 읽어 보세요.

2025년 11월 18일

  • 첫 Gemini 3 시리즈 모델인 gemini-3-pro-preview를 출시했어요. 강력한 에이전트·코딩 능력을 갖춘 최첨단 추론·멀티모달 이해 모델이에요.

2025년 11월 11일

  • 폐기 공지: 다음 모델이 종료돼요. 11월 12일: veo-3.0-fast-generate-preview, veo-3.0-generate-preview. 11월 14일: gemini-2.0-flash-exp-image-generation, gemini-2.0-flash-preview-image-generation.

2025년 11월 10일

  • 다음 모델이 종료됐어요: imagen-3.0-generate-002. 대신 Imagen 4를 사용하세요. 자세한 내용은 Gemini deprecations 표를 참고하세요.

2025년 11월 6일

  • 개발자가 응답을 자신의 데이터에 기반해 접지할 수 있게 하는 File Search API를 공개 프리뷰로 출시했어요. 자세한 내용은 새 File Search 페이지를 읽어 보세요.

2025년 11월 4일

  • Gemini 2.5 Flash Image의 이미지 입력 토큰 수가 1290에서 258로 줄어 이미지 편집 비용이 낮아졌어요.
  • 폐기 공지: 다음 모델이 종료돼요. 11월 18일: gemini-2.5-flash-lite-preview-06-17, gemini-2.5-flash-preview-05-20. 12월 2일: gemini-2.0-flash-thinking-exp, gemini-2.0-flash-thinking-exp-01-21, gemini-2.0-flash-thinking-exp-1219, gemini-2.5-pro-preview-03-25, gemini-2.5-pro-preview-05-06, gemini-2.5-pro-preview-06-05. 12월 9일: gemini-2.0-flash-lite-preview, gemini-2.0-flash-lite-preview-02-05, gemini-2.0-flash-exp, gemini-2.0-pro-exp, gemini-2.0-pro-exp-02-05.

2025년 10월 29일

2025년 10월 20일

  • 다음 Gemini Live API 모델이 이제 종료됐어요: gemini-2.5-flash-preview-native-audio-dialog, gemini-2.5-flash-exp-native-audio-thinking-dialog. 대신 gemini-2.5-flash-native-audio-preview-09-2025를 사용할 수 있어요.
  • 폐기 공지: gemini-2.0-flash-live-001와 gemini-live-2.5-flash-preview의 종료가 2025년 12월 9일로 예정돼요.

2025년 10월 17일

  • **Google Maps 기반 접지(Grounding with Google Maps)**가 이제 일반 제공(GA)이에요. 자세한 내용은 Grounding with Google Maps 문서를 참고하세요.

2025년 10월 15일

  • Veo 3.1 및 3.1 Fast 모델을 공개 프리뷰로 출시했어요. 새 기능은 다음과 같아요.
    • Veo로 만든 비디오 확장.
    • 최대 세 개의 이미지를 참조해 비디오 생성.
    • 첫·마지막 프레임 이미지를 제공해 비디오 생성.
    • 또한 Veo 3 출력 비디오 길이(4, 6, 8초)에 더 많은 옵션을 추가했어요.
  • 폐기 공지: veo-3.0-generate-preview와 veo-3.0-fast-generate-preview의 종료가 2025년 11월 12일로 예정돼요.

2025년 10월 7일

2025년 10월 2일

2025년 9월 29일

  • 다음 Gemini 1.5 모델이 이제 종료됐어요: gemini-1.5-pro, gemini-1.5-flash-8b, gemini-1.5-flash.

2025년 9월 25일

  • Gemini Robotics ER 1.5 모델을 프리뷰로 출시했어요. 로보틱스 애플리케이션에서 모델을 사용하는 방법은 Robotics overview를 참고하세요.
  • 다음 프리뷰 모델을 출시했어요: gemini-2.5-flash-preview-09-2025, gemini-2.5-flash-lite-preview-09-2025. 자세한 내용은 Models 페이지를 참고하세요.

2025년 9월 23일

  • Live API용 새 네이티브 오디오 모델인 gemini-2.5-flash-native-audio-preview-09-2025를 출시했어요. 개선된 function calling과 음성 끊김 처리 기능이 있어요. 자세한 내용은 Live API 가이드와 Gemini 2.5 Flash Native Audio를 참고하세요.

2025년 9월 16일

  • 폐기 공지: 다음 모델이 2025년 10월에 종료돼요: embedding-001, embedding-gecko-001, gemini-embedding-exp-03-07(gemini-embedding-exp). 최신 임베딩 모델에 대한 자세한 내용은 Embeddings 페이지를 참고하세요.

2025년 9월 10일

2025년 9월 9일

  • 더 낮은 가격과 새 종횡비·해상도·시드 옵션으로 Veo 3 및 Veo 3 Fast GA를 출시했어요. 자세한 내용은 Veo 문서를 참고하세요.

2025년 8월 26일

2025년 8월 18일

  • 프롬프트에 URL을 추가 컨텍스트로 제공하는 도구인 URL context tool을 일반 제공(GA)으로 출시했어요. gemini-2.0-flash 모델과 함께 URL context를 사용하는 지원(실험 릴리스 중 제공)은 1주 후 중단돼요.

2025년 8월 14일

  • Imagen 4 Ultra, Standard, Fast 모델을 일반 제공(GA)으로 출시했어요. 자세한 내용은 Imagen 페이지를 참고하세요.

2025년 8월 7일

  • Image to Video 생성의 allow_adult 설정이 제한된 지역에서 사용 가능해졌어요. 자세한 내용은 Veo 페이지를 참고하세요.

2025년 7월 31일

  • Veo 3 Preview 모델의 이미지-투-비디오 생성을 출시했어요.
  • Veo 3 Fast Preview 모델을 출시했어요.
  • Veo 3에 대해 더 알아보려면 Veo 페이지를 방문하세요.

2025년 7월 22일

  • 빠르고 저비용이며 고성능인 Gemini 2.5 모델인 gemini-2.5-flash-lite를 출시했어요. 자세한 내용은 Gemini 2.5 Flash-Lite 참고.

2025년 7월 17일

  • 오디오 포함 비디오 생성을 도입한 Veo의 최신 업데이트인 veo-3.0-generate-preview를 출시했어요. Veo 3에 대해 더 알아보려면 Veo 페이지를 방문하세요.
  • Imagen 4 Standard와 Ultra의 요금 한도를 늘렸어요. 자세한 내용은 Rate limits 페이지를 참고하세요.

2025년 7월 14일

  • 텍스트 임베딩 모델의 안정 버전인 gemini-embedding-001을 출시했어요. 자세한 내용은 embeddings 참고. gemini-embedding-exp-03-07 모델은 2025년 8월 14일에 폐기될 예정이에요.

2025년 7월 7일

  • Gemini API Batch Mode를 출시했어요. 요청을 일괄 처리해 비동기로 보낼 수 있어요. 자세한 내용은 Batch Mode 참고.

2025년 6월 26일

  • 프리뷰 모델 gemini-2.5-pro-preview-05-06과 gemini-2.5-pro-preview-03-25가 이제 최신 안정 버전 gemini-2.5-pro로 리다이렉트돼요.
  • gemini-2.5-pro-exp-03-25가 종료됐어요.

2025년 6월 24일

2025년 6월 17일

  • 이제 적응형 사고(adaptive thinking)를 갖춘 가장 강력한 모델의 안정 버전인 gemini-2.5-pro를 출시했어요. 자세한 내용은 Gemini 2.5 Pro와 Thinking 참고. gemini-2.5-pro-preview-05-06은 2025년 6월 26일에 gemini-2.5-pro로 리다이렉트돼요.
  • 첫 안정 2.5 Flash 모델인 gemini-2.5-flash를 출시했어요. 자세한 내용은 Gemini 2.5 Flash 참고. gemini-2.5-flash-preview-04-17은 2025년 7월 15일에 폐기돼요.
  • 저비용·고성능 Gemini 2.5 모델인 gemini-2.5-flash-lite-preview-06-17을 출시했어요. 자세한 내용은 Gemini 2.5 Flash-Lite Preview 참고.

2025년 6월 5일

  • 이제 적응형 사고를 갖춘 가장 강력한 모델의 새 버전인 gemini-2.5-pro-preview-06-05를 출시했어요. 자세한 내용은 Gemini 2.5 Pro Preview와 Thinking 참고. gemini-2.5-pro-preview-05-06은 2026년 6월 26일에 gemini-2.5-pro로 리다이렉트돼요.

2025년 5월 27일

  • 마지막으로 사용 가능한 튜닝 모델이었던 Gemini 1.5 Flash 001이 종료됐어요. 이제 어떤 모델에서도 튜닝이 지원되지 않아요. Gemini API로 파인튜닝 참고.

2025년 5월 20일

API 업데이트:

모델 업데이트:

  • 가격 대비 성능과 적응형 사고에 최적화된 Gemini 프리뷰 모델인 gemini-2.5-flash-preview-05-20을 출시했어요.
  • gemini-2.5-pro-preview-tts와 gemini-2.5-flash-preview-tts 모델을 출시했어요. 이 모델들은 한 명 또는 두 명의 화자로 음성을 생성할 수 있어요.
  • 실시간으로 음악을 생성하는 lyria-realtime-exp 모델을 출시했어요.
  • 네이티브 오디오 출력 기능을 가진 Live API용 새 Gemini 모델인 gemini-2.5-flash-preview-native-audio-dialog와 gemini-2.5-flash-exp-native-audio-thinking-dialog를 출시했어요. 자세한 내용은 Live API 가이드와 Gemini 2.5 Flash Native Audio 참고.
  • Gemma 3n 출시의 일부로 AI Studio와 Gemini API에서 사용 가능한 gemma-3n-e4b-it 프리뷰를 출시했어요.

2025년 5월 7일

2025년 5월 6일

  • 코드와 function calling이 개선된 가장 강력한 모델의 새 버전인 gemini-2.5-pro-preview-05-06을 출시했어요. gemini-2.5-pro-preview-03-25는 자동으로 새 버전을 가리켜요.

2025년 4월 17일

  • 가격 대비 성능과 적응형 사고에 최적화된 Gemini 프리뷰 모델인 gemini-2.5-flash-preview-04-17을 출시했어요.

2025년 4월 16일

2025년 4월 9일

모델 업데이트:

  • 상세하고 예술적으로 미묘한 비디오를 생성할 수 있는 일반 제공(GA) 텍스트·이미지-투-비디오 모델인 veo-2.0-generate-001을 출시했어요. Veo 문서 참고.
  • 청구가 활성화된 Live API 모델의 공개 프리뷰 버전인 gemini-2.0-flash-live-001을 출시했어요.

개선된 세션 관리 및 신뢰성

  • 세션 재개(Session Resumption): 일시적인 네트워크 중단에도 세션을 유지해요. API가 서버 측 세션 상태 저장(최대 24시간)을 지원하고, 중단된 지점부터 재연결·재개할 수 있는 핸들(session_resumption)을 제공해요.
  • 컨텍스트 압축으로 더 긴 세션: 이전 시간 제한을 넘어 확장된 상호작용을 지원해요. 슬라이딩 윈도우 메커니즘으로 컨텍스트 창 압축을 구성해 컨텍스트 길이를 자동 관리하며, 컨텍스트 한도로 인한 갑작스러운 종료를 방지해요.
  • 정상적인 연결 종료 알림: 연결이 곧 닫히려 할 때 GoAway 서버 메시지를 받아 종료 전에 정상적으로 처리할 수 있어요.

상호작용 역학에 대한 더 많은 제어

  • 구성 가능한 VAD(Voice Activity Detection): 민감도 수준을 선택하거나 자동 VAD를 완전히 끄고 새 클라이언트 이벤트(activityStart, activityEnd)로 수동 턴 제어를 할 수 있어요.
  • 구성 가능한 인터럽트 처리: 사용자 입력이 모델 응답을 인터럽트할지 결정할 수 있어요.
  • 구성 가능한 턴 커버리지: API가 모든 오디오·비디오 입력을 지속적으로 처리할지, 아니면 최종 사용자가 말하는 것이 감지될 때만 캡처할지 선택할 수 있어요.
  • 구성 가능한 미디어 해상도: 입력 미디어의 해상도를 선택해 품질 또는 토큰 사용량을 최적화할 수 있어요.

더 풍부한 출력과 기능

  • 확장된 음성·언어 옵션: 오디오 출력을 위해 두 개의 새 음성과 30개의 새 언어를 선택할 수 있어요. 출력 언어는 이제 speechConfig 안에서 구성할 수 있어요.
  • 텍스트 스트리밍: 텍스트 응답을 생성되는 대로 점진적으로 받아 사용자에게 더 빠르게 표시할 수 있어요.
  • 토큰 사용량 보고: 서버 메시지의 usageMetadata 필드에 모달리티와 프롬프트·응답 단계별로 세분화된 상세 토큰 수를 제공해 사용량을 파악할 수 있어요.

2025년 4월 4일

  • 청구가 활성화된 공개 프리뷰 Gemini 2.5 Pro 버전인 gemini-2.5-pro-preview-03-25를 출시했어요. 무료 티어에서는 gemini-2.5-pro-exp-03-25를 계속 사용할 수 있어요.

2025년 3월 25일

  • 기본적으로 thinking 모드가 항상 켜져 있는 공개 실험용 Gemini 모델인 gemini-2.5-pro-exp-03-25를 출시했어요. 자세한 내용은 Gemini 2.5 Pro Experimental 참고.

2025년 3월 12일

모델 업데이트:

  • 이미지 생성·편집이 가능한 실험적 Gemini 2.0 Flash 모델을 출시했어요.
  • Gemma 3 출시의 일부로 AI Studio와 Gemini API에서 사용 가능한 gemma-3-27b-it를 출시했어요.

API 업데이트:

2025년 3월 11일

SDK 업데이트:

2025년 3월 7일

모델 업데이트:

  • 공개 프리뷰의 실험적 Gemini 기반 임베딩 모델인 gemini-embedding-exp-03-07을 출시했어요.

2025년 2월 28일

API 업데이트:

2025년 2월 25일

모델 업데이트:

  • 속도, 규모, 비용 효율에 최적화된 Gemini 2.0 Flash-Lite의 일반 제공(GA) 버전인 gemini-2.0-flash-lite를 출시했어요.

2025년 2월 19일

AI Studio 업데이트: 추가 지역(코소보, 그린란드, 페로 제도) 지원.

API 업데이트: 추가 지역(코소보, 그린란드, 페로 제도) 지원.

2025년 2월 18일

모델 업데이트: Gemini 1.0 Pro가 더 이상 지원되지 않아요. 지원 모델 목록은 Gemini 모델 참고.

2025년 2월 11일

API 업데이트: OpenAI 라이브러리 호환성 업데이트.

2025년 2월 6일

모델 업데이트: Gemini API의 Imagen 3의 일반 제공(GA) 버전인 imagen-3.0-generate-002를 출시했어요.

SDK 업데이트: Google Gen AI SDK for Java를 공개 프리뷰로 출시했어요.

2025년 2월 5일

모델 업데이트:

  • 텍스트 전용 출력을 지원하는 Gemini 2.0 Flash의 일반 제공(GA) 버전인 gemini-2.0-flash-001을 출시했어요.
  • Gemini 2.0 Pro의 실험적 공개 프리뷰 버전인 gemini-2.0-pro-exp-02-05를 출시했어요.
  • 비용 효율에 최적화된 실험적 공개 프리뷰 모델인 gemini-2.0-flash-lite-preview-02-05를 출시했어요.

API 업데이트: 코드 실행에 파일 입력 및 그래프 출력 지원을 추가했어요.

SDK 업데이트: Google Gen AI SDK for Python을 일반 제공(GA)으로 출시했어요.

2025년 1월 21일

모델 업데이트: Gemini 2.0 Flash Thinking Model의 기반 모델 최신 프리뷰 버전인 gemini-2.0-flash-thinking-exp-01-21을 출시했어요.

2024년 12월 19일

모델 업데이트: Gemini 2.0 Flash Thinking Mode를 공개 프리뷰로 출시했어요. Thinking Mode는 응답 생성 중 모델의 사고 과정을 볼 수 있게 하고 더 강력한 추론 능력을 가진 응답을 생성하는 테스트-타임 컴퓨팅 모델이에요. Gemini 2.0 Flash Thinking Mode 개요 페이지에서 더 읽어 보세요.

2024년 12월 11일

모델 업데이트: Gemini 2.0 Flash Experimental을 공개 프리뷰로 출시했어요. Gemini 2.0 Flash Experimental의 기능 일부는 다음과 같아요.

  • Gemini 1.5 Pro보다 두 배 빠름.
  • Live API로 양방향 스트리밍.
  • 텍스트, 이미지, 음성 형태의 멀티모달 응답 생성.
  • 코드 실행, 검색, function calling 등 기능을 사용하는 다중 턴 추론을 통한 내장 도구 사용.
  • Gemini 2.0 Flash 개요 페이지에서 더 읽어 보세요.

2024년 11월 21일

모델 업데이트: 더 강력한 실험용 Gemini API 모델인 gemini-exp-1121을 출시했어요. 모델 업데이트: gemini-1.5-flash-latest와 gemini-1.5-flash 모델 별칭을 gemini-1.5-flash-002를 사용하도록 업데이트했어요.

  • top_k 파라미터 변경: gemini-1.5-flash-002 모델은 1에서 41(제외) 사이의 top_k 값을 지원해요. 40보다 큰 값은 40으로 바뀌어요.

2024년 11월 14일

모델 업데이트: 강력한 실험용 Gemini API 모델인 gemini-exp-1114를 출시했어요.

2024년 11월 8일

API 업데이트: OpenAI 라이브러리 / REST API에 Gemini 지원을 추가했어요.

2024년 10월 31일

API 업데이트: Google Search 기반 접지 지원을 추가했어요.

2024년 10월 3일

모델 업데이트: 가장 작은 Gemini API 모델의 안정 버전인 gemini-1.5-flash-8b-001을 출시했어요.

2024년 9월 24일

모델 업데이트:

  • 일반 제공을 위해 Gemini 1.5 Pro와 1.5 Flash의 두 개의 새 안정 버전인 gemini-1.5-pro-002와 gemini-1.5-flash-002를 출시했어요.
  • gemini-1.5-pro-latest 모델 코드를 gemini-1.5-pro-002를, gemini-1.5-flash-latest 모델 코드를 gemini-1.5-flash-002를 사용하도록 업데이트했어요.
  • gemini-1.5-flash-8b-exp-0827을 대체하는 gemini-1.5-flash-8b-exp-0924를 출시했어요.
  • Gemini API와 AI Studio용 시민 무결성 안전 필터(civic integrity safety filter)를 출시했어요.
  • Python과 NodeJS의 Gemini 1.5 Pro 및 1.5 Flash에 두 개의 새 파라미터 지원을 출시했어요: frequencyPenalty와 presencePenalty.

2024년 9월 19일

AI Studio 업데이트: 모델 응답에 엄지척(thumb-up/thumb-down) 버튼을 추가해 사용자가 응답 품질에 대한 피드백을 제공할 수 있게 했어요. API 업데이트: Gemini API 사용에 사용할 수 있는 Google Cloud 크레딧 지원을 추가했어요.

2024년 9월 17일

AI Studio 업데이트: 프롬프트와 실행 코드를 Colab 노트북으로 내보내는 Open in Colab 버튼을 추가했어요. 이 기능은 아직 도구(JSON 모드, function calling, 코드 실행)를 사용한 프롬프팅을 지원하지 않아요.

2024년 9월 13일

AI Studio 업데이트: 모델과 프롬프트 간 응답을 비교해 사용 사례에 가장 적합한 것을 찾을 수 있는 비교(compare) 모드 지원을 추가했어요.

2024년 8월 30일

모델 업데이트: Gemini 1.5 Flash가 모델 설정을 통한 JSON 스키마 제공을 지원해요.

2024년 8월 27일

모델 업데이트: 다음 실험적 모델을 출시했어요: gemini-1.5-pro-exp-0827, gemini-1.5-flash-exp-0827, gemini-1.5-flash-8b-exp-0827.

2024년 8월 9일

API 업데이트: PDF 처리 지원을 추가했어요.

2024년 8월 5일

모델 업데이트: Gemini 1.5 Flash 파인튜닝 지원을 출시했어요.

2024년 8월 1일

모델 업데이트: Gemini 1.5 Pro의 새 실험적 버전인 gemini-1.5-pro-exp-0801을 출시했어요.

2024년 7월 12일

모델 업데이트: Gemini 1.0 Pro Vision 지원이 Google AI 서비스와 도구에서 제거됐어요.

2024년 6월 27일

모델 업데이트: Gemini 1.5 Pro의 2M 컨텍스트 창 일반 제공. API 업데이트: 코드 실행 지원을 추가했어요.

2024년 6월 18일

API 업데이트: 컨텍스트 캐싱 지원을 추가했어요.

2024년 6월 12일

모델 업데이트: Gemini 1.0 Pro Vision 폐기.

2024년 5월 23일

모델 업데이트:

2024년 5월 14일

API 업데이트:

  • Gemini 1.5 Pro에 2M 컨텍스트 창 도입(웨이트리스트).
  • Gemini 1.0 Pro에 종량제 청구 도입. Gemini 1.5 Pro와 Gemini 1.5 Flash 청구는 곧 제공 예정.
  • 다가오는 Gemini 1.5 Pro 유료 티어를 위한 요금 한도 증가 도입.
  • File API에 내장 비디오 지원 추가.
  • File API에 평문 텍스트 지원 추가.
  • 한 번에 두 개 이상의 호출을 반환하는 병렬 function calling 지원 추가.

2024년 5월 10일

모델 업데이트: Gemini 1.5 Flash(gemini-1.5-flash-latest)를 프리뷰로 출시했어요.

2024년 4월 9일

모델 업데이트:

API 업데이트:

  • 프롬프팅에 사용할 미디어 파일을 임시 저장하는 File API를 출시했어요.
  • 텍스트, 이미지, 오디오 데이터로 프롬프팅하는 멀티모달 프롬프팅 지원을 추가했어요. 자세한 내용은 미디어로 프롬프팅 참고.
  • 베타로 시스템 지침(System instructions)을 출시했어요.
  • function calling의 실행 동작을 정의하는 Function calling 모드를 추가했어요.
  • JSON 형식의 응답을 요청할 수 있는 response_mime_type 설정 옵션 지원을 추가했어요.

2024년 3월 19일

모델 업데이트: Google AI Studio 또는 Gemini API에서 Gemini 1.0 Pro 튜닝 지원 추가.

2023년 12월 13일

모델 업데이트:

  • gemini-pro: 다양한 작업을 위한 새 텍스트 모델. 능력과 효율의 균형.
  • gemini-pro-vision: 다양한 작업을 위한 새 멀티모달 모델. 능력과 효율의 균형.
  • embedding-001: 새 임베딩 모델.
  • aqa: 생성된 답변을 접지하기 위해 텍스트 구절을 사용해 질문에 답하도록 훈련된 특별 튜닝 모델.
  • 자세한 내용은 Gemini 모델 참고.

API 버전 업데이트:

  • v1: 안정 API 채널.
  • v1beta: 베타 채널. 개발 중일 수 있는 기능이 있는 채널.
  • 자세한 내용은 API 버전 주제 참고.

API 업데이트:

  • GenerateContent는 채팅과 텍스트를 위한 단일 통합 엔드포인트예요.
  • StreamGenerateContent 메서드를 통해 스트리밍을 사용할 수 있어요.
  • 멀티모달 능력: 이미지가 새로 지원되는 모달리티.
  • 새 베타 기능: Function Calling, Attributed Question Answering(AQA).
  • 후보 수 업데이트: Gemini 모델은 후보 1개만 반환해요.
  • 다른 Safety Settings와 SafetyRating 카테고리. 자세한 내용은 안전 설정 참고.
  • Gemini 모델에 대한 모델 튜닝은 아직 지원되지 않아요(작업 중).

더 알아보기 (Learn more)