이 가이드에서는 Gemini API를 통해 사용할 수 있는 모든 모델을 소개합니다.
Gemini 3
안정
미리보기
모든 Gemini 3 모델
| 모델 | 엔드포인트 |
|---|---|
| Gemini 3.1 Pro | gemini-3.1-pro-preview |
| Gemini 3.5 Flash | gemini-3.5-flash |
| Gemini 3 Flash | gemini-3-flash-preview |
| Gemini 3.1 Flash-Lite | gemini-3.1-flash-lite |
| Nano Banana 2 | gemini-3.1-flash-image |
| Nano Banana 2 Lite | gemini-3.1-flash-lite-image |
| Nano Banana Pro | gemini-3-pro-image |
| Gemini 3.5 Live Translate | gemini-3.5-live-translate-preview |
| Gemini 3.1 Flash Live | gemini-3.1-flash-live-preview |
| Gemini 3.1 Flash TTS | gemini-3.1-flash-tts-preview |
Gemini 2.5 Flash
| 모델 | 설명 | 엔드포인트 |
|---|---|---|
| Gemini 2.5 Flash | 추론이 필요한 지연 시간이 짧은 대용량 작업을 위한 최고의 가격 대비 성능 모델입니다. | gemini-2.5-flash |
| Nano Banana | 빠른 창작 워크플로를 위해 설계된 최첨단 네이티브 이미지 생성 및 편집 기능입니다. | gemini-2.5-flash-image |
| Gemini 2.5 Flash Live | 1초 미만의 네이티브 오디오 스트리밍을 지원하는 실시간 대화형 에이전트에 최적화되어 있습니다. | gemini-2.5-flash-native-audio-preview-12-2025 |
| Gemini 2.5 Flash TTS | 스타일과 속도를 세밀하게 제어할 수 있는 제어 가능한 텍스트 음성 변환 오디오 생성 | gemini-2.5-flash-preview-tts |
Gemini 2.5 Flash-Lite
| 모델 | 설명 | 엔드포인트 |
|---|---|---|
| Gemini 2.5 Flash-Lite | 2.5 제품군에서 가장 빠르고 예산 친화적인 멀티모달 모델입니다. | gemini-2.5-flash-lite |
Gemini 2.5 Pro
| 모델 | 설명 | 엔드포인트 |
|---|---|---|
| Gemini 2.5 Pro | 2.5 제품군에서 심층적인 추론 및 코딩 기능을 제공하는 복잡한 작업을 위한 최첨단 모델입니다. | gemini-2.5-pro |
| Gemini 2.5 Pro TTS | 팟캐스트, 오디오북과 같은 구조화된 워크플로에서 품질에 최적화된 고품질 음성 합성 | gemini-2.5-pro-preview-tts |
오디오 모델
이 섹션에는 다른 섹션에 이미 나열되어 있을 수 있는 오디오 모델을 비롯한 모든 오디오 모델이 포함되어 있습니다.
| 모델 | 설명 | 엔드포인트 |
|---|---|---|
| Gemini 3.1 Flash Live | 실시간 대화 및 음성 우선 AI 애플리케이션을 위해 설계된 고품질의 짧은 지연 시간 오디오 대 오디오 (A2A) 모델입니다. | gemini-3.1-flash-live-preview |
| Gemini 3.1 Flash TTS | 자연스러운 출력, 조종 가능한 프롬프트, 정확한 내레이션 제어를 위한 새로운 표현 오디오 태그를 갖춘 강력하고 지연 시간이 짧은 음성 생성 기능 | gemini-3.1-flash-tts-preview |
| Gemini 2.5 Flash Live | 네이티브 오디오 추론을 지원하는 지연 시간이 짧은 양방향 음성 및 동영상 에이전트를 위한 대표적인 Live API 모델입니다. | gemini-2.5-flash-native-audio-preview-12-2025 |
| Gemini 2.5 Flash TTS | 짧은 지연 시간, 비용 효율적인 애플리케이션, 실시간 어시스턴트를 위한 빠르고 제어 가능한 텍스트 음성 변환 | gemini-2.5-flash-preview-tts |
| Gemini 2.5 Pro TTS | 팟캐스트, 오디오북과 같은 구조화된 워크플로에서 품질에 최적화된 고품질 음성 합성 | gemini-2.5-pro-preview-tts |
이 섹션에는 다른 섹션에 이미 나열되어 있을 수 있는 모델을 포함하여 모든 생성형 미디어 모델이 포함되어 있습니다.
| 모델 | 설명 | 엔드포인트 |
|---|---|---|
| Nano Banana 2 | Gemini 3 시리즈의 인텔리전스와 빠른 생성 속도를 결합한 고효율 프로덕션 규모의 시각적 콘텐츠 제작 | gemini-3.1-flash-image |
| Nano Banana 2 Lite | 이미지 생성 제품군의 효율성 전문가로 설계되어 지연 시간이 매우 짧고 비용 효율적인 이미지 생성 및 편집을 제공합니다. | gemini-3.1-flash-lite-image |
| Veo 3.1 | 고급 창의적 제어 기능과 기본적으로 동기화된 오디오를 갖춘 최첨단 영화 같은 동영상 생성 기능 | veo-3.1-generate-preview |
| Nano Banana Pro | 스튜디오급 4K 시각적 요소, 복잡한 레이아웃, 정확한 텍스트 렌더링을 위한 추론 핵심이 있는 전문 디자인 엔진입니다. | gemini-3-pro-image |
| Veo 3.1 Lite | Veo 3.1 제품군의 고효율, 저비용, 개발자 우선 동영상 생성, 편집, 영화 같은 제어 기능 | veo-3.1-lite-generate-preview |
| Gemini Omni Flash | 빠르고 대화형 동영상 생성 및 수정 텍스트와 이미지를 동영상으로 변환하고 자연어를 통해 결과를 개선합니다. | gemini-omni-flash |
| Nano Banana | 빠른 창작 워크플로를 위해 설계된 최첨단 네이티브 이미지 생성 및 편집 기능입니다. | gemini-2.5-flash-image |
| Imagen 4 (지원 중단됨) | 빠르고 초고속 생성과 최대 2K 해상도의 뛰어난 선명도를 제공하는 텍스트 이미지 변환 모델입니다. | imagen-4.0-generate |
음악 생성 모델
이 섹션에는 다른 섹션에 이미 나열되어 있을 수 있는 모델을 포함하여 모든 음악 생성 모델이 포함되어 있습니다.
| 모델 | 설명 | 엔드포인트 |
|---|---|---|
| Lyria 3 Pro | 복잡한 구조적 일관성을 갖춘 전체 길이 노래에 최적화된 Google의 대표적인 음악 생성 모델입니다. | lyria-3-pro-preview |
| Lyria 3 Clip | 최대 30초 길이의 짧은 음악 클립, 루프, 미리보기를 생성하는 데 최적화되어 있습니다. | lyria-3-clip-preview |
| Lyria RealTime | 세부적인 창작 제어 기능과 실시간 스트리밍 기능을 제공하는 충실도 높은 음악 생성 모델입니다. | lyria-realtime-exp |
| 모델 | 설명 | 엔드포인트 |
|---|---|---|
| 컴퓨터 사용 | 디지털 화면을 '볼' 수 있고 클릭, 입력, 탐색과 같은 UI 작업을 실행하여 복잡한 브라우저 작업을 자동화할 수 있는 전문 모델입니다. | gemini-2.5-computer-use-preview-10-2025 |
| Gemini Deep Research | 수백 개의 소스에서 다단계 조사를 자율적으로 계획하고 실행하여 출처가 표시된 대화형 보고서를 생성하는 에이전트형 모델입니다. | deep-research-preview-04-2026 |
| Gemini Deep Research Max | 수백 개의 소스에서 자동 컨텍스트 수집 및 종합을 위한 최대 포괄성 | deep-research-max-preview-04-2026 |
| Antigravity Agent | 안전하고 격리된 Linux 샌드박스 내에서 자율적으로 계획하고, 추론하고, 코드를 실행하고, 파일을 관리하고, 웹을 탐색하는 범용 관리형 에이전트입니다. | antigravity-preview-05-2026 |
특화된 작업 모델
| 모델 | 설명 | 엔드포인트 |
|---|---|---|
| Gemini Embedding 2 | 고급 시맨틱 검색 및 RAG 시스템을 위해 텍스트, 이미지, 동영상, 오디오, PDF를 통합 임베딩 공간에 매핑하는 Google의 첫 번째 멀티모달 임베딩 모델입니다. | gemini-embedding-2-preview |
| Gemini 임베딩 | 고급 시맨틱 검색, 텍스트 분류, RAG 시스템을 위한 고차원 벡터 표현 | gemini-embedding-001 |
| Gemini Robotics ER 2 | 로봇공학 작업을 위한 고급 동영상 이해, 공간 추론, 다단계 도구 오케스트레이션, 다중 로봇 협업을 제공하는 구현된 추론 모델 | gemini-robotics-er-2-preview |
| Gemini Robotics ER 1.6 | 물리적 공간을 이해하고 기기 읽기, 개선된 공간 및 물리적 추론과 같은 새로운 기능을 갖춘 로봇 에이전트의 다단계 작업을 계획하는 고급 구현된 추론 모델 | gemini-robotics-er-1.6-preview |
이전 모델
| 모델 | 설명 | 엔드포인트 |
|---|---|---|
| Gemini 2.0 Flash (종료됨) | 빠른 속도, 네이티브 도구 사용, 토큰 컨텍스트 윈도우 100만 개 등 차세대 기능과 향상된 기능을 갖춘 2세대 워크호스 모델입니다. | gemini-2.0-flash |
| Gemini 2.0 Flash-Lite (종료됨) | 비용 효율성과 짧은 지연 시간에 최적화된 가장 빠른 2세대 모델입니다. | gemini-2.0-flash-lite |
| Gemini 3.1 Flash-Lite 프리뷰 (종료됨) | 가장 비용 효율적인 멀티모달 모델로, 고빈도 경량 작업에 가장 빠른 성능을 제공합니다. | gemini-3.1-flash-lite-preview |
| Gemini 3 Pro 프리뷰 (종료됨) | 고급 멀티모달 이해 기능을 갖춘 최첨단 추론 모델입니다. | gemini-3-pro-preview |
모델 버전 이름 패턴
Gemini 모델은 안정화, 미리보기, 최신 또는 실험 버전으로 제공됩니다.
안정
특정 안정 모델을 가리킵니다. 안정적인 모델은 일반적으로 변경되지 않습니다. 대부분의 프로덕션 앱은 특정 안정화 모델을 사용해야 합니다.
예: gemini-3.6-flash
미리보기
프로덕션에 사용할 수 있는 미리보기 모델을 가리킵니다. 미리보기 모델은 일반적으로 청구가 사용 설정되어 있으며, 더 제한적인 비율 제한이 적용될 수 있고, 최소 2주 전에 지원 중단됩니다.
예: gemini-2.5-flash-preview-09-2025
최신
특정 모델 변형의 최신 버전을 가리킵니다. 안정화 버전, 미리보기 버전 또는 실험용 버전일 수 있습니다. 이 별칭은 특정 모델 변형의 새 출시마다 핫 스왑됩니다. 브레이킹 체인지의 경우 최신 버전이 변경되기 전에 이메일을 통해 2주 전에 알림이 제공됩니다.
예: gemini-flash-latest
실험용
일반적으로 프로덕션에 적합하지 않고 더 제한적인 비율 제한이 적용되는 실험 모델을 가리킵니다. Google에서는 실험용 모델을 출시하여 피드백을 수집하고 최신 업데이트를 개발자에게 빠르게 제공합니다.
실험용 모델은 안정적이지 않으며 모델 엔드포인트의 가용성은 변경될 수 있습니다.
모델 지원 중단
모델 지원 중단에 대한 자세한 내용은 Gemini 지원 중단 페이지를 참고하세요.