구글 Gemini 3 완전 정리: Pro·Deep Think·Flash·Lite 모델별 차이와 선택 가이드 (2026)

Gemini 모델이 너무 많아서 뭘 써야 할지 모르겠다고요?

2026년 7월, 구글이 Gemini 3 시리즈를 Stable로 올리면서 모델명이 확 바뀌었습니다. Pro, Deep Think, Flash, Flash-Lite에 3.5, 3.6까지 붙으니 “도대체 뭘 골라야 하지?”라는 말이 절로 나옵니다.

이 글에서는 2026년 7월 21일 기준 최신 Gemini 3 모델 4종의 포지션, 가격, 핵심 기능을 한눈에 정리하고, 내 용도에 맞는 모델을 고르는 기준까지 알려드립니다.

Google Gemini 3 모델 라인업: Pro, Deep Think, Flash, Flash-Lite 비교

Gemini 3 모델 라인업 한눈에 보기

구글은 Gemini 3를 4개 등급으로 나눴습니다. 위계는 명확합니다.

  • Gemini 3.1 Pro — 가장 똑똑한 플래그십. 검색·그라운딩 결합으로 “정확한 답”이 필요한 작업에 최적
  • Gemini 3 Deep Think — 심층 추론 특화. 수학·과학·복잡한 논리 문제처럼 “오래 생각해야 하는” 작업용
  • Gemini 3.6 Flash — 속도와 지능의 균형. 에이전트·멀티모달 작업의 실전 주력 모델
  • Gemini 3.5 Flash-Lite — 가장 빠르고 저렴. 대량 처리·문서 파싱·반복 자동화에 최적

4개 모델 모두 1M 토큰 컨텍스트 윈도우, 64K 최대 출력, 추론(thinking) 모드, Computer Use를 지원합니다.

Gemini API 공식 모델 목록 바로가기

가격과 성능, 숫자로 비교하기

개발자 API(Paid Tier) 기준, 1M 토큰당 가격입니다.

모델 입력 가격 출력 가격 기본 추론 강도 포지션
Gemini 3.1 Pro 프리미엄 프리미엄 높음 최고 지능 + 검색
Gemini 3 Deep Think 프리미엄 프리미엄 최대 심층 추론
Gemini 3.6 Flash $1.50 $7.50 medium 균형형 주력
Gemini 3.5 Flash-Lite $0.30 $2.50 minimal 최저가·고속

Batch API를 쓰면 비용이 50% 줄어듭니다. 3.6 Flash 기준 입력 $0.75, 출력 $3.75입니다. 실시간이 아닌 배치 처리라면 무조건 Batch를 검토하세요.

Context Caching도 활용할 수 있습니다. 캐시 저장료는 시간당 1M 토큰당 $1.00이고, 캐시된 입력 토큰은 표준 가격의 10%로 떨어집니다. 반복 프롬프트가 많은 챗봇·에이전트에 특히 효과적입니다.

Google Search 그라운딩은 월 5,000건까지 무료이고, 초과 시 1,000건당 $14입니다.

3.6 Flash가 3.5 Flash보다 나아진 것

3.6 Flash는 단순 버전 넘버가 아니라 체감 품질이 달라졌습니다.

  • 토큰·턴 절감 — 같은 작업을 더 적은 추론 단계와 도구 호출로 완료합니다. 불필요한 반복 루프가 줄었습니다.
  • 코드 생성 품질 향상 — 프로덕션급 코드를 더 적게 고치고, 디버깅 루프가 줄었습니다.
  • 지시 이행 개선 — 진단 작업 중 원치 않는 파일 수정이 감소했습니다.
  • 멀티모달·공간 추론 강화 — 차트 해석, 설계도 변환, 웹 레이아웃 생성 성능이 올라갔습니다.
  • 가격 인하 — 출력 토큰 가격이 3.5 Flash의 $9.00에서 $7.50으로 내렸습니다.

다만 UI 스타일링·레이아웃은 이전 모델을 선호하는 평가자도 있었습니다. 디자인 가이드를 명시적으로 주면 보완됩니다.

3.5 Flash-Lite, 2.5 Flash에서 얼마나 좋아졌나

Flash-Lite는 “가장 싼 모델”이 아니라 “가성비 최강”이 됐습니다.

  • HLE(Humanity’s Last Exam): 18.0% (2.5 Flash 11.0% 대비 +7%p)
  • CharXIV(차트 이해): 74.5% (2.5 Flash 63.7% 대비 +10.8%p)
  • 도구 실행 신뢰도 — 코드 실행, 검색, MCP 워크플로에서 안정성 향상
  • 문서 파싱 정확도 — 구조화 데이터 추출 성능 개선
  • 멀티턴 일관성 — 챗봇·페르소나 유지력이 이전 Flash-Lite보다 강력

대량 문서 처리, 데이터 추출, 반복 API 호출이 많은 서비스라면 3.5 Flash-Lite가 비용 대비 최선의 선택입니다.

최신 Gemini 모델 마이그레이션 가이드 바로가기

Gemini 3 생태계: 텍스트 모델만이 아니다

Gemini 3는 텍스트 LLM을 넘어 멀티모달 생태계로 확장됐습니다.

  • Nano Banana 2 — Gemini 3 기반으로 고속 이미지 생성·편집. 프로급 4K 비주얼을 만드는 Nano Banana Pro도 별도 운영
  • Veo 3.1 — 시네마틱 영상 생성 + 네이티브 오디오 동기화. Lite 버전은 저비용 개발자용
  • Lyria 3 — 음악 생성. 풀 트랙(Pro)과 30초 클립(Clip) 두 가지 모드
  • Computer Use — 화면을 보고 클릭·타이핑·네비게이션으로 브라우저 작업을 자동화하는 UI 에이전트
  • Deep Research Agent — 수백 개 소스를 자율 탐색하며 다단계 리서치 보고서를 작성하는 에이전트
  • Gemini Omni Flash — 텍스트·이미지로 영상을 만들고 자연어로 수정하는 대화형 영상 생성
  • Live API — 실시간 음성 대화(A2A)와 라이브 번역. 음성 우선 AI 앱 구축용

Google AI Studio에서 무료로 시작하기

용도별 모델 선택 체크리스트

아래 기준으로 고르면 실패하지 않습니다.

  • ☑️ 정확한 답 + 최신 정보가 필수 → Gemini 3.1 Pro (검색 그라운딩 결합)
  • ☑️ 수학·과학·복잡한 논리 문제 → Gemini 3 Deep Think (최대 추론)
  • ☑️ 에이전트·코딩·멀티모달 실전 작업 → Gemini 3.6 Flash (균형형 주력)
  • ☑️ 대량 처리·문서 파싱·반복 호출 → Gemini 3.5 Flash-Lite (최저가·고속)
  • ☑️ 실시간 음성 대화 앱 → Gemini 3.1 Flash Live Preview (Live API)
  • ☑️ 이미지·영상·음악 생성 → Nano Banana 2 / Veo 3.1 / Lyria 3

초보자라면 3.6 Flash로 시작하세요. 무료 티어에서 체험할 수 있고, 부족하면 Pro로, 비용이 부담되면 Flash-Lite로 옮기면 됩니다.

자주 묻는 질문 (FAQ)

Q1. Gemini 3는 무료로 쓸 수 있나요?

네. Google AI Studio에서 무료 티어로 시작할 수 있습니다. 다만 일부 고급 모델(Pro, Deep Think) 접근이 제한되고, 무료 티어 데이터는 구글 제품 개선에 사용될 수 있습니다. 프로덕션에는 유료 전환을 권장합니다.

Q2. OpenAI API 코드를 그대로 쓸 수 있나요?

Gemini API는 OpenAI 호환 모드를 제공합니다. base_url만 바꾸면 기존 OpenAI SDK 코드를 상당 부분 재활용할 수 있습니다. 다만 thinking 관련 파라미터는 Gemini 고유 문법을 확인해야 합니다.

Q3. temperature, top_p를 직접 설정할 수 있나요?

Gemini 3.6 Flash와 3.5 Flash-Lite는 temperature, top_p, top_k 같은 비추천 샘플링 파라미터를 제거해야 합니다. 추론 강도는 thinking 레벨(minimal / low / medium / high / max)로 조절합니다.

Q4. GPT-5.6이나 Claude Fable 5와 비교하면 어떤가요?

Gemini 3.1 Pro는 검색 그라운딩이 내장된 점이 가장 큰 차별점입니다. GPT-5.6 Sol, Claude Fable 5와 함께 2026년 최상위 지능 모델로 평가받으며, 가격·속도·생태계(영상·음악·UI 자동화)에서 구글이 우위를 가집니다.

결론: 지금 Gemini 3를 시작하는 가장 빠른 방법

Gemini 3는 “모델 고르는 고민”을 줄여주는 라인업입니다. 정확한 답이 필요하면 Pro, 깊은 추론이면 Deep Think, 실전 밸런스는 3.6 Flash, 대량 처리는 3.5 Flash-Lite. 이 네 가지만 기억하면 됩니다.

지금 Google AI Studio에서 무료 API 키를 발급받고, 3.6 Flash로 첫 호출을 날려보세요. 5분이면 충분합니다.

Gemini API 키 무료로 발급받기

함께 읽으면 좋은 글