Gemini 3 가격·성능 리뷰(2026): 지금 써야 할 모델은?
Gemini 3 가격과 성능을 최신 벤치마크로 분석했습니다. 3.1 Pro와 3.5 Flash의 차이, 무료 요금제부터 API 비용까지 짚고, 어떤 작업에 어떤 모델이 맞는지와 ChatGPT·Claude 대신 선택할 가치가 있는지 과장 없이 평가합니다.

Google의 Gemini 3는 더 이상 하나의 모델이 아닙니다. 이 사실 하나만으로 평가 기준이 완전히 달라집니다. 11월에 "Gemini 3 Pro"로 출발했지만, 이제는 가장 어려운 추론을 맡는 3.1 Pro, 기존 플래그십보다 코딩 성능이 뛰어난 빠른 기본 모델 3.5 Flash, 그리고 출시를 며칠 앞둔 3.5 Pro로 구성된 라인업입니다. 따라서 Gemini 3 가격과 성능을 제대로 평가하려면 “Gemini 3가 좋은가”가 아니라 실제로 어떤 모델을 써야 하는지, ChatGPT나 Claude를 떠날 만큼 가치가 있는지를 물어야 합니다.
한눈에 보는 결론
Gemini 3는 분명 최전선급 모델 라인업이며, 이제 대부분의 사람에게는 무료 요금제만으로도 매일 쓰기에 충분합니다. 다만 “Gemini 3”라는 이름 아래 성격이 전혀 다른 모델들이 있고, 기본으로 선택되는 버전이 정작 원하는 모델이 아닌 경우가 많습니다.
이미 Gmail, Docs, Search, Android 등 Google 생태계 안에서 일한다면 Gemini 3는 가장 쉽게 도입할 수 있는 최전선 AI입니다. 비용 대비 혜택도 가장 큽니다. 실제로 쓸 만한 무료 요금제, 경쟁 제품보다 저렴한 $4.99/month 유료 요금제, 그리고 API에서 가장 뛰어난 가격 대비 지능을 제공합니다. 긴 컨텍스트 작업, 멀티모달·동영상 이해, 에이전트형 검색에서도 선두권입니다.
약점도 있습니다. 길고 중요한 작업에서 결과의 일관성이 떨어지고, 모델의 판단을 그대로 믿고 맡길 만한 신뢰도에서는 여전히 Claude를 선택하게 되는 이유가 남아 있습니다. 라인업 변화도 워낙 빨라 지난달 테스트한 모델이 이미 최신 모델이 아닐 수 있습니다. 브랜드가 아니라 작업에 맞춰 고르면 Gemini 3의 장점을 제대로 활용할 수 있습니다.
지금 “Gemini 3”는 무엇을 뜻할까?
“Gemini 3”는 하나의 모델이 아니라 한 세대의 이름입니다. 지금까지 네 가지 버전이 출시됐거나 출시를 앞두고 있습니다. 이름은 비슷하지만 작동 방식은 전혀 다르므로, 이 구분만 정확히 알아도 선택의 대부분은 끝납니다.
여기서 모델은 생각을 담당하는 엔진이라고 보면 됩니다. “Pro” 엔진은 더 크고 깊게 추론하며, “Flash” 엔진은 더 작고 빠르며 저렴합니다. 2026년 중반 현재 라인업은 다음과 같습니다.
상식을 뒤집는 대목은 따로 있습니다. 저렴하고 빠른 3.5 Flash가 이제 코딩과 에이전트 작업에서 기존 3 Pro 플래그십을 앞섭니다. Google은 이 영역에서 대형 플래그십 모델과 맞먹는다고 설명합니다(Engadget). 따라서 “중요한 작업에는 비싼 모델을 써야 한다”는 직감이 이제 많은 작업에서 통하지 않습니다.
라인업 전체가 공유하는 특징은 1 million 토큰 컨텍스트 윈도입니다. 한 대화에서 대략 1,500페이지 분량의 텍스트를 읽을 수 있습니다. 하나의 프롬프트에서 텍스트, 이미지, 동영상, 오디오, PDF를 기본 지원하며, 지식 기준 시점은 2025년 1월입니다(모델 카드).

한 가지만 기억한다면 이것이면 됩니다. 누군가 “Gemini 3”라고 말하면 어떤 버전인지부터 확인해야 합니다. 답에 따라 가격은 4x까지 달라지고 강점도 완전히 바뀝니다.
벤치마크를 정직하게 읽으면
Google이 공개한 수치에서 Gemini 3.1 Pro는 여러 영역에서 최전선 모델을 앞서지만, 몇몇 항목에서는 뒤처집니다. 오히려 완승이 아닌 이런 혼합된 결과가 더 믿을 만합니다. 패배한 항목을 보면 경쟁 모델이 실제로 더 나은 지점이 드러나기 때문입니다.
벤치마크는 모든 모델에 같은 문제를 내고 같은 방식으로 채점하는 표준화된 시험입니다. 아래는 모델 카드에 실린 **Gemini 3.1 Pro (Thinking, High)**와 현재 Claude·OpenAI 모델의 맞대결 결과입니다(출처).
결과는 이렇게 읽어야 합니다. 계속 변하는 방대한 정보를 찾고, 탐색하고, 추론하는 작업에서는 Gemini 3.1 Pro가 앞섭니다. 항목에 따라 격차도 큽니다. BrowseComp의 85.9%와 GPT-5.2의 65.8%는 박빙이라고 보기 어렵습니다. 반면 한곳에 집중하는 소프트웨어 엔지니어링에서는 세 모델이 사실상 동률이며, 가장 널리 인용되는 코딩 벤치마크인 SWE-Bench Verified에서는 Claude Opus 4.6가 근소하게 앞섭니다. 규칙에 맞춘 툴 사용에서도 Opus가 여전히 가장 안정적이지만 차이는 작습니다.
플래그십의 추론 성적도 같은 결론을 뒷받침합니다. 출시 당시 Gemini 3 Pro는 LMArena 리더보드에서 1501 Elo로 정상에 올랐고, 대학원 수준의 과학 문제인 GPQA Diamond에서 91.9%, 도구 없이 **Humanity's Last Exam에서 37.5%**를 기록했습니다. Humanity's Last Exam은 전문가에게도 극도로 어려운 시험이라 37.5% 역시 높은 점수입니다(출시 글). 강화 추론 모드인 Deep Think를 켜면 Humanity's Last Exam은 41.0%로, 암기보다 새로운 문제 해결 능력을 보도록 설계된 ARC-AGI-2는 두드러진 **45.1%**로 올라갑니다.
Gemini 3 가격: 실제 비용 계산
현재 Gemini 3는 구독과 API 양쪽 모두에서 최전선 AI를 가장 저렴하게 이용하는 방법입니다. 이것이 가장 날카로운 경쟁력이며, 정작 중요한 요금제의 이름이 조용히 바뀌어 알아채기 쉽지 않습니다.
일반 사용자용 현재 가격은 다음과 같습니다(요금제 페이지).
대부분의 사람에게 중요한 숫자는 Google AI Plus의 $4.99/month입니다. ChatGPT Plus와 Claude Pro의 표준 요금제는 모두 약 $20/month이므로 Gemini의 중간 요금제는 대략 4분의 1 가격입니다. 다른 곳에서 “$7.99”라는 정보를 봤다면 오래된 수치입니다. Google 공식 페이지의 현재 가격은 $4.99입니다.
개발자라면 API의 가격 경쟁력이 더욱 선명하게 보입니다(가격, 1M 토큰 기준).
- Gemini 3.1 Pro: 200k 토큰 미만 프롬프트는 입력 $2.00 / 출력 $12.00이며, 그 이상은 $4.00 / $18.00으로 올라갑니다.
- Gemini 3.5 Flash: 입력 $1.50 / 출력 $9.00입니다. 코딩과 에이전트 작업에서는 기존 Pro보다 뛰어나다는 점도 기억할 만합니다.
- Grounding with Google Search: Gemini 3 라인업 전체에서 매달 5,000개 프롬프트까지 무료이며, 이후에는 쿼리 1,000개당 $14입니다.
구체적인 사례로 계산해 보겠습니다. 매달 100,000건의 대화를 처리하는 고객 지원 에이전트를 만들고 있으며, 대화당 평균 입력 4k 토큰과 출력 1k 토큰을 쓴다고 가정합니다. 3.5 Flash에서는 입력 약 400M 토큰, 출력 100M 토큰이므로 정가 기준 비용은 $600 + $900 = $1,500/month에 가깝습니다. 출력 단가가 두 배인 최전선 모델에서 같은 작업을 처리하면 비용은 $2,500를 넘어갑니다. 100k건 규모에서는 그 차이가 직원 한 명을 채용할 비용입니다. 팀이 대규모 작업을 Gemini로 옮기는 진짜 이유는 벤치마크 표가 아니라 이 계산입니다. 이 등급 모델들의 벤치마크 차이는 몇 점에 불과하지만 청구액 차이는 40% 이상입니다.
Gemini 3가 실제로 강한 영역과 약한 영역
넓은 활용 범위와 접근성, 가격이 중요하다면 Gemini 3를 고를 만합니다. 반대로 모델의 판단을 더 이상 재확인하지 않아도 될 만큼 높은 신뢰성이 필요하다면 다른 선택이 낫습니다.
- 시장에서 가장 뛰어난 가격 대비 지능. 제대로 쓸 수 있는 무료 요금제, $4.99 유료 요금제, 그리고 세 제품 가운데 가장 저렴한 최전선 API를 제공합니다.
- 긴 컨텍스트와 멀티모달. 1M 토큰을 지원하고 하나의 프롬프트에서 동영상, 오디오, 이미지, PDF를 기본으로 처리합니다. 두 경쟁사 모두 이 조합을 이만큼 매끄럽게 제공하지는 못합니다.
- 에이전트형 검색과 리서치. BrowseComp에서 선두이며 Google Search의 AI Mode에도 탑재돼 있어 실시간 웹 추론이 본래 강점입니다.
- 폭넓은 배포. Gmail, Docs, Android, Search뿐 아니라 Cursor, GitHub, JetBrains, Replit 같은 서드파티 툴에도 이미 들어가 있습니다. Google을 쓰고 있다면 도입 비용이 거의 들지 않습니다.
단점도 솔직히 봐야 합니다. 가장 자주 나오는 불만은 일관성입니다. 뛰어난 결과를 내다가도 한 시간 뒤 비슷한 프롬프트에는 이상할 만큼 평범한 답을 줄 수 있으며, 포럼 리뷰에서도 바로 이 문제가 지적됐습니다. 계약서, 의료·법률 문서 초안, 재무 분석처럼 오류 비용이 큰 업무에서는 여전히 Claude의 안정성을 더 신뢰하는 팀이 많습니다. τ2-bench 툴 사용과 SWE-Bench Verified의 수치도 근소한 차이로나마 이런 판단을 뒷받침합니다. 라인업 교체 속도 역시 빠릅니다. 3 Pro에 맞춘 워크플로는 이제 3.5 Flash에 다시 맞춰야 하고, 3.5 Pro가 나오면 또 한 번 조정해야 합니다. 성능 향상에는 좋은 속도지만 안정적인 운영에는 부담입니다.
일상적인 어시스턴트 경험을 자세히 비교하려면 Gemini와 ChatGPT 상세 비교를 참고할 수 있습니다. [세 모델을 나란히 다룬 Claude·ChatGPT·Gemini 비교](/blog/claude-vs-chatgpt-vs-gemini)에서는 세 제품을 한눈에 비교합니다.
어떤 Gemini 3 모델을 써야 할까?
가격표가 아니라 작업에 모델을 맞춰야 합니다. 예상과 달리 저렴한 모델이 더 좋은 선택인 경우가 많습니다.
결정 기준은 한 문장으로 정리할 수 있습니다. 대규모 처리, 폭넓은 활용, 검색, 예산이 중요하면 Gemini가 이깁니다. 다시 확인할 여유가 없는 중요한 판단이라면 가격 차이는 덜 중요해지고 신뢰성이 선택을 가릅니다. 주된 작업이 코딩이라면 한 모델로 표준화하기 전에 전문 코딩 에이전트와도 비교해야 합니다.
Gemini 3 사용법: 실제로 시작하려면
Gemini 3를 시작하는 데는 약 2분이면 충분하며, 중요한 기능 대부분을 무료 요금제에서 먼저 써볼 수 있습니다.
무료로 시작하기
Gemini 앱이나 gemini.google.com을 열고 Google 계정으로 로그인합니다. 비용 없이 바로 Gemini 3 Flash를 사용할 수 있습니다. 결제하기 전에 실제 업무에 일주일 동안 써보는 것이 좋습니다.
한도에 부딪힐 때만 업그레이드하기
일일 한도에 도달하거나 Workspace 연동을 더 깊게 쓰고 싶다면 대부분의 사람에게는 Google AI Plus의 $4.99/month 요금제가 적합합니다. $19.99의 Pro는 사용량과 저장공간이 더 필요한 경우를 위한 요금제입니다.
개발용 API 키 받기
Google AI Studio에서 키를 만든 뒤 3.5 Flash부터 호출합니다. 가장 깊은 추론이나 가장 긴 컨텍스트가 정말 필요한 프롬프트만 3.1 Pro로 옮겨야 합니다. 비용이 몇 배 더 들기 때문입니다.
Deep Think는 꼭 필요할 때만 쓰기
Deep Think를 쓰려면 Google AI Ultra가 필요합니다. 일상 대화가 아니라 정말 어렵고 새로운 문제에서만 비용을 들일 가치가 있습니다. 대부분의 사람에게는 필요하지 않습니다.
Gemini 3는 무료인가요?
그렇습니다. Gemini 앱은 일일 한도와 함께 Gemini 3 Flash를 무료로 제공하며, 대부분의 일상적인 용도에는 충분합니다. 유료 요금제는 Google AI Plus의 $4.99/month부터 시작하고, Deep Think를 쓰려면 $99.99 Ultra 요금제가 필요합니다.
Gemini 3 가격은 얼마인가요?
일반 사용자용 요금은 무료, AI Plus $4.99/mo, AI Pro $19.99/mo, AI Ultra $99.99와 $199.99/mo입니다. API에서 Gemini 3.5 Flash는 1 million 토큰당 입력 $1.50 / 출력 $9이고, 3.1 Pro는 프롬프트 크기에 따라 입력 $2~$4 / 출력 $12~$18입니다.
Gemini 3는 ChatGPT나 Claude보다 좋은가요?
Google이 공개한 벤치마크에서는 에이전트형 검색, 긴 컨텍스트, 경쟁형 코딩에서 앞서며 SWE-Bench Verified와 툴 사용에서는 Claude Opus 4.6에 근소하게 뒤처집니다. 세 제품 중 가성비는 가장 좋지만, 중요한 업무에서의 안정성은 여전히 Claude의 강점입니다.
Gemini 3 Deep Think는 무엇인가요?
어려운 문제에 더 많은 연산을 투입하는 강화 추론 모드입니다. ARC-AGI-2 같은 시험에서 45.1%라는 최고 수준의 점수를 기록했습니다. Google AI Ultra 요금제에서만 제공되며 일상적인 작업에는 과한 기능입니다.
Gemini 3 Flash와 Pro 중 무엇을 써야 하나요?
속도와 비용, 일상 대화, 에이전트 루프가 중요하다면 3.5 Flash를 선택하면 됩니다. 이제 코딩에서도 기존 Pro를 앞섭니다. 가장 깊은 추론이나 매우 긴 컨텍스트가 필요하고 높은 비용을 감당할 수 있을 때는 3.1 Pro가 맞습니다.
실제로 중요한 툴의 최신 정보와 가격, 과장 없는 장단점을 매주 받아보고 싶다면 뉴스레터에 가입하세요.
2026년 9월 4일







