Gemini 3レビュー(2026年版):性能・料金と選ぶべきモデル

Gemini 3は本当に使う価値があるのか。3.1 Proと3.5 Flashの性能、ベンチマーク、料金、APIコストを比較し、ChatGPTやClaudeから乗り換えるべき人を整理。無料版からDeep Thinkまで、用途別に選ぶべきモデルと注意点を2026年版の最新データで率直に解説します。

Friday, September 4, 2026Omid Saffari
Gemini 3レビュー(2026年版):性能・料金と選ぶべきモデル

GoogleのGemini 3は、もはや単一のモデルではありません。この一点だけで、評価の前提は大きく変わります。11月に「Gemini 3 Pro」として登場したモデルは、現在ではラインアップへと拡大しました。最難関の推論を担う3.1 Pro、旧フラッグシップをコーディング性能で上回る高速な新標準の3.5 Flash、そして数日以内の登場を控える3.5 Proです。率直にレビューするなら、問うべきは「Gemini 3は優秀か」ではありません。実際にどのモデルを使うべきか、ChatGPTやClaudeから乗り換える価値があるかです。

Gemini 3レビューの結論

Gemini 3は、間違いなくフロンティア級のモデルラインです。いまでは多くの人にとって、無料プランだけでも日常的に使える水準に達しています。ただし、「Gemini 3」は性格の大きく異なるモデルの総称であり、初期設定で選ばれるモデルが最適とは限りません。

すでにGoogleのサービス(Gmail、Docs、Search、Android)を中心に使っているなら、Gemini 3は最も導入しやすいフロンティアAIです。価格面でも非常に充実しており、実用的な無料プラン、競合より安い**$4.99/month**の有料プラン、そしてAPIでは最高水準の価格対性能を備えています。長いコンテキストの処理、マルチモーダルと動画の理解、エージェント型検索では業界をリードしています。

弱点は、長時間に及ぶ重要なタスクでの一貫性と、「判断をそのまま信頼できる」というClaudeの強みにあたる安定感です。ラインアップの更新も速く、先月試したモデルがすでに現行ではないことさえあります。ブランド名ではなく用途で選べば、Gemini 3は非常に強力です。

現在の「Gemini 3」は何を指すのか

Gemini 3」は1つのモデルではなく、1つの世代です。すでに登場したものと近日登場予定のものを合わせ、4つのバージョンがあります。名前は似ていても特性はまったく異なるため、この違いを理解することがモデル選びの大半を占めます。

ここでいうモデルとは、思考を担うエンジンのことです。「Pro」は規模が大きく、より深く推論します。「Flash」は小型で高速、しかも低コストです。2026年半ば時点のラインアップは次のとおりです。

モデル位置づけ提供状況向いている用途
Gemini 3 Pro2025年11月登場の初代フラッグシップ後継モデルあり新規利用には不要、3.1を選択
Gemini 3.1 Pro現行の推論フラッグシップ提供中(プレビュー)最難関の推論、最長のコンテキスト
Gemini 3.5 FlashI/O 2026で登場した高速な標準モデル提供中日常のチャット、コーディング、エージェントループ
Gemini 3.5 Pro~2Mコンテキストの次期フラッグシップ近日提供(GA間近の見込み)高度な作業で3.1 Proを置き換える予定

意外なのは、安価で高速な3.5 Flashが、コーディングとエージェント型タスクで旧フラッグシップの3 Proを上回るようになったことです。Googleは、この領域では大型フラッグシップモデルに匹敵すると説明しています(Engadget)。つまり、「本格的な作業には高価なモデル」という感覚は、多くの用途ですでに当てはまりません。

全モデルに共通するのは、100万トークンのコンテキストウィンドウ(1回の会話で読める量で、テキスト約1,500ページ分)、1つのプロンプトでテキスト、画像、動画、音声、PDFをネイティブに扱えること、そして2025年1月の知識カットオフです(モデルカード)。

Geminiアプリの画面
Gemini

覚えておくべきことは1つです。誰かが「Gemini 3」と言ったら、どのモデルかを確認してください。答えによって料金は4倍変わり、得意分野もまったく異なります。

Gemini 3のベンチマークを正しく読む

Googleが公開した数値では、Gemini 3.1 Proは複数の分野でフロンティアモデルの先頭に立つ一方、いくつかの分野では競合に及びません。すべて首位という結果より、むしろこの混在した結果のほうが信頼できます。負けている項目を見れば、競合が本当に優れている領域がわかるからです。

ベンチマークとは、すべてのモデルに同じ問題を与え、同じ方法で採点する標準テストです。以下はモデルカードに掲載された、**Gemini 3.1 Pro(Thinking, High)**と現行のClaudeおよびOpenAIモデルの比較です(出典)。

ベンチマーク(測定内容)Gemini 3.1 ProClaude Opus 4.6GPT-5.2
BrowseComp(エージェント型Web検索)85.9%84.0%65.8%
LiveCodeBench Pro(競技プログラミング、Elo)2887n/a2393
APEX-Agents(長期にわたる専門タスク)33.5%29.8%23.0%
Terminal-Bench 2.0(ターミナル経由のコンピューター操作)68.5%65.4%54.0%
SciCode(研究向けコーディング)59%52%52%
SWE-Bench Verified(実務的なコーディングエージェント)80.6%80.8%80.0%
τ2-bench retail(ツール利用)90.8%91.9%82.0%
MRCR v2, 128k(長いコンテキストからの情報再現)84.9%84.0%83.8%

読み方は明快です。大量の変化する情報を探し、閲覧し、推論するタスクでは、Gemini 3.1 Proが先行しており、差が大きい項目もあります。BrowseCompの85.9%に対してGPT-5.2は65.8%で、これは僅差ではありません。一方、腰を据えたソフトウェア開発では3モデルは事実上の横並びです。最もよく引用されるコーディング指標のSWE-Bench Verifiedでは、Claude Opus 4.6がわずかに上回ります。手順を守ったツール利用でも、Opusが僅差ながら最も安定しています。

フラッグシップの推論スコアも同じ傾向を示します。登場時のGemini 3 ProはLMArenaランキングで1501 Eloの首位となり、大学院レベルの科学問題であるGPQA Diamondで91.9%、ツールを使わないHumanity's Last Examで37.5%を記録しました。後者は専門家向けに意図的に難しく作られた試験で、37.5%でも高いスコアです(発表記事)。強化推論モードのDeep Thinkを有効にすると、Humanity's Last Examは41.0%、暗記では突破しにくく未知の問題解決力を測るARC-AGI-2では際立った**45.1%**まで上昇します。

Gemini 3の料金を具体的に計算する

Gemini 3は現在、サブスクリプションでもAPIでも、フロンティアAIを最も安く使い始められる選択肢です。これが最大の強みですが、重要なプランの名称がひっそり変更されたため、見落とされがちです。

一般ユーザー向けの現行料金は次のとおりです(プラン一覧)。

プラン料金内容
無料$0Gemini 3 Flashを使えるGeminiアプリ、1日あたりの上限あり
Google AI Plus$4.99/mo利用枠を拡大、400 GBストレージ(旧「AI Premium」)
Google AI Pro$19.99/mo5 TBストレージ、$10/moのCloudクレジット、利用枠を拡大
Google AI Ultra$99.99/moDeep Think、Gemini Agent、20 TB、$40/moのクレジット
Google AI Ultra 20x$199.99/mo最大の利用枠、30 TB、$100/moのクレジット

多くの人にとって重要なのは、Google AI Plusが$4.99/monthという点です。ChatGPT PlusとClaude Proの標準プランはいずれも約$20/monthなので、Geminiの中間プランはおよそ4分の1の価格です。他で「$7.99」という数字を見かけても、それは古い情報です。Googleの公式ページでは$4.99と案内されています。

開発者にとって、価格差がより鮮明になるのはAPIです(100万トークンあたりの料金表)。

  • Gemini 3.1 Pro:200kトークン未満のプロンプトは入力$2.00 / 出力$12.00、それを超えると入力$4.00 / 出力$18.00です。
  • Gemini 3.5 Flash:入力$1.50 / 出力$9.00です。しかも、コーディングとエージェントでは旧Proを上回ります。
  • Grounding with Google Search:Gemini 3ライン全体で月5,000プロンプトまで無料、その後は1,000クエリあたり$14です。

具体例で計算します。月100,000件の会話を処理するサポートエージェントを開発し、1件あたりの平均が入力4kトークン、出力1kトークンだとします。3.5 Flashなら入力は約400M、出力は100Mトークンとなり、定価で**$600 + $900 = $1,500/month**です。出力料金が2倍のフロンティアモデルで同じ処理をすれば、$2,500を超えます。100k件の規模では、この差額は人を1人雇えるほどです。大量処理を担うチームがGeminiへ移る理由は、ベンチマーク表ではなくこの計算にあります。 このクラスのモデル間でベンチマークの差は数ポイントでも、請求額には40%以上の差が出ます。

Gemini 3が本当に強い領域、弱い領域

用途の広さ、サービスへの浸透度、料金を重視するならGemini 3が適しています。反対に、モデルの判断を確認せずに任せられることが必要なら、別の選択肢を検討すべきです。

強み
得意なこと
4 points

  • 市場最高水準の価格対性能。 実用的な無料プラン、$4.99の有料プラン、3社で最も安いフロンティアAPIがそろっています。
  • 長いコンテキストとマルチモーダル対応。 1Mトークンに加え、1つのプロンプトで動画、音声、画像、PDFをネイティブに扱えます。競合2社はここまで自然に統合できていません。
  • エージェント型の検索とリサーチ。 BrowseCompで首位に立ち、Google SearchのAI Modeにも組み込まれているため、Web上の最新情報を扱う推論は得意分野です。
  • 圧倒的な接点。 Gmail、Docs、Android、Searchに加え、Cursor、GitHub、JetBrains、Replitなどの外部ツールにもすでに組み込まれています。Googleを使っているなら、導入の負担はほぼありません。

短所も明確です。繰り返し指摘されるのは一貫性で、ある場面では驚くほど優秀なのに、1時間後の似たプロンプトでは平凡な回答になることがあります。フォーラムのレビューでも、まさにこの点が挙げられています。契約書、医療・法務文書の作成、財務分析など、誤りの代償が大きい業務では、Claudeの安定感を信頼するチームが今も少なくありません。τ2-benchのツール利用とSWE-Bench Verifiedの数値も、わずかな差ながらその判断を裏づけています。さらにラインアップの入れ替わりが速く、3 Pro向けに調整したワークフローは3.5 Flashに合わせ直す必要があり、3.5 Proの登場で再び見直しが発生します。進化の速さは性能面では歓迎できますが、安定運用には不利です。

日常のAIアシスタントとして詳しく比べるなら、GeminiとChatGPTの比較をご覧ください。[3者を並べたClaude vs ChatGPT vs Geminiの比較記事](/blog/claude-vs-chatgpt-vs-gemini)では、それぞれの違いを横断的に確認できます。

Gemini 3はどのモデルを選ぶべきか?

価格の高さではなく、仕事の内容に合わせてモデルを選んでください。想像以上に多くの用途で、安価なモデルが勝つからです。

利用者・用途選ぶモデル/プラン理由
無料チャット/日常利用無料プラン(3 Flash)フロンティア級の回答、無料、余裕のある上限
GoogleエコシステムのパワーユーザーAI Plus、$4.99サブスクリプションとして最高水準のコストパフォーマンス、Workspace連携
大量処理する機能を提供する開発者3.5 Flash APIコーディングで旧Proを上回り、出力料金は約40%安い
ライブWebを必要とするエージェント開発者3.1 Pro + groundingBrowseComp首位、ツール履歴を保持できる長いコンテキスト
最難関の推論タスクに取り組む人Ultra + Deep Think極めて難しい試験で最高水準のスコア
最大限の信頼性が必要な人Claudeも検討長く重要な判断ではより安定

判断基準を1文にまとめると、処理量、用途の広さ、検索、予算を優先するならGemini、再確認が許されない重要な判断なら価格差より信頼性で選ぶ、となります。作業の中心がコードなら、1つのモデルに統一する前に、コーディング専用エージェントとも比較してください。

Gemini 3の使い方:始める手順

Gemini 3は約2分で使い始められます。まずは無料プランで、重要な機能のほとんどを試せます。

  1. まず無料で始める

    Geminiアプリまたはgemini.google.comを開き、Googleアカウントでログインします。すぐにGemini 3 Flashを無料で利用できます。料金を支払う前に、実際の仕事で1週間使ってみてください。

  2. 上限に達してからアップグレードする

    1日あたりの上限に達した場合や、Workspaceとの連携を深めたい場合は、$4.99/monthのGoogle AI Plusがほとんどの人に適したアップグレードです。$19.99のProは、より多くの利用枠とストレージが必要な人向けです。

  3. 開発用のAPIキーを取得する

    Google AI Studioでキーを作成し、まず3.5 Flashを呼び出します。料金は数倍になるため、本当に最深の推論や最大のコンテキストが必要なプロンプトだけ3.1 Proへ切り替えてください。

  4. Deep Thinkは難問に限定する

    Deep ThinkにはGoogle AI Ultraが必要です。日常のチャットではなく、本当に難しく新規性のある問題に限れば価値があります。ほとんどの人には必要ありません。

Gemini 3は無料で使えますか?

はい。Geminiアプリでは、1日あたりの上限付きでGemini 3 Flashを無料利用でき、ほとんどの日常用途には十分です。有料プランは$4.99/monthのGoogle AI Plusから始まり、Deep Thinkには$99.99のUltraプランが必要です。

Gemini 3の料金はいくらですか?

一般向けは無料から始まり、AI Plusが$4.99/mo、AI Proが$19.99/mo、AI Ultraが$99.99と$199.99/moです。APIは、Gemini 3.5 Flashが100万トークンあたり入力$1.50 / 出力$9、3.1 Proはプロンプトの長さに応じて入力$2~$4 / 出力$12~$18です。

Gemini 3はChatGPTやClaudeより優れていますか?

Google公表のベンチマークでは、エージェント型検索、長いコンテキスト、競技プログラミングで上回り、SWE-Bench Verifiedとツール利用ではClaude Opus 4.6にわずかに及びません。3モデルの中で価格対性能が最も高い一方、重要な業務での安定性を優先するならClaudeが依然として有力です。

Gemini 3のDeep Thinkとは何ですか?

難問により多くの計算資源を使う強化推論モードで、ARC-AGI-2などのテストで45.1%という最高水準のスコアを記録しています。Google AI Ultra限定で、日常的な用途には過剰です。

Gemini 3 FlashとProはどちらを選ぶべきですか?

速度、料金、日常のチャット、エージェントループを重視するなら3.5 Flashです。コーディングでは旧Proを上回ります。最深の推論や最長のコンテキストが必要で、高い料金に見合う場合は3.1 Proを選んでください。

誇張を省き、本当に重要なツールを最新の料金と率直なトレードオフで毎週解説する記事を読みたい方は、ニュースレターにご登録ください

最終更新

2026年9月4日

カテゴリーAI

Googleでこのサイトを優先する

omidsaffari.comをGoogle検索の優先ソースに追加

omidsaffari.comを優先ソースに設定すると、GoogleがTop Stories・AI Overviews・AI Modeであなたのために優先表示します。

ニュースレター

毎週日曜、一通の手紙。 動くシステムの話。感想戦ではなく。

AIベンチャーのポートフォリオ運営から生まれるビルドログ、稼働中のシステム、現場ノート。

週刊。スパムなし。いつでも解除できます。