何が起こったのか
Google は、Gemini 2.5 のリリースからわずか 7 か月後の 2025 年 11 月 18 日に Gemini 3 を正式に発売しました。新しいモデルは、Gemini アプリ、Google AI Studio、Vertex AI、および Google Antigravity と呼ばれるまったく新しいエージェント開発プラットフォームを通じてすぐに利用できるようになりました。
CEOのSundar Pichai氏はこれを「複雑な推論のための世界最高のモデル」と呼び、ベンチマークもその主張を裏付けている。 Gemini 3 は、1501 という画期的な Elo スコアで LMArena リーダーボードのトップになりました。これは、1500 のしきい値を超えた最初の LLM です。
これは、1450 Elo 付近で推移していた Google の以前の Gemini 2.5 Pro から約 50 ポイントの上昇を示しており、直接的な人間の好みのテストでは OpenAI の GPT-5.1 や Anthropic の Claude 4.5 Sonnet よりも上位にあります。
主要な詳細
- 発売日: 2025 年 11 月 18 日
- LMArena Elo スコア: 1501 (1500 を超えた最初のモデル)
- 博士レベルの推論:人類最後の試験で 37.5%、GPQA ダイヤモンドで 91.9%
- 数学: MathArena Apex (新しい最先端) で 23.4%
- コーディング: WebDev Arena では 1487 Elo、SWE ベンチでは 76.2% 検証済み
- マルチモーダル: MMMU-Pro で 81%、Video-MMMU で 87.6%
- 利用可能性: Gemini アプリ、AI Studio、Vertex AI、Google Antigravity
なぜそれが重要なのか
消費者向け
Gemini 3 の強化された推論は、モデルが人間による絶え間ない監視なしで「10 ~ 15 の一貫した論理ステップを確実に完了」できることを意味します。これにより、複数のステップからなる研究プロジェクトから複雑なコーディングの課題に至るまで、より複雑なタスクが、中断したり手動介入を必要としたりすることなく、自律的に完了することが可能になります。
このモデルには「生成インターフェイス」も導入されており、プレーン テキストの応答ではなく、デジタル雑誌に似た形式で特定の回答が提供されます。これにより、情報がよりわかりやすく、視覚的に魅力的になります。
業界向け
Gemini 3 を 2.5 からわずか 7 か月後に出荷するという Google の迅速な開発は、AI 軍拡競争の激化を示唆しています。 50 ポイントの Elo ジャンプは重要です。ちなみに、Gemini 2.5 とほとんどの競合他社との差は通常 20 ~ 30 ポイントでした。
OpenAIとAnthropicはこれに応じてリリーススケジュールを早める可能性が高い。競争は「誰が優れたチャットボットを構築できるか」から「誰が最も有能な自律エージェントを構築できるか」へと移りつつあります。
開発者向け
本当のゲームチェンジャーは、Gemini 3 に同梱される新しいエージェント開発プラットフォームである Google Antigravity かもしれません。従来の IDE とは異なり、Antigravity は AI エージェントに「エディター、ターミナル、ブラウザーへの直接アクセス」を提供し、複雑なソフトウェア タスクを自律的に計画、実行、検証できるようにします。
初期のレビューではこれを Cursor AI と好意的に比較しており、一部の開発者はこれを「カーソルキラー」と呼んでいます。現在、macOS、Windows、Linux 向けのパブリック プレビュー版を無料で利用できます。
バックストーリー
Googleは、変圧器(GPTの「T」)の先駆的研究にもかかわらず、2022年後半にChatGPTを立ち上げてバイラルに広まって以来、同社の不意を突かれて以来、プレッシャーにさらされている。 Bard のローンチとその後の Gemini へのブランド変更の後、Google は巻き返しを図ってきました。
2025 年 4 月にリリースされた Gemini 2.5 は、そのギャップの多くを埋めました。しかし、OpenAIのGPT-5.1とAnthropicのClaude 4.5 Sonnetはいずれもここ数カ月で強力なモデルを発表し、競争は熾烈を極めている。
Gemini 3 は、追いついているだけではなく、リードしているという Google の声明のように見えます。
専門家の反応
サンダー・ピチャイ (Google CEO):
「ジェミニ 3 は、幅広い世界の知識と深い推論を組み合わせた、これまでで最も有能なモデルです」とピチャイ氏は述べました。
Constellation Research の 業界アナリスト は次のように述べています。
「Gemini 3 の推論機能と Antigravity プラットフォームの組み合わせは、AI システムが支援するだけでなく実行する、『エージェントファースト』開発への Google の移行を示しています。」
次は何ですか
Google は、「さらに優れた推論とマルチモーダルな理解」を備えた Gemini 3 Deep Think モードを AI Ultra 加入者向けに数週間以内に提供すると発表しました。価格は明らかにされていない。
このモデルは、Gemini Enterprise および Vertex AI を通じて企業顧客向けにすでに提供されています。今週、Gemini アプリを介した無料利用枠のアクセスが世界中で展開されます。
タイムライン:
- 現在: Gemini 3 は Gemini アプリ、AI Studio、Vertex AI、Antigravity で利用可能です
- 今後数週間: Ultra 加入者向けの Gemini 3 Deep Think モード
- 不明: 開発者向けの API 価格 (現在プレビュー段階)
分析
1501 Elo スコアは印象的ですが、数値は現実世界の実用性に換算される場合にのみ重要です。初期の実践レポートによると、Gemini 3 は、特に強力な推論と (反重力による) ツールの使用の組み合わせが真に差別化されたエクスペリエンスを生み出すコーディング タスクで効果を発揮することが示唆されています。
特筆すべきはそのスピードです。 Gemini 2.5 から Gemini 3 までの 7 か月はアグレッシブであり、OpenAI と Anthropic が独自のフロンティアを開拓する間、Google がこのペースを維持できれば、業界は 2026 年に、フロンティア モデルがほとんどの企業が導入するよりも早く改良されることになると予想しています。
ワイルドカードは反重力です。開発者に採用されれば、GitHub Copilot が機能だけでなくワークフローの統合を通じて OpenAI モデルにメリットをもたらすのと同じように、Gemini の周囲に堀が築かれる可能性があります。
結論
Google Gemini 3 は単なる増分アップデートではありません。これは、Google を AI 競争の最前線に戻す声明リリースです。記録的なベンチマーク スコア、複雑な複数ステップのタスクを処理する強化された推論、開発者が AI を使用する方法を再構築できる新しいコーディング プラットフォームを備えた Gemini 3 は、話題を「AI は人間と競争できるか」から「自律型 AI システムを中心としたワークフローを設計する方法」に移します。
あなたが開発者であれば、Antigravity はすぐにテストする価値があります。 AI プラットフォームを評価している企業であれば、Gemini 3 の推論機能とマルチモーダルなパフォーマンスを新たに検討する価値があります。 AI 戦争の展開を見ているだけなら、シートベルトを締めてください。2026 年は大変なことになるでしょう。
出典 (4)
- blog.google Gemini 3: Introducing the latest Gemini AI model from Google
- techcrunch.com Google launches Gemini 3 with new coding app and record benchmark scores
- cnbc.com Google announces Gemini 3 as battle with OpenAI intensifies
- blog.google Gemini 3 for developers: New reasoning, agentic capabilities
🦋 Bluesky での議論
Bluesky で議論する