Was ist passiert?
Google hat Gemini 3 am 18. November 2025 offiziell eingeführt, nur sieben Monate nach der Veröffentlichung von Gemini 2.5. Das neue Modell wurde sofort über die Gemini-App, Google AI Studio, Vertex AI und eine brandneue Agenten-Entwicklungsplattform namens Google Antigravity verfügbar.
CEO Sundar Pichai nannte es „das beste Modell der Welt für komplexes Denken“, und die Benchmarks untermauern diese Behauptung. Gemini 3 führte die LMArena-Rangliste mit einem bahnbrechenden Elo-Wert von 1501 an – der erste LLM, der die 1500-Schwelle überschritt.
Dies stellt einen Sprung von etwa 50 Punkten gegenüber dem vorherigen Gemini 2.5 Pro von Google dar, der bei etwa 1450 Elo lag, und liegt in direkten Vergleichstests zur menschlichen Präferenz vor GPT-5.1 von OpenAI und Claude 4.5 Sonnet von Anthropic.
Wichtige Details
- Veröffentlichungsdatum: 18. November 2025
- LMArena Elo Score: 1501 (erstes Modell, das 1500 überschritt)
- Begründung auf PhD-Niveau: 37,5 % bei Humanity’s Last Exam, 91,9 % bei GPQA Diamond
- Mathematik: 23,4 % auf MathArena Apex (neuer Stand der Technik)
- Codierung: 1487 Elo auf WebDev Arena, 76,2 % auf SWE-Bench Verified
- Multimodal: 81 % bei MMMU-Pro, 87,6 % bei Video-MMMU
- Verfügbarkeit: Gemini-App, AI Studio, Vertex AI, Google Antigravity
Warum es wichtig ist
Für Verbraucher
Die verbesserte Argumentation von Gemini 3 bedeutet, dass das Modell nun „zuverlässig 10 bis 15 kohärente logische Schritte“ ohne ständige menschliche Aufsicht ausführen kann. Dies bedeutet, dass komplexere Aufgaben autonom erledigt werden können, von mehrstufigen Forschungsprojekten bis hin zu komplizierten Codierungsherausforderungen, ohne dass es zu Ausfällen oder manuellen Eingriffen kommt.
Das Modell führt außerdem „generative Schnittstellen“ ein, die bestimmte Antworten in einem Format liefern, das eher einem digitalen Magazin als einfachen Textantworten ähnelt. Dadurch werden Informationen leichter verdaulich und visuell ansprechender.
Für die Industrie
Googles schnelle Iteration, die Gemini 3 nur sieben Monate nach 2.5 ausliefert, signalisiert ein sich verschärfendes KI-Wettrüsten. Der Elo-Sprung um 50 Punkte ist bedeutend; Zum Vergleich: Der Abstand zwischen Gemini 2.5 und den meisten Konkurrenten betrug typischerweise 20–30 Punkte.
Als Reaktion darauf werden OpenAI und Anthropic wahrscheinlich ihre Veröffentlichungspläne beschleunigen. Der Wettbewerb verlagert sich von „Wer kann einen guten Chatbot bauen“ hin zu „Wer kann den leistungsfähigsten autonomen Agenten bauen?“
Für Entwickler
Der eigentliche Game-Changer könnte Google Antigravity sein, eine neue Agenten-Entwicklungsplattform, die mit Gemini 3 ausgeliefert wird. Im Gegensatz zu herkömmlichen IDEs gewährt Antigravity KI-Agenten „direkten Zugriff auf den Editor, das Terminal und den Browser“, sodass sie komplexe Softwareaufgaben autonom planen, ausführen und validieren können.
In ersten Rezensionen wird es positiv mit Cursor AI verglichen, wobei einige Entwickler es als „Cursor-Killer“ bezeichnen. Es ist jetzt kostenlos als öffentliche Vorschau für macOS, Windows und Linux verfügbar.
Die Hintergrundgeschichte
Google steht unter Druck, seit die virale Einführung von ChatGPT Ende 2022 das Unternehmen trotz seiner bahnbrechenden Forschung im Bereich Transformer (das „T“ in GPT) überraschte. Nach einem holprigen Bard-Start und der anschließenden Umbenennung in Gemini hat Google aufgeholt.
Gemini 2.5, veröffentlicht im April 2025, schloss einen Großteil der Lücke. Aber GPT-5.1 von OpenAI und Claude 4.5 Sonnet von Anthropic haben in den letzten Monaten beide starke Modelle auf den Markt gebracht, was die Konkurrenz hart hält.
Gemini 3 scheint die Aussage von Google zu sein, dass das Unternehmen nicht nur aufholt, sondern auch führend ist.
Expertenreaktionen
Sundar Pichai (CEO, Google):
„Gemini 3 ist das bisher leistungsfähigste Modell, das umfassendes Weltwissen mit fundiertem Denken kombiniert“, erklärte Pichai.
Branchenanalysten von Constellation Research stellten fest:
„Die Kombination der Argumentationsfähigkeiten von Gemini 3 und der Antigravity-Plattform signalisiert Googles Wandel hin zur „Agent-First“-Entwicklung, bei der KI-Systeme nicht nur unterstützen, sondern auch ausführen.“
Was kommt als nächstes?
Google hat für AI Ultra-Abonnenten in den nächsten Wochen einen Gemini 3 Deep Think-Modus mit „noch besserem Denken und multimodalem Verständnis“ angekündigt. Der Preis wurde nicht bekannt gegeben.
Das Modell ist bereits für Unternehmenskunden über Gemini Enterprise und Vertex AI verfügbar. Der kostenlose Kontingentzugang über die Gemini-App wird diese Woche weltweit eingeführt.
Zeitleiste:
- Jetzt: Gemini 3 verfügbar in der Gemini-App, AI Studio, Vertex AI, Antigravity
- Kommende Wochen: Gemini 3 Deep Think-Modus für Ultra-Abonnenten
- Unbekannt: API-Preise für Entwickler (derzeit in der Vorschau)
Analyse
Der Elo-Wert von 1501 ist beeindruckend, aber die Zahlen sind nur dann von Bedeutung, wenn sie sich in einem realen Nutzen widerspiegeln. Erste praktische Berichte deuten darauf hin, dass Gemini 3 gute Ergebnisse liefert, insbesondere bei Codierungsaufgaben, bei denen die Kombination aus starkem Denken und Werkzeugeinsatz (über Antigravity) ein wirklich differenziertes Erlebnis schafft.
Bemerkenswert ist die Geschwindigkeit. Sieben Monate von Gemini 2.5 bis Gemini 3 sind ehrgeizig, und wenn Google dieses Tempo beibehalten kann, während OpenAI und Anthropic ihre eigenen Grenzen erweitern, blickt die Branche auf ein Jahr 2026, in dem sich Grenzmodelle schneller verbessern, als die meisten Unternehmen sie überhaupt einsetzen können.
Der Platzhalter ist Antigravitation. Wenn es von den Entwicklern angenommen wird, könnte es einen Burggraben um Gemini schaffen, ähnlich wie GitHub Copilot OpenAI-Modellen zugute kommt, nicht nur durch die Leistungsfähigkeit, sondern auch durch die Workflow-Integration.
Das Fazit
Google Gemini 3 ist nicht nur ein inkrementelles Update; Es ist eine Erklärung, die Google wieder an die Spitze des KI-Rennens bringt. Mit Rekord-Benchmark-Ergebnissen, verbessertem Denken, das komplexe mehrstufige Aufgaben bewältigt, und einer neuen Codierungsplattform, die die Art und Weise, wie Entwickler mit KI arbeiten, neu gestalten könnte, verlagert Gemini 3 die Diskussion von „Kann KI mit Menschen konkurrieren“ hin zu „Wie gestaltet man Arbeitsabläufe rund um autonome KI-Systeme?“.
Wenn Sie Entwickler sind, lohnt es sich, Antigravity sofort zu testen. Wenn Sie ein Unternehmen sind, das KI-Plattformen evaluiert, verdienen die Argumentationsfähigkeiten und die multimodale Leistung von Gemini 3 einen neuen Blick. Und wenn Sie nur zusehen, wie sich die KI-Kriege entfalten, schnallen Sie sich an, das Jahr 2026 wird wild.
Quellen (4)
- blog.google Gemini 3: Introducing the latest Gemini AI model from Google
- techcrunch.com Google launches Gemini 3 with new coding app and record benchmark scores
- cnbc.com Google announces Gemini 3 as battle with OpenAI intensifies
- blog.google Gemini 3 for developers: New reasoning, agentic capabilities
🦋 Diskussion auf Bluesky
Auf Bluesky diskutieren