KI-Modelle und Plattformen

Google stellt Gemini 3 Pro mit rekordbrechender Leistung vor

mm
Unite.AI zu deinen bevorzugten Quellen auf Google hinzufÞgen

Google (GOOGL ) hat heute Gemini 3 Pro verÃķffentlicht, sein fortschrittlichstes KI-Modell mit rekordbrechenden Benchmarks und einer neuen agentischen Entwicklungsplattform namens Antigravity. Das Modell erreicht 1501 Elo auf LMArena, was Gemini 2.5 Pro mit 1451 Þbertrifft und die Spitzenposition in allen wichtigen KI-Bewertungsmetriken einnimmt.

Die VerÃķffentlichung erfolgt nach monatelanger Vorfreude in der KI-Branche, wobei das Modell zunÃĪchst stillschweigend am 22. Oktober an ausgewÃĪhlte Benutzer ausgerollt wurde, bevor die Ãķffentliche AnkÞndigung erfolgte. Google’s Entwickler-orientierte VerÃķffentlichung betont die KodierfÃĪhigkeiten und die autonome Agentenfunktion, wodurch das Unternehmen in der Lage ist, mit Claude’s Kodierleistung und OpenAI’s Entwicklungstools konkurrieren zu kÃķnnen.

Gemini 3 Pro unterstÞtzt ein Kontextfenster von 1 Million Token – etwa 750.000 WÃķrter – mit zwei Tarifen, die 200.000 und 1 Million Token fÞr verschiedene AnwendungsfÃĪlle anbieten. Das Modell zeigt außergewÃķhnliche multimodale FÃĪhigkeiten, indem es Text, Bilder, Videos und Audio mit verbesserter visueller Argumentation und Grafikgenerierung verarbeitet. Die Integration umfasst Google’s Produkt-Ökosystem, einschließlich Workspace, Chrome und Android.

Rekordbrechende Benchmark-Leistung

Gemini 3 Pro erreicht 91,8 % Genauigkeit auf dem MMLU-Benchmark, was eine Verbesserung von 5 Punkten gegenÞber Gemini 2.5 Pro mit 89,5 % darstellt. Das Modell zeigt insbesondere StÃĪrke bei Fragen, die mehrere Wissensbereiche umfassen, mit 92 % bei Aufgaben, die mehrere Wissensbereiche umfassen, wÃĪhrend Gemini 2.5 bei ÃĪhnlichen Herausforderungen auf 65 % fiel.

Auf Kodier-spezifischen Benchmarks erzielte Gemini 3 Pro 76,2 % auf SWE-bench Verified, was seine VorgÃĪngerversion deutlich Þbertrifft, aber hinter Claude 4.5 mit 77,2 % zurÞckbleibt. Das Modell fÞhrt die WebDev Arena-Liste mit 1487 Elo an, was seine außergewÃķhnlichen Web-EntwicklungsfÃĪhigkeiten unterstreicht. Auf Terminal-Bench 2.0, das die Werkzeugnutzung und Computeroperation Þber die Konsole misst, erreichte Gemini 3 Pro 54,2 %.

Das Modell liefert etwa 2-mal schnellere Inferenz als Gemini 2.5 Pro bei allen AufgabengrÃķßen. Kleine Aufgaben wie 50-zeilige Python-Skripte sind in 12 Sekunden abgeschlossen, gegenÞber 25 Sekunden, wÃĪhrend große Aufgaben mit 10.000 Datenzeilen in 15 Minuten und 30 Sekunden abgeschlossen sind, gegenÞber 32 Minuten und 15 Sekunden zuvor.

Google hat auch den Gemini 3 Deep Think-Modus vorgestellt, eine erweiterte ArgumentationsfÃĪhigkeit, die auf anspruchsvollen Benchmarks hÃķhere Leistungen liefert. Der Modus erreicht 93,8 % auf GPQA Diamond (gegenÞber 91,9 % Standard), 41,0 % auf Humanity’s Last Exam (gegenÞber 37,5 %) und wird in den kommenden Wochen fÞr AI-Ultra-Abonnenten verfÞgbar sein.

Antigravity-Plattform verwandelt Entwickler-Workflows

Google hat Antigravity vorgestellt, eine agentische Entwicklungsplattform, die von Gemini 3 angetrieben wird und es autonomen Agenten ermÃķglicht, gleichzeitig in Code-Editoren, Terminals und Browsern zu arbeiten. Die Plattform markiert einen Wechsel von traditioneller tool-basierter UnterstÞtzung zu kollaborativen Modellen, bei denen Agenten wesentliche Entwicklungsverantwortungen Þbernehmen.

Antigravity nutzt mehrere KI-Modelle, darunter Gemini 3 Pro als primÃĪren Argumentations-Engine, Gemini 2.5 Computer Use fÞr Browser-Steuerung und Nano Banana (Gemini 2.5 Image) fÞr Bildbearbeitung. Agenten kÃķnnen unabhÃĪngig komplexe Entwicklungs-Aufgaben planen und ausfÞhren, wÃĪhrend sie ihren eigenen Code validieren, bevor sie Ergebnisse prÃĪsentieren.

Die Plattform beschleunigt die “Vibe-Coding“, bei der die natÞrliche Sprache zur primÃĪren Syntax wird. Entwickler kÃķnnen hochrangige kreative Ideen in vollstÃĪndig interaktive Anwendungen Þbersetzen, ohne Implementierungsdetails anzugeben. Diese FunktionalitÃĪt wird durch Gemini 3’s außergewÃķhnliche Web-Entwicklungspunktzahl unterstÞtzt.

Agenten in Antigravity verwalten autonom die Erstellung von Funktionen, UI-Iterationen, Fehlerbehebung, LÃķsungsforschung und Berichtsgenerierung. Die Plattform ist fÞr die Öffentlichkeit kostenlos verfÞgbar und unterstÞtzt Mac, Windows und Linux, mit Integrationen fÞr Cursor, GitHub, JetBrains, Manus und Cline.

Unternehmensintegration und Markteinfluss

Gemini 3 Pro ist fÞr Google AI Ultra-Abonnenten und bezahlte Gemini API-Nutzer verfÞgbar. Das Modell ist direkt in Google Search integriert und erreicht damit 2 Milliarden monatliche AI-Überblicks-Benutzer, laut CEO Sundar Pichai. Unternehmens-Deployments kÃķnnen auf das Modell Þber Google AI Studio und Vertex AI zugreifen.

Die Gemini-App hat Updates mit neuen Schnittstellen und erweiterten Agenten-FÃĪhigkeiten erhalten, die speziell fÞr Gemini 3 entwickelt wurden. Diese Verbesserungen positionieren Google gegenÞber konkurrierenden KI-Assistenten, wÃĪhrend sie gleichzeitig die dominanten VertriebskanÃĪle des Unternehmens nutzen.

Google’s VerÃķffentlichungsstrategie betont die Adoption durch Entwickler und die Unternehmens-Deployments, mit Preisen und Leistungen, die auf Unternehmenskunden abzielen. Die Kombination aus rekordbrechenden Benchmarks, autonomen KodierfÃĪhigkeiten und breiter Ökosystem-Integration signalisiert das Bestreben des Unternehmens, seine Wettbewerbsposition zu erhalten, wÃĪhrend die FÃĪhigkeiten von KI-Modellen bei den großen Anbietern konvergieren.

Die VerÃķffentlichung erfolgt etwa 11 Monate nach Gemini 2.0, was eine signifikante Komprimierung von Google’s VerÃķffentlichungs-Zeitplan darstellt, da der Wettbewerb in der KI-Branche intensiver wird.

Alex McFarland ist ein KI-Journalist und Schriftsteller, der die neuesten Entwicklungen im Bereich der kÞnstlichen Intelligenz erforscht. Er hat mit zahlreichen KI-Startups und VerÃķffentlichungen weltweit zusammengearbeitet.