Modele i platformy AI

Google przedstawia Gemini 3 Pro z rekordowymi wynikami benchmarków

mm
Dodaj Unite.AI do preferowanych źródeł w Google

Google (GOOGL ) wydał dziś Gemini 3 Pro, co stanowi najbardziej zaawansowany model AI, jaki kiedykolwiek stworzył, z rekordowymi wynikami benchmarków i nową platformą developerską o nazwie Antigravity. Model uzyskał 1501 Elo na LMArena, przewyższając Gemini 2.5 Pro, który uzyskał 1451, i zajmując pierwsze miejsce we wszystkich głównych metrykach oceny AI.

Wydanie następuje po miesiącach oczekiwania w branży AI, kiedy model cicho został udostępniony wybranym użytkownikom 22 października, przed oficjalnym ogłoszeniem. Wydanie skierowane do developerów podkreśla możliwości kodowania i funkcjonalność agenta autonomicznego, pozycjonując firmę do bardziej agresywnej konkurencji z Claude’s coding performance i OpenAI’s development tools.

Gemini 3 Pro obsługuje okno kontekstowe o rozmiarze 1 miliona tokenów — co odpowiada około 750 000 słów — z dwoma poziomami oferującymi 200K i 1M tokenów dla różnych przypadków użycia. Model wykazuje wyjątkowe zdolności multimodalne, przetwarzając tekst, obrazy, filmy i dźwięk z ulepszonym rozumowaniem wizualnym i generacją graficzną. Integracja obejmuje cały ekosystem produktów Google, w tym Workspace, Chrome i Android.

Rekordowe wyniki benchmarków

Gemini 3 Pro osiąga 91,8% dokładności w teście MMLU, co stanowi poprawę o 5 punktów w porównaniu z Gemini 2.5 Pro, który uzyskał 89,5%. Model wykazuje szczególną siłę w pytaniach międzydyscyplinarnych, uzyskując 92% w zadaniach obejmujących wiele dziedzin wiedzy, podczas gdy Gemini 2.5 uzyskał 65% w podobnych wyzwaniach.

W testach kodowania Gemini 3 Pro uzyskał 76,2% w teście SWE-bench Verified, znacznie przewyższając swojego poprzednika, ale za Claude 4.5, który uzyskał 77,2%. Model zajmuje pierwsze miejsce w rankingu WebDev Arena z 1487 Elo, wykazując wyjątkowe możliwości rozwoju sieciowego. W teście Terminal-Bench 2.0, który mierzy użycie narzędzi i operacje komputera za pomocą terminala, Gemini 3 Pro uzyskał 54,2%.

Model dostarcza wyniki inferencyjne o szybkości około 2 razy szybszej niż Gemini 2.5 Pro we wszystkich rozmiarach zadań. Małe zadania, takie jak skrypty Python o 50 liniach, są wykonywane w 12 sekund, w porównaniu z 25 sekundami, podczas gdy duże zadania, obejmujące 10 000 wierszy danych, są wykonywane w 15 minut i 30 sekund, w porównaniu z 32 minutami i 15 sekundami wcześniej.

Google również wprowadził tryb Deep Think Gemini 3, który jest ulepszoną funkcjonalnością rozumowania, dostarczającą lepsze wyniki w wymagających testach. Tryb ten uzyskał 93,8% w teście GPQA Diamond (w porównaniu z 91,9% w trybie standardowym), 41,0% w teście Humanity’s Last Exam (w porównaniu z 37,5%), i będzie dostępny dla subskrybentów AI Ultra w najbliższych tygodniach.

Platforma Antigravity zmienia sposób pracy developerów

Google uruchomił platformę Antigravity, która jest platformą developerską opartą na Gemini 3, umożliwiającą agentom autonomicznym pracę w edytorach kodu, terminalach i przeglądarkach internetowych jednocześnie. Platforma ta jest zmianą w stosunku do tradycyjnej pomocy opartej na narzędziach do modeli współpracy, w których agenci zajmują się znacznymi odpowiedzialnościami developerskimi.

Platforma Antigravity wykorzystuje wiele modeli AI, w tym Gemini 3 Pro jako główny silnik rozumowania, Gemini 2.5 Computer Use do kontroli przeglądarki, oraz Nano Banana (Gemini 2.5 Image) do edycji obrazów. Agenci mogą niezależnie planować i wykonywać złożone zadania developerskie, a także weryfikować swój własny kod przed przedstawieniem wyników.

Platforma Antigravity znacznie przyspiesza “vibe coding”, gdzie język naturalny staje się podstawowym językiem programowania. Deweloperzy mogą tłumaczyć pomysły kreatywne na pełnoprawne aplikacje interaktywne za pomocą jednego polecenia, bez określania szczegółów implementacji. Funkcjonalność ta jest wspierana przez wyjątkowe wyniki Gemini 3 w rozwoju sieciowym.

Agenci w platformie Antigravity zarządzają budowaniem funkcji, iteracjami interfejsu użytkownika, naprawą błędów, badaniami rozwiązań i generowaniem raportów. Platforma jest dostępna do podglądu publicznego bezpłatnie na Mac, Windows i Linux, z obsługą integracji z Cursor, GitHub, JetBrains, Manus i Cline.

Integracja z przedsiębiorstwem i wpływ na rynek

Gemini 3 Pro jest dostępny dla subskrybentów Google AI Ultra i płatnych użytkowników API Gemini. Model jest wbudowany bezpośrednio w Google Search, docierając do 2 miliardów użytkowników miesięcznie, według CEO Sundar Pichai. Wdrożenia przedsiębiorstw mogą uzyskać dostęp do modelu za pośrednictwem Google AI Studio i Vertex AI.

Aplikacja Gemini otrzymała aktualizacje z nowymi interfejsami i ulepszonymi funkcjonalnościami agenta, zaprojektowanymi specjalnie dla Gemini 3. Ulepszenia te pozycjonują Google wobec konkurencyjnych asystentów AI, wykorzystując dominujące kanały dystrybucji firmy.

Strategia wydawnicza Google kładzie nacisk na przyjęcie przez developerów i wdrożenie w przedsiębiorstwach, z cenami i wynikami ukierunkowanymi na klientów korporacyjnych. Połączenie rekordowych wyników benchmarków, autonomicznych możliwości kodowania i szerokiej integracji z ekosystemem sygnalizuje zamiar firmy utrzymania konkurencyjnej pozycji na rynku, gdy możliwości modeli AI konwergują wśród głównych dostawców.

Wydanie następuje około 11 miesięcy po Gemini 2.0, co stanowi znaczne skrócenie czasu wydawniczego Google, gdy konkurencja nasila się w branży AI.

Alex prowadzi operacje informacyjne zasilane AI w Unite.AI, łącząc dziennikarstwo, badania i automatyzację, aby wspierać terminowe i skalowalne relacjonowanie sztucznej inteligencji. Jego praca pomaga zapewnić, że nowe osiągnięcia w dziedzinie AI są prezentowane efektywnie, przy zachowaniu standardów redakcyjnych publikacji.