Modele i platformy AI

Google przedstawia Gemini 3 Pro z rekordowymi wynikami benchmarkÃģw

mm
Dodaj Unite.AI do preferowanych ÅšrÃģdeł w Google

Google (GOOGL ) wydał dziś Gemini 3 Pro, co stanowi najbardziej zaawansowany model AI, jaki kiedykolwiek stworzył, z rekordowymi wynikami benchmarkÃģw i nową platformą developerską o nazwie Antigravity. Model uzyskał 1501 Elo na LMArena, przewyÅžszając Gemini 2.5 Pro, ktÃģry uzyskał 1451, i zajmując pierwsze miejsce we wszystkich głÃģwnych metrykach oceny AI.

Wydanie następuje po miesiącach oczekiwania w branÅžy AI, kiedy model cicho został udostępniony wybranym uÅžytkownikom 22 paÅšdziernika, przed oficjalnym ogłoszeniem. Wydanie skierowane do developerÃģw podkreśla moÅžliwości kodowania i funkcjonalność agenta autonomicznego, pozycjonując firmę do bardziej agresywnej konkurencji z Claude’s coding performance i OpenAI’s development tools.

Gemini 3 Pro obsługuje okno kontekstowe o rozmiarze 1 miliona tokenÃģw — co odpowiada około 750 000 słÃģw — z dwoma poziomami oferującymi 200K i 1M tokenÃģw dla rÃģÅžnych przypadkÃģw uÅžycia. Model wykazuje wyjątkowe zdolności multimodalne, przetwarzając tekst, obrazy, filmy i dÅšwięk z ulepszonym rozumowaniem wizualnym i generacją graficzną. Integracja obejmuje cały ekosystem produktÃģw Google, w tym Workspace, Chrome i Android.

Rekordowe wyniki benchmarkÃģw

Gemini 3 Pro osiąga 91,8% dokładności w teście MMLU, co stanowi poprawę o 5 punktÃģw w porÃģwnaniu z Gemini 2.5 Pro, ktÃģry uzyskał 89,5%. Model wykazuje szczegÃģlną siłę w pytaniach międzydyscyplinarnych, uzyskując 92% w zadaniach obejmujących wiele dziedzin wiedzy, podczas gdy Gemini 2.5 uzyskał 65% w podobnych wyzwaniach.

W testach kodowania Gemini 3 Pro uzyskał 76,2% w teście SWE-bench Verified, znacznie przewyÅžszając swojego poprzednika, ale za Claude 4.5, ktÃģry uzyskał 77,2%. Model zajmuje pierwsze miejsce w rankingu WebDev Arena z 1487 Elo, wykazując wyjątkowe moÅžliwości rozwoju sieciowego. W teście Terminal-Bench 2.0, ktÃģry mierzy uÅžycie narzędzi i operacje komputera za pomocą terminala, Gemini 3 Pro uzyskał 54,2%.

Model dostarcza wyniki inferencyjne o szybkości około 2 razy szybszej niÅž Gemini 2.5 Pro we wszystkich rozmiarach zadań. Małe zadania, takie jak skrypty Python o 50 liniach, są wykonywane w 12 sekund, w porÃģwnaniu z 25 sekundami, podczas gdy duÅže zadania, obejmujące 10 000 wierszy danych, są wykonywane w 15 minut i 30 sekund, w porÃģwnaniu z 32 minutami i 15 sekundami wcześniej.

Google rÃģwnieÅž wprowadził tryb Deep Think Gemini 3, ktÃģry jest ulepszoną funkcjonalnością rozumowania, dostarczającą lepsze wyniki w wymagających testach. Tryb ten uzyskał 93,8% w teście GPQA Diamond (w porÃģwnaniu z 91,9% w trybie standardowym), 41,0% w teście Humanity’s Last Exam (w porÃģwnaniu z 37,5%), i będzie dostępny dla subskrybentÃģw AI Ultra w najbliÅžszych tygodniach.

Platforma Antigravity zmienia sposÃģb pracy developerÃģw

Google uruchomił platformę Antigravity, ktÃģra jest platformą developerską opartą na Gemini 3, umoÅžliwiającą agentom autonomicznym pracę w edytorach kodu, terminalach i przeglądarkach internetowych jednocześnie. Platforma ta jest zmianą w stosunku do tradycyjnej pomocy opartej na narzędziach do modeli wspÃģłpracy, w ktÃģrych agenci zajmują się znacznymi odpowiedzialnościami developerskimi.

Platforma Antigravity wykorzystuje wiele modeli AI, w tym Gemini 3 Pro jako głÃģwny silnik rozumowania, Gemini 2.5 Computer Use do kontroli przeglądarki, oraz Nano Banana (Gemini 2.5 Image) do edycji obrazÃģw. Agenci mogą niezaleÅžnie planować i wykonywać złoÅžone zadania developerskie, a takÅže weryfikować swÃģj własny kod przed przedstawieniem wynikÃģw.

Platforma Antigravity znacznie przyspiesza “vibe coding”, gdzie język naturalny staje się podstawowym językiem programowania. Deweloperzy mogą tłumaczyć pomysły kreatywne na pełnoprawne aplikacje interaktywne za pomocą jednego polecenia, bez określania szczegÃģłÃģw implementacji. Funkcjonalność ta jest wspierana przez wyjątkowe wyniki Gemini 3 w rozwoju sieciowym.

Agenci w platformie Antigravity zarządzają budowaniem funkcji, iteracjami interfejsu uÅžytkownika, naprawą błędÃģw, badaniami rozwiązań i generowaniem raportÃģw. Platforma jest dostępna do podglądu publicznego bezpłatnie na Mac, Windows i Linux, z obsługą integracji z Cursor, GitHub, JetBrains, Manus i Cline.

Integracja z przedsiębiorstwem i wpływ na rynek

Gemini 3 Pro jest dostępny dla subskrybentÃģw Google AI Ultra i płatnych uÅžytkownikÃģw API Gemini. Model jest wbudowany bezpośrednio w Google Search, docierając do 2 miliardÃģw uÅžytkownikÃģw miesięcznie, według CEO Sundar Pichai. WdroÅženia przedsiębiorstw mogą uzyskać dostęp do modelu za pośrednictwem Google AI Studio i Vertex AI.

Aplikacja Gemini otrzymała aktualizacje z nowymi interfejsami i ulepszonymi funkcjonalnościami agenta, zaprojektowanymi specjalnie dla Gemini 3. Ulepszenia te pozycjonują Google wobec konkurencyjnych asystentÃģw AI, wykorzystując dominujące kanały dystrybucji firmy.

Strategia wydawnicza Google kładzie nacisk na przyjęcie przez developerÃģw i wdroÅženie w przedsiębiorstwach, z cenami i wynikami ukierunkowanymi na klientÃģw korporacyjnych. Połączenie rekordowych wynikÃģw benchmarkÃģw, autonomicznych moÅžliwości kodowania i szerokiej integracji z ekosystemem sygnalizuje zamiar firmy utrzymania konkurencyjnej pozycji na rynku, gdy moÅžliwości modeli AI konwergują wśrÃģd głÃģwnych dostawcÃģw.

Wydanie następuje około 11 miesięcy po Gemini 2.0, co stanowi znaczne skrÃģcenie czasu wydawniczego Google, gdy konkurencja nasila się w branÅžy AI.

Alex McFarland jest dziennikarzem i pisarzem zajmującym się sztuczną inteligencją, ktÃģry bada najnowsze rozwoje w dziedzinie sztucznej inteligencji. WspÃģłpracował z licznymi startupami i wydawnictwami związanymi z sztuczną inteligencją na całym świecie.