AI-mallit ja alustat

Google julkisti Gemini 3 Pro:n, jossa on ennätysmäiset suorituskyvyn mittarit

mm
Lisää Unite.AI suosikkilähteisiisi Google-palvelussa

Google (GOOGL ) julkisti tänään Gemini 3 Pro:n, joka on edistynein AI-malli tähän mennessä ennätysmäisillä suorituskyvyn mittareilla ja uudella Antigravity-kehitysalustalla. Malli saa 1501 Elo:n tuloksen LMArenalla, joka ylittää Gemini 2.5 Pro:n 1451 tuloksen ja ottaa johtavan aseman suurten AI-arviointimittareiden joukossa.

Julkaisu seuraa kuukausien odotusta AI-teollisuudessa, ja malli on ollut hiljaisesti saatavilla valituille käyttäjille 22. lokakuuta ennen julkista ilmoitusta. Google:n kehittäjäkeskeinen julkaisu korostaa koodausominaisuuksia ja autonomisten agenttien toimintoja, jolloin yhtiö pystyy kilpailemaan aggressiivisemmin Claude:n koodausominaisuuksien ja OpenAI:n kehitystyökalujen kanssa.

Gemini 3 Pro tukee 1 miljoonan tokenin kontekstiuikkua, joka on noin 750 000 sanaa, ja tarjoaa kaksi tasoa, 200K ja 1M tokenia, eri käyttötarkoituksiin. Malli osoittaa poikkeuksellisia monimodaalisia kykyjä, prosessoiden tekstin, kuvat, videot ja äänen parannetulla visuaalisella päättelyllä ja grafiikan luomisella. Integraatio kattaa Google:n tuoteekosysteemin, mukaan lukien Workspace, Chrome ja Android.

Ennätysmäiset suorituskyvyn mittarit

Gemini 3 Pro saavuttaa 91,8 prosentin tarkin MMLU-benchmarkissa, joka on 5 prosentin parannus Gemini 2.5 Pro:n 89,5 prosenttiin. Malli osoittaa erityistä vahvuuksia monitieteellisissä kysymyksissä, saavuttaen 92 prosentin tuloksen tehtävissä, jotka kattavat useita tieteenaloja, kun taas Gemini 2.5 sai 65 prosentin vastaavissa haasteissa.

Koodauskohtaisissa benchmarkkeissa Gemini 3 Pro sai 76,2 prosentin tuloksen SWE-bench Verified -kokeessa, joka on merkittävä parannus edeltäjäänsä, mutta jää Claude 4.5:n 77,2 prosentin tuloksesta. Malli on WebDev Arena -liigan johtaja 1487 Elo:n tuloksella, osoittaen poikkeuksellisia web-kehityskykyjä. Terminal-Bench 2.0:ssa, joka mitata toolin käyttöä ja tietokoneen toimintaa terminaalin kautta, Gemini 3 Pro saavutti 54,2 prosentin tuloksen.

Malli toimii noin kaksi kertaa nopeammin kuin Gemini 2.5 Pro eri tehtävien koissa. Pienet tehtävät, kuten 50-riviset Python-koodit, valmistuvat 12 sekunnissa, kun taas suuret tehtävät, jotka sisältävät 10 000 tietoriviä, valmistuvat 15 minuutissa ja 30 sekunnissa, kun aiemmin ne valmistuivat 32 minuutissa ja 15 sekunnissa.

Google esitteli myös Gemini 3 Deep Think -tilan, joka on parannettu päättelykyky, joka tarjoaa paremman suorituskyvyn haastavissa benchmarkkeissa. Tila saa 93,8 prosentin tuloksen GPQA Diamond -kokeessa (91,9 prosenttia normaali tilassa), 41,0 prosentin tuloksen Humanity’s Last Exam -kokeessa (37,5 prosenttia normaali tilassa) ja tulee olemaan saatavilla AI Ultra -tilaajille tulevina viikkoina.

Antigravity-alusta muuttaa kehittäjien työjärjestelmiä

Google julkisti Antigravity-alustan, joka on kehittäjien kehitysalusta, joka perustuu Gemini 3:een ja mahdollistaa autonomisten agenttien toiminnan koodieditoreissa, terminaaleissa ja selaimissa samanaikaisesti. Alusta on siirtymä perinteisistä työkalupohjaisista avustajista yhteistyöhön perustuviin malleihin, joissa agentit hoitavat merkittäviä kehitysvastuita.

Antigravity hyödyntää useita AI-malleja, mukaan lukien Gemini 3 Pro pääasiallisena päättelymoottorina, Gemini 2.5 Computer Use selainohjaukseen ja Nano Banana (Gemini 2.5 Image) kuvankäsittelyyn. Agentit voivat suunnitella ja suorittaa itsenäisesti monimutkaisia kehitystehtäviä ja vahvistaa oman koodinsa ennen tuloksien esittämistä.

Alusta vauhdittaa “vibe-koodausta“, jossa luonnollinen kieli on ensisijainen syntaksi. Kehittäjät voivat kääntää korkean tason luovia ideoita täysin interaktiivisiksi sovelluksiksi yhdellä käskyllä ilman toteutusyksityisten määrittelyä. Tämä toiminto on tuettu Gemini 3:n poikkeuksellisilla web-kehitystuloksilla.

Agentit Antigravity-alustalla hallinnoivat itsenäisesti ominaisuuksien rakentamista, UI-iteraatiota, virheenkorjausta, ratkaisujen tutkimusta ja raporttien luomista. Alusta on saatavilla julkisessa esikatselussa ilman maksua Mac-, Windows- ja Linux-alustoille, ja se tukee integraatiota Cursor-, GitHub-, JetBrains-, Manus- ja Cline-työkalujen kanssa.

Yritysintegraatio ja markkinavaikutus

Gemini 3 Pro on saatavilla Google AI Ultra -tilaajille ja maksullisten Gemini API -käyttäjille. Malli upotetaan suoraan Google-hakuun, jolloin se tavoittaa yhtiön 2 miljardia kuukausittaista AI-katselijaa, kuten toimitusjohtaja Sundar Pichai on ilmoittanut. Yritysasiakkaiden käyttöön malli on saatavilla Google AI Studio- ja Vertex AI -palvelun kautta.

Gemini-sovellus sai päivityksiä, jotka sisälsivät uudet käyttöliittymät ja parannetut agenttitoiminnot, jotka on suunniteltu erityisesti Gemini 3:lle. Nämä parannukset asemoittavat Googlea kilpailijoiden AI-avustajien rinnalle hyödyntäen yhtiön johtavaa jakelukanavaa.

Google:n julkaisustrategia korostaa kehittäjien omaksumista ja yritysasiakkaiden käyttöönottoa, ja hinnoittelu ja suorituskyky on suunniteltu yritysasiakkaiden tarpeisiin. Yhdistelmä ennätysmittareista, autonomisista koodausominaisuuksista ja laajasta ekosysteemistä integraatiosta osoittaa yhtiön aikomusta ylläpitää kilpailukykyään AI-mallien kykyjen yhdistyessä suurten toimittajien välillä.

Julkaisu tapahtuu noin 11 kuukauden kuluttua Gemini 2.0:n julkaisusta, mikä on merkittävä tiivistys Google:n julkaisuaikatauluun kilpailun kiihtyessä AI-teollisuudessa.

Alex McFarland on AI-toimittaja ja kirjailija, joka tutkii viimeisimpiä kehityksiä tekoälyssä. Hän on tehnyt yhteistyötä useiden AI-startup-yritysten ja julkaisujen kanssa maailmanlaajuisesti.