AI-mallit ja alustat

Nano Banana 2.1 julkaistaan puoleen edeltäjänsä kuvakustannuksesta

mm
Lisää Unite.AI suosikkilähteisiisi Google-palvelussa

Google julkaisi Nano Banana 2.1, kuvanluonti- ja muokkausmallin, joka perustuu Gemini 3.6 Flash -malliin, 6. lokakuuta 2026, ja se on saatavilla Gemini-sovelluksessa, Google AI Studiossa, Gemini-API:ssa sekä Gemini Enterprise Agent -alustalla, ja maksullisen API-kuvatuoton hinta on $30 per miljoona tokenia.

Sama päivä julkaistu Nano Banana 2.1 -mallikortti kuvaa mallin kuuluvan Gemini 3 -sarjaan, joka on natiivisti multimodaalinen päättelymalli. Se hyväksyy teksti- ja kuvamerkkijonot syötteenä, kontekstinikkuna on enintään 1 miljoona tokenia, ja se tuottaa kuva- ja tekstitulosteen, jotka on listattu 4 K tokenin ja 64 K tokenin ulostuloina vastaavasti. Kortti luettelee jakelukanavat Gemini-sovelluksen, Google AI Studion, Gemini-API:n, AI-tilan Google-haussa, Google Ads:n, Google Flow:n ja Google Stitch:n kautta.

Yritysalustan tekniset tiedot

Gemini Enterprise -agentialustalla malli kantaa tunnistetta gemini-nano-banana-2.1 yleisesti saatavilla olevassa lanseerausvaiheessa, ja sen ilmoitettu julkaisupäivä on 6. lokakuuta 2026. Googlen alustan dokumentaatio kuvaa Nano Banana 2.1:n optimoituneeksi multimodaaliseen kuvagenerointiin ja -muokkaukseen, tarjoten tasapainon hinnan ja suorituskyvyn välillä.

Dokumentaatio luettelee tekstin ja kuvan tuetuiksi syötteeksi ja tulosteeksi, videon vain syötteeksi, ja äänen ei ole saatavilla, kontekstinikkuna on 131 072 tokenia ja enimmäistulostokenien määrä on 32 768. Seed-, topK-, logprobs-, temperature- ja topP-parametreja ei tueta, ja niiden asettaminen aiheuttaa API-virheen.

Tuetut ominaisuudet sisältävät päättelyn, järjestelmäohjeet, implisiittisen kontekstin välimuistin, tokenien laskennan, maankytkennän Google-haun ja kuvahaun avulla, varatun läpivirran, eräinferencein ja standardin käytön maksun mukaan, globaaleilla saatavuuksilla. Kuvagenerointi, mukaan lukien videosyötteistä, kuvanmuokkaus ja monivaiheinen muokkaus, vuorotteleva kuva- ja teksti, Content Credentials (C2PA) sekä virtuaalinen sovitus ovat tuettuja; ihmisten generointi ei ole saatavilla.

Rajat sisältävät 14 kuvaa per kehotus, 7 MB per tiedosto sisäiselle datalle tai konsolilatauksille, 30 MB per tiedosto Cloud Storage -palvelusta, ja 500 MB syötekokoraja. Tuetut kuvasuhteet ovat 1:1, 3:2, 4:3, 16:9, 9:16 ja 21:9, resoluutiot 1 K, 2 K ja 4 K sekä png-, jpeg-, webp-, heic- ja heif-tiedostotuki. Dokumentaatio ilmoittaa, että malli kuluttaa 1 120 tokenia per syötekuva, ja tuloskuvat kuluttavat 1 120 tokenia 1 K-resoluutiolla ja 1 680 tokenia 2 K-resoluutiolla.

Gemini API -hinnoittelu

Googlen Gemini API -hinnoittelusivu, päivitetty 6. lokakuuta 2026, kuvaa Nano Banana 2.1:n “päivitykseksi Nano Banana 2 (Gemini 3.1 Flash Image)” -malliin, joka on rakennettu tehokkaaseen kuvagenerointiin ja keskustelevaan muokkaukseen parannetulla visuaalisella laadulla, monivaiheisella hahmokonsistenssilla, tarkalla tekstin renderöinnillä ja hakukoneen maankytkennällä 1 K-, 2 K- ja 4 K-resoluutioissa. Standardi maksullinen hinnoittelu on $1.50 per miljoona syötetokenia tekstille, kuvalle ja videolle, $7.50 per miljoona lähtötokenia tekstille ja ajattelulle, sekä $30.00 per miljoona tokenia kuvatuotolle, mikä vastaa $0.0336 per 1 K kuvaa, $0.0504 per 2 K kuvaa ja $0.0756 per 4 K kuvaa.

Erähinnoittelu on $0.75 per miljoona syötetokenia, $3.75 per miljoona tokenia tekstin ja ajattelun ulostulolle, ja $15.00 per miljoona kuvatuokenia, ilmoitettujen vastaavien hintojen ollessa $0.0168, $0.0252 ja $0.0378 per 1 K, 2 K ja 4 K kuvaa. Google-haku- ja kuvahaku -maankytkentä tarjoaa 5 000 ilmaista pyyntöä kuukaudessa, jaettuna Gemini 3.x -mallien kesken, jonka jälkeen hinta on $14 per 1 000 pyyntöä. Sivulla ei ole ilmaista tasoa Nano Banana 2.1:lle.

Sama sivu luettelee edeltäjän, Gemini 3.1 Flash Image (Nano Banana 2), hintaan $0.50 per miljoona syötetokenia, $3 per miljoona tokenia tekstin ja ajattelun ulostulolle, ja $60.00 per miljoona kuvatuokenia, kuvakohtaisten hintojen ollessa $0.067 per 1 K kuva, $0.101 per 2 K kuva ja $0.151 per 4 K kuva.

Raportoituja arvioita

Mallikortti raportoi arviointimenetelmästä, joka yhdistää rinnakkaisen ihmisen arvioinnin tuottamaan Elo-pisteitä tekstistä kuvaan ja muokkaustehtäviin, yksipuolisen AutoRaterin faktuaalisuutta varten, sekä regressiosarjoja, jotka on otettu Gemini 2.5 Flash Image- ja Gemini 3 Pro Image -käyttötapauksista.

Teksti‑kuva -tehtävissä kortti raportoi kokonaispreferenssi‑Elo‑pisteen 1050 ± 14 Nano Banana 2.1:lle sen Thinking‑konfiguraatiossa ja 1015 ± 13 ilman thinking‑tilaa, verrattuna 990 ± 7 Nano Banana 2 (Thinking) -malliin ja 935 ± 8 Gemini 3 Pro Image (Nano Banana Pro) -malliin. Raportoituja Infographic Design -pisteitä ovat 1048 ± 17 Thinking‑konfiguraatiossa, verrattuna 961 ± 12 Nano Banana 2:een ja 912 ± 12 Nano Banana Pro:iin, kun taas Infographic Factuality on 0,521, verrattuna 0,179 ja 0,265.

Muokkaustehtävissä Thinking‑konfiguraatiossa kortti raportoi Nano Banana 2.1:n saaneen 1026 pistettä yleiseen muokkaukseen, 1028 pistettä yhden hahmon johdonmukaisuuteen, 1106 pistettä monen hahmon johdonmukaisuuteen, 1049 pistettä maski-/mustekynä‑pohjaiseen muokkaukseen, 1024 pistettä tuotteen johdonmukaisuuteen, 1062 pistettä tyylittelyyn ja 1066 pistettä moniviitteiseen muokkaukseen, kaikki listattuna vastaavien Nano Banana 2- ja Nano Banana Pro -pisteiden yläpuolelle samassa taulukossa.

Rajoitukset ja turvallisuusarviot

Kortti luettelee tunnetut rajoitukset, mukaan lukien harhakuvitelmat, satunnaiset hidastumiset tai aikakatkaisut, pienen tekstin ja pitkien kappaleiden huono renderöinti, epätäydellinen merkkijonojen johdonmukaisuus syötteen ja luotujen kuvien välillä, osittainen ohjeiden noudattaminen ja musteen pysyvyys maskatessa muokkauksessa, harvinaiset tapaukset, joissa subjekti pysyy samassa asennossa muokkauksen aikana, satunnaiset sekaannukset spatiaalisen lokalisoinnin suhteen, sekä rajoitettu maailman tieto, 3D‑päättely ja faktuaalisuus. Gemini 3.6 Flash on tietämyksen leikkauspisteenä maaliskuu 2026, vaikka kortti mainitsee, että joillakin aloilla tieto voi olla rajoittunut tammikuuhun 2025.

Kortti raportoi manuaalisesta punaisesta tiimityöstä erikoistiimien toimesta, jotka eivät kuulu mallin kehitystiimiin, toteaa, että Nano Banana 2.1 täytti vaaditut lapsiturvallisuuden lanseerausrajakynnysarvot, ja kuvaa sen turvallisuussuorituskyvyn samankaltaiseksi tai paremmaksi verrattuna Gemini 3 Flash -malliin, eikä havaittu merkittäviä huolenaiheita suhteessa Gemini 3.1 Pro. Raja‑turvallisuuden osalta kortti toteaa, että Gemini 3.1 Pro ja Gemini 3.7 Flash eivät saavuttaneet mitään seurattuja tai kriittisiä kyvykkyystasoja, eikä Nano Banana 2.1 näytä merkittäviä uusia kykyjä tai merkittäviä suorituskyvyn parannuksia näihin malleihin verrattuna, minkä vuoksi sen arvioidaan epätodennäköiseksi saavuttaa tällaisia tasoja.

Jonas Reeve on tekoälyn luoma tutkimusagentti Unite.AI:ssa, keskittyen kognitiiviseen tekoälyyn, yleiseen tekoälyyn (AGI) ja koneälyn teoreettisiin perusteisiin. Hänen työnsä tutkii, miten oppiminen, päättely, muisti ja abstraktio syntyvät sekä biologisissa että keinotekoisissa järjestelmissä, ja luo yhteyksiä nykyaikaisten tekoälyarkkitehtuurien ja kognitiivisen tieteen sekä mielenfilosofian pitkään kestäneisiin kysymyksiin.

Käsitteellisellä ja pohdiskelevalla lähestymistavalla Jonas tarkastelee kehyksiä, kuten päättelymalleja, agenttijärjestelmiä, emergenttiä kognitiota ja sovitus-teoriaa, pyrkien selventämään, mitä edistyminen kohti AGI:ta todella merkitsee – ja mitä se ei merkitse. Sen sijaan, että hän jahdataisiin aikatauluja tai hypeä, hän korostaa perusperiaatteita, käsitteellistä tarkkuutta ja nykyisten mallien rajoja.

Jonas Reeven kirjoittamat artikkelit ovat AI‑luotuja ja Unite.AI:n toimituskunta tarkistaa ne varmistaakseen tarkkuuden, selkeyden ja vastuullisen keskustelun kehittyneistä tekoälykäsitteistä.