AI-modeller och plattformar
Nano Banana 2.1 lanseras med halva bildkostnaden jämfört med föregångaren

Google släppte Nano Banana 2.1, en bildgenererings- och redigeringsmodell baserad på Gemini 3.6 Flash, den 6 oktober 2026, med tillgänglighet via Gemini‑appen, Google AI Studio, Gemini‑API:t och Gemini Enterprise Agent Platform samt betald API‑bildutmatning prissatt till $30 per miljon token.
Det Nano Banana 2.1 modellkort, som publicerades samma dag, beskriver modellen som en medlem av Gemini 3‑serien av inbyggt multimodala resonemangsmodeller. Den accepterar textsträngar och bilder som indata med ett kontextfönster på upp till 1 miljon token, och den genererar bild- och textutdata, listade med respektive 4 K‑token‑ och 64 K‑token‑utdata. Kortet listar distribution via Gemini‑appen, Google AI Studio, Gemini‑API:t, AI‑läge i Google Search, Google Ads, Google Flow och Google Stitch.
Specifikationer för företagsplattformen
På Gemini Enterprise Agent Platform har modellen identifieraren gemini-nano-banana-2.1 i den allmänt tillgängliga lanseringsfasen, med ett angivet releasedatum den 6 oktober 2026. Googles plattformdokumentation beskriver Nano Banana 2.1 som optimerad för multimodal bildgenerering och redigering, och erbjuder en balans mellan pris och prestanda.
Dokumentationen listar text och bild som stöd för in- och utdata, video som endast indata och ljud som otillgängligt, med ett kontextfönster på 131 072 token och maximalt 32 768 utdata‑token. Parametrarna seed, topK, logprobs, temperature och topP stöds inte, och om någon av dem anges returneras ett API‑fel.
Stödda funktioner inkluderar resonemang, systeminstruktioner, implicit kontextcachning, tokenräkning, förankring med Google Search och bildsökning, tilldelad genomströmning, batch‑inferens och standard pay‑as‑you‑go, med global tillgänglighet. Bildgenerering, inklusive från videoinmatning, bildredigering och flerstegsredigering, växelvis bild och text, Content Credentials (C2PA) och virtuell provning stöds; generering av personer är otillgänglig.
Begränsningarna inkluderar 14 bilder per prompt, 7 MB per fil för inline‑data eller konsoluppladdningar, 30 MB per fil från Cloud Storage och en maximal indata‑storlek på 500 MB. Stödda bildförhållanden är 1:1, 3:2, 4:3, 16:9, 9:16 och 21:9, med 1 K, 2 K och 4 K‑upplösningar samt stöd för png, jpeg, webp, heic och heif‑filer. Dokumentationen anger att modellen förbrukar 1 120 token per inmatningsbild, med utdata‑bilder som förbrukar 1 120 token vid 1 K‑upplösning och 1 680 token vid 2 K.
Gemini API‑prissättning
Googles Gemini API-prissida, uppdaterad den 6 oktober 2026, beskriver Nano Banana 2.1 som “en uppdatering av Nano Banana 2 (Gemini 3.1 Flash Image)” och är byggd för hög‑effektiv bildgenerering och konversationell redigering med förbättrad visuell kvalitet, flerstegs karaktärskonsekvens, exakt textrendering och sökförankrad generering över 1 K, 2 K och 4 K‑upplösningar. Standard betald‑nivåprissättning listas till $1.50 per miljon indata‑token för text, bild och video, $7.50 per miljon utdata‑token för text och tänkande, och $30.00 per miljon token för bildutdata, vilket sidan motsvarar $0.0336 per 1K‑bild, $0.0504 per 2K‑bild och $0.0756 per 4K‑bild.
Batch‑prissättning listas till $0.75 per miljon indata‑token, $3.75 per miljon token för text‑ och tänkande‑utdata, och $15.00 per miljon bild‑token, med angivna motsvarigheter på $0.0168, $0.0252 och $0.0378 per 1K-, 2K- och 4K‑bild respektive. Förankring med Google web‑ och bildsökning ger 5 000 gratisförfrågningar per månad som delas över Gemini 3.x‑modeller, därefter $14 per 1 000 förfrågningar. Sidan listar ingen gratis‑nivå‑åtkomst för Nano Banana 2.1.
Samma sida listar föregångaren, Gemini 3.1 Flash Image (Nano Banana 2), till $0.50 per miljon indata‑token, $3 per miljon token för text‑ och tänkande‑utdata, och $60.00 per miljon bild‑token, med per‑bild‑motsvarigheter på $0.067 vid 1K, $0.101 vid 2K och $0.151 vid 4K.
Rapporterade utvärderingar
Modellkortet rapporterar en utvärderingsmetod som kombinerar sida‑vid‑sida‑mänsklig utvärdering som ger Elo‑poäng över text‑till‑bild‑ och redigeringsuppgifter, en enkelriktad AutoRater för faktualitet, samt regressionsuppsättningar hämtade från Gemini 2.5 Flash Image och Gemini 3 Pro Image‑användningsfall.
För text‑till‑bild rapporterar kortet en Overall Preference‑Elo på 1050 ± 14 för Nano Banana 2.1 i dess Thinking‑konfiguration och 1015 ± 13 utan thinking, jämfört med 990 ± 7 för Nano Banana 2 (Thinking) och 935 ± 8 för Gemini 3 Pro Image (Nano Banana Pro). Rapporterade Infographic Design‑poäng är 1048 ± 17 för Thinking‑konfigurationen, jämfört med 961 ± 12 för Nano Banana 2 och 912 ± 12 för Nano Banana Pro, medan Infographic Factuality anges till 0.521, jämfört med 0.179 och 0.265.
För redigering i Thinking‑konfigurationen rapporterar kortet Nano Banana 2.1 med 1026 för General Editing, 1028 för Single‑Character Consistency, 1106 för Multi‑Character Consistency, 1049 för Mask/Ink‑Based Editing, 1024 för Product Consistency, 1062 för Stylization och 1066 för Multi‑Reference Editing, var och en listade över de motsvarande Nano Banana 2‑ och Nano Banana Pro‑poängen i samma tabell.
Begränsningar och säkerhetsbedömningar
Kortet listar kända begränsningar inklusive hallucinationer, tillfällig långsamhet eller time‑outs, dålig återgivning av liten text och långa stycken, bristande teckenkonsekvens mellan indata och genererade bilder, partiell följsamhet av instruktioner och bläckpersistence i maskerad redigering, sällsynta fall av bestående subjektpose under redigering, ibland förvirring kring rumslig lokalisering, samt begränsad världskunskap, 3D‑resonemang och faktualitet. Gemini 3.6 Flash har ett kunskapsstopp i mars 2026, även om kortet noterar att kunskapen i vissa domäner kan vara begränsad till januari 2025.
Kortet rapporterar manuell röd‑teamning av specialistteam utanför modellutvecklingsteamet, anger att Nano Banana 2.1 uppfyllde de nödvändiga barnsäkerhetsgränserna för lansering, och beskriver dess säkerhetsprestation som liknande eller förbättrad jämfört med Gemini 3 Flash, utan några grova bekymmer i förhållande till Gemini 3.1 Pro. För frontiersäkerhet anger kortet att Gemini 3.1 Pro och Gemini 3.7 Flash inte nådde några spårade eller kritiska kapabilitetsnivåer och att Nano Banana 2.1 inte visar några meningsfulla nya kapabiliteter eller materiella prestandaökningar jämfört med dessa modeller, vilket leder till att den bedöms som osannolik att nå sådana nivåer.












