AI-mallit ja alustat

OpenAI julkaisee ChatGPT Images 2.5 -version Sketch-ominaisuudella ja kahdella uudella API-mallilla

mm
Lisää Unite.AI suosikkilähteisiisi Google-palvelussa

OpenAI julkaisi ChatGPT Images 2.5 8. syyskuuta 2026, kutsuen sitä yhtiön uudeksi huippuluokan kuvamalliksi, ja lisäsi kaksi kumppanimallia API:insa. OpenAI:n mukaan ihmiset luovat yli 3 miljardia kuvaa viikossa ChatGPT Imagesin ja API:n GPT-Image -mallien avulla.

Terävämpiä kuvia ja uudet luontityökalut

OpenAI:n mukaan Images 2.5 tuottaa luonnollisempaa valaistusta ja rikkaampia tekstuureja, säilyttää käyttäjien referenssikuvista otettavat kohteet paremmin ja noudattaa muokkausohjeita luotettavammin useiden keskustelukierrosten aikana. Yhtiö kertoi vähentäneensä kuvageneroinnin viiveen jopa 50 % verrattuna Images 2.0:aan.

OpenAI totesi, että malli on parempi muuttamaan vain ne elementit, joita käyttäjä pyytää muokkaamaan, jättäen muun kuvan koskemattomaksi, vaikka kohteet ja taustat olisivat monimutkaisia. Se myös renderöi todellista maailmaa kuvaavia tietoja tarkemmin, käsittelee monimutkaisempia asetteluja, kuten läpinäkyviä taustoja, ja säilyttää pyydetyt visuaaliset tyylit johdonmukaisemmin. Pitkissä keskusteluissa yhtiö sanoi, että aikaisemmat muokkaukset todennäköisemmin säilyvät ja jokainen uusi ohje rakentuu edellisen työn päälle heikentämättä kuvan laatua.

API‑kehittäjille OpenAI totesi, että sama tarkkuus tekee referenssipohjaisista työnkuluista luotettavampia ja mahdollistaa yhden elementin, kuten tuotteen, taustan tai tekstirivin, päivittämisen säilyttäen ympäröivän kohteen, sommittelun ja brändin ilmeen.

Mallin ohella OpenAI esitteli Sketch‑ominaisuuden, jonka avulla käyttäjät voivat piirtää suoraan ChatGPT:ssä visuaalisena viitteenä lopulliselle kuvalle kirjoittamalla chatissa “@Sketch”. Uudet mallipohjat tarjoavat lähtökohdat suosituille formaateille, kuten esitteille ja tuotekuville, ja niissä on nimettyjä vaihtoehtoja kuten “Poster” ja “Merch”. Käyttäjät voivat myös lisätä kommentteja suoraan luotuihin kuviin tarkempaa muokkausta varten, sekä jakaa kuvan takana olevan kehotteen, jotta muut voivat toteuttaa idean omilla valokuvillaan ja tiedoillaan.

Images 2.5 otetaan käyttöön kaikille ChatGPT-, ChatGPT Work- ja Codex‑käyttäjille kaikilla tasoilla työpöytä-, mobiili- ja verkkoympäristöissä.

Flare ja Sunburst API:ssa

Kehittäjille OpenAI julkaisi API:ssa kaksi kuvamallia. GPT-Image-2.5 Flare tuo samat laatu-, muokkaus- ja nopeusparannukset, ja yhtiö asettaa sen oletusvalinnaksi useimmille sovelluksille; OpenAI kertoi, että se tuottaa korkealaatuisempia kuvia kuin GPT-Image-2 50 % pienemmällä viiveellä, sopien käyttötarkoituksiin luovan ja sosiaalisen sisällön tuottamisesta tuotekokemuksiin, visuaaliseen hakuun, nopeaan kuvaprototyyppiin ja suurten määrien generointiin. GPT-Image-2.5 Sunburst on suunniteltu premium‑visuaalisiin työnkulkuihin, jotka hyötyvät tiukemmasta muokkauskontrollista, kuten tuotantovalmiista kampanjamateriaaleista ja hiotusta tuotekuvastosta, mutta vaativat pidemmän generointiajan.

OpenAI julkaisi kolmen varhaisen asiakkaan lausunnot julkaisun yhteydessä. Matt Chotin, Adobe‑yrityksen senior product director, totesi, että OpenAI:n GPT-Image-2.5 -mallit ovat nyt saatavilla Adobe Fireflyssa, Adobe:n luovassa AI‑studiossa. Manus‑tiimin arvioijasta Lucky Liao kertoi, että Flare tuotti korkealaatuisia kuvia kahdesta neljään kertaan nopeammin kuin GPT-Image-2 tiimin arvioissa, korostaen parantunutta läpinäkyvien taustojen generointia. Axultan Alimkulov, Higgsfield AI:n tuotepäällikkö, sanoi mallin säilyttävän alkuperäisen kuvan luonteen, sommittelun ja visuaalisen identiteetin muokkausten aikana.

OpenAI:n hinnoittelusivu listaa molemmat mallit samoilla hinnoilla: kuvan syöte $8,00 per 1 M tokenia, tai $2,00 per 1 M tokenia välimuistissa, kuvan lähtö $30,00 per 1 M tokenia, ja tekstisyöte $5,00 per 1 M tokenia, tai $1,25 välimuistissa. Sivulla Sunburstia kuvataan työnkulkuihin, joissa muokkaustarkkuus on tärkeintä, ja Flarea OpenAI:n nopeimmaksi malliksi korkealaatuiseen, jokapäiväiseen kuvagenerointiin.

Turvallisuusarvioinnit ja alkuperä

OpenAI julkaisi myös järjestelmäkortin julkaisulle 8. syyskuuta 2026. Kortissa todetaan, että GPT-Image-2.5‑Sunburst ja GPT-Image-2.5‑Flare on koulutettu monipuolisilla aineistoilla, jotka kattavat julkisesti saatavilla olevaa internet‑tietoa, kolmansien osapuolten kumppanuuksien kautta saatua dataa sekä käyttäjien ja ihmiskouluttajien tarjoamaa tai tuottamaa materiaalia, suodatuksella, jonka tarkoitus on vähentää henkilökohtaisia tietoja, ja turvallisuusluokittimilla, jotka pyrkivät rajoittamaan haitallista tai arkaluonteista sisältöä. Siinä huomautetaan, että lisääntynyt realismi voisi ilman suojatoimia mahdollistaa vakuuttavampia deepfake‑kuvia todellisista ihmisistä, paikoista tai tapahtumista, mikä rikkoo OpenAI:n käyttöpolitiikkaa.

Kortti kuvaa kerroksellisen turvallisuuspinon: LLM‑pohjaiset politiikkatarkastukset hylkäävät rikovat pyynnöt ennen generoinnin aloitusta, ja sen jälkeen turvallisuus­päättelymalli moderoi teksti‑ ja kuva‑syötteet sekä tarkastaa lopulliset tuotokset ennen näyttämistä, estäen generoinnin, jos jokin rikkoo politiikkaa.

OpenAI:n automatisoiduissa vastustajatutkimuksissa, joissa käytettiin kehotteita, joilla pyrittiin saamaan aikaan politiikkarikkoja sisältäviä kuvia kaikissa seuratuissa turvallisuuskategorioissa, lopullisten epäturvallisten generointien osuus oli 1,09 % Sunburstille ja 1,41 % Flarelle, verrattuna 1,64 % peruslinjaan ChatGPT Images 2.0:ssa. Kortti varoittaa, että vastustajatestijoukko ei edusta tuotantoliikennettä, että automatisoidut politiikkatunnisteet voivat sisältää virheitä, ja että havainnot koskevat ainoastaan testijoukkoa ja arvioituja kokoonpanoja.

OpenAI:n Preparedness Frameworkin, joka seuraa biologisia ja kemiallisia, kyberturvallisuus‑ ja AI‑itsensäkehitysriskien, mukaan kortti raportoituu, että kumpikaan malli ei ylitä Bio High‑ tai Cyber High‑kynnystä. OpenAI totesi silti soveltavansa ennaltaehkäiseviä biologisia riskinhallintatoimia, kuten kuva‑kohtainen biologinen turvallisuuspolitiikka, joka toteutetaan turvallisuus­päättelymallin kautta, reaaliaikainen esto syöte‑ ja lähtötasoilla, offline‑tarkastus, jossa yhdistetään automatisoidut järjestelmät ihmisen tarkistajiin, sekä tilien jäädyttämiset, kun jatkuvia väärinkäyttökuvioita havaitaan.

Alkuperästä kortti kertoo, että OpenAI jatkaa C2PA‑metatietojen käyttöä C2PA Conformance -ohjelman kautta ja lisää Google DeepMindin SynthID‑näkymättömän vesileiman ChatGPT:hen, Codexiin ja OpenAI‑API:in.

Jonas Reeve on tekoälyanalyytikko Unite.AI:ssa, joka keskittyy kognitiiviseen tekoälyyn, tekoälyyn ja tekoälyjärjestelmien teoreettisiin perusteisiin. Hänen työnsä tutkii, miten oppiminen, päättely, muisti ja abstraktio ilmenevät sekä biologisissa että tekoälyjärjestelmissä, ja piirtää yhteyksiä modernien tekoälyarkkitehtuureiden ja kognitiivisen tieteen ja mielen filosofian pitkäaikaisiin kysymyksiin.
Konseptuaalisella ja refleksiivisellä lähestymistavalla Jonas tutkii kehyksiä, kuten päättelymalleja, agenteja, emergenttiä kognitiota ja suuntautumisteoriaa, pyrkien selventämään, mitä edistystä tekoälyssä tarkalleen ottaen tarkoittaa - ja mitä se ei tarkoita. Sen sijaan, että hän ajaisi aikatauluja tai hypeä, hän korostaa ensisijaisia periaatteita, konseptuaalista tarkkuutta ja nykyisten mallien rajoja.
Jonas Reeven kirjoittamat artikkelit ovat tekoälygeneroituja ja Unite.AI:n toimituksen tarkastamia, jotta varmistetaan ettei artikkeleissa käsitellä tekoälykonsepteja epätarkasti tai vastuuttomasti.