AI-modeller og plattformer

GPT-2, kunstig intelligens tekstgenerator utgis i sin helhet

mm
Legg til Unite.AI blant dine foretrukne kilder på Google

Som TheNextWeb (TNW) rapporterer, OpenAI, den non-profit organisasjonen bak flere kunstig intelligens-prosjekter, har nettopp publisert den endelige modellen i den planlagte trinvis utgivelsen av GPT-2, en tekstgenerator som har forårsaket en del debatt siden den ble annonsert i februar.

Basert på OpenAI sine forskningsrapporter med tittelen Language Models are Unsupervised Multitask Learners, ”GPT-2 bruker maskinlæring til å generere nye tekstbasert på begrenset innputt.” Det betyr at en bruker kan skrive inn en setning eller to om et tema, og AI-generatoren vil komme opp med en tekst som har noen relasjon til den opprinnelige innputten. I essensen, som TNW påpeker, til forskjell fra de fleste ”tekstgeneratorer” utsteder den ikke forhånds skrevne strenger. GPT-2 lager tekst som ikke tidligere har eksistert.”

I en tweet, gir Scott B. Weingart, programdirektør ved Carnegie Mellon University Libraries, et konkrekt eksempel:

 

OpenAI var opprinnelig bekymret for mulige skadelige bruk av deres system, så i februar 2019 bestemte de seg for å utgi GPT-2 i fire deler over åtte måneder. Som de forklarte i deres blogg, “På grunn av våre bekymringer om skadelige anvendelser av teknologien, utgir vi ikke den trente modellen. Som et eksperiment i ansvarlig åpenhet, utgir vi i stedet en mye mindre modell for forskere å eksperimentere med, samt en teknisk rapport.”

Som forklart, den fullstendige modellen inneholder 1,5 milliarder parametre. “Jo flere parametre en modell er trent med, jo ”smartere” ser den ut til å være – akkurat som mennesker, øving gjør perfekt.”

TNW påpeker at OpenAI opprinnelig utga en modell med 124 millioner parametre, etterfulgt av utgivelser med 355 og 774 millioner. Ifølge dem, etter å ha testet de utgitte modellene, ”viste hver iterasjon en betydelig forbedring i evne sammenlignet med tidligere iterasjoner.”

For å forhindre misbruk utga OpenAI GPT-2 detekteringsmodeller som er ment ”å forebygge misbruk.” Ifølge deres eget innrømmelse i en blogginnlegg, trenger disse detekteringsmodellene fortsatt arbeid for å nå det kvalitetsnivået som er oppnådd så langt i GPT-2 selv.

De som er interesserte kan laste ned GPT-2 modellen her på Github, se modellkortet her, og lese OpenAI sitt blogginnlegg her.

Tidligere diplomat og oversetter for FN, nå frilans journalist/forfatter/forsker, med fokus på moderne teknologi, kunstig intelligens og moderne kultur.