AI-modeller og plattformer
GPT-2, kunstig intelligens tekstgenerator utgis i sin helhet
Som TheNextWeb (TNW) rapporterer, OpenAI, den non-profit organisasjonen bak flere kunstig intelligens-prosjekter, har nettopp publisert den endelige modellen i den planlagte trinvis utgivelsen av GPT-2, en tekstgenerator som har forårsaket en del debatt siden den ble annonsert i februar.
Basert på OpenAI sine forskningsrapporter med tittelen Language Models are Unsupervised Multitask Learners, ”GPT-2 bruker maskinlæring til å generere nye tekstbasert på begrenset innputt.” Det betyr at en bruker kan skrive inn en setning eller to om et tema, og AI-generatoren vil komme opp med en tekst som har noen relasjon til den opprinnelige innputten. I essensen, som TNW påpeker, til forskjell fra de fleste ”tekstgeneratorer” utsteder den ikke forhånds skrevne strenger. GPT-2 lager tekst som ikke tidligere har eksistert.”
I en tweet, gir Scott B. Weingart, programdirektør ved Carnegie Mellon University Libraries, et konkrekt eksempel:
What is a Panther but a young lion?
En hel korridor fylt med mennesker som skriker.
How’s this for a happy ending? pic.twitter.com/qvPTrs790N
— Scott B. Weingart (@scott_bot) 20. august 2019
If death, in some obscure and distant hour,
Strikes me still as I slept, if I yet dream:
Is that my peace with an eternity spent?
[…]
But I fear it will be no peace or rest
Until the stars give me the full glow of their light
To see all my cares and woes in an instant.Skitt. pic.twitter.com/QRoi1C3rjj
— Scott B. Weingart (@scott_bot) 20. august 2019
OpenAI var opprinnelig bekymret for mulige skadelige bruk av deres system, så i februar 2019 bestemte de seg for å utgi GPT-2 i fire deler over åtte måneder. Som de forklarte i deres blogg, “På grunn av våre bekymringer om skadelige anvendelser av teknologien, utgir vi ikke den trente modellen. Som et eksperiment i ansvarlig åpenhet, utgir vi i stedet en mye mindre modell for forskere å eksperimentere med, samt en teknisk rapport.”
Som forklart, den fullstendige modellen inneholder 1,5 milliarder parametre. “Jo flere parametre en modell er trent med, jo ”smartere” ser den ut til å være – akkurat som mennesker, øving gjør perfekt.”
TNW påpeker at OpenAI opprinnelig utga en modell med 124 millioner parametre, etterfulgt av utgivelser med 355 og 774 millioner. Ifølge dem, etter å ha testet de utgitte modellene, ”viste hver iterasjon en betydelig forbedring i evne sammenlignet med tidligere iterasjoner.”
For å forhindre misbruk utga OpenAI GPT-2 detekteringsmodeller som er ment ”å forebygge misbruk.” Ifølge deres eget innrømmelse i en blogginnlegg, trenger disse detekteringsmodellene fortsatt arbeid for å nå det kvalitetsnivået som er oppnådd så langt i GPT-2 selv.
De som er interesserte kan laste ned GPT-2 modellen her på Github, se modellkortet her, og lese OpenAI sitt blogginnlegg her.












