AI-mallit ja alustat
GPT-2, Tekoälytekstigeneraattori Julkaistaan Kokonaisuudessaan
Kuten TheNextWeb (TNW) raportoi, OpenAI, voittoa tavoittelematon organisaatio, joka on vastuussa useista tekoälyprojekteista, on juuri julkaissut lopullisen mallin suunnitellussa julkaisussa GPT-2:lle, tekstigeneraattorille, joka on herättänyt melkoisen keskustelun sen julkistamisesta helmikuussa.
OpenAI:n tutkimusraportin Language Models are Unsupervised Multitask Learners mukaan, GPT-2 käyttää koneoppimista luomaan uutta tekstiä rajoitetun syötteen perusteella. Tämä tarkoittaa, että käyttäjä voi kirjoittaa lauseen tai kaksi mistä tahansa aiheesta, ja tekoälygeneraattori luo tekstin, jolla on jokin suhde alkuperäiseen syötteeseen. Olennaisesti, kuten TNW toteaa, toisin kuin useimmat “tekstigeneraattorit”, se ei tulosta ennalta kirjoitettuja merkkijonoja. GPT-2 luo tekstin, jota ei aiemmin ollut olemassa.”
Scott B. Weingart, Carnegie Mellon Universityn kirjaston ohjelmajohtaja, esittää konkreettisen esimerkin twiitissään:
What is a Panther but a young lion?
An entire corridor filled entirely with people screaming.
How’s this for a happy ending? pic.twitter.com/qvPTrs790N
— Scott B. Weingart (@scott_bot) 20. elokuuta 2019
If death, in some obscure and distant hour,
Strikes me still as I slept, if I yet dream:
Is that my peace with an eternity spent?
[…]
But I fear it will be no peace or rest
Until the stars give me the full glow of their light
To see all my cares and woes in an instant.Shit. pic.twitter.com/QRoi1C3rjj
— Scott B. Weingart (@scott_bot) 20. elokuuta 2019
OpenAI oli aluksi huolissaan mahdollisista väärinkäytöistä, joten helmikuussa 2019 se päätti julkaista GPT-2:n neljässä osassa kahdeksan kuukauden aikana. Kuten he selittivät blogissaan, “Meidän huolenaiheemme väärinkäytön mahdollisuuksista johtuen emme julkaise koulutettua mallia. Vastuullisen julkaisun kokeiluna julkaisemme paljon pienemmän mallin tutkijoille kokeiltavaksi, sekä teknisen raportin.”
Kuten selitetään, täysi malli sisältää 1,5 miljardia parametreja. “Mitä enemmän parametreja malli on koulutettu, sitä “älykkäämmäksi” se näyttää – kuten ihmisillä, harjoittelu tekee täydelliseksi.”
TNW toteaa, että aluksi OpenAI julkaisi mallin, jossa oli 124 miljoonaa parametriä, minkä jälkeen seurasi julkaisut 355 ja 774 miljoonalla parametrilla. Heidän mukaansa jokainen iteraatio osoitti merkittävän parantumisen edellisiin iteraatioihin verrattuna.”
Väärinkäytön estämiseksi OpenAI julkaisi GPT-2:n havaintamallit, jotka ovat tarkoitettu “väärinkäytön ennaltaehkäisemiseen.” Heidän omien sanojensa mukaan blogikirjoituksessaan, nämä havaintamallit tarvitsevat vielä lisää työtä saavuttaakseen GPT-2:ssa tähän asti saavutetun laadun.
Kiinnostuneet voivat ladata GPT-2-mallin täältä Githubista, tarkastella mallikorttia täältä, ja lukea OpenAI:n blogikirjoituksen täältä.












