AI-mallit ja alustat

GPT-2, Tekoälytekstigeneraattori Julkaistaan Kokonaisuudessaan

mm
Lisää Unite.AI suosikkilähteisiisi Google-palvelussa

Kuten TheNextWeb (TNW) raportoi, OpenAI, voittoa tavoittelematon organisaatio, joka on vastuussa useista tekoälyprojekteista, on juuri julkaissut lopullisen mallin suunnitellussa julkaisussa GPT-2:lle, tekstigeneraattorille, joka on herättänyt melkoisen keskustelun sen julkistamisesta helmikuussa.

OpenAI:n tutkimusraportin Language Models are Unsupervised Multitask Learners mukaan, GPT-2 käyttää koneoppimista luomaan uutta tekstiä rajoitetun syötteen perusteella. Tämä tarkoittaa, että käyttäjä voi kirjoittaa lauseen tai kaksi mistä tahansa aiheesta, ja tekoälygeneraattori luo tekstin, jolla on jokin suhde alkuperäiseen syötteeseen. Olennaisesti, kuten TNW toteaa, toisin kuin useimmat “tekstigeneraattorit”, se ei tulosta ennalta kirjoitettuja merkkijonoja. GPT-2 luo tekstin, jota ei aiemmin ollut olemassa.”

Scott B. Weingart, Carnegie Mellon Universityn kirjaston ohjelmajohtaja, esittää konkreettisen esimerkin twiitissään:

 

OpenAI oli aluksi huolissaan mahdollisista väärinkäytöistä, joten helmikuussa 2019 se päätti julkaista GPT-2:n neljässä osassa kahdeksan kuukauden aikana. Kuten he selittivät blogissaan, “Meidän huolenaiheemme väärinkäytön mahdollisuuksista johtuen emme julkaise koulutettua mallia. Vastuullisen julkaisun kokeiluna julkaisemme paljon pienemmän mallin tutkijoille kokeiltavaksi, sekä teknisen raportin.”

Kuten selitetään, täysi malli sisältää 1,5 miljardia parametreja. “Mitä enemmän parametreja malli on koulutettu, sitä “älykkäämmäksi” se näyttää – kuten ihmisillä, harjoittelu tekee täydelliseksi.”

TNW toteaa, että aluksi OpenAI julkaisi mallin, jossa oli 124 miljoonaa parametriä, minkä jälkeen seurasi julkaisut 355 ja 774 miljoonalla parametrilla. Heidän mukaansa jokainen iteraatio osoitti merkittävän parantumisen edellisiin iteraatioihin verrattuna.”

Väärinkäytön estämiseksi OpenAI julkaisi GPT-2:n havaintamallit, jotka ovat tarkoitettu “väärinkäytön ennaltaehkäisemiseen.” Heidän omien sanojensa mukaan blogikirjoituksessaan, nämä havaintamallit tarvitsevat vielä lisää työtä saavuttaakseen GPT-2:ssa tähän asti saavutetun laadun.

Kiinnostuneet voivat ladata GPT-2-mallin täältä Githubista, tarkastella mallikorttia täältä, ja lukea OpenAI:n blogikirjoituksen täältä.

n kääntäjä, tällä hetkellä freelancer-toimittaja/kirjailija/tutkija, joka keskittyy moderniin teknologiaan, tekoälyyn ja moderniin kulttuuriin.