AI-modeller och plattformar

GPT-2, konstgjord intelligens textgenerator släpps i sin helhet

mm
Lägg till Unite.AI bland dina föredragna källor på Google

Som TheNextWeb (TNW) rapporterar, OpenAI, den icke-vinstdrivande organisationen bakom ett antal konstgjorda intelligensprojekt, har just publicerat den slutliga modellen i den planerade etappvis utgåvan av GPT-2, en textgenerator som har orsakat en hel del debatt sedan dess tillkännagivna utgivning i februari.

Baserat på OpenAI:s forskningsartikel med titeln Language Models are Unsupervised Multitask Learners, ”GPT-2 använder maskinlärning för att generera ny text baserat på begränsad inmatning.” Det betyder att en användare kan skriva in en mening eller två om något ämne och AI-generatoren kommer att skapa en text som har någon relation till den ursprungliga inmatningen. I själva verket, som TNW noterar, till skillnad från de flesta ”textgenereratorer” producerar den inte förskrivna strängar. GPT-2 skapar text som tidigare inte funnits.”

I sin tweet ger Scott B. Weingart, programdirektör för Carnegie Mellon University Libraries, ett konkret exempel:

 

OpenAI var initialt orolig för möjliga skadliga användningar av sitt system, så i februari 2019 beslutade de att släppa GPT-2 i fyra delar under åtta månader. Som de förklarade i sin blogg, ” “På grund av våra farhågor om skadliga tillämpningar av tekniken, släpper vi inte den tränade modellen. Som ett experiment i ansvarsfull avslöjande, släpper vi istället en mycket mindre modell för forskare att experimentera med, samt en teknisk rapport.”

Som förklarats, innehåller den fullständiga modellen 1,5 miljarder parametrar. ”Ju fler parametrar en modell tränas med, desto ”smartare” verkar den – precis som människor, övning ger färdighet.”

TNW noterar att initialt släppte OpenAI en modell med 124 miljoner parametrar, följt av utgåvor med 355 och 774 miljoner. Enligt dem visade varje iteration en betydande förbättring av förmåga jämfört med tidigare iterationer.

För att förhindra missbruk släppte OpenAI GPT-2-identifieringsmodeller som är tänkta att ”förebyggande bekämpa missbruk.” I enlighet med deras eget medgivande i en blogginlägg, behöver dessa identifieringsmodeller fortfarande ytterligare arbete för att nå den kvalitetsnivå som hittills uppnåtts i GPT-2 själv.

De som är intresserade kan ladda ner GPT-2-modellen här på Github, kolla in modellkortet här, och läsa OpenAI:s blogginlägg här.

Före detta diplomat och översättare för UN, för närvarande frilansjournalist/författare/forskare, med fokus på modern teknik, artificiell intelligens och modern kultur.