Modele și platforme AI

GPT-2, generatorul de text cu inteligență artificială, este lansat în întregime

mm
Adaugă Unite.AI la sursele tale preferate pe Google

După cum raportează TheNextWeb (TNW), OpenAI, organizația non-profit din spatele mai multor proiecte de inteligență artificială, a publicat recent modelul final din lansarea planificată în etape pentru GPT-2, un generator de text care a stârnit o mare dezbatere de la anunțul lansării sale în februarie.

Pe baza lucrării de cercetare a OpenAI, intitulată Modelele de limbaj sunt învățători multitask nesupravegheați, „GPT-2 utilizează învățarea automată pentru a genera texte noi pe baza unor intrări limitate.” Ce înseamnă acest lucru este că un utilizator poate să tasteze o propoziție sau două despre orice subiect, iar generatorul de text va produce un text care are o anumită legătură cu intrarea inițială. În esență, după cum notează TNW, spre deosebire de majoritatea „generatorilor de text”, el nu produce șiruri de caractere pre-scrise. GPT-2 creează texte care nu au existat anterior.”

Într-un tweet, Scott B. Weingart, director de program al Bibliotecii Universității Carnegie Mellon, oferă un exemplu concret:

 

OpenAI a fost inițial îngrijorat de posibilele utilizări malefice ale sistemului său, așa că, în februarie 2019, a decis să lanseze GPT-2 în patru părți, pe parcursul a opt luni. Așa cum au explicat în blogul lor, „Din cauza îngrijorărilor noastre cu privire la aplicațiile malefice ale tehnologiei, nu vom lansa modelul antrenat. Ca un experiment în ceea ce privește divulgarea responsabilă, vom lansa în schimb un model mult mai mic pentru ca cercetătorii să poată experimenta, precum și o lucrare tehnică.”

Așa cum s-a explicat, modelul complet conține 1,5 miliarde de parametri. „Cu cât un model este antrenat cu mai mulți parametri, cu atât pare mai „deștept” – la fel ca oamenii, practica face perfect.”

TNW notează că inițial OpenAI a lansat un model cu 124 de milioane de parametri, urmat de lansări cu 355 și 774 de milioane de parametri. Conform lor, după testarea modelelor lansate, „fiecare iterație a arătat o îmbunătățire semnificativă a capacităților față de iterațiile anterioare.”

Pentru a preveni utilizările abuzive, OpenAI a lansat modele de detectare GPT-2 care sunt menite „să combată în mod preventiv utilizările abuzive.” Într-o postare pe blog, ei admit că aceste modele de detectare încă au nevoie de lucru suplimentar pentru a atinge nivelul de calitate realizat până acum în GPT-2 însuși.

Cei interesați pot descărca modelul GPT-2 aici de pe Github, să verifice cardul modelului aici și să citească postarea pe blog a OpenAI aici.

Foster diplomat și traducător pentru UN, în prezent jurnalist/scenarist/cercetător freelancer, axat pe tehnologia modernă, inteligența artificială și cultura modernă.