Modele i platformy AI
GPT-2, generator tekstu sztucznej inteligencji, jest wydany w peÅnej wersji
Jak donosi TheNextWeb (TNW), OpenAI, organizacja non-profit zaÅoÅžona przez szereg projektÃģw sztucznej inteligencji, opublikowaÅa ostateczny model w planowanej stopniowej publikacji GPT-2, generatora tekstu, ktÃģry wywoÅaÅ duÅžÄ debatÄ od momentu ogÅoszenia jego premiery w lutym.
Na podstawie pracy badawczej OpenAI zatytuÅowanej Language Models are Unsupervised Multitask Learners, âGPT-2 wykorzystuje uczenie maszynowe do generowania nowych tekstÃģw na podstawie ograniczonego wejÅcia.â To oznacza, Åže uÅžytkownik moÅže wpisaÄ zdanie lub dwa na dowolny temat, a generator AI wygeneruje tekst, ktÃģry ma jakiÅ zwiÄ zek z oryginalnym wejÅciem. W istocie, jak zauwaÅža TNW, w przeciwieÅstwie do wiÄkszoÅci âgeneratorÃģw tekstuâ, nie generuje on wczeÅniej napisanych ciÄ gÃģw. GPT-2 tworzy tekst, ktÃģry wczeÅniej nie istniaÅ.â
W swoim tweecie Scott B. Weingart, dyrektor programu w Carnegie Mellon University Libraries, podaje konkretny przykÅad:
What is a Panther but a young lion?
An entire corridor filled entirely with people screaming.
Howâs this for a happy ending? pic.twitter.com/qvPTrs790N
â Scott B. Weingart (@scott_bot) 20 sierpnia 2019
If death, in some obscure and distant hour,
Strikes me still as I slept, if I yet dream:
Is that my peace with an eternity spent?
[âĶ]
But I fear it will be no peace or rest
Until the stars give me the full glow of their light
To see all my cares and woes in an instant.Shit. pic.twitter.com/QRoi1C3rjj
â Scott B. Weingart (@scott_bot) 20 sierpnia 2019
Â
OpenAI poczÄ tkowo obawiaÅo siÄ moÅžliwych niepoÅžÄ danych zastosowaÅ swojego systemu, wiÄc w lutym 2019 zdecydowaÅo siÄ opublikowaÄ GPT-2 w czterech czÄÅciach w ciÄ gu oÅmiu miesiÄcy. Jak wyjaÅnili w swoim blogu, âZe wzglÄdu na nasze obawy dotyczÄ ce niepoÅžÄ danych zastosowaÅ tej technologii, nie publikujemy wytrenowanego modelu. Jako eksperyment w odpowiedzialnym ujawnianiu, publikujemy znacznie mniejszy model dla badaczy do eksperymentowania, a takÅže pracÄ technicznÄ .â
Jak wyjaÅniono, peÅny model zawiera 1,5 miliarda parametrÃģw. âIm wiÄcej parametrÃģw model jest wytrenowany, tym âmÄ drzejszyâ siÄ wydaje â tak jak ludzie, Äwiczenie czyni doskonaÅym.â
TNW zauwaÅža, Åže poczÄ tkowo OpenAI opublikowaÅo model z 124 milionami parametrÃģw, a nastÄpnie modele z 355 i 774 milionami. WedÅug nich, po przetestowaniu opublikowanych modeli, âkaÅžda iteracja wykazaÅa znacznÄ poprawÄ moÅžliwoÅci w porÃģwnaniu z poprzednimi iteracjami.â
Aby zapobiec naduÅžyciom, OpenAI opublikowaÅo modele wykrywania GPT-2, ktÃģre sÄ âprzeznaczone do prewencyjnego zwalczania naduÅžyÄ.â W swoim blogu przyznajÄ , Åže te modele wykrywania nadal wymagajÄ dodatkowej pracy, aby osiÄ gnÄ Ä poziom jakoÅci, jaki zostaÅ dotychczas osiÄ gniÄty w samym GPT-2.
Zainteresowani mogÄ pobraÄ model GPT-2 tutaj na Github, sprawdziÄ kartÄ modelu tutaj, oraz przeczytaÄ blog OpenAI tutaj.












