Modele i platformy AI

GPT-2, generator tekstu sztucznej inteligencji, jest wydany w pełnej wersji

mm
Dodaj Unite.AI do preferowanych źródeł w Google

Jak donosi TheNextWeb (TNW), OpenAI, organizacja non-profit założona przez szereg projektów sztucznej inteligencji, opublikowała ostateczny model w planowanej stopniowej publikacji GPT-2, generatora tekstu, który wywołał dużą debatę od momentu ogłoszenia jego premiery w lutym.

Na podstawie pracy badawczej OpenAI zatytułowanej Language Models are Unsupervised Multitask Learners, „GPT-2 wykorzystuje uczenie maszynowe do generowania nowych tekstów na podstawie ograniczonego wejścia.” To oznacza, że użytkownik może wpisać zdanie lub dwa na dowolny temat, a generator AI wygeneruje tekst, który ma jakiś związek z oryginalnym wejściem. W istocie, jak zauważa TNW, w przeciwieństwie do większości „generatorów tekstu”, nie generuje on wcześniej napisanych ciągów. GPT-2 tworzy tekst, który wcześniej nie istniał.”

W swoim tweecie Scott B. Weingart, dyrektor programu w Carnegie Mellon University Libraries, podaje konkretny przykład:

 

OpenAI początkowo obawiało się możliwych niepożądanych zastosowań swojego systemu, więc w lutym 2019 zdecydowało się opublikować GPT-2 w czterech częściach w ciągu ośmiu miesięcy. Jak wyjaśnili w swoim blogu, „Ze względu na nasze obawy dotyczące niepożądanych zastosowań tej technologii, nie publikujemy wytrenowanego modelu. Jako eksperyment w odpowiedzialnym ujawnianiu, publikujemy znacznie mniejszy model dla badaczy do eksperymentowania, a także pracę techniczną.”

Jak wyjaśniono, pełny model zawiera 1,5 miliarda parametrów. „Im więcej parametrów model jest wytrenowany, tym „mądrzejszy” się wydaje – tak jak ludzie, ćwiczenie czyni doskonałym.”

TNW zauważa, że początkowo OpenAI opublikowało model z 124 milionami parametrów, a następnie modele z 355 i 774 milionami. Według nich, po przetestowaniu opublikowanych modeli, „każda iteracja wykazała znaczną poprawę możliwości w porównaniu z poprzednimi iteracjami.”

Aby zapobiec nadużyciom, OpenAI opublikowało modele wykrywania GPT-2, które są „przeznaczone do prewencyjnego zwalczania nadużyć.” W swoim blogu przyznają, że te modele wykrywania nadal wymagają dodatkowej pracy, aby osiągnąć poziom jakości, jaki został dotychczas osiągnięty w samym GPT-2.

Zainteresowani mogą pobrać model GPT-2 tutaj na Github, sprawdzić kartę modelu tutaj, oraz przeczytać blog OpenAI tutaj.

Były dyplomata i tłumacz dla UN, obecnie wolny strzelec/journalista/pisarz/badacz, koncentrujący się na nowoczesnej technologii, sztucznej inteligencji i nowoczesnej kulturze.