Моделі та платформи ШІ

GPT-2, штучний інтелект текст-генератор повністю випущений

mm
Додайте Unite.AI до бажаних джерел у Google

Як повідомляє TheNextWeb (TNW), OpenAI, некомерційна організація, яка стоїть за численними проектами штучного інтелекту,刚 опублікувала остаточну модель у плановому етапному випуску для GPT-2, текстового генератора, який викликав досить велику дискусію з моменту його оголошення у лютому.

На основі дослідницької праці OpenAI під назвою Language Models are Unsupervised Multitask Learners, “GPT-2 використовує машинне навчання для генерації нових текстів на основі обмеженого вводу.” Це означає, що користувач може ввсти кілька речень про будь-яку тему, а генератор штучного інтелекту створить текст, який має певну відношення до вихідного вводу. По суті, як зазначає TNW, на відміну від більшості “текстових генераторів” він не виводить попередньо написані рядки. GPT-2 створює текст, який раніше не існував.”

У своєму твіті Скотт Б. Вейнгарт, директор програми університетської бібліотеки Карнегі-Меллон, наводить конкретний приклад:

 

OpenAI спочатку була стурбована можливим зловживанням своєї системи, тому у лютому 2019 року вирішила випустити GPT-2 у чотирьох частинах протягом восьми місяців. Як вони пояснили у своєму блозі, “Через нашу стурбованість щодо зловживання технологією, ми не випускаємо навчену модель. Як експеримент у відповідальному розкритті, ми випускаємо значно меншу модель для дослідників, а також технічну працю.”

Як пояснюється, повна модель містить 1,5 млрд параметрів. “Чим більше параметрів має модель, тим ‘розумнішою’ вона здається – як і люди, практика робить досконалішим.”

TNW зазначає, що спочатку OpenAI випустила модель з 124 млн параметрів, згодом випустила моделі з 355 і 774 млн параметрів. За їхніми словами, після тестування випущених моделей “кожна ітерація показала значне покращення можливостей порівняно з попередніми ітераціями.”

Для запобігання зловживанню OpenAI випустила моделі виявлення GPT-2, які мають “попереджувально боротися з зловживанням.” За їхнім власним зізнанням у блозі, ці моделі виявлення ще потребують додаткової роботи, щоб досягти рівня якості, досягнутого на даний момент у GPT-2 самому.

Ті, хто цікавиться, можуть завантажити модель GPT-2 тут на Github, переглянути карту моделі тут, і прочитати блог-пост OpenAI тут.

Колишній дипломат і перекладач для ООН, зараз фріланс-журналіст/письменник/дослідник, зосереджений на сучасних технологіях, штучному інтелекті та сучасній культурі.