Моделі та платформи ШІ
GPT-2, штучний інтелект текст-генератор повністю випущений
Як повідомляє TheNextWeb (TNW), OpenAI, некомерційна організація, яка стоїть за численними проектами штучного інтелекту,刚 опублікувала остаточну модель у плановому етапному випуску для GPT-2, текстового генератора, який викликав досить велику дискусію з моменту його оголошення у лютому.
На основі дослідницької праці OpenAI під назвою Language Models are Unsupervised Multitask Learners, “GPT-2 використовує машинне навчання для генерації нових текстів на основі обмеженого вводу.” Це означає, що користувач може ввсти кілька речень про будь-яку тему, а генератор штучного інтелекту створить текст, який має певну відношення до вихідного вводу. По суті, як зазначає TNW, на відміну від більшості “текстових генераторів” він не виводить попередньо написані рядки. GPT-2 створює текст, який раніше не існував.”
У своєму твіті Скотт Б. Вейнгарт, директор програми університетської бібліотеки Карнегі-Меллон, наводить конкретний приклад:
What is a Panther but a young lion?
An entire corridor filled entirely with people screaming.
How’s this for a happy ending? pic.twitter.com/qvPTrs790N
— Scott B. Weingart (@scott_bot) 20 серпня 2019
If death, in some obscure and distant hour,
Strikes me still as I slept, if I yet dream:
Is that my peace with an eternity spent?
[…]
But I fear it will be no peace or rest
Until the stars give me the full glow of their light
To see all my cares and woes in an instant.Shit. pic.twitter.com/QRoi1C3rjj
— Scott B. Weingart (@scott_bot) 20 серпня 2019
OpenAI спочатку була стурбована можливим зловживанням своєї системи, тому у лютому 2019 року вирішила випустити GPT-2 у чотирьох частинах протягом восьми місяців. Як вони пояснили у своєму блозі, “Через нашу стурбованість щодо зловживання технологією, ми не випускаємо навчену модель. Як експеримент у відповідальному розкритті, ми випускаємо значно меншу модель для дослідників, а також технічну працю.”
Як пояснюється, повна модель містить 1,5 млрд параметрів. “Чим більше параметрів має модель, тим ‘розумнішою’ вона здається – як і люди, практика робить досконалішим.”
TNW зазначає, що спочатку OpenAI випустила модель з 124 млн параметрів, згодом випустила моделі з 355 і 774 млн параметрів. За їхніми словами, після тестування випущених моделей “кожна ітерація показала значне покращення можливостей порівняно з попередніми ітераціями.”
Для запобігання зловживанню OpenAI випустила моделі виявлення GPT-2, які мають “попереджувально боротися з зловживанням.” За їхнім власним зізнанням у блозі, ці моделі виявлення ще потребують додаткової роботи, щоб досягти рівня якості, досягнутого на даний момент у GPT-2 самому.
Ті, хто цікавиться, можуть завантажити модель GPT-2 тут на Github, переглянути карту моделі тут, і прочитати блог-пост OpenAI тут.












