Modely a platformy AI
GPT-2, umělá inteligence textového generátoru je vydána v plném rozsahu
Jak TheNextWeb (TNW) uvádí, OpenAI, nezisková organizace za několika projekty umělé inteligence, právě vydala konečnou verzi plánovaného uvolnění GPT-2, textového generátoru, který vyvolal velkou debatu od jeho oznámeného vydání v únoru.
Na základě výzkumné práce OpenAI s názvem Language Models are Unsupervised Multitask Learners, „GPT-2 používá strojové učení k generování nových textů na základě omezeného vstupu.” To znamená, že uživatel může zadat jeden nebo dva věty na jakékoli téma a generátor umělé inteligence vyprodukuje text, který má nějakou souvislost s původním vstupem. V podstatě, jak TNW poznamenává, na rozdíl od většiny „textových generátorů” nevydává předem napsané řetězce. GPT-2 vytváří text, který předtím neexistoval.”
V svém tweetu Scott B. Weingart, programový ředitel Carnegie Mellon University Libraries, uvádí konkrétní příklad:
What is a Panther but a young lion?
An entire corridor filled entirely with people screaming.
How’s this for a happy ending? pic.twitter.com/qvPTrs790N
— Scott B. Weingart (@scott_bot) 20. srpna 2019
If death, in some obscure and distant hour,
Strikes me still as I slept, if I yet dream:
Is that my peace with an eternity spent?
[…]
But I fear it will be no peace or rest
Until the stars give me the full glow of their light
To see all my cares and woes in an instant.Shit. pic.twitter.com/QRoi1C3rjj
— Scott B. Weingart (@scott_bot) 20. srpna 2019
OpenAI se zpočátku obávala možného zneužití svého systému, a proto v únoru 2019 rozhodla o uvolnění GPT-2 ve čtyřech částech během osmi měsíců. Jak vysvětlila ve svém blogu, „Due to our concerns about malicious applications of the technology, we are not releasing the trained model. As an experiment in responsible disclosure, we are instead releasing a much smaller model for researchers to experiment with, as well as a technical paper.”
Jak je vysvětleno, plná verze modelu obsahuje 1,5 miliardy parametrů. „Čím více parametrů má model, tím „chytlavější” se zdá – stejně jako u lidí, cvičení dělá dokonalé.”
TNW poznamenává, že zpočátku OpenAI vydala model s 124 miliony parametrů, následovaný vydáními s 355 a 774 miliony. Podle nich, po testování vydaných modelů, „každá iterace ukázala významné zlepšení oproti předchozím iteracím.”
Aby se zabránilo zneužití, OpenAI vydala detekční modely GPT-2, které jsou určeny „k předcházení zneužití.” Podle jejich vlastního přiznání v blogovém příspěvku, tyto detekční modely ještě potřebují další práci, aby dosáhly kvalitativní úrovně, kterou dosud GPT-2 sám o sobě dosáhl.
Ti, kteří jsou intéressováni, si mohou stáhnout model GPT-2 zde na Github, prohlédnout si kartu modelu zde, a přečíst si blogový příspěvek OpenAI zde.












