Modely a platformy AI

OpenAI vydá komerční verzi slavného modelu generování textu

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Výzkumná laboratoř umělé inteligence OpenAI bude nabízet ke koupi svou slavnou nástroj pro generování textu GPT-3, což bude první komerční produkt vyvinutý touto laboratoří strojového učení.

V únoru loňského roku OpenAI zpřístupnila svůj model generování textu GPT-2 jako open source. GPT-2 byl schopen generovat působivě srozumitelný text, když mu byl dán krátký podnět, a model byl považován za významný krok vpřed v oblastech zpracování přirozeného jazyka a umělé inteligence. Ve skutečnosti OpenAI最初 odmítla zveřejnit model GPT-2, tvrdila, že je příliš nebezpečný pro open-source vydání, obávala se zneužití. Nicméně, poté, co se verze modelu stala dostupnou po určitou dobu a nezisková organizace nezaznamenala žádné důkazy o zneužití, bylo rozhodnuto učinit model open source. Nedávno OpenAI oznámila nástupce GPT-2, nazvaný GPT-3.

Model GPT-3 je přibližně 100krát větší než jeho předchůdce a je to tento model, který nabízí jako komerční produkt. Model GPT-2 se skládal z přibližně 1,5 miliardy parametrů, zatímco GPT-3 se skládá z přibližně 175 miliard parametrů. Sofistikovanost a spolehlivost modelu GPT vedly k tomu, že se staly standardem pro projekty strojového učení související s textem. Stejně jako konvoluční neuronové sítě se staly výchozím modelem pro projekty související s obrazem, projekty související s textem stále více využívají GPT-2 a možná brzy i GPT-3.

Jak uvádí The Verge, OpenAI se zdá, že doufá, že bude moci podpořit přijetí standardu GPT tím, že učiní svůj model GPT-3 komerčně dostupným. V současné době je přístup k API GPT-3 pouze na pozvání. Nicméně, je pravděpodobné, že GPT-3 bude brzy dostupnější. OpenAI uvedla, že bude prověřovat zákazníky svých modelů, aby zabránila zneužití technologie pro neetické účely, jako je spamování, vytváření dezinformací nebo obtěžování.

Je poněkud nejasné, jak má být GPT-3 použit zákazníky. To je zřejmě proto, že GPT-3 je tak flexibilní a má tolik potenciálních aplikací. Modely založené na GPT lze upravit podle potřeby pro generování textu vhodného pro konkrétní úkoly. Model je schopen přizpůsobit se širokému spektru různých podnětů a vstupních stylů, což znamená, že by mohl být použit k vytvoření nástrojů pro souhrny textu, odpovědí na jednoduché otázky nebo jako základ pro sofistikovaného chatbota. Jak vysvětluje Greg Brockman, technický ředitel OpenAI, v rozhovoru pro Wired:

“Velký mentální posun spočívá v tom, že je to mnohem více jako mluvení s člověkem než formátování věcí pro stroj,” říká Greg Brockman, technický ředitel OpenAI. „Dejte mu několik otázek a odpovědí a najednou je v režimu otázek a odpovědí.”

Je neznámé, jak spolehlivé budou komerční modely odvozené od GPT-3. Zatímco GPT-3 může generovat syntakticky správný, přirozeně znějící jazyk, chybí mu intuitivní pochopení skutečného světa a toho, jak se pojmy vzájemně souvisí. To by mohlo být problematické pro použití, kde je zachování kontextu zvláště důležité, jako jsou chatboti navržené pro podporu zákazníků.

Joe Davison, výzkumný inženýr ve společnosti Hugging Face, uvedl pro Digital Trends, že velikost GPT-3 by mohla omezit jeho potenciální použití. Davison argumentoval, že zatímco OpenAI významně pokročila ve stavu umění generování textu, demonstrováním toho, že vytváření obecných modelů může snížit potřebu dat specifických pro úkoly, výpočetní zdroje požadované pro použití GPT-3 činí jej poměrně nepraktickým pro mnoho společností.

OpenAI byla dříve neziskovou organizací, ale od roku 2019 laboratoř přešla na model ziskový. GPT-3 je prvním hlavním komerčním produktem vyvinutým laboratoří a zůstává otázkou, zda přechod na ziskový model ovlivní výzkumné priority OpenAI.

Blogger a programátor se specializací na Machine Learning a Deep Learning témata. Daniel doufá, že pomůže ostatním využít sílu AI pro sociální dobro.