AI-modeller och plattformar

OpenAI släpper kommersiell version av berömd textgenereringsmodell

mm
Lägg till Unite.AI bland dina föredragna källor på Google

Den artificiella intelligensforskningslabben OpenAI kommer att göra sin berömda textgenereringverktyg GPT-3 tillgänglig för köp, vilket markerar den första kommersiella produkten som producerats av maskinlärningsnon-profiten.

I februari förra året gjorde OpenAI sin textgenereringsmodell GPT-2 öppen källkod. GPT-2 kunde generera imponerande sammanhängande text när den gavs en kort prompt, och modellen ansågs vara ett betydande steg framåt inom områdena naturlig språkbehandling och artificiell intelligens. I själva verket vägrade OpenAI initialt att släppa GPT-2-modellen, med hänsyn till att den var för farlig för en öppen källkodsrelease, och fruktade missbruk. Men efter att en version av modellen hade varit tillgänglig under en tid, och den ideella organisationen rapporterade att de inte hade sett några bevis på skadligt användande, togs beslutet att göra modellen öppen källkod. Alldeles nyligen meddelade OpenAI uppföljaren till GPT-2, som kallas GPT-3.

GPT-3-modellen är ungefär 100 gånger större än sin föregångare, och det är denna modell som de erbjuder som en kommersiell produkt. GPT-2-modellen bestod av cirka 1,5 miljarder parametrar, medan GPT-3 består av cirka 175 miljarder parametrar. Den sofistikerade och tillförlitliga GPT-modellserien har orsakat att modellerna konvergerar mot att bli standarden för maskinlärningsprojekt som involverar text. Liksom hur konvolutionsneuronnät har blivit standardmodellen för bildrelaterade projekt, använder textrelaterade projekt alltmer GPT-2, och kanske snart GPT-3.

Enligt The Verge verkar det som om OpenAI hoppas på att driva adoptionen av en GPT-standard framåt genom att göra sin GPT-3-modell kommersiellt tillgänglig. För närvarande är åtkomst till GPT-3 API inbjuden endast. Men detta är troligen bara en testkörning, och det verkar sannolikt att GPT-3 kommer att göras mer allmänt tillgänglig snart. OpenAI har uttalat att de kommer att granska kunderna av deras modeller för att förhindra missbruk av tekniken för oetiska användningar som spam, skapande av desinformation eller trakasserier.

Det är ganska oklart exakt hur GPT-3 är tänkt att användas av kunder. Detta beror troligen på att GPT-3 är så flexibel och har så många potentiella tillämpningar. GPT-baserade modeller kan finjusteras efter behov för att generera text som är lämplig för specifika uppgifter. Modellen kan anpassa sig till en mängd olika prompter och inmatningsstilar, vilket innebär att den kan användas för att skapa textsammanfattningar, svara på enkla frågor eller fungera som grund för en sofistikerad chatbot. Som OpenAI:s chefs tekniska officer Greg Brockman förklarade för Wired:

“Den stora mentala förändringen är att det är mycket mer som att prata med en människa än att formatera saker för en maskin”, säger Greg Brockman, OpenAI:s chefs tekniska officer. “Du ger den några frågor och svar, och plötsligt är den i fråge- och svarsläge.”

Det är okänt hur tillförlitliga de kommersiella modellerna som härrör från GPT-3 kommer att vara. Medan GPT-3 kan generera syntaktiskt korrekt, naturligt ljudande språk, saknar den en intuitiv förståelse av den verkliga världen och hur begrepp relaterar till varandra. Detta kan visa sig vara problematiskt för användningar där bevarande av sammanhang är särskilt viktigt, såsom chatbotar som är utformade för kundsupport.

Joe Davison, en forskningsingenjör på Hugging Face, uttryckte till Digital Trends att den renodlade storleken på GPT-3 kan begränsa dess potentiella användningar. Davison hävdade att medan OpenAI har avsevärt förbättrat tillståndet inom textgenerering, och visat att skapandet av allmänna modeller kan minska behovet av uppgiftsspecifik data, gör de beräkningsresurser som krävs för att använda GPT-3 det ganska opraktiskt för många företag.

OpenAI var tidigare en ideell organisation, men sedan 2019 har labbet skiftat till en vinstinriktad modell. GPT-3 är den första stora kommersiella produkten som producerats av labbet, och det återstår att se om övergången till en vinstinriktad modell kommer att förändra OpenAI:s forskningsprioriteringar.

Blogger och programmerare med specialområden inom Machine Learning och Deep Learning ämnen. Daniel hoppas på att hjälpa andra att använda kraften från AI för socialt väl.