AI-modeller og platforme

OpenAI udgiver kommerciel version af berømt tekstgenereringsmodel

mm
Føj Unite.AI til dine foretrukne kilder på Google

Det kunstig intelligens-forskningslaboratorium OpenAI vil gøre deres berømte tekstgenereringsværktøj GPT-3 tilgængeligt til køb, hvilket markerer det første kommercielle produkt produceret af den maskinlæringsnon-profitorganisation.

I februar sidste år gjorde OpenAI deres tekstgenereringsmodel GPT-2 åben kilde. GPT-2 kunne generere imponerende sammenhængende tekst, når der blev givet en kort prompt, og modellen blev betragtet som et betydeligt skridt fremad i områderne naturlig sprogbehandling og kunstig intelligens. I virkeligheden havde OpenAI oprindeligt nægtet at udgive GPT-2-modellen, idet de hævdede, at den var for farlig til en åben kildeudgivelse, og frygtede misbrug. Men efter at en version af modellen havde været tilgængelig i en periode, og nonprofit-organisationen havde rapporteret, at de ikke havde set nogen beviser for ondsindet brug, blev der taget beslutning om at gøre modellen åben kilde. Meget nylig annoncerede OpenAI opfølgeren til GPT-2, kaldet GPT-3.

GPT-3-modellen er omtrent 100 gange større end dens forgænger, og det er denne model, som de tilbyder som et kommercielt produkt. GPT-2-modellen bestod af omtrent 1,5 milliarder parametre, mens GPT-3 består af omtrent 175 milliarder parametre. Sophistikationen og pålideligheden af GPT-modellserien har medført, at modellerne er blevet standarden for maskinlæringsprojekter, der involverer tekst. Ligesom convolutionelle neurale netværk er blevet standardmodellen for billedrelaterede projekter, er tekstrelaterede projekter i stigende grad ved at anvende GPT-2, og måske snart GPT-3.

Som rapporteret af The Verge, synes det, som om OpenAI håber at fremme overtagelsen af en GPT-standard ved at gøre deres GPT-3-model kommercielt tilgængelig. For øjeblikket er adgangen til GPT-3-API’en kun ved invitation. Men dette er sandsynligvis kun en testkørsel, og det ser ud til, at GPT-3 vil blive gjort mere bredt tilgængelig snart. OpenAI har erklæret, at de vil screene kunderne af deres modeller for at forhindre misbrug af teknologien til uetiske formål som spam, oprettelse af misinformation eller chikane.

Det er noget uklart, hvordan GPT-3 er tænkt til at blive brugt af kunderne. Dette skyldes sandsynligvis, at GPT-3 er så fleksibel og har så mange potentielle anvendelser. GPT-baserede modeller kan justeres efter behov for at generere tekst, der er egnet til bestemte opgaver. Modellen kan tilpasse sig en bred vifte af forskellige prompts og inputstilarter, hvilket betyder, at den kan bruges til at oprette tekstsummeringsværktøjer, besvare simple spørgsmål eller fungere som grundlag for en sofistikeret chatbot. Som OpenAI’s tekniske direktør Greg Brockman forklarede til Wired:

“Den store mentale skift er, at det er meget mere som at tale med et menneske end at formatere ting til en maskine,” siger Greg Brockman, OpenAI’s tekniske direktør. “Du giver det et par spørgsmål og svar, og pludselig er det i spørgsmål- og svar-tilstand.”

Det er ukendt, hvor pålidelig de kommercielle modeller, der er afledt af GPT-3, vil være. Mens GPT-3 kan generere syntaktisk korrekt, naturligt lydende sprog, mangler den en intuitiv forståelse af den virkelige verden og, hvordan begreber relaterer til hinanden. Dette kan vise sig at være problematisk for formål, hvor bevarelse af kontekst er særligt vigtig, såsom chatbots designet til kundesupport.

Joe Davison, en forskningsingeniør hos Hugging Face, udtrykte til Digital Trends, at den enorme størrelse af GPT-3 kunne begrænse dets potentielle anvendelser. Davison argumenterede for, at selvom OpenAI havde fremmet tilstanden for tekstgenerering betydeligt, og demonstreret, at oprettelse af generelle formålmodeller kan reducere behovet for opgavebestemt data, ville beregningsressourcerne, der kræves for at anvende GPT-3, gøre det ret urealistisk for mange virksomheder.

OpenAI var tidligere en non-profit-virksomhed, men siden 2019 har laboratoriet skiftet til en for-profit-model. GPT-3 er det første større kommercielle produkt, der er produceret af laboratoriet, og det er endnu ikke klart, om skiftet til en for-profit-model vil ændre OpenAI’s forskningsprioriteter.

Blogger og programmør med specialer i Machine Learning og Deep Learning emner. Daniel håber at hjælpe andre med at bruge AI's kraft til sociale formål.