AI-modeller og plattformer

OpenAI vil lansere kommersiell versjon av berømt tekstgenereringsmodell

mm
Legg til Unite.AI blant dine foretrukne kilder på Google

Det kunstig intelligens-forskningslaboratoriet OpenAI vil gjøre sin berømte tekstgenereringsverktøy GPT-3 tilgjengelig for salg, og dette markerer den første kommersielle produkten produsert av den maskinlæringsbaserte non-profit-organisasjonen.

I februar i fjor gjorde OpenAI sin tekstgenereringsmodell GPT-2 åpen kilde. GPT-2 var i stand til å generere imponerende sammenhengende tekst når den ble gitt en kort prompt, og modellen ble ansett som et betydelig skritt fremover i feltene naturlig språkbehandling og kunstig intelligens. I virkeligheten nektet OpenAI først å slippe GPT-2-modellen, med påstand om at den var for farlig for en åpen kilde-utgivelse, og de fryktet misbruk. Likevel, etter at en versjon av modellen ble tilgjengelig en stund, og den non-profit-organisasjonen rapporterte at de ikke hadde sett noen bevis på skadelig bruk, ble det besluttet å gjøre modellen åpen kilde. Nylig annonserte OpenAI oppfølgeren til GPT-2, kalt GPT-3.

GPT-3-modellen er omtrent 100 ganger større enn sin forgjenger, og det er denne modellen som de tilbyr som et kommersielt produkt. GPT-2-modellen bestod av omtrent 1,5 milliarder parametre, mens GPT-3 består av omtrent 175 milliarder parametre. Sophistikasjonen og påliteligheten til GPT-modellserien har ført til at modellene har blitt standarden for maskinlæringsprosjekter som involverer tekst. Like som konvolusjonsneurale nettverk har blitt standardmodellen for bilde-relaterte prosjekter, så brukes tekst-relaterte prosjekter i økende grad GPT-2, og kanskje snart GPT-3.

Ifølge The Verge ser det ut til at OpenAI håper å drive adopteringen av en GPT-standarden fremover ved å gjøre sin GPT-3-modell kommersielt tilgjengelig. For øyeblikket er tilgangen til GPT-3-API kun på invitasjon. Likevel er dette sannsynligvis bare en testkjøring, og det ser ut til at GPT-3 vil bli gjort mer tilgjengelig snart. OpenAI har uttalt at de vil være nøye med å vurdere kundene av sine modeller for å forhindre misbruk av teknologien for uetiske formål som spamming, å lage desinformasjon eller trakassering.

Det er noenlunde uklart hvordan GPT-3 er ment å bli brukt av kundene. Dette er kanskje fordi GPT-3 er så fleksibel og har så mange potensielle anvendelser. GPT-baserte modeller kan bli finjustert etter behov for å generere tekst som er egnet for bestemte oppgaver. Modellen kan tilpasse seg en rekke forskjellige prompter og inndatastiler, noe som betyr at den kan bli brukt til å lage tekstsummeringsverktøy, svare på enkle spørsmål eller fungere som basis for en sofistikert chatbot. Som OpenAI sin teknologidirektør Greg Brockman forklarte til Wired:

“Den store mentale skiftet er at det er mye mer som å snakke med en menneske enn å formatere ting for en maskin,” sier Greg Brockman, OpenAI sin teknologidirektør. “Du gir den noen spørsmål og svar, og plutselig er den i Q&A-modus.”

Det er ukjent hvor pålitelig GPT-3-avledede kommersielle modeller vil være. Mens GPT-3 kan generere syntaktisk korrekt, naturlig lydende språk, mangler den en intuitiv forståelse av den virkelige verden og hvordan konsepter henger sammen. Dette kan vise seg å være problematisk for anvendelser der det er viktig å bevare konteksten, som f.eks. chatboter designet for kundestøtte.

Joe Davison, en forskningsingeniør hos Hugging Face, uttrykte til Digital Trends at den rene størrelsen på GPT-3 kan begrense dens potensielle anvendelser. Davison argumenterte for at mens OpenAI har gjort betydelige fremskritt når det gjelder tekstgenerering, og demonstrert at å lage generelle modeller kan redusere behovet for oppgave-spesifikke data, så kan beregningsressursene som er nødvendige for å bruke GPT-3 gjøre det ganske upraktisk for mange bedrifter.

OpenAI var tidligere en non-profit-organisasjon, men siden 2019 har laboratoriet skiftet til en for-profit-modell. GPT-3 er den første store kommersielle produkten produsert av laboratoriet, og det gjenstår å se om skiftet til en for-profit-modell vil endre OpenAi sin forskningsprioritering.

Blogger og programmerer med spesialområder i Machine Learning og Deep Learning emner. Daniel håper å hjelpe andre med å bruke kraften av AI for sosialt godt.