AI-modeller og platforme

GPT-2, kunstig intelligens tekstgenerator frigÃļres i sin helhed

mm
FÃļj Unite.AI til dine foretrukne kilder pÃĨ Google

Som TheNextWeb (TNW) rapporterer, OpenAI, den non-profit organisation bag en rÃĶkke kunstig intelligens-projekter, har netop offentliggjort den endelige model i den planlagte trinvis frigivelse af GPT-2, en tekstgenerator, der har vÃĶret genstand for meget debat siden dens annoncerede frigivelse i februar.

Basert pÃĨ OpenAI’s forskningspapir med titlen Language Models are Unsupervised Multitask Learners, ”GPT-2 bruger maskinlÃĶring til at generere nye tekstbaserede pÃĨ begrÃĶnsede input.” Det betyder, at en bruger kan taste en sÃĶtning eller to om et emne, og AI-generatoren vil komme med en tekst, der har nogen relation til det originale input. I virkeligheden, som TNW bemÃĶrker, adskiller GPT-2 sig fra de fleste ’tekstgeneratore’ ved, at den ikke udskriver foruddefinerede strenge. GPT-2 opfinder tekst, der ikke tidligere har eksisteret.”

I sin tweet giver Scott B. Weingart, programdirektÃļr for Carnegie Mellon University Libraries, et konkrekt eksempel:

 

OpenAI var oprindeligt bekymret for mulige skadelige brug af deres system, sÃĨ i februar 2019 besluttede de at frigive GPT-2 i fire dele over otte mÃĨneder. Som de forklarede i deres blog, “PÃĨ grund af vores bekymringer om skadelige anvendelser af teknologien, frigiver vi ikke den trÃĶnede model. Som et eksperiment i ansvarlig ÃĨbenhed frigiver vi i stedet en meget mindre model, som forskere kan eksperimentere med, samt en teknisk rapport.”

Som forklaret indeholder den fulde model 1,5 milliarder parametre. “Jo flere parametre en model er trÃĶnet med, jo ’klogere’ ser den ud til at vÃĶre – ligesom mennesker, Ãļvelse gÃļr perfekt.”

TNW bemÃĶrker, at OpenAI oprindeligt frigav en model med 124 millioner parametre, efterfulgt af frigivelser med 355 og 774 millioner. IfÃļlge dem viste hver iteration en betydelig forbedring af kapaciteten i forhold til tidligere iterationer.

For at forhindre misbrug frigav OpenAI GPT-2-detektionsmodeller, der er ”til at forebygge misbrug.” IfÃļlge deres egen tilstÃĨelse i en blogpost, har disse detektionsmodeller stadig brug for yderligere arbejde for at nÃĨ det kvalitetsniveau, der er opnÃĨet indtil nu i GPT-2 selv.

De, der er interesseret, kan downloade GPT-2-modellen her pÃĨ Github, se modellkortet her, og lÃĶse OpenAI’s blogpost her.

Tidligere diplomat og oversÃĶtter for FN, nuvÃĶrende freelance journalist/forfatter/forsker, fokuserer pÃĨ moderne teknologi, kunstig intelligens og moderne kultur.