AI-modeller og platforme

GPT-2, kunstig intelligens tekstgenerator frigøres i sin helhed

mm
Føj Unite.AI til dine foretrukne kilder på Google

Som TheNextWeb (TNW) rapporterer, OpenAI, den non-profit organisation bag en række kunstig intelligens-projekter, har netop offentliggjort den endelige model i den planlagte trinvis frigivelse af GPT-2, en tekstgenerator, der har været genstand for meget debat siden dens annoncerede frigivelse i februar.

Basert på OpenAI’s forskningspapir med titlen Language Models are Unsupervised Multitask Learners, ”GPT-2 bruger maskinlæring til at generere nye tekstbaserede på begrænsede input.” Det betyder, at en bruger kan taste en sætning eller to om et emne, og AI-generatoren vil komme med en tekst, der har nogen relation til det originale input. I virkeligheden, som TNW bemærker, adskiller GPT-2 sig fra de fleste ’tekstgeneratore’ ved, at den ikke udskriver foruddefinerede strenge. GPT-2 opfinder tekst, der ikke tidligere har eksisteret.”

I sin tweet giver Scott B. Weingart, programdirektør for Carnegie Mellon University Libraries, et konkrekt eksempel:

 

OpenAI var oprindeligt bekymret for mulige skadelige brug af deres system, så i februar 2019 besluttede de at frigive GPT-2 i fire dele over otte måneder. Som de forklarede i deres blog, “På grund af vores bekymringer om skadelige anvendelser af teknologien, frigiver vi ikke den trænede model. Som et eksperiment i ansvarlig åbenhed frigiver vi i stedet en meget mindre model, som forskere kan eksperimentere med, samt en teknisk rapport.”

Som forklaret indeholder den fulde model 1,5 milliarder parametre. “Jo flere parametre en model er trænet med, jo ’klogere’ ser den ud til at være – ligesom mennesker, øvelse gør perfekt.”

TNW bemærker, at OpenAI oprindeligt frigav en model med 124 millioner parametre, efterfulgt af frigivelser med 355 og 774 millioner. Ifølge dem viste hver iteration en betydelig forbedring af kapaciteten i forhold til tidligere iterationer.

For at forhindre misbrug frigav OpenAI GPT-2-detektionsmodeller, der er ”til at forebygge misbrug.” Ifølge deres egen tilståelse i en blogpost, har disse detektionsmodeller stadig brug for yderligere arbejde for at nå det kvalitetsniveau, der er opnået indtil nu i GPT-2 selv.

De, der er interesseret, kan downloade GPT-2-modellen her på Github, se modellkortet her, og læse OpenAI’s blogpost her.

Tidligere diplomat og oversætter for FN, nuværende freelance journalist/forfatter/forsker, fokuserer på moderne teknologi, kunstig intelligens og moderne kultur.