AGI og fremtidens AI
Er GPT-4 et spring fremad mod at nÃĨ AGI?
Microsoft (MSFT ) har nyligt udgivet en forskningsrapport med titlen: Sparks of Artificial General Intelligence: Early experiments with GPT-4. Som beskrevet af Microsoft:
Denne rapport beskriver vores undersÃļgelse af en tidlig version af GPT-4, da det stadig var under aktiv udvikling af OpenAI. Vi hÃĶvder, at (denne tidlige version af) GPT-4 er en del af en ny kohorte af LLMâer (sammen med ChatGPT og Googleâs PaLM for eksempel), der viser mere generel intelligens end tidligere AI-modeller.
I denne rapport er der overbevisende beviser for, at GPT-4 gÃĨr langt ud over memorering, og at det har en dyb og fleksibel forstÃĨelse af begreber, fÃĶrdigheder og domÃĶner. I virkeligheden overstiger dets evne til at generalisere langt det, der er muligt for noget menneske i dag.
mens vi tidligere har diskuteret fordelene ved AGI, skal vi hurtigt sammenfatte den generelle konsensus om, hvad et AGI-system er. I essensen er et AGI en type avanceret AI, der kan generalisere pÃĨ tvÃĶrs af multiple domÃĶner og ikke er snÃĶvert i omfang. Eksempler pÃĨ snÃĶvert AI inkluderer en selvstÃĶndig bil, en chatbot, en skakbot eller enhver anden AI, der er designet til et enkelt formÃĨl.
Et AGI ville i modsÃĶtning vÃĶre i stand til fleksibelt at skifte mellem enhver af ovenstÃĨende eller andre fagomrÃĨder. Det er en AI, der ville tage udgangspunkt i nye algoritmer som transfer learning og evolutionÃĶr lÃĶring, samt udnytte legacy-algoritmer som dyb forstÃĶrket lÃĶring.
Beskrivelsen af AGI matcher min personlige erfaring med at bruge GPT-4, samt beviserne, der er delt i forskningsrapporten, der er udgivet af Microsoft.
En af de prompts, der er beskrevet i rapporten, er, at GPT-4 skal skrive en bevis for uendeligheden af primtal i form af en digt.

Hvis vi analyserer kravene for at skabe sÃĨdan en digt, indser vi, at det krÃĶver matematisk resonnering, poetisk udtryk og naturlig sproggenerering. Dette er en udfordring, der ville overstige den gennemsnitlige evne hos de fleste mennesker.
Rapporten Ãļnskede at forstÃĨ, om GPT-4 blot producerede indhold baseret pÃĨ generel memorering eller om det forstod kontekst og kunne resonere. Da det blev bedt om at genskabe en digt i Shakespeares stil, kunne det gÃļre det. Dette krÃĶver en multifacetteret niveau af forstÃĨelse, der langt overstiger den gennemsnitlige befolknings evne og inkluderer teori om sind og matematisk geni.
Hvordan beregner man GPT-4âs intelligens?
SpÃļrgsmÃĨlet bliver sÃĨ, hvordan vi kan mÃĨle en LLMâs intelligens? Og viser GPT-4 adfÃĶrd, der svarer til sand lÃĶring eller blot memorering?
DannelsesmÃĨden for at teste et AI-system er ved at evaluere systemet pÃĨ en rÃĶkke standard benchmark-datasets og sikre, at de er uafhÃĶngige af trÃĶningsdata og dÃĶkker et bredt udvalg af opgaver og domÃĶner. Denne type test er nÃĶsten umulig pÃĨ grund af den nÃĶsten ubegrÃĶnsede mÃĶngde data, som GPT-4 er trÃĶnet pÃĨ.
Rapporten diskuterer generering af nye og svÃĶre opgaver/spÃļrgsmÃĨl, der overbevisende demonstrerer, at GPT-4 gÃĨr langt ud over memorering, og at det har en dyb og fleksibel forstÃĨelse af begreber, fÃĶrdigheder og domÃĶner.
NÃĨr det kommer til intelligens, kan GPT-4 generere korte historier, filmmanuskripter og kan beregne de mest komplicerede formler.
GPT-4 er ogsÃĨ i stand til at kode pÃĨ et meget hÃļjt niveau, bÃĨde i forhold til at skrive kode fra instruktioner og forstÃĨ eksisterende kode. GPT-4 kan hÃĨndtere et bredt udvalg af kodningsopgaver, fra kodningsudfordringer til virkelige verdensansÃļgninger, fra lavniveau-sammenfÃļjning til hÃļjniveau-rammer, fra simple datastrukturer til komplekse programmer som spil. GPT-4 kan ogsÃĨ resonere om kodekÃļrsel, simulere effekterne af instruktioner og forklare resultaterne i naturligt sprog. GPT-4 kan endda udfÃļre pseudokode,
GPT-4 kan tilbyde rationelle svar pÃĨ nÃĶsten enhver prompt. I virkeligheden er dets intelligens nÃĶsten uovervindelig i kompleksitet.
GPT-4âs begrÃĶnsninger
Rapporten fortsÃĶtter herefter med at beskrive, hvordan de undersÃļgte GPT-4âs svar og adfÃĶrd for at verificere dets konsistens, koherens og korrekthed og for at afslÃļre dets begrÃĶnsninger og fordomme.
Den mest ÃĨbenlyse begrÃĶnsning er dets tendens til at hallucinere. Her er et eksempel pÃĨ en hallucination, der er givet i rapporten, hvor GPT-4 var sikker pÃĨ sit svar, der var helt forkert.

Det ser ud til, at selv GPT-4 forstÃĨr denne nuvÃĶrende begrÃĶnsning med hallucinationer, da dette var svaret, det gav, da jeg spurgte, hvad en GPT-hallucination er:
En GPT-hallucination refererer til et fÃĶnomen, hvor en Generative Pre-trained Transformer (GPT)-model, som den du interagerer med, producerer et svar, der ikke er baseret pÃĨ faktuel information eller er ikke koherent med den kontekst, der er givet. Disse hallucinationer opstÃĨr, nÃĨr modellen genererer tekst, der kan synes plausibel, men i virkeligheden er forkert, misvisende eller meningslÃļs.
Med andre ord, nÃĨr du trÃĶner en LLM-AI pÃĨ verdens data, hvordan undgÃĨr du, at systemet lÃĶrer forkert data? En stor sprogmodel, der lÃĶrer og genererer misinformation og konspirationsteorier, kunne faktisk vÃĶre en af de stÃļrste faldgruber og trusler, som menneskeheden stÃĨr overfor med storstilet brug af LLMâer. Dette kunne faktisk vÃĶre en af de stÃļrre trusler fra AGI, en, der overraskende nok bliver overset, nÃĨr man diskuterer farerne ved AGI.
GPT-4âs beviser for intelligens
Rapporten illustrerer, at det ikke havde nogen betydning, hvilke komplekse prompts, der blev rettet mod det, GPT-4 ville overgÃĨ forventningerne. Som det er beskrevet i rapporten:
Dets ubesvarelige mesterstil over naturligt sprog. Det kan ikke kun generere flydende og koherent tekst, men ogsÃĨ forstÃĨ og manipulere det pÃĨ forskellige mÃĨder, sÃĨsom sammenfatning, oversÃĶttelse eller besvarelse af et ekstremt bredt udvalg af spÃļrgsmÃĨl. Desuden kan det oversÃĶtte ikke kun mellem forskellige naturlige sprog, men ogsÃĨ oversÃĶttelser i tone og stil samt pÃĨ tvÃĶrs af domÃĶner som medicin, jura, regnskab, computerprogrammering, musik og mere.
Falske tekniske anmeldelser blev givet til GPT-4, og det bestod let, hvilket betyder, at hvis dette var et menneske pÃĨ den anden side, ville det Ãļjeblikkeligt blive ansat som software-ingeniÃļr. En lignende prÃĶliminÃĶr test af GPT-4âs kompetence pÃĨ den multistate bar-eksamen viste en nÃļjagtighed over 70%. Dette betyder, at vi i fremtiden kunne automatisere mange af de opgaver, der i Ãļjeblikket gives til advokater. I virkeligheden er der nogle startups, der arbejder pÃĨ at skabe robot-advokater ved hjÃĶlp af GPT-4.
Produktion af ny viden
Et af argumenterne i rapporten er, at det eneste, der er tilbage for GPT-4 for at bevise sande niveauer af forstÃĨelse, er, at det kan producere ny viden, sÃĨsom at bevise nye matematiske teorier, en bedrift, der i Ãļjeblikket er uden for rÃĶkkevidde for LLMâer.
Herefter er dette det hellige mal for et AGI. Mens der er farer forbundet med et AGI, der kontrolleres af de forkerte hÃĶnder, er fordelene ved et AGI, der kan analysere alle historiske data for at opdage nye teorier, kur og behandlinger, nÃĶsten uendelige.
Et AGI kunne vÃĶre det manglende led til at finde kur mod sjÃĶldne genetiske sygdomme, der i Ãļjeblikket mangler privat industribaseret finansiering, til at kurere krÃĶft en gang for alle og til at maksimere effektiviteten af vedvarende energi for at fjerne vores afhÃĶngighed af ikke-bÃĶredygtig energi. I virkeligheden kunne det lÃļse enhver konsekvensfuld problem, der indfÃļres i AGI-systemet. Dette er, hvad Sam Altman og holdet pÃĨ OpenAI forstÃĨr, et AGI er virkelig den sidste opfindelse, der er nÃļdvendig for at lÃļse de fleste problemer og fordelene for menneskeheden.
Det lÃļser naturligvis ikke problemet med, hvem der kontrollerer AGI, og hvad deres intentioner er. Uanset hvad dette papir gÃļr en fÃĶnomenal job med at argumentere for, at GPT-4 er et spring fremad mod at nÃĨ det drÃļmme, AI-forskere har haft siden 1956, da det fÃļrste Dartmouth Summer Research Project on Artificial Intelligence sommer-workshop blev lanceret.
Mens det er diskutabelt, om GPT-4 er et AGI, kan det let argumenteres for, at det for fÃļrste gang i menneskehedens historie er et AI-system, der kan bestÃĨ Turing-testen.












