AGI och framtidens AI

Är GPT-4 ett stort steg mot att uppnÃĨ AGI?

mm
LÃĪgg till Unite.AI bland dina fÃķredragna kÃĪllor pÃĨ Google

Microsoft (MSFT ) har nyligen slÃĪppt en forskningsrapport med titeln: Sparks of Artificial General Intelligence: Early experiments with GPT-4. Som beskrivs av Microsoft:

Denna rapport redovisar vÃĨr undersÃķkning av en tidig version av GPT-4, nÃĪr det fortfarande var under aktiv utveckling av OpenAI. Vi hÃĪvdar att (denna tidiga version av) GPT-4 ÃĪr en del av en ny grupp av LLM:er (tillsammans med ChatGPT och Google’s PaLM till exempel) som visar mer allmÃĪn intelligens ÃĪn tidigare AI-modeller.

I denna rapport finns det Ãķvertygande bevis som visar att GPT-4 gÃĨr lÃĨngt utÃķver memorering, och att det har en djup och flexibel fÃķrstÃĨelse av begrepp, fÃĪrdigheter och domÃĪner. I sjÃĪlva verket ÃķvertrÃĪffar dess fÃķrmÃĨga att generalisera alla levande mÃĪnniskor idag.

Medan vi tidigare har diskuterat fÃķrdelarna med AGI, bÃķr vi snabbt sammanfatta den allmÃĪnna uppfattningen om vad ett AGI-system ÃĪr. I grund och botten ÃĪr ett AGI en typ av avancerad AI som kan generalisera Ãķver flera domÃĪner och inte ÃĪr smal i omfattning. Exempel pÃĨ smal AI inkluderar en autonom fordon, en chattbot, en schackbot eller nÃĨgon annan AI som ÃĪr utformad fÃķr ett enda syfte.

Ett AGI i jÃĪmfÃķrelse skulle kunna flexibelt alternera mellan nÃĨgon av ovanstÃĨende eller nÃĨgot annat expertomrÃĨde. Det ÃĪr en AI som skulle dra nytta av nascenta algoritmer som ÃķverfÃķringsinlÃĪrning och evolutionÃĪr inlÃĪrning, samtidigt som det utnyttjar legacy-algoritmer som djup fÃķrstÃĪrkningsinlÃĪrning.

OvanstÃĨende beskrivning av AGI matchar min personliga erfarenhet av att anvÃĪnda GPT-4, samt bevisen som delas i forskningsrapporten som slÃĪpptes av Microsoft.

En av de prompter som beskrivs i rapporten ÃĪr fÃķr GPT-4 att skriva ett bevis fÃķr oÃĪndligheten av primtal i form av en dikt.

Om vi analyserar kraven fÃķr att skapa en sÃĨdan dikt fÃķrstÃĨr vi att det krÃĪver matematiskt resonemang, poetisk uttrycksfÃķrmÃĨga och naturligt sprÃĨkgenerering. Detta ÃĪr en utmaning som skulle ÃķvertrÃĪffa den genomsnittliga fÃķrmÃĨgan hos de flesta mÃĪnniskor.

Rapporten ville fÃķrstÃĨ om GPT-4 enbart producerade innehÃĨll baserat pÃĨ allmÃĪn memorering eller om det kunde fÃķrstÃĨ sammanhang och resonera. NÃĪr det fick i uppdrag att ÃĨterskapa en dikt i Shakespeares stil kunde det gÃķra det. Detta krÃĪver en mÃĨngfacetterad nivÃĨ av fÃķrstÃĨelse som vida ÃķvertrÃĪffar den allmÃĪnna befolkningens fÃķrmÃĨga och inkluderar teorin om sinne och matematiskt geni.

Hur berÃĪknar man GPT-4:s intelligens?

FrÃĨgan blir dÃĨ hur kan vi mÃĪta en LLM:s intelligens? Och visar GPT-4 beteenden av verkligt lÃĪrande eller enbart memorering?

Det nuvarande sÃĪttet att testa ett AI-system ÃĪr att utvÃĪrdera systemet pÃĨ en uppsÃĪttning standardbenchmark-datasets, och att se till att de ÃĪr oberoende av trÃĪningsdata och att de tÃĪcker en rad uppgifter och domÃĪner. Detta test ÃĪr nÃĪstan omÃķjligt pÃĨ grund av den nÃĪstan oÃĪndliga mÃĪngden data som GPT-4 trÃĪnades pÃĨ.

Rapporten diskuterar generering av nya och svÃĨra uppgifter/frÃĨgor som Ãķvertygande visar att GPT-4 gÃĨr lÃĨngt utÃķver memorering, och att det har en djup och flexibel fÃķrstÃĨelse av begrepp, fÃĪrdigheter och domÃĪner.

NÃĪr det gÃĪller intelligens kan GPT-4 generera korta berÃĪttelser, manus och det kan berÃĪkna de mest komplicerade formlerna.

GPT-4 kan ocksÃĨ koda pÃĨ en mycket hÃķg nivÃĨ, bÃĨde nÃĪr det gÃĪller att skriva kod frÃĨn instruktioner och fÃķrstÃĨ befintlig kod. GPT-4 kan hantera en mÃĪngd olika koduppgifter, frÃĨn kodutmaningar till verkliga tillÃĪmpningar, frÃĨn lÃĨgnivÃĨsammansÃĪttning till hÃķgnivÃĨramverk, frÃĨn enkla datastrukturer till komplexa program som spel. GPT-4 kan ocksÃĨ resonera om kÃķrning av kod, simulera effekterna av instruktioner och fÃķrklara resultaten i naturligt sprÃĨk. GPT-4 kan till och med kÃķra pseudokod,

GPT-4 kan ge rationella svar pÃĨ nÃĪstan alla prompter som ges. I sjÃĪlva verket ÃĪr dess intelligens nÃĪstan oÃķvervinnelig i sin komplexitet.

GPT-4:s begrÃĪnsningar

Rapporten fortsÃĪtter sedan att beskriva hur de undersÃķkte GPT-4:s svar och beteenden, fÃķr att verifiera dess konsekvens, sammanhang och riktighet, och fÃķr att avslÃķja dess begrÃĪnsningar och partiskhet.

Den mest uppenbara begrÃĪnsningen ÃĪr dess benÃĪgenhet att hallucinera. HÃĪr ÃĪr ett exempel pÃĨ en hallucination som ges i rapporten dÃĪr GPT-4 var sÃĪker pÃĨ sitt svar som var helt fel.

Det verkar som att ÃĪven GPT-4 fÃķrstÃĨr denna nuvarande begrÃĪnsning med hallucinationer, eftersom det gav fÃķljande svar nÃĪr jag frÃĨgade vad en GPT-hallucination ÃĪr:

En GPT-hallucination refererar till ett fenomen dÃĪr en Generative Pre-trained Transformer (GPT)-modell, som den du fÃķr nÃĪrvarande interagerar med, producerar ett svar som inte baseras pÃĨ faktisk information eller ÃĪr sammanhÃĪngande med det tillhandahÃĨllna sammanhanget. Dessa hallucinationer uppstÃĨr nÃĪr modellen genererar text som kan verka trovÃĪrdig men i sjÃĪlva verket ÃĪr felaktig, vilseledande eller meningslÃķs.

Med andra ord, nÃĪr du trÃĪnar en LLM-AI pÃĨ vÃĪrldens data, hur undviker du att systemet lÃĪr sig felaktig data? En stor sprÃĨkmodell som lÃĪr sig och ÃĨterger felaktig information och konspirationsteorier kunde faktiskt vara en av de stÃķrsta fallgroparna och hoten som mÃĪnskligheten stÃĨr infÃķr med stor skala adoption av LLM:er. Detta kunde faktiskt vara ett av de stÃķrre hoten frÃĨn AGI, ett som fÃķrvÃĨnansvÃĪrt missas nÃĪr man diskuterar farorna med AGI.

GPT-4:s bevis fÃķr intelligens

Rapporten illustrerar att det inte spelade nÃĨgon roll vilken typ av komplexa prompter som riktades mot det, GPT-4 skulle ÃķvertrÃĪffa fÃķrvÃĪntningarna. Som det stÃĨr i rapporten:

Dess obeskrivliga mÃĪsterskap av naturligt sprÃĨk. Det kan inte bara generera flytande och sammanhÃĪngande text, utan ocksÃĨ fÃķrstÃĨ och manipulera den pÃĨ olika sÃĪtt, sÃĨsom att sammanfatta, ÃķversÃĪtta eller svara pÃĨ en extremt bred uppsÃĪttning frÃĨgor. Dessutom, med ÃķversÃĪttning menar vi inte bara mellan olika naturliga sprÃĨk, utan ocksÃĨ ÃķversÃĪttningar i ton och stil, samt Ãķver domÃĪner som medicin, juridik, redovisning, dataprogrammering, musik och mer.

Falska tekniska recensioner gavs till GPT-4, det klarade med lÃĪtthet, vilket i detta sammanhang betyder att om detta var en mÃĪnniska pÃĨ andra sidan, skulle de omedelbart bli anstÃĪllda som programvaruutvecklare. En liknande preliminÃĪr test av GPT-4:s kompetens pÃĨ Multistate Bar Exam visade en noggrannhet Ãķver 70%. Detta betyder att i framtiden kunde vi automatisera mÃĨnga av de uppgifter som fÃķr nÃĪrvarande ges till jurister. I sjÃĪlva verket finns det vissa startups som arbetar med att skapa robotjurister med hjÃĪlp av GPT-4.

Att producera ny kunskap

Ett av argumenten i rapporten ÃĪr att det enda som ÃĨterstÃĨr fÃķr GPT-4 fÃķr att bevisa verklig fÃķrstÃĨelse ÃĪr att producera ny kunskap, sÃĨsom att bevisa nya matematiska satser, en prestation som fÃķr nÃĪrvarande ligger utanfÃķr rÃĪckhÃĨll fÃķr LLM:er.

Sedan igen ÃĪr detta det heliga korset fÃķr ett AGI. Medan det finns faror med ett AGI som kontrolleras av fel personer, ÃĪr fÃķrdelarna med ett AGI som kan snabbt analysera all historisk data fÃķr att upptÃĪcka nya satser, botemedel och behandlingar nÃĪstan oÃĪndliga.

Ett AGI kunde vara den saknade lÃĪnken fÃķr att hitta botemedel fÃķr sÃĪllsynta genetiska sjukdomar som fÃķr nÃĪrvarande saknar privat industrifinansiering, fÃķr att bota cancer en gÃĨng fÃķr alla och fÃķr att maximera effektiviteten av fÃķrnybar energi fÃķr att ta bort vÃĨr beroende av ohÃĨllbar energi. I sjÃĪlva verket kunde det lÃķsa vilket konsekvent problem som helst som matas in i AGI-systemet. Detta ÃĪr vad Sam Altman och teamet pÃĨ OpenAI fÃķrstÃĨr, ett AGI ÃĪr verkligen den sista uppfinningen som behÃķvs fÃķr att lÃķsa de flesta problem och fÃķr att gynna mÃĪnskligheten.

Detta lÃķser fÃķrstÃĨs inte problemet med knappen fÃķr kÃĪrnvapen, vem som kontrollerar AGI och vad deras avsikter ÃĪr. Oavsett detta papper gÃķr ett fenomenalt jobb med att hÃĪvda att GPT-4 ÃĪr ett stort steg mot att uppnÃĨ drÃķmmen som AI-forskare har haft sedan 1956, nÃĪr den ursprungliga Dartmouth Summer Research Project on Artificial Intelligence sommarworkshop fÃķrst lanserades.

Medan det ÃĪr debatterbart om GPT-4 ÃĪr ett AGI, kunde det lÃĪtt hÃĪvdas att fÃķr fÃķrsta gÃĨngen i mÃĪnsklighetens historia ÃĪr det ett AI-system som kan klara Turingtestet.

Antoine ÃĪr en visionÃĪr ledare och medgrundare av Unite.AI, driven av en outtrÃķttlig passion fÃķr att forma och frÃĪmja framtidens AI och robotik. En serieentreprenÃķr, han tror att AI kommer att vara lika stÃķrande fÃķr samhÃĪllet som elektricitet, och han fÃĨngas ofta i att prata om potentialen fÃķr stÃķrande teknologier och AGI.

Som en futurist ÃĪr han dedikerad till att utforska hur dessa innovationer kommer att forma vÃĨr vÃĪrld. Dessutom ÃĪr han grundare av Securities.io, en plattform som fokuserar pÃĨ att investera i banbrytande teknologier som omdefinierar framtiden och omformar hela sektorer.