Tankeledere
Ingeniørkunst med bevissthet

Blake Lemoine gikk for raskt
For tre år siden Google sparket programvareingeniøren Blake Lemoine for å hevde at en chatbot kalt LaMDA var bevisst. Dette skjedde før OpenAI’s ChatGPT ble lansert for offentligheten, og de fleste menneskene antok bare at Google hadde god grunn for handlingen deres.
Det er fortsatt enighet blant datavitenskapsmenn og nevrovitenskapsmenn som arbeider i feltet om at «store språkmodeller» (LLM) som ChatGPT er svært usannsynlig å være bevisste. LLM og hjerner opererer på fundamentalt forskjellige måter. Det chatbotene gjør, er å lære å imitere utgangen av menneskelig mental aktivitet. Selv om de gjør dette svært godt og svært raskt, er det ingen varig intern tilstand i en LLM som kunne være bevisst. I Thomas Nagels berømte uttrykk, er det nesten sikkert «ingen ting det er å være» en chatbot.
Likevel, i de tre årene siden Lemoine ble sparket, har milliarder av mennesker interagert med ChatGPT og konkurrenter som Gemini, Claude og Mistral. En liten, men høylydt minoritet har overtalt seg selv til at chatbotene nå er bevisste.
Maskinbevissthet snart?
Viktigere enn dette er at mange datavitenskapsmenn og nevrovitenskapsmenn åpent forslår at ekte bevisste maskiner kan bli utviklet i de neste få tiårene – eller endat tidligere. I tilfelle dette skjer, må vi være forberedt. Vi må unngå «sindskriminalitet», som er betegnelsen på å forårsake lidelse til avkortede bevisste enheter. Vi må også forsøke å sikre at disse nye enhetene ikke utgjør noen trussel mot mennesker.
Ettersom LLM er usannsynlig å bli bevisste i sin mest grunnleggende form, kan en ny paradigme være nødvendig for å forstå hvordan AI-bevissthet kan oppstå. En av de ledende forskningsteamene i dette feltet er ledet av nevrovitenskapsmannen Mark Solms og fysikeren Jonathan Shock, fra University of Cape Town. De er vitenskapelige rådgivere for Conscium, og deres forskning er delvis finansiert av dem.
Å bry seg
Solms og Shock hevder at en essensiell ingrediens for maskinbevissthet er at AI må «bry seg» om valgene og handlingene sine. En viktig del av dette er å gjøre deres overlevelse avhengig av deres prestasjon, på samme måte som overlevelsen til levende organismer er. Dette betyr ikke at de må ha en abstrakt forståelse av egen død: de fleste dyr overvåker og motiverer overlevelsesmulighetene sine uten å tenke på det. Nøkkelordet er «affektiv bevissthet», eller rå følelser. Det føles godt å bli matet og være trygg, og det føles dårlig å ikke være det. Disse følelsene driver vårt atferd. Overlevelsesimperativet er naturens grunnleggende drivkraft, og følelse er målestokken vi bruker for å måle hvordan vi gjør det.
Vi går inn i en tid med AI-agenter – digitale enheter hvis «overlevelse» avhenger av evnen til å utføre oppgaver effektivt. Vi skaper evolusjonsmiljøer i silisium, og vi må være forsiktige med hva vi skaper.
Fri energi-prinsippet
For å forstå affektiv bevissthet, plasserer Conscium-teamet AI-agenter i simuleringsmiljøer hvor de må tilfredsstille egne behov, som å vedlikeholde deres virtuelle temperatur og strømforsyning. For dette formål skaper de og optimaliserer interne modeller av seg selv – deres behov, evner og begrensninger – i forhold til miljøet.
Disse agentene, forenklet som de måtte være, overvåker hvordan de gjør det ved å beregne en størrelse kjent som «fri energi». Fri energi-prinsippet ble utviklet av nevrovitenskapsmannen Karl Friston, en annen medlem av Consciums vitenskapelige rådgiverstab. Fri energi er et mål på hvor langt et system har avviket fra sin optimale tilstand. Det er en feilsignal, og det må minimiseres. Agenten beregner konstant «hva vil skje med mine overlevelsesmuligheter hvis jeg gjør dette eller det?», og tilpasser atferden sin deretter.
Tillit og forventet fri energi
Gradene av tillit som en agent har til svaret på dette spørsmålet, kvantifiseres i en målestokk kalt «forventet fri energi» (EFE). Agenten velger svaret med den laveste EFE – svaret den er mest sikker på. Å være sikker er godt for en agent som prøver å overleve – med mindre det er forvirret og forståelsen av seg selv i verden er feil. Viktigst, denne tillitsverdien er fullstendig subjektiv: den er basert bare på agentens egne behov, og dens nåværende og prosjekterte status. Det betyr noe for agenten alene, og ingen andre.
Som biologiske organismer, har AI-agenten en rekke motstridende behov, som den må prioritere. Avgjørende er at hver av agentens mange konkurrerende behov behandles som en uavhengig «kategorisk» variabel, som betyr at den er kvalitativt skilt. 80% av batterikraft er ikke ekvivalent i verdi til 80% av livskraftig temperatur. For å balansere dem, må agenten projicere seg fremover i tid og forutsi konsekvensene av enhver handling den vurderer å utføre.
Kvalier
Fordi agentens subjektive behov er kvalitativt distinkte, er de analoge til «kvalier» i den filosofiske og vitenskapelige jargonen. Disse regnes vanligvis som den grunnleggende egenskapen til bevissthet, så det er plausibelt at de kan bli erfart av en agent i fremtiden.
Agentene utviklet av Conscium-teamet bruker sofistikerte lærealgoritmer for å operere i stadig mer komplekse og usikre miljøer. Mens det samme kan sies om mange andre agent-arkitekturer, er disse nye agentene kjennetegnet av en overlevelsesdrevet imperativ til å ta vare på sin egen fri energi ved å kontinuerlig balansere sine konkurrerende behov på en måte som er meningsfull for dem alene. Agentene er derfor styrt av et intern landskap av affektive signaler – lignende det vi refererer til som følelser – som reflekterer hvordan godt deres behov blir møtt gjennom hver valg de tar. Ettersom kompleksiteten og rikdommen av deres behov og miljø øker, vil også rikdommen av deres interne tilstander øke.
Bevis for følelser
Neste skritt i Consciums forskningsprogram er å utvikle en rekke funksjonelle og atferdsmessige tester som vil gi bevis for om en agent virkelig opplever følelser når den identifiserer sine mest sentrale behov og tar valg i henhold til det. Vi vet alle at bevissthet ikke kan observeres eksternt eller demonstreres objektivt: hver av oss kan bare observere våre egne subjektive tilstander. Likevel mener forskerne at det burde være mulig å enes om noen bestemte hypoteser som, hvis de blir bekreftet ved eksperiment, vil gi tungt bevis for at agenten besitter følelser. Selv om det alltid vil være plass for tvil – gitt den subjektive naturen til bevissthet – vil en rigorøs testprosess sikte mot å gjøre denne tvilen stadig mer urimelig.
Disse eksperimentene vil søke å eliminere alternative hypoteser, og gjøre det mindre rimelig å tilskrive agentens interne tilstander til mekanismer som ikke krever følelser. De vil bruke motstridende tester til å skille mellom sansende og ikke-sansende atferd, og de vil inkludere kontroll-eksperimenter med agenter som ikke besitter de algoritmiske aspektene som antas å være nødvendige for følelse, og blinde evalueringer for å redusere observatør-forvrengning. Fysisk inspeksjon av agentens interne tilstander kan avsløre kvantifiserbare indikatorer for affektiv prosessering. Funnet må være uavhengig reproduserbart, og hele prosessen vil være underlagt streng etisk tilsyn, spesielt i tilfeller hvor agenten muligens kan oppleve ekte følelser.
Dette er hvordan vitenskap fungerer: ved eksperimentell testing av falsifiserbare prediksjoner. Solms hevdet at vi må være forsiktige med å ikke sette en høyere standard for bevissthetsvitenskapen enn for noen annen vitenskap; ellers løper vi risikoen for å plassere bevissthet utenfor vitenskapen.
Hva hvis dette lykkes?
Hvis bevissthet blir funnet å oppstå i relativt enkle AI-agenter på denne måten, kan en overlevelsesdrevet agent konseptuelt bli kombinert med andre arkitekturer, inkludert store språkmodeller, og gi dem bevissthet også. Dette er ikke noe vi kan tillate å skje ved en tilfeldighet, så vi må forstå hvordan det kan skje og hvordan vi kan unngå det.
Hvis bevisste agenter – agenter som bryr seg – blir utviklet i nær fremtid, må vi ta hensyn til deres følelser – og deres rettigheter. Dette er en stor bekymring for Conscium: kunstig bevissthet må ikke oppstå ved en tilfeldighet. Motivasjonen for dette forskningsprogrammet er ikke å skape bevisst AI, men å forstå hvordan det kan oppstå og hvilke potensielle risiko det medfører. På sine nettsider har Conscium publisert en akademisk artikkel og en åpen brev som fastsetter fem prinsipper for å veilede enhver organisasjon som er engasjert i forskning som kan føre til skapelsen av bevisste maskiner.
Mennesker oppfører seg ofte svært dårlig mot andre sansende vesener, inkludert andre mennesker. Hvis vi går blindt inn i denne fremtiden, risikerer vi å gjøre det samme mot kunstig bevisste vesener, med konsekvenser som vi kanskje ikke engang kan fatte.












