AI-modeller og platforme
Vi er ikke længere ved at justere AI. Vi er ved at justere civilisationer

I mange år har den primære spørgsmål i kunstig intelligens (AI) været, hvordan man kan justere AI-modeller med menneskelige værdier. Forskere har forsøgt at definere sikkerhedsregler, etiske principper og kontrolmekanismer, der vejleder AI-beslutninger. Dette arbejde har opnået betydelig fremgang. Men nu, da disse AI-systemer bliver mere kapable og udbredte, begynder fokus på justering at skifte. Det, der startede som udfordringen med at justere en enkelt model til en enkelt sæt instruktioner, er nu blevet den langt større udfordring med at justere hele civilisationer, der bruger disse systemer på global skala. AI er ikke længere bare et værktøj. Det udvikler sig til en omgang, hvor samfund arbejder, kommunikerer, forhandler og konkurrerer. Som følge heraf forbliver justering ikke længere et teknisk problem. Det er blevet et civilisationsproblem. I denne artikel forklarer jeg, hvorfor justering ikke længere kun handler om modeller, og hvorfor vi må begynde at tænke i termer af civilisationer i stedet for maskiner. Jeg diskuterer også, hvordan denne skift påvirker vores ansvar og hvad det betyder for globalt samarbejde.
Hvis værdier repræsenterer AI virkelig?
Hvis du spørger en AI om et følsomt historisk begivenhed, afhænger dens svar af de data, det har studeret. Hvis disse data kommer primært fra den vestlige internet, vil svaret have en vestlig bias. Det vil prioritere individualisme, åben tale og demokratiske idealer. Disse er gode værdier for mange mennesker. Men de er ikke de eneste værdier i verden.
En bruger i Singapore, en bruger i Riyadh og en bruger i San Francisco har forskellige definitioner af, hvad der er “nyttigt” og hvad der er “skadeligt”. I nogle kulturer er social harmoni mere vigtig end absolut ytringsfrihed. I andre er respekt for hierarki mere vigtig end disruption.
Når et Silicon Valley-selskab bruger “Reinforcement Learning from Human Feedback” (RLHF), hyrer de mennesker til at vurderere AI’s svar. Men hvem er disse mennesker? Hvad er deres overbevisninger? Hvis de justerer modellen med amerikanske standarder, bygger de utilsigtet en amerikansk kultureksport. De bygger en digital diplomat, der gennemtvinger en bestemt civilisations regler på resten af verden.
Opkomsten af feedback-løkker
Udfordringen er ikke kun, at AI reflekterer overbevisninger fra en enkelt kultur. Det er, hvordan disse overbevisninger kan ændre os. Moderne AI-systemer har potentialet til at forme adfærd hos individer, organisationer og endda nationer. De kan påvirke, hvordan vi tænker, arbejder, stoler og konkurrerer. Dette skaber feedback-løkker mellem AI-systemer og menneskelige samfund; vi træner AI, og AI former, hvordan vi tænker og handler. Disse løkker bliver stærkere, da AI bliver mere udbredt. For at se, hvordan denne feedback-løkke fungerer, kan du se på følgende to eksempler:
- Stort set AI-udvikling ændrer social adfærd, og social adfærd ændrer de data, der træner nye systemer. For eksempel kan en anbefalingsalgoritme forme, hvad mennesker ser, læser og tror. Produktivitetsværktøjer former, hvordan hold samarbejder og hvordan studerende lærer. Disse ændringer i adfærd ændrer data-mønstre i form af forskellige sevaner, kommunikationsmønstre på arbejdspladsen eller skrivevaner. Når disse data flyder ind i fremtidige træningsdata, justerer modellerne deres antagelser og output entsprechende. Menneskelig adfærd former modellerne, og modellerne former igen menneskelig adfærd.
- Automatiserede beslutningsværktøjer påvirker offentlig politik, og offentlig politik påvirker fremtidig modeltræning. For eksempel bruger mange regeringer nu AI til at foreslå, hvor de skal allokerer ressourcer, såsom at identificere, hvilke kvarterer har brug for mere sundhedsstøtte eller hvilke områder, der måske ser en højere kriminel risiko. Når beslutningstagerne handler på disse anbefalinger, bliver resultaterne af disse beslutninger senere en del af nye datasæt. Over tid bliver politiske beslutninger, der er formet af AI, til at forme den næste generation af AI-modeller.
Når du erkender denne feedback-løkke, bliver det klart, at AI langsomt former og justerer civilisationer. Som følge heraf begynder nationer at spørge: Hvordan kan de sikre deres værdier, mens de integrerer AI i deres samfund og institutioner?
Opkomsten af suveræn AI
Denne justeringsudfordring har udløst en betydelig reaktion fra regeringer verden over. Nationer har indset, at de ikke kan afhænge af importeret AI, da det er en risiko for deres suverænitet. De kan ikke have deres borgere uddannet, informeret og rådført af en sort boks, der tænker som en fremmed.
Dette har ført til opkomsten af “suveræn AI“. Frankrig investerer tungt i at bygge modeller, der taler fransk og forstår fransk lovgivning og kultur. Indien bygger indfødt AI-modeller for at sikre deres kulturelle værdier. De Forenede Arabiske Emirater og Kina bygger AI-modeller, der er justeret med deres egne nationale visioner.
Dette er det nye våbenkapløb. Det er et kapløb om narrativ kontrol. En civilisation, der ikke har sin egen AI, vil til sidst miste sin egen hukommelse. Hvis dine børn spørger en maskine om et spørgsmål, og maskinen svarer med logikken fra en anden kultur, begynder din kultur at erodere. Denne erkendelse kan dog føre til dannelsen af distinkte digitale blokke. Vi kan ende med en vestlig AI, en kinesisk AI, en indisk AI og så videre. Disse systemer vil fungere med forskellige fakta og forskellige moralske kompasser. Disse udviklinger gør det klart, at hvis vi vil skabe en enkelt, virkelig justeret AI-model, må vi først finde en måde at justere civilisationer på.
Behov for en diplomatisk AI
Traditionel justering antager, at en model kan justeres ved omhyggelig træning, prompting og guardrails. Denne tænkning kommer fra den tekniske mindset i tidlig AI-sikkerhedsforskning. Men selv perfekt model-niveau justering kan ikke løse udfordringerne med at justere civilisationer. Justeringen kan ikke forblive stabil, når samfund trækker i modsat retning. Hvis lande, selskaber og fællesskaber har modsatrettede mål, vil de presse AI-systemer til at reflektere disse konflikter. Disse begrænsninger viser, at justering ikke kun er et teknisk problem. Det er et styre-, kulturelt og koordinationsproblem. Og disse problemer kræver ikke kun eksperter eller udviklere. De involverer hele civilisationer.
Så, hvordan går vi videre? Hvis vi accepterer, at universal justering er umulig, må vi ændre vores strategi. Vi må stoppe med at lede efter en teknisk løsning på et filosofisk problem. Vi må begynde at tænke som diplomater. Vi må bygge protokoller for “Civilisationsjustering”. Vi må finde ud af, hvordan AI kan respektere en samfunds overbevisninger og værdier uden at påtvinge det overbevisninger fra andre kulturer. Med andre ord, vi må have en digital FN for vores algoritmer.
Dette kræver gennemsigtighed. For tiden ved vi ikke rigtig, hvilke værdier der er gemt i de dybe lag af en neural netværk. Vi ser kun outputtet. For at justere civilisationer må vi være klare om “forfatningen” af hver model. En model skal kunne erklære sin bias. Den skal kunne sige: “Jeg er trænet på denne data, med disse sikkerhedsregler, prioriterer disse værdier.” Først når bias er synligt, kan vi stole på systemet. En bruger skal kunne skifte mellem perspektiver. Du skal kunne stille et spørgsmål og se, hvordan en “vestlig” model svarer i forhold til, hvordan en “østlig” model svarer. Dette ville gøre AI til et værktøj for forståelse, snarere end et værktøj for indoktrinering.
Bottom Line
Vi har brugt for meget tid på at bekymre os om Terminator. Den virkelige risiko er ikke, at en robot ødelægger os. Den virkelige risiko er, at en robot får os til at glemme, hvem vi er. Justering er ikke en kode, vi kan skrive en gang og glemme. Det er en konstant forhandling med AI-modeller for at holde dem justeret med vores overbevisninger og værdier. Det er en politisk akt. Mens vi går ind i denne næste fase af intelligensalderen, må vi se ud over skærmen. Vi må overveje, hvordan AI fortolker vores historie, vores grænser og vores overbevisninger. Vi bygger de tanker, der vil hjælpe os med at styre verden. Vi må sikre, at disse tanker respekterer forskellene mellem civilisationer.












