Tankeledare
Att tänka som en människa: Kan AI utveckla analogiskt resonemang?

När människor ställs inför något nytt, sträcker de sig instinktivt efter jämförelser. Ett barn som lär sig om atomer kan höra att elektronerna kretsar kring atomkärnan “liksom planeter kretsar kring solen.” En entreprenör kan presentera sitt startup som “Uber för djurgrooming.” En forskare kan förklara för en icke-specialistpublik att hjärnan bearbetar information “liksom en dator.”
Detta mentala språng – att se hur en sak liknar en annan i sin djupare struktur – kallas analogiskt resonemang. Och det kan vara den ingrediens som skiljer mänsklig intelligens från AI i dess nuvarande form. Om vi någonsin ska utveckla Artificiell Allmän Intelligens – den Heliga Graal för AI som hittills har visat sig vara svår att uppnå – måste vi ta reda på om det är möjligt för maskiner att lära sig att tänka analogt. Insatserna kunde inte vara högre. Om svaret är “Nej”, då kommer även de mest avancerade AI-systemen för alltid att förbli ingenting mer än glorifierade kalkylatorer. De kommer att vara oförmögna att lösa problem som kräver mer än en omarrangemang av de data de har tränats på.
Arkitekturen för förståelse
Analogiskt resonemang fungerar på en strukturell nivå, snarare än en ytnivå, likheter. Till exempel, vad gör hjärtan och vattenpumpar liknande? Det är inte deras fysiska utseende. Det är faktum att båda utför exakt samma funktion, nämligen att cirkulera vätska genom ett system. Och det är just denna förmåga att kartlägga relationer som är typiska i en kontext till en annan kontext som gör mänskligt lärande, kreativitet och problemlösning så unikt.
Det finns inget som helst brist på verkliga exempel. Ta August Kekulé, den briljanta tyska kemisten, som fick en antydan om benzens struktur i form av en dröm där han såg en orm som bet sig själv i svansen. Idag tillämpar programmerare lärdomar från att organisera ett kök när de strukturerar kod, och lärare förklarar elektrisk ström genom att jämföra den med vatten som flödar genom rör.
Nuvarande AI-system har dock svårt att hantera denna vanliga kognitiva färdighet. När de tillfrågas, är moderna stora språkmodeller (LLM) mer än glada att förklara varför “tid är pengar” eller att slutföra verbala resonemangspussel. Men växande bevis tyder på att de ofta ägnar sig åt sofistikerad mönsterigenkänning, snarare än äkta strukturell kartläggning. När forskare presenterar dessa modeller med nya analogiska problem som avviker från deras träningsdata, sjunker prestationen ofta. Detta beror på att LLM är bra på att reproducera analogier de har sett tidigare, men sviker när de tillfrågas att skapa nya kopplingar.
Inget analogiskt resonemang, ingen AGI
Tydligt, analogiskt resonemang är sine qua non för AGI. Utan det, förblir AI-system sköra, oförmögna att anpassa kunskap som är relevant i en domän för att lösa problem i en annan. Till exempel, föreställ er en självkörande bil som har lärt sig att navigera på soliga Kaliforniens gator, men inte kan extrapolera det lärandet till att hantera snöiga förhållanden. Bilens AI-system är en dyr mönsterigenkänning, inte ett system som är kapabelt till äkta intelligens. Sann intelligens skulle kräva den kognitiva flexibiliteten att känna igen att att köra på isiga vägar är strukturellt jämförbart med andra hala-ytor-scenarier, även om detaljerna skiljer sig.
Samma princip gäller i domäner bortom autonoma fordon, naturligtvis. Analogiskt tänkande driver också framåt i vetenskap, medicinsk diagnos, juridiskt resonemang och kreativa företag. AI-system utan denna förmåga liknar en lärde som har memorerat en hel bibliotek, men inte kan syntetisera den kunskapen över discipliner. Imponerande, visst, men bara på ett smalt begränsat sätt.
Att bygga den analogiska hjärnan
Så, vad skulle det ta att utveckla AI-system som är kapabla till mänskligt analogiskt resonemang? Baserat på ny forskning och den grundläggande naturen av analogiskt tänkande, verkar flera kritiska förhållanden och tekniker vara nödvändiga.
Strukturellt rikt och varierat träningsdata
Det första kravet är att AI-system tränas på data som går bortom ytnivå-textmönster. Internet, med dess enorma repository av vetenskapliga artiklar, teknisk dokumentation, kreativa verk och förklarande innehåll, är en bra utgångspunkt. Men inte vilken internetdata som helst kommer att fungera. Vad som krävs är strukturell mångfald. Med andra ord, för att vägleda AI-system mot att lära sig att känna igen abstrakta mönster, bör utvecklare börja exponera dem för kontraster från den första dagen av träningsdata. Deras träningsdata kunde innehålla arkitektoniska ritningar bredvid musikaliska partitur, matematiska bevis tillsammans med poesi, eller juridiska argument bredvid recept.
Mer viktigt, denna data behöver bevara och framhäva strukturella relationer, inte bara statistiska korrelationer. Kunskapsgrafer, orsakssambandsdiagram och explicit kartlagda relationer mellan koncept kunde hjälpa AI-system att lära sig att “se” struktur snarare än att memorerar associationer mekaniskt. Tänk på det som att lära AI inte bara vad saker är, utan hur de relaterar till varandra på principiella sätt.
Testning bortom träningsuppsättningen
För att säkerställa att AI-system lär sig att resonera analogt, och inte bara förbättrar sin mimikry, behöver vi verktyg som medvetet testar deras förmåga att kartlägga struktur på situationer de aldrig har stött på tidigare. Detta innebär att konstruera testproblem som är medvetet olika från allt som sannolikt kommer att dyka upp i träningsdata – vad forskare kallar “kontrafaktiska” uppgifter.
Till exempel, istället för att be en AI att slutföra standardanalogier som “valp är till hund som katt är till ____”, kunde vi presentera dem med problem som använder uppfunna koncept eller be dem att kartlägga relationer mellan domäner de aldrig har sett kopplade. Kan de känna igen att relationen mellan ingredienser och ett recept paralleller relationen mellan bevis och ett juridiskt argument, även om de aldrig har sett den specifika jämförelsen? Sådana tester skulle avslöja om systemet förstår underliggande strukturer eller bara minns liknande exempel.
Att mäta vad som betyder något
Den goda nyheten för AI-utvecklare är att det finns decennier av kognitiv vetenskaplig forskning som behandlar specifikt hur människor bearbetar analogier. De kan använda denna forskning för att utveckla robusta benchmark för analogiskt resonemang. Men dessa benchmark måste gå bortom att bara räkna rätt svar på analogitester. Vad som verkligen behövs är metoder som fångar om AI-system kan identifiera vilka relationer som är relevanta att kartlägga, medan de ignorerar ytnivålikheter och upprätthåller konsekvens över sina kartläggningar.
Detta kan innefatta system som belönar identifiering av högre ordningens relationer. Till exempel, en AI kommer att få högre poäng om den kan inte bara känna igen att både atomer och solsystem innehåller kretsande, utan också förstå de orsakssamband som styr dessa kretsningar. En annan kompetens att utvärdera kunde vara om AI kan spontant generera lämpliga analogier för att förklara nya koncept, inte bara slutföra förstrukturerade analogiproblem.
Stöd genom att fråga
Nylig forskning tyder på att AI:s förmåga att tänka analogt beror till stor del på hur det tillfrågas att göra det. Analogiskt frågande – att explicit vägleda modeller genom processen att kartlägga struktur – kan framkalla mer sofistikerat resonemang än att bara presentera problem kallt. Detta kan innefatta att först be systemet att identifiera relationer i en käll-domän, sedan explicit begära att det kartlägger dessa relationer till en mål-domän.
Denna teknik kunde tjäna dubbla syften: att förbättra nuvarande AI-systems analogiska förmågor, samtidigt som den genererar träningsdata för framtida modeller. Genom att spela in lyckade instanser av väglett analogiskt resonemang, kan exempel skapas som kan lära efterföljande system att engagera sig i denna process mer naturligt.
Hybridarkitekturer
Att uppnå mänskligt analogiskt resonemang kan kräva att man går bortom rena neurala nätverksapprocher. Hybrid-system som kombinerar mönsterigenkänning med symboliskt resonemang – explicit representera och manipulera strukturella relationer – kunde tillhandahålla den saknade biten. Medan neurala nätverk excellerar i att lära sig implicita mönster, kan symboliska system tvinga strukturell konsekvens och logisk kartläggning som analogiskt resonemang kräver.
Hybridarkitekturer är fortfarande i sin linda, men forskare undersöker aktivt deras potential. Vissa, till exempel, argumenterar för att kombinera neurala nätverk med symboliskt resonemang som kan leda till förbättrade analogiska förmågor. Andra främjar hybridmodeller som byggs för att hantera AI-modellers tendens att fabulera och tänka analogt på ett grunt sätt.
Vart nästa?
Beroende på vem du frågar, är analogiskt resonemang antingen redan framträdande eller AI-modeller blir bara mer sofistikerade i sin mimikry. Oavsett vilken position som är närmare sanningen, är det tydligt att, om drömmen om AGI ska förverkligas, kommer det att kräva mer än bara större modeller eller mer data. Det kommer också att kräva några grundläggande innovationer i hur vi strukturerar, tränar och utvärderar våra AI-system.
När AI:s transformerande förmågor utvecklas, kommer analogiskt resonemang att representera både en kritisk benchmark för prestation och en nykter påminnelse om gapet mellan AI:s nuvarande förmågor och äkta mänsklig kognition. När ett AI-system kan se att demokrati är för medborgare vad en orkester är för musiker – att känna igen inte ytnivåegenskaper utan djupa strukturella relationer om samordning, representation och framväxande harmoni – kommer det att ha korsat en avgörande tröskel mot sann intelligens.












