Modelli e piattaforme di IA

La Svolta Neurosimbolica: Perché i Modelli di Linguaggio Puri Stanno Incontrando un Ostacolo

mm
Aggiungi Unite.AI alle tue fonti preferite su Google

L’industria dell’intelligenza artificiale sta vivendo un cambiamento significativo che non è ancora ampiamente riconosciuto. Mentre i modelli di linguaggio grandi (LLM) continuano a dominare il campo, un nuovo approccio sta emergendo silenziosamente. Questo approccio, denominato qui Neurosymbolic LLM, consente ai modelli di linguaggio basati su reti neurali di utilizzare il ragionamento simbolico per eseguire il compito. A differenza dei modelli di linguaggio puri, che si basano esclusivamente sulle reti neurali e sul riconoscimento di pattern, i Neurosymbolic LLM convertano prima le istruzioni del linguaggio naturale in programmi simbolici e poi utilizzano interpreti simbolici esterni, come interpreti di linguaggi di programmazione, per eseguirli. Questa integrazione migliora la capacità del modello di gestire compiti complessi, offrendo maggiore accuratezza, trasparenza e interpretazione. In questo articolo, esploreremo le ragioni dietro il crescente spostamento verso i Neurosymbolic LLM.

La Mitologia della Scalabilità si Sfaldra

La promessa chiave dell’era dei modelli di linguaggio puri era semplice: modelli più grandi produrrebbero risultati migliori. L’idea era che con più dati e potenza di calcolo, l’intelligenza artificiale potesse produrre risultati migliori. Questa teoria funzionava per un po’, ma gli sviluppi recenti hanno mostrato i suoi limiti. Un esempio recente è Grok 4, che utilizzava 100 volte la potenza di calcolo del suo predecessore ma non mostrava miglioramenti significativi su benchmark impegnativi come Humanity’s Last Exam. Mentre Grok 4 si è esibito meglio in alcune aree, i guadagni sono stati molto più piccoli del previsto. Tuttavia, quando sono stati integrati strumenti simbolici in questi modelli, le prestazioni sono migliorate in modo drammatico. Ciò suggerisce che la scalabilità da sola non è la chiave per migliorare le prestazioni dell’intelligenza artificiale e che l’approccio neurosimbolico ha il potenziale per superare i modelli di linguaggio puri.

Le Limitazioni delle Reti Neurali Pure

I modelli di linguaggio puri hanno debolezze innate che la scalabilità non può superare. Queste limitazioni derivano dal modo in cui i modelli di linguaggio sono costruiti utilizzando reti neurali, che si basano principalmente sul riconoscimento di pattern. Sebbene efficaci in molti contesti, la loro dipendenza dal riconoscimento di pattern e la mancanza di capacità di ragionamento limitano la loro capacità di eseguire compiti complessi che richiedono una comprensione più profonda o un’inferenza logica. Ad esempio, quando i ricercatori di Apple (AAPL ) hanno aggiunto clausole non pertinenti a problemi matematici, i modelli di linguaggio di stato dell’arte hanno visto cali di accuratezza fino al 65%. Nello studio GSM-Symbolic , i modelli di linguaggio si sono esibiti male quando i numeri sono stati spostati o sono state aggiunte clausole extra, anche con input visivi perfetti.

Un altro esempio di questo difetto è visibile nella costruzione di cruciverba. ChatGPT, che non può comprendere il codice, fatica con compiti come la costruzione di griglie. Ciò lo ha portato a fare errori semplici come riconoscere “RCRCT” come una parola valida. Al contrario, o3 di OpenAI, che utilizza codice simbolico, può creare griglie di cruciverba correttamente. Ciò mostra che i modelli di linguaggio puri non possono eseguire in modo affidabile processi algoritmici, distinguere la correlazione dalla causalità o mantenere la coerenza logica in compiti di ragionamento a più passaggi.

La Ascesa dell’Intelligenza Artificiale Simbolica: Precisione Logica sul Riconoscimento di Pattern

L’intelligenza artificiale simbolica utilizza un sistema trasparente e basato su regole che è più facile da comprendere e verificare. A differenza delle reti neurali, che sono spesso opache, i sistemi simbolici forniscono percorsi di ragionamento chiari dall’input alla conclusione. Ciò rende l’intelligenza artificiale simbolica ideale per applicazioni che richiedono trasparenza e responsabilità.

I sistemi simbolici sono anche più efficienti. Ad esempio, il Neuro-Symbolic Concept Learner raggiunge un’alta accuratezza utilizzando solo il 10% dei dati richiesti dalle reti neurali tradizionali. Inoltre, i sistemi simbolici possono fornire spiegazioni leggibili dagli esseri umani per ogni decisione, il che è cruciale per settori come la sanità, la finanza e il diritto.

Studi recenti mostrano l’efficacia degli approcci simbolici in compiti come il problema della Torre di Hanoi, dove modelli come o3 si sono esibiti meglio quando è stato utilizzato codice simbolico. Allo stesso modo, il Abductive Rule Learner con consapevolezza del contesto (ARLC) ha dimostrato un’accuratezza quasi perfetta in problemi aritmetici, mentre i modelli di linguaggio puri hanno faticato a raggiungere anche il 10% di accuratezza man mano che i problemi diventavano più complessi.

La Crescita della Domanda di Intelligenza Artificiale Spiegabile

Man mano che le normative sui sistemi di intelligenza artificiale aumentano, la domanda di intelligenza artificiale spiegabile e trasparente crescerà. Settori come la sanità, la finanza e il diritto richiedono sistemi di intelligenza artificiale che possano spiegare il loro ragionamento. L’intelligenza artificiale neurosimbolica è particolarmente adatta a soddisfare queste esigenze. L’Atto sull’Intelligenza Artificiale dell’Unione Europea e normative simili stanno spingendo le aziende ad adottare sistemi di intelligenza artificiale che dimostrino responsabilità e trasparenza.

Inoltre, le tendenze di investimento si stanno spostando verso sistemi di intelligenza artificiale che possano bilanciare le prestazioni con la spiegabilità. Le aziende che valorizzano sia l’innovazione che la fiducia stanno trovando i sistemi neurosimbolici, con la loro superiore capacità di spiegare le decisioni, sempre più attraenti.

Migliorare l’Affidabilità dell’Intelligenza Artificiale con l’Integrazione Neurosimbolica

Mentre i modelli di linguaggio puri hanno fatto progressi significativi, la loro affidabilità rimane una preoccupazione, in particolare in settori ad alto rischio come la sanità, il diritto e la finanza. Questa mancanza di affidabilità deriva dalla dipendenza dei modelli di linguaggio da pattern e probabilità, che può portare a output imprevedibili e errori. I modelli di linguaggio neurosimbolici, che combinano reti neurali con ragionamento simbolico, offrono una soluzione. Utilizzando la logica per verificare e organizzare le informazioni, i modelli di linguaggio possono garantire che le risposte generate siano sia accurate che affidabili. Ciò può ridurre gli errori, migliorare la trasparenza e mantenere la coerenza negli output. Questo approccio potrebbe essere particolarmente prezioso in settori critici, migliorando la fiducia nei sistemi di intelligenza artificiale. Un esempio di questo approccio, il modello GraphRAG, mostra come combinare queste tecnologie possa migliorare sia la creatività che l’accuratezza.

I Modelli di Linguaggio Neurosimbolici in Azione

I modelli di linguaggio neurosimbolici hanno mostrato prestazioni notevoli nel affrontare sfide complesse. I sistemi di Google DeepMind, come AlphaFold, AlphaProof e AlphaGeometry, combinano modelli di linguaggio con ragionamento simbolico per ottenere risultati eccezionali nella piegatura delle proteine, nella dimostrazione di teoremi matematici e nella risoluzione di problemi geometrici. Utilizzano tecniche di ragionamento simbolico come la ricerca e l’iterazione condizionale, che le reti neurali tradizionali avevano abbandonato. Inoltre, i modelli moderni stanno utilizzando sempre più regole simboliche per l’aumento dei dati, mostrando che il ragionamento simbolico sta diventando una parte chiave dei sistemi di intelligenza artificiale leader.

Sfide e Opportunità

Mentre i modelli di linguaggio neurosimbolici hanno fatto progressi significativi, c’è ancora molto lavoro da fare. Le attuali implementazioni, come l’aggiunta di interpreti di codice ai modelli di linguaggio, offrono capacità funzionali, ma non sono ancora una soluzione completa per soddisfare i requisiti dell’intelligenza artificiale generale (AGI). La vera sfida è sviluppare sistemi in cui i componenti neurali e simbolici lavorino insieme in modo fluido, consentendo alle macchine di ragionare e comprendere il mondo come gli esseri umani. Uno degli obiettivi futuri dei modelli di linguaggio neurosimbolici è abilitarli a integrarsi dinamicamente con diversi modi di ragionamento senza perdere coerenza. Ciò li renderà in grado di ragionare in modo diverso in diverse situazioni. Tuttavia, ciò richiede una nuova architettura che possa utilizzare il ragionamento simbolico insieme alle reti neurali.

Il Punto di Partenza

L’ascesa dell’intelligenza artificiale neurosimbolica rappresenta un cambiamento di paradigma nello sviluppo dell’intelligenza artificiale. Mentre i modelli di linguaggio tradizionali hanno dimostrato la loro efficacia in molti ambiti, sono limitati dalla loro dipendenza dal riconoscimento di pattern e dalla mancanza di capacità di ragionamento. L’approccio neurosimbolico emergente, che combina modelli di linguaggio con ragionamento simbolico, offre vantaggi significativi in termini di accuratezza, trasparenza e interpretazione. I sistemi neurosimbolici eccellono in compiti che richiedono ragionamento complesso, precisione logica e spiegabilità. Queste qualità sono sempre più importanti in settori regolamentati come la sanità, la finanza e il diritto. Con la crescente domanda di trasparenza e responsabilità dell’intelligenza artificiale, l’intelligenza artificiale neurosimbolica sta diventando una soluzione critica per lo sviluppo di sistemi più affidabili e comprensibili. Tuttavia, rimangono sfide nella piena integrazione dei componenti neurali e simbolici, e sarà necessaria una continua innovazione per creare sistemi in grado di ragionare dinamicamente attraverso più modalità.

Il dottor Tehseen Zia è un professore associato con tenure presso l'Università COMSATS di Islamabad, con un dottorato in Intelligenza Artificiale presso l'Università Tecnica di Vienna, Austria. Specializzato in Intelligenza Artificiale, Apprendimento Automatico, Scienza dei Dati e Visione Artificiale, ha apportato contributi significativi con pubblicazioni su riviste scientifiche reputate. Il dottor Tehseen ha anche guidato vari progetti industriali come principale investigatore e ha lavorato come consulente di Intelligenza Artificiale.