Modelli e piattaforme di IA

L’AI impara dall’AI: l’emergere dell’apprendimento sociale tra i grandi modelli linguistici

mm
Aggiungi Unite.AI alle tue fonti preferite su Google

Dal momento in cui OpenAI ha presentato ChatGPT 3.5 alla fine del 2022, il ruolo dei grandi modelli linguistici (LLM) fondamentali è diventato sempre più importante nell’intelligenza artificiale (AI), in particolare nell’elaborazione del linguaggio naturale (NLP). Questi LLM, progettati per elaborare e generare testi simili a quelli umani, imparano da una vasta gamma di testi tratti da internet, che vanno da libri a siti web. Questo processo di apprendimento consente loro di catturare l’essenza del linguaggio umano, facendo apparire gli LLM come risolutori di problemi generali.

Mentre lo sviluppo degli LLM ha aperto nuove porte, il metodo di adattamento di questi modelli per applicazioni specifiche, noto come fine-tuning, presenta le sue sfide. Il fine-tuning di un modello richiede un’ulteriore formazione su dataset più focalizzati, il che può portare a difficoltà come la necessità di dati etichettati, il rischio di deriva del modello e sovrapprendimento, e la necessità di risorse significative.

Affrontando queste sfide, i ricercatori di Google (GOOGL ) hanno recentemente adottato l’idea di ‘apprendimento sociale‘ per aiutare l’AI a imparare dall’AI. L’idea chiave è che, quando gli LLM vengono convertiti in chatbot, possono interagire e imparare gli uni dagli altri in modo simile all’apprendimento sociale umano. Questa interazione consente loro di imparare gli uni dagli altri, migliorando così la loro efficacia.

Cosa è l’apprendimento sociale?

L’apprendimento sociale non è un’idea nuova. Si basa su una teoria degli anni ’70 di Albert Bandura, che suggerisce che le persone imparano osservando gli altri. Questo concetto applicato all’AI significa che i sistemi di intelligenza artificiale possono migliorare interagendo gli uni con gli altri, imparando non solo dalle esperienze dirette ma anche dalle azioni dei pari. Questo metodo promette un’acquisizione di abilità più rapida e potrebbe anche permettere ai sistemi di intelligenza artificiale di sviluppare la loro propria “cultura” condivisa, condividendo conoscenze.

A differenza di altri metodi di apprendimento dell’AI, come l’apprendimento per tentativi ed errori apprendimento per rinforzo o apprendimento imitativo da esempi diretti, l’apprendimento sociale enfatizza l’apprendimento attraverso l’interazione. Offre un modo più pratico e comunitario per l’AI di acquisire nuove abilità.

Apprendimento sociale negli LLM

Un aspetto importante dell’apprendimento sociale è scambiare le conoscenze senza condividere informazioni originali e sensibili. Pertanto, i ricercatori hanno impiegato una dinamica insegnante-allievo in cui i modelli insegnanti facilitano il processo di apprendimento per i modelli allievi senza rivelare dettagli confidenziali. Per raggiungere questo obiettivo, i modelli insegnanti generano esempi sintetici o direzioni da cui i modelli allievi possono imparare senza condividere i dati effettivi. Ad esempio, considera un modello insegnante addestrato a distinguere tra messaggi di posta indesiderata e non indesiderata utilizzando dati contrassegnati dagli utenti. Se desideriamo che un altro modello padroneggi questo compito senza toccare i dati originali e privati, l’apprendimento sociale entra in gioco. Il modello insegnante creerebbe esempi sintetici o fornirebbe indicazioni in base alle proprie conoscenze, consentendo al modello allievo di identificare i messaggi di posta indesiderata in modo accurato senza essere esposto direttamente ai dati sensibili. Questa strategia non solo migliora l’efficienza dell’apprendimento, ma dimostra anche il potenziale degli LLM di imparare in modi dinamici e adattabili, potenzialmente costruendo una cultura condivisa della conoscenza. Una caratteristica fondamentale di questo approccio è la sua dipendenza da esempi sintetici e istruzioni create. Generando nuovi esempi informativi distinti dal set di dati originale, i modelli insegnanti possono preservare la privacy mentre guidano i modelli allievi verso un apprendimento efficace. Questo approccio ha dimostrato di essere efficace, raggiungendo risultati paragonabili a quelli ottenuti utilizzando i dati effettivi.

Come l’apprendimento sociale affronta le sfide del fine-tuning?

L’apprendimento sociale offre un nuovo modo per raffinare gli LLM per compiti specifici. Aiuta a gestire le sfide del fine-tuning nei seguenti modi:

  1. Meno bisogno di dati etichettati: Imparando da esempi sintetici condivisi tra modelli, l’apprendimento sociale riduce la dipendenza dai dati etichettati difficili da ottenere.
  2. Evitare la sovrapppecializzazione: Mantiene i modelli versatili esponendoli a una gamma più ampia di esempi rispetto a quelli presenti in piccoli set di dati specifici.
  3. Ridurre il sovrapprendimento: L’apprendimento sociale amplia l’esperienza di apprendimento, aiutando i modelli a generalizzare meglio e a evitare il sovrapprendimento.
  4. Risparmio di risorse: Questo approccio consente un uso più efficiente delle risorse, poiché i modelli imparano dalle esperienze degli altri senza necessità di accesso diretto a grandi set di dati.

Direzioni future

Il potenziale dell’apprendimento sociale negli LLM suggerisce vari modi interessanti e significativi per future ricerche sull’AI:

  1. Culture ibride dell’AI: Mentre gli LLM partecipano all’apprendimento sociale, potrebbero iniziare a formare metodologie comuni. Gli studi potrebbero essere condotti per indagare gli effetti di queste emergenti “culture” dell’AI, esaminando la loro influenza sulle interazioni umane e le questioni etiche coinvolte.
  2. Apprendimento cross-modale: Estendere l’apprendimento sociale oltre il testo per includere immagini, suoni e altro potrebbe portare a sistemi di intelligenza artificiale con una comprensione più ricca del mondo, simile a come gli esseri umani imparano attraverso più sensi.
  3. Apprendimento decentralizzato: L’idea di modelli di AI che imparano gli uni dagli altri attraverso una rete decentralizzata presenta un nuovo modo per scalare la condivisione della conoscenza. Ciò richiederebbe di affrontare sfide significative in termini di coordinamento, privacy e sicurezza.
  4. Interazione uomo-AI: C’è potenziale nell’esplorare come gli esseri umani e l’AI possano trarre vantaggio reciproco dall’apprendimento sociale, specialmente in ambienti educativi e collaborativi. Ciò potrebbe ridefinire come avviene il trasferimento della conoscenza e l’innovazione.
  5. Sviluppo etico dell’AI: Insegnare all’AI a gestire le sfide etiche attraverso l’apprendimento sociale potrebbe essere un passo verso sistemi di AI più responsabili. L’attenzione si concentrerebbe sullo sviluppo di sistemi di AI in grado di ragionare eticamente e allinearsi con i valori della società.
  6. Sistemi auto-miglioranti: Un ecosistema in cui i modelli di AI imparano e si migliorano continuamente gli uni dagli altri potrebbe accelerare l’innovazione dell’AI. Ciò suggerisce un futuro in cui l’AI possa adattarsi a nuove sfide in modo più autonomo.
  7. Privacy nell’apprendimento: Con i modelli di AI che condividono conoscenze, assicurarsi della privacy dei dati sottostanti è cruciale. Gli sforzi futuri potrebbero esplorare metodi più sofisticati per abilitare il trasferimento della conoscenza senza compromettere la sicurezza dei dati.

Il punto fondamentale

I ricercatori di Google hanno fatto da pionieri in un approccio innovativo chiamato apprendimento sociale tra i grandi modelli linguistici (LLM), ispirato alla capacità umana di imparare osservando gli altri. Questo quadro consente agli LLM di condividere conoscenze e migliorare le loro capacità senza accedere o esporre dati sensibili. Generando esempi sintetici e istruzioni, gli LLM possono imparare efficacemente, affrontando sfide chiave nello sviluppo dell’AI come la necessità di dati etichettati, la sovrapppecializzazione, il sovrapprendimento e il consumo di risorse. L’apprendimento sociale non solo migliora l’efficienza e l’adattabilità dell’AI, ma apre anche possibilità per l’AI di sviluppare culture condivise, impegnarsi in apprendimento cross-modale, partecipare a reti decentralizzate, interagire con gli esseri umani in nuovi modi, navigare le sfide etiche e assicurare la privacy. Ciò segna un significativo passo verso sistemi di AI più collaborativi, versatili ed etici, promettendo di ridefinire il panorama della ricerca e dell’applicazione dell’intelligenza artificiale.

Il dottor Tehseen Zia è un professore associato con tenure presso l'Università COMSATS di Islamabad, con un dottorato in Intelligenza Artificiale presso l'Università Tecnica di Vienna, Austria. Specializzato in Intelligenza Artificiale, Apprendimento Automatico, Scienza dei Dati e Visione Artificiale, ha apportato contributi significativi con pubblicazioni su riviste scientifiche reputate. Il dottor Tehseen ha anche guidato vari progetti industriali come principale investigatore e ha lavorato come consulente di Intelligenza Artificiale.