Leader di pensiero
Nuove Frontiere nell’Intelligenza Artificiale Generativa — Lontano dalle Nuvole

All’inizio, c’era internet, che ha cambiato le nostre vite per sempre — il modo in cui comunichiamo, facciamo acquisti, conduciamo attività commerciali. E poi, per motivi di latenza, privacy e efficienza dei costi, internet si è spostato verso il bordo della rete, dando origine all'”internet delle cose”.
Ora c’è l’intelligenza artificiale, che rende tutto ciò che facciamo su internet più facile, personalizzato e intelligente. Tuttavia, per utilizzarla, sono necessari grandi server e una grande capacità di calcolo, quindi è confinata alle nuvole. Ma le stesse motivazioni — latenza, privacy, efficienza dei costi — hanno spinto aziende come Hailo a sviluppare tecnologie che consentono l’utilizzo dell’intelligenza artificiale al bordo.
Senza dubbio, la prossima grande cosa è l’intelligenza artificiale generativa. L’intelligenza artificiale generativa presenta un enorme potenziale in vari settori. Può essere utilizzata per semplificare il lavoro e aumentare l’efficienza di vari creatori — avvocati, scrittori di contenuti, designer grafici, musicisti e molti altri. Può aiutare a scoprire nuovi farmaci terapeutici o aiutare nelle procedure mediche. L’intelligenza artificiale generativa può migliorare l’automazione industriale, sviluppare nuovo codice software e migliorare la sicurezza dei trasporti attraverso la sintesi automatica di video, audio, immagini e altro.
Tuttavia, l’intelligenza artificiale generativa come esiste oggi è limitata dalla tecnologia che la consente. Ciò perché l’intelligenza artificiale generativa avviene nelle nuvole — grandi centri di dati costosi e consumatori di energia lontani dagli utenti reali. Quando qualcuno invia una richiesta a uno strumento di intelligenza artificiale generativa come ChatGPT o una nuova soluzione di videoconferenza basata sull’intelligenza artificiale, la richiesta viene trasmessa via internet alle nuvole, dove viene elaborata dai server prima che i risultati vengano restituiti sulla rete.
Man mano che le aziende sviluppano nuove applicazioni per l’intelligenza artificiale generativa e le distribuiscono su diversi tipi di dispositivi — telecamere e sistemi di sicurezza, robot industriali e personali, laptop e anche auto — le nuvole rappresentano un collo di bottiglia in termini di larghezza di banda, costo e connettività.
E per applicazioni come l’assistenza alla guida, il software per computer personale, la videoconferenza e la sicurezza, spostare costantemente dati su una rete può rappresentare un rischio per la privacy.
La soluzione è consentire a questi dispositivi di elaborare l’intelligenza artificiale generativa al bordo. In effetti, l’intelligenza artificiale generativa basata sul bordo può beneficiare molte applicazioni emergenti.
L’Intelligenza Artificiale Generativa in Ascesa
Considera che nel giugno scorso, Mercedes-Benz ha dichiarato che avrebbe introdotto ChatGPT nelle sue auto. In un’auto Mercedes con ChatGPT, ad esempio, un guidatore potrebbe chiedere all’auto — senza usare le mani — una ricetta per la cena in base agli ingredienti che già ha a casa. Ciò è possibile se l’auto è connessa a internet. In un parcheggio o in una località remota, tutte le scommesse sono chiuse.
Negli ultimi due anni, la videoconferenza è diventata una seconda natura per la maggior parte di noi. Già, le aziende di software stanno integrando forme di intelligenza artificiale nelle soluzioni di videoconferenza. Forse è per ottimizzare la qualità audio e video in tempo reale, o per “collocare” le persone nello stesso spazio virtuale. Ora, le videoconferenze basate sull’intelligenza artificiale generativa possono creare automaticamente i verbali delle riunioni o recuperare informazioni rilevanti dalle fonti aziendali in tempo reale mentre vengono discusse diverse questioni.
Tuttavia, se un’auto intelligente, un sistema di videoconferenza o qualsiasi altro dispositivo al bordo non può raggiungere le nuvole, allora l’esperienza di intelligenza artificiale generativa non può verificarsi. Ma cosa succede se non dovessero farlo? Sembra un compito impegnativo considerando l’enorme elaborazione dell’intelligenza artificiale nelle nuvole, ma ora sta diventando possibile.
L’Intelligenza Artificiale Generativa al Bordo
Già ci sono strumenti di intelligenza artificiale generativa, ad esempio, che possono creare automaticamente presentazioni PowerPoint ricche e coinvolgenti. Tuttavia, l’utente ha bisogno che il sistema funzioni da qualsiasi luogo, anche senza una connessione internet.
Allo stesso modo, stiamo già vedendo una nuova classe di assistenti “copilota” basati sull’intelligenza artificiale generativa che cambieranno radicalmente il modo in cui interagiamo con i nostri dispositivi di calcolo, automatizzando molte attività di routine, come la creazione di report o la visualizzazione dei dati. Immagina di aprire un laptop, il laptop che ti riconosce attraverso la sua telecamera, quindi genera automaticamente un piano d’azione per il giorno/settimana/mese in base agli strumenti più utilizzati, come Outlook, Teams, Slack, Trello, ecc. Tuttavia, per mantenere la privacy dei dati e una buona esperienza utente, è necessario avere la possibilità di eseguire l’intelligenza artificiale generativa localmente.
In aggiunta alle sfide delle connessioni instabili e della privacy dei dati, l’intelligenza artificiale al bordo può aiutare a ridurre le richieste di larghezza di banda e migliorare le prestazioni delle applicazioni. Ad esempio, se un’applicazione di intelligenza artificiale generativa crea contenuti ricchi di dati, come uno spazio di conferenza virtuale, tramite le nuvole, il processo potrebbe essere lento a seconda della larghezza di banda disponibile (e costosa). E certi tipi di applicazioni di intelligenza artificiale generativa, come la sicurezza, la robotica o l’assistenza sanitaria, richiedono risposte ad alta prestazione e bassa latenza che le connessioni alle nuvole non possono gestire.
Nella sicurezza dei video, la capacità di riconoscere nuovamente le persone mentre si muovono tra molte telecamere — alcune posizionate dove le reti non possono raggiungere — richiede modelli di dati e elaborazione dell’intelligenza artificiale nelle telecamere stesse. In questo caso, l’intelligenza artificiale generativa può essere applicata alle descrizioni automatiche di ciò che le telecamere vedono attraverso semplici query come, “Trova il bambino di 8 anni con la maglietta rossa e il berretto da baseball”.
Quella è l’intelligenza artificiale generativa al bordo.
Sviluppi nell’Intelligenza Artificiale al Bordo
Attraverso l’adozione di una nuova classe di processori di intelligenza artificiale e lo sviluppo di modelli di intelligenza artificiale generativa più snelli e efficienti, sebbene non meno potenti, i dispositivi al bordo possono essere progettati per operare in modo intelligente dove la connessione alle nuvole è impossibile o indesiderabile.
Certo, l’elaborazione nelle nuvole rimarrà un componente critico dell’intelligenza artificiale generativa. Ad esempio, l’addestramento dei modelli di intelligenza artificiale rimarrà nelle nuvole. Tuttavia, l’atto di applicare gli input dell’utente a quei modelli, chiamato inferenza, può — e in molti casi dovrebbe — avvenire al bordo.
L’industria sta già sviluppando modelli di intelligenza artificiale più snelli, più piccoli e più efficienti che possono essere caricati sui dispositivi al bordo. Aziende come Hailo producono processori di intelligenza artificiale progettati appositamente per eseguire l’elaborazione dei network neurali. Tali processori di network neurali non solo gestiscono i modelli di intelligenza artificiale in modo incredibilmente rapido, ma lo fanno anche con meno potenza, rendendoli efficienti in termini energetici e adatti a una varietà di dispositivi al bordo, dalle smartphone alle telecamere.
L’elaborazione dell’intelligenza artificiale generativa al bordo può anche caricare efficacemente il bilanciamento dei carichi di lavoro in crescita, consentire alle applicazioni di scalare in modo più stabile, alleviare i centri di dati delle nuvole da elaborazioni costose e aiutarli a ridurre la loro impronta carbonica.
L’intelligenza artificiale generativa è pronta a cambiare nuovamente il modo di calcolare. In futuro, il modello di linguaggio grande sulla tua laptop potrebbe auto-aggiornarsi allo stesso modo del tuo sistema operativo oggi — e funzionare allo stesso modo. Ma per arrivare lì, dovremo abilitare l’elaborazione dell’intelligenza artificiale generativa al bordo della rete. Il risultato promette di essere una maggiore prestazione, efficienza energetica e sicurezza. Tutto ciò porta a applicazioni di intelligenza artificiale che cambiano il mondo tanto quanto l’intelligenza artificiale generativa stessa.












