Leader di pensiero

La personalizzazione dell’AI continua a fallire, e il modello raramente è il motivo

mm
Aggiungi Unite.AI alle tue fonti preferite su Google

Ogni funzionalità dell’AI sembra brillante nella demo. Il saluto personalizzato atterra, la raccomandazione sembra incredibile e la stanza annuisce. Il problema inizia settimane dopo, quando la stessa funzionalità dice a un utente reale qualcosa di confusamente sbagliato, e loro non si fidano più di essa.

Nel 2026, la personalizzazione dell’AI è l’elemento principale che ogni team di prodotto pianifica. Eppure, il 42% delle aziende ha abbandonato la maggior parte delle loro iniziative di AI prima della produzione, rispetto al 17% dell’anno precedente. La maggior parte di ciò che viene spedito è aggiunto tardi e si rompe in modi che si potevano prevedere fin dal primo giorno. Ecco i quattro errori che continuiamo a vedere, appresi costruendo una linea di dispositivi di rilevamento, ma nessuno di loro riguarda i sensori o il hardware in sé. Se stai aggiungendo un livello di personalizzazione a qualcosa, loro ti stanno aspettando.

Parlando del rilevamento della qualità dell’aria, un esempio veloce per rendere concreto. Un dispositivo posizionato in una nuova casa inizia a sapere nulla sulla sua baseline, sui modelli di cottura, sulle peculiarità della ventilazione o sui cicli di polline stagionali. Ogni modello che emerge nelle prime settimane è una proiezione, non un ritratto. La lacuna tra proiezione e ritratto è dove vivono i quattro errori.

Errore 1: Raggiungere per un modello più grande quando il problema è i dati

Quando la personalizzazione non funziona, l’istinto è quello di aggiornare il modello, il che raramente aiuta. La personalizzazione funziona sui dati per utente, eppure questi dati sono sottili e pieni di buchi. Un nuovo utente non ha storia, e ogni team riscopre il problema di avvio freddo in modo difficile. Un utente attivo ti dà alcuni giorni di letture che sembrano nulla come un modello stabile. Alimenta questo in un modello capace e… non ottieni insight. Ottieni spesso nonsense confidenziale perché il modello riempie silenziosamente le lacune con la media di tutti gli altri e la presenta come la tua.

La catena di approvvigionamento dei dati è il vero vincolo. Secondo un sondaggio del 2025 di 200 CMO negli Stati Uniti, Regno Unito, Germania, Austria e Svizzera, solo il 45% dei dati che le organizzazioni raccolgono è effettivamente utilizzabile per la presa di decisioni guidata dall’AI. Un’analisi separata RAND ha trovato che molti progetti di AI falliscono perché le organizzazioni mancano dei dati necessari per addestrare modelli di AI efficaci, insieme a lacune organizzative e di flusso di lavoro, piuttosto che la qualità del modello. Il rapporto “GenAI Divide” del MIT pone il tasso di fallimento della produzione ancora più alto. Circa il 95% dei piloti di AI generativa aziendale falliscono nel fornire un impatto P&L misurabile, con workflow fragili e apprendimento contestuale insufficiente citati come i principali colpevoli.

Uno studio Nature Medicine ha trovato lo stesso modello nell’AI medica. I sistemi hanno funzionato bene quando sono stati forniti di casi completi e strutturati e hanno inciampato quando le persone comuni hanno descritto le loro situazioni in modo parziale e un po’ confuso, come le persone reali parlano effettivamente. La verità è che i vostri utenti sono in uno stato parziale e confuso per default. La soluzione non è un modello più affilato – è un resoconto onesto di quanto poco si sa realmente su questa persona, e la disciplina di agire di conseguenza. Fino a quando non si è imparato (e guadagnato) una baseline personale, la mossa giusta è spesso personalizzare di meno, non di più, e fare affidamento su ciò che vale per le persone piuttosto che inventare un profilo da un pugno di punti.

Nel rilevamento della qualità dell’aria, il problema della baseline è strutturale. Stabilire un profilo di qualità dell’aria personale significativo richiede settimane di letture continue attraverso diverse attività, stati di ventilazione e condizioni meteorologiche. Un dispositivo indoor installato in inverno cattura nulla del profilo di inquinanti estivi. Uno posizionato in cucina cattura nulla sulle condizioni della camera da letto. La deriva stagionale, i cambiamenti di occupazione e anche il riarrangiamento dei mobili possono spostare la baseline di un nucleo familiare di più di quanto gli anomali segnalati dall’AI siano supposti rilevare. Eppure, i team iniziano regolarmente a mostrare “intuizioni personalizzate” dopo 48 ore di dati – nel momento esatto in cui le medie della popolazione sono l’unico segnale onesto disponibile.

Errore 2: Spedire la fiducia che i dati non hanno guadagnato

Un modello non segnalerà quando sta indovinando a meno che non lo si costringa a farlo. Lasciato solo, spesso restituisce la stessa risposta nitida per un utente con tre anni di storia e un utente con tre ore. All’utente che lo legge, quelle risposte sembrano identiche – fino a quando una di loro è sbagliata.

È così che muore la fiducia. Dire a qualcuno che ha dormito male a causa di X con falsa certezza, sbagliare una volta in modo ovvio, e loro archivieranno il vostro intero prodotto come un gingillo. Sono pronti a farlo. Il deficit di fiducia è già strutturale: in un sondaggio di benchmark di Quantum Metric del 2026, l’81% dei consumatori ha detto che non sarebbe tornato a un marchio dopo un’unica esperienza di AI guidata scadente. Un sondaggio Rithum di acquirenti statunitensi e britannici ha trovato che il 58% incolpa il marchio – non lo strumento di AI – quando una raccomandazione di AI si rivela sbagliata, e il 16% eviterebbe di acquistare il prodotto nel complesso. Solo il 13% dei consumatori afferma di fidarsi completamente dell’AI.

La qualità dell’aria è un caso chiaro. Le concentrazioni di PM2.5 variano di un ordine di grandezza in una singola giornata a seconda della cottura, della pulizia, del traffico, del tempo e di una moltitudine di altri fattori. Dire a un utente che la sua esposizione è “elevata per lui” dopo tre giorni di letture confonde un martedì mattina con un modello personale permanente. Il modello non sta mentendo. Semplicemente, non ha modo di sapere ciò che non sa – a meno che il team non abbia costruito quella consapevolezza all’interno. Visualizzare un intervallo di confidenza (“il tuo intervallo tipico è ancora in fase di definizione”) non è un segnale di debolezza. Nei prodotti di rilevamento legati alla salute, è l’unica cosa onesta da mostrare.

Le poste in gioco si moltiplicano nei contesti sanitari. Uno studio qualitativo JMIR mHealth ha trovato che la disponibilità degli utenti a condividere dati sanitari personali e ad agire in base alle raccomandazioni di AI dipende fortemente dalla comprensione di come il sistema utilizzi i loro dati e se il ragionamento sia spiegato chiaramente. Uno studio di visualizzazione dell’incertezza ha trovato che la visualizzazione dell’incertezza di AI può aumentare la fiducia appropriata piuttosto che allarmare semplicemente gli utenti.

La funzionalità di affidabilità più economica da costruire è la linea “ancora non ci sono abbastanza dati” o “in fase di apprendimento”. Quasi nessuno la costruisce, perché sembra ammettere debolezza. Eppure è il contrario. Quella linea mantiene un utente il giorno in cui una stima confidenziale li avrebbe persi.

Errore 3: Ottimizzare per il wow invece che per l’utilità

Molte personalizzazioni sono costruite per impressionare nella prima sessione, non per aiutare nella centesima. Il momento wow si dimostra in modo splendido e invecchia male. Peggio, lo stesso trucco che sembra magico si capovolge in inquietante nel momento in cui fraintende qualcuno – la valle inquietante che silenziosamente distrugge un marchio.

Le persone possono sentire la differenza tra AI che serve loro e AI che serve un cruscotto. Un rapporto sulle tendenze dell’esperienza del consumatore Qualtrics del 2026 ha trovato che quasi uno su cinque consumatori che hanno utilizzato l’AI per il servizio clienti non ha visto alcun vantaggio.

I numeri di abbandono raccontano la storia chiaramente. Il 71% dei consumatori afferma che abbandonerebbe un acquisto se l’esperienza guidata dall’AI non fosse pertinente per loro. Nel commercio elettronico in particolare, il 69% degli acquirenti lascia una ricerca a causa di raccomandazioni di AI non pertinenti. Nel frattempo, l’80% dei leader aziendali valuta la personalizzazione della propria azienda come eccellente – ma solo l’8% dei clienti è d’accordo. Quella lacuna è un problema di prodotto poiché i team ottimizzano le metriche che si sentono bene internamente piuttosto che i risultati che si sentono bene e pertinenti per gli utenti.

La ricerca di Gartner ha trovato che i clienti personalizzati sono 3,2 volte più propensi a pentirsi di un acquisto e il 44% meno propensi a ricomprare dallo stesso marchio – un’accusa di personalizzazione che priorizza la conversione sull’adattamento. Il wow diventa un passivo.

La novità tende a svanire più velocemente ogni anno. Le funzionalità che sopravvivono al secondo anno di un prodotto sono quelle costruite per la centesima sessione, non per la prima.

Errore 4: Personalizzare all’interno di una scatola nera

La personalizzazione spesso richiede dati piuttosto intimi, e più il modello è personale, più sensibile è il mucchio per cui ora sei responsabile. Ciò ha smesso di essere astratto nel 2026. Nei primi mesi dell’anno, cinque aziende tecnologiche hanno lanciato strumenti di salute AI dedicati ai consumatori, inclusi prodotti che consentono agli utenti di collegare registri medici, risultati di laboratorio e dati di wearable in un unico profilo. Qualsiasi cosa tu personalizzi si sta avvicinando a sistemi come quelli.

Due fallimenti seguono. Il primo è l’opacità. Una raccomandazione che un utente non può aprire, mettere in discussione o correggere non è personalizzazione, è un verdetto, e le persone risentono dei verdetti sul loro corpo e sulle loro abitudini. Gli allenatori di salute AI ora comuni nelle app di benessere vivono o muoiono in base alla capacità dell’utente di vedere il ragionamento dietro il consiglio. Lo studio JMIR mHealth ha confermato questo direttamente: la disponibilità degli utenti a condividere dati sanitari personali e ad agire in base alle raccomandazioni di AI dipendeva fortemente dalla possibilità di accedere a spiegazioni chiare e proattive su come venivano utilizzati i loro dati.

Il secondo fallimento è la negligenza. I team accumulano ogni segnale “nel caso in cui il modello lo richieda”, creando un passivo che non hanno mai valutato. Il rapporto State of Customer Data del 2026 di Transcend ha trovato che il 93% delle organizzazioni affronta problemi di autorizzazione o governance dei dati durante il ciclo di vita di AI, e che l’85% delle imprese manca di almeno una delle quattro capacità di governance dei dati di AI fondamentali. Il 30% delle iniziative di personalizzazione/esperienza del cliente di AI si è bloccato specificamente a causa di queste lacune. Un ulteriore 61% dei consumatori è scettico su come i marchi utilizzino i loro dati, mentre il 54% vuole sapere quando interagisce con l’AI.

È meglio raccogliere meno e rendere le inferenze leggibili. Lascia che le persone discutano con loro.

Cosa hanno in comune i fallimenti

Nota il filo conduttore. Nessuno di questi è un fallimento di intelligenza. Il modello è solitamente la parte più forte dello stack. Sono fallimenti di onestà: su quanti pochi dati si hanno, su quanto si è realmente sicuri, su cosa si è costruito la funzionalità per fare e su cosa si sta raccogliendo e perché. È scomodo, perché l’onestà non si dimostra bene, purtroppo. Un margine è meno impressionante di una risposta confidenziale, e una funzionalità piccola e curata sembra modesta accanto a una funzionalità ampia. I team che vincono il secondo anno sono quelli che hanno fatto pace con questo.

Cosa funziona effettivamente

Nessuna di queste è un’argomentazione contro la personalizzazione dell’AI. È un’argomentazione per la moderazione. Ristringi l’ambito fino a quando non puoi essere giusto all’interno di esso. Calibra prima di interpretare e mantieni ciò che hai misurato separato da ciò che hai dedotto. Mostra l’incertezza invece di nasconderla. Rendi ogni inferenza qualcosa che un utente possa ispezionare e mettere in discussione o respingere. Guadagna la prossima parte di fiducia prima di spenderla. Tutto ciò è poco glamour – ed è la linea tra una funzionalità che le persone mantengono e una che spegne in una settimana.

Torna alla demo. La versione che impressiona una stanza il primo giorno e la versione che un utente si fida ancora di un anno dopo non sono lo stesso prodotto, e la distanza tra loro è quasi mai il modello. È se il team ha detto la verità sui dati sottili, si è sentito a suo agio dicendo “non so” e ha mostrato il suo lavoro. La parte difficile della personalizzazione dell’AI non è mai stata sull’intelligenza. È stata l’umiltà. La maggior parte dei team sta ancora saltando quella parte, e i loro utenti possono dirlo.

Alex Pyshkin, Responsabile Ricerca e Sviluppo presso ATMO (Atmotech Inc.), un'azienda che sviluppa traccianti di qualità dell'aria intelligenti. Alex si specializza in elettronica di consumo, IoT e dispositivi mobili, con oltre 15 anni di esperienza nel settore dei dispositivi mobili, compresa l'esperienza lavorativa internazionale per società multinazionali in un ambiente multiculturale.