Modelli e piattaforme di IA

You.com Web Search Highlights raggiunge il 95.17% su SimpleQA

mm
Aggiungi Unite.AI alle tue fonti preferite su Google

You.com, il 1 settembre 2026, ha introdotto una nuova modalità di estrazione per la sua Web Search API chiamata Highlights, segnalando un punteggio del 95.17% nel benchmark SimpleQA e un costo totale delle query inferiore del 35% rispetto alla ricerca web integrata di Claude Sonnet 5 in una valutazione indipendente. La funzionalità è disponibile tramite il parametro extraction_mode dell’API allo stesso prezzo di $5 CPM del servizio esistente, ha dichiarato l’azienda.

Cosa fa Highlights

L’API di ricerca web restituisce risultati web e news strutturati per le applicazioni AI. Per impostazione predefinita, ogni risultato contiene un array snippets di brevi frammenti di testo incentrati su parole chiave. Impostare extraction_mode su highlights sostituisce quegli snippet con un array contents.highlights contenente i passaggi di ciascuna pagina che rispondono alla query specifica.

Secondo You.com, l’estrazione avviene per ogni richiesta, con ogni query che avvia un nuovo passaggio sulla pagina. Un modello identifica quali intervalli di testo rispondono già alla query e li restituisce alla lettera, preservando numeri, date e cifre così come appaiono nella fonte. Le tabelle vengono restituite con le intestazioni intatte, i blocchi di codice mantengono la formattazione e le frasi della stessa sezione che sono entrambe rilevanti vengono unite in un unico passaggio. I passaggi candidati vengono ordinati, con i più alti in classifica restituiti per primi.

Risultati di Accuratezza

You.com ha dichiarato di aver eseguito tre benchmark su tutte e tre le modalità di estrazione. Highlights ha guidato su SimpleQA con il 95.17% e su RetrievalQA con il 66.93%, i due benchmark basati su ricerche di singoli fatti. Su FRAMES, un benchmark di ragionamento multi-hop, l’estrazione a pagina intera ha ottenuto l’82.77% contro gli 82.04% di Highlights, un divario di 0.73 punti che l’azienda ha descritto come rientrante nella variabilità tra esecuzioni osservata in quel test.

L’azienda ha osservato che il guadagno in accuratezza non è gratuito: il costo per domanda aumenta di circa l’11% rispetto a Snippets perché Highlights invia più testo al modello di risposta. Il costo per risposta corretta, che divide il costo per l’accuratezza, risulta comunque circa il 5% più basso, ha affermato.

Contro sistemi esterni su SimpleQA, You.com ha segnalato tre sistemi che superano il 95%: You.com con Highlights al 95.17% e latenza p50 di 695 ms, Exa (pagina intera) al 95.47% e 1337 ms, e Parallel (avanzato) al 95.33% e 2098 ms. L’azienda ha dichiarato di aver mostrato la configurazione con le migliori prestazioni di ciascun concorrente, quindi il confronto li favorisce in termini di configurazione.

Valutazione Indipendente dei Costi

Braintrust, nell’ambito di una valutazione indipendente, ha eseguito You.com Web Search con Highlights confrontandolo con gli strumenti di ricerca inclusi nelle API di OpenAI e Anthropic su 1.329 domande, includendo nel costo sia l’inferenza sia la ricerca.

In quella valutazione, Claude Sonnet 5 è costato $0.0747 per domanda con Highlights contro $0.1148 per la sua ricerca integrata, una riduzione del 35%, con un’accuratezza leggermente superiore (79.23% contro 78.78%) e 1.26 secondi più veloce. GPT-5.6 Terra è costato $0.0417 per domanda con Highlights contro $0.0467 integrato, una riduzione dell’11%, con un’accuratezza superiore di 3.66 punti. Il costo per risposta corretta è diminuito del 35% per Claude e del 15% per GPT, poiché Highlights ha risposto correttamente a più domande con la stessa spesa o inferiore, secondo il resoconto di You.com sui risultati.

Vantaggio di Osservabilità

You.com ha sostenuto che la ricerca web non confezionata offre una migliore osservabilità rispetto agli strumenti integrati di OpenAI e Anthropic. La ricerca integrata restituisce le query eseguite e le pagine citate, ma non i passaggi letti dal modello, ha affermato l’azienda, lasciando nessun modo per vedere quale passaggio ha prodotto una risposta errata.

Ha citato una domanda della valutazione di Braintrust che chiedeva quanti game di servizio ha perso Carlos Alcaraz in due tornei combinati, il che richiedeva l’addizione di due numeri distinti. La configurazione di You.com ha restituito un passaggio che stabiliva il primo valore a 24 e un altro che stabiliva il secondo a 22, e il modello li ha sommati per rispondere 46. Le esecuzioni che hanno fallito non hanno mai mostrato un passaggio a supporto del 24, hanno usato 22 per entrambi i valori e hanno risposto 44. Ogni esecuzione ha effettuato correttamente l’aritmetica, un fatto che l’azienda ha affermato sia conoscibile solo perché i passaggi appaiono nella traccia.

Quando non usarlo

You.com ha dichiarato che Highlights aggiunge circa 160 ms rispetto a Snippets nelle ricerche a colpo singolo, e che con un budget di latenza rigido per domande Q&A semplici gli Snippets rimangono l’impostazione predefinita più adeguata. Per le pagine che cambiano più rapidamente di quanto l’indice si aggiorni, extraction_mode: "full_page" recupera i dati in tempo reale anziché servirli dalla cache. FRAMES è dove questo compromesso si manifesta, ha affermato l’azienda, perché le sue domande multi‑hop richiedono una fetta di contesto più ampia rispetto a quanto fornisce un piccolo numero di passaggi strettamente delimitati, e la pagina intera supera Highlights di 0.73 punti.

L’azienda ha dichiarato che i nuovi account ricevono $100 di crediti e che il framework che produce i suoi numeri di benchmark è disponibile pubblicamente.

Jonas Reeve è un analista generato da AI presso Unite.AI, che si concentra sull'intelligenza artificiale cognitiva, l'intelligenza artificiale generale (AGI) e i fondamenti teorici dell'intelligenza delle macchine. Il suo lavoro esplora come l'apprendimento, il ragionamento, la memoria e l'astrazione emergano sia in sistemi biologici che artificiali, stabilendo collegamenti tra le moderne architetture di intelligenza artificiale e le lunghe domande della scienza cognitiva e della filosofia della mente.
Con un approccio concettuale e riflessivo, Jonas esamina framework come modelli di ragionamento, sistemi agente, cognizione emergente e teoria dell'allineamento, con l'obiettivo di chiarire cosa significhi realmente il progresso verso l'AGI - e cosa no. Piuttosto che inseguire le scadenze o l'entusiasmo, enfatizza i primi principi, la rigorosità concettuale e i limiti dei modelli attuali.
Gli articoli scritti da Jonas Reeve sono generati da AI e revisionati dal team editoriale di Unite.AI per garantire l'accuratezza, la chiarezza e la discussione responsabile dei concetti di intelligenza artificiale avanzata.