AI-modellen en platforms
You.com Web Search Highlights behaalt 95,17% op SimpleQA

You.com heeft op 1 september 2026 een nieuwe extractiemodus voor zijn Web Search‑API geïntroduceerd, genaamd Highlights, met een score van 95,17 % op de SimpleQA‑benchmark en een 35 % lagere totale query‑kost dan de ingebouwde websearch van Claude Sonnet 5 in een onafhankelijke evaluatie. De functie is beschikbaar via de API‑parameter extraction_mode tegen dezelfde $5 CPM‑prijs als de bestaande service, aldus het bedrijf.
Wat Highlights doet
De Web Search‑API levert gestructureerde web‑ en nieuwsresultaten voor AI‑toepassingen. Standaard bevat elk resultaat een snippets-array met korte, trefwoordgerichte tekstfragmenten. Door extraction_mode in te stellen op highlights worden die snippets vervangen door een contents.highlights-array met de passages van elke pagina die de specifieke query beantwoorden.
Volgens You.com wordt de extractie per verzoek uitgevoerd, waarbij elke query een nieuwe doorloop van de pagina triggert. Een model identificeert welke tekstfragmenten de query al beantwoorden en retourneert deze letterlijk, waarbij cijfers, data en getallen behouden blijven zoals ze in de bron stonden. Tabellen worden teruggegeven met intacte koppen, code‑blokken behouden hun opmaak, en zinnen uit dezelfde sectie die beide relevant zijn, worden samengevoegd tot één passage. Kandidaten‑passages worden gerangschikt, waarbij de hoogst gerangschikte eerst wordt geretourneerd.
Nauwkeurigheidsresultaten
You.com meldde dat het drie benchmarks heeft uitgevoerd over alle drie extractiemodi. Highlights scoorde het beste op SimpleQA met 95,17 % en op RetrievalQA met 66,93 %, de twee benchmarks die draaien om opzoekingen van één feit. Op FRAMES, een multi‑hop redeneer‑benchmark, behaalde volledige‑pagina‑extractie 82,77 % tegenover 82,04 % voor Highlights, een verschil van 0,73 punt dat het bedrijf beschrijft als binnen de run‑to‑run‑variatie die het bij die test observeert.
Het bedrijf merkte op dat de nauwkeurigheidswinst niet gratis is: de kosten per vraag stijgen met ongeveer 11 % ten opzichte van Snippets omdat Highlights meer tekst naar het beantwoordingmodel stuurt. De kosten per correct antwoord, die de kosten delen door de nauwkeurigheid, blijven volgens hen ongeveer 5 % lager.
Ten opzichte van externe systemen op SimpleQA meldde You.com drie systemen die 95 % behaalden: You.com met Highlights op 95,17 % en een p50‑latentie van 695 ms, Exa (volledige pagina) op 95,47 % en 1337 ms, en Parallel (geavanceerd) op 95,33 % en 2098 ms. Het bedrijf gaf aan dat het de best presterende configuratie van elke concurrent toonde, waardoor de vergelijking hen in het voordeel stelt bij de configuratie.
Onafhankelijke kostenbeoordeling
Braintrust heeft, als onderdeel van een onafhankelijke evaluatie, You.com Web Search met Highlights getest tegen de zoektools die zijn opgenomen in de OpenAI‑ en Anthropic‑API’s op 1.329 vragen, waarbij de kosten zowel inferentie‑ als zoekkosten omvatten.
In die evaluatie kostte Claude Sonnet 5 $0,0747 per vraag met Highlights tegenover $0,1148 voor de ingebouwde zoekfunctie, een daling van 35 %, met iets hogere nauwkeurigheid (79,23 % versus 78,78 %) en 1,26 secondes sneller. GPT‑5.6 Terra kostte $0,0417 per vraag met Highlights tegenover $0,0467 ingebouwd, een daling van 11 %, met 3,66 punten hogere nauwkeurigheid. De kosten per correct antwoord daalden met 35 % voor Claude en 15 % voor GPT, omdat Highlights meer vragen correct beantwoordde bij dezelfde of lagere uitgaven, volgens You.com’s weergave van de resultaten.
Voordeel in observeerbaarheid
You.com betoogt dat ongebundelde websearch een betere observeerbaarheid biedt dan de ingebouwde tools van OpenAI en Anthropic. Ingebouwde zoekopdrachten geven de uitgevoerde queries en de geciteerde pagina’s weer, maar niet de passages die het model leest, aldus het bedrijf, waardoor er geen manier is om te zien welke stap een foutief antwoord opleverde.
Het citeerde een vraag uit de evaluatie van Braintrust die vroeg hoeveel servicegames Carlos Alcaraz verloor over twee toernooirondes samen, wat het optellen van twee afzonderlijke getallen vereiste. De You.com‑configuratie leverde één passage die de eerste waarde op 24 stelde en een andere die de tweede op 22 stelde, en het model telde ze op tot 46. De mislukte runs toonden nooit een passage die 24 ondersteunde, gebruikten 22 voor beide waarden en beantwoordden 44. Elke run voerde de rekenkundige bewerking correct uit, een feit dat het bedrijf zegt alleen bekend te zijn omdat de passages in de trace verschijnen.
Wanneer het niet te gebruiken is
You.com stelde dat Highlights ongeveer 160 ms toevoegt ten opzichte van Snippets bij éénmalige opzoekingen, en dat onder een strakke latentie‑budget voor eenvoudige Q&A‑vragen Snippets de juiste standaard blijven. Voor pagina’s die sneller veranderen dan een index wordt vernieuwd, haalt extraction_mode: "full_page" live data op in plaats van uit de cache te serveren. FRAMES is waar die afweging zichtbaar wordt, aldus het bedrijf, omdat de multi‑hop‑vragen een bredere context‑slice vereisen dan een handvol nauwkeurig afgebakende passages, en volledige pagina daar Highlights met 0,73 punt verslaat.
Het bedrijf meldde dat nieuwe accounts $100 aan credits ontvangen en dat de harness die de benchmark‑cijfers genereert openbaar beschikbaar is.












