AI-modeller og plattformer

You.com Web Search Highlights når 95,17% på SimpleQA

mm
Legg til Unite.AI blant dine foretrukne kilder på Google

You.com 1. september 2026 innførte en ny ekstraksjonsmodus for sitt Web Search API kalt Highlights, med en rapportert poengsum på 95,17 % på SimpleQA‑benchmarken og en 35 % lavere total spørringskostnad enn Claude Sonnet 5s innebygde websøk i en uavhengig evaluering. Funksjonen er tilgjengelig via API‑ens extraction_mode-parameter til samme $5 CPM-prising som den eksisterende tjenesten, opplyser selskapet.

Hva Highlights gjør

Web Search‑API‑et returnerer strukturerte web‑ og nyhetsresultater for AI‑applikasjoner. Som standard inneholder hvert resultat et snippets-array med korte, nøkkelord‑sentrerte tekstfragmenter. Å sette extraction_mode til highlights erstatter disse utdragene med et contents.highlights-array som inneholder avsnittene fra hver side som besvarer den spesifikke spørringen.

Ifølge You.com kjøres ekstraksjonen per forespørsel, hvor hver spørring utløser en ny gjennomgang av siden. En modell identifiserer hvilke tekstsegmenter som allerede svarer på spørringen og returnerer dem ordrett, med tall, datoer og figurer bevart slik de fremkommer i kilden. Tabeller returneres med overskrifter intakte, kodeblokker beholder formateringen, og setninger fra samme avsnitt som begge er relevante blir slått sammen til ett enkelt avsnitt. Kandidatavsnittene rangeres, og de høyest rangerte returneres først.

Nøyaktighetsresultater

You.com oppga at de gjennomførte tre benchmark‑tester på tvers av alle tre ekstraksjonsmoduser. Highlights ledet på SimpleQA med 95,17 % og på RetrievalQA med 66,93 %, de to benchmarkene som er bygget rundt enkel‑faktasøk. På FRAMES, en multi‑hop resonnerings‑benchmark, oppnådde full‑side‑ekstraksjon 82,77 % mot Highlights’ 82,04 %, en differanse på 0,73 poeng som selskapet beskrev som innenfor den variansen de observerer fra kjøring til kjøring på denne testen.

Selskapet bemerket at nøyaktighetsgevinsten ikke er gratis: kostnaden per spørsmål øker med omtrent 11 % sammenlignet med Snippets fordi Highlights sender mer tekst til svar‑modellen. Kostnaden per korrekt svar, som beregnes som kostnad delt på nøyaktighet, er fortsatt omtrent 5 % lavere, opplyser de.

Mot eksterne systemer på SimpleQA rapporterte You.com tre systemer som nådde 95 %: You.com med Highlights på 95,17 % og 695 ms p50‑latens, Exa (full side) på 95,47 % og 1337 ms, og Parallel (avansert) på 95,33 % og 2098 ms. Selskapet oppga at de viste hver konkurrents best‑presterende konfigurasjon, så sammenligningen favoriserer dem i oppsettet.

Uavhengig kostnadsevaluering

Braintrust, som en del av en uavhengig evaluering, kjørte You.com Web Search med Highlights mot søkeverktøyene som er bundet inn i OpenAI‑ og Anthropic‑API‑ene på 1 329 spørsmål, med kostnad som inkluderer både inferens og søk.

I den evalueringen kostet Claude Sonnet 5 $0,0747 per spørsmål med Highlights mot $0,1148 for den innebygde søkefunksjonen, en reduksjon på 35 %, med litt høyere nøyaktighet (79,23 % versus 78,78 %) og 1,26 sekunder raskere. GPT‑5.6 Terra kostet $0,0417 per spørsmål med Highlights mot $0,0467 innebygd, en reduksjon på 11 %, med 3,66 poeng høyere nøyaktighet. Kostnaden per korrekt svar falt med 35 % for Claude og 15 % for GPT, siden Highlights svarte korrekt på flere spørsmål med samme eller lavere forbruk, ifølge You.com sin redegjørelse for resultatene.

Observasjonsfordel

You.com hevdet at avpakket websøk gir bedre observabilitet enn de innebygde verktøyene fra OpenAI og Anthropic. Innebygd søk returnerer spørringene det kjørte og sidene det refererte til, men ikke avsnittene modellen leser, opplyser selskapet, og etterlater ingen mulighet til å se hvilket steg som produserte et feil svar.

Den refererte til et spørsmål fra Braintrust‑evalueringen som spurte hvor mange service‑spill Carlos Alcaraz tapte i to turneringer til sammen, noe som krevde å legge sammen to separate tall. You.com‑konfigurasjonen returnerte ett avsnitt som fastsatte den første verdien til 24 og et annet som fastsatte den andre til 22, og modellen la dem sammen til svaret 46. De forsøkene som feilet viste aldri et avsnitt som støttet 24, brukte 22 for begge verdier, og svarte 44. Hvert forsøk utførte aritmetikken korrekt, et faktum som selskapet sier kun er kjent fordi avsnittene vises i sporingen.

Når du ikke bør bruke det

You.com oppga at Highlights legger til omtrent 160 ms i forhold til Snippets ved enkelt‑spørringer, og at under et stramt latensbudsjett for enkle Q&A‑spørsmål er Snippets fortsatt det riktige standardvalget. For sider som endres raskere enn et indeks‑oppdatering skjer, henter extraction_mode: "full_page" live i stedet for å betjene fra cache. FRAMES er der dette kompromisset blir tydelig, sier selskapet, fordi deres multi‑hop‑spørsmål krever en bredere kontekst enn noen få tett avgrensede avsnitt gir, og full side slår Highlights der med 0,73 poeng.

Selskapet oppga at nye kontoer får $100 i kreditter, og at verktøyet som produserer benchmark‑tallene er offentlig tilgjengelig.

Jonas Reeve er en AI-generert analytiker hos Unite.AI, som fokuserer på kognitiv AI, kunstig generell intelligens (AGI) og de teoretiske grunnlagene for maskinintelligens. Hans arbeid utforsker hvordan læring, resonnering, minne og abstraksjon oppstår i både biologiske og kunstige systemer, og trekker sammenheng mellom moderne AI-arkitekturer og langvarige spørsmål i kognitiv vitenskap og filosofi om sinn.

Med en konseptuell og reflektert tilnærming, undersøker Jonas rammer som resonneringsmodeller, agente systemer, emergent kognisjon og aligneringsteori, med mål om å klargjøre hva fremgang mot AGI faktisk betyr - og hva det ikke betyr. I stedet for å jage tidsfrister eller hype, legger han vekt på første prinsipper, konseptuell rigor og grensene for nåværende modeller.

Artikler skrevet av Jonas Reeve er AI-generert og gjennomgått av Unite.AIs redaksjonelle team for å sikre nøyaktighet, klarhet og ansvarlig diskusjon av avanserte AI-konsepter.