KI-Modelle und Plattformen

You.com Web Search Highlights erreicht 95,17% bei SimpleQA

mm
Unite.AI zu deinen bevorzugten Quellen auf Google hinzufügen

You.com am 1. September 2026 stellte einen neuen Extraktionsmodus für seine Web Search API namens Highlights vor und meldete eine Punktzahl von 95,17 % im SimpleQA‑Benchmark sowie 35 % geringere Gesamtabfragekosten im Vergleich zur integrierten Websuche von Claude Sonnet 5 in einer unabhängigen Bewertung. Die Funktion ist über den extraction_mode-Parameter der API zum gleichen Preis von $5 CPM wie der bestehende Dienst verfügbar, so das Unternehmen.

Was Highlights leistet

Die Web Search API liefert strukturierte Web‑ und Nachrichten‑Ergebnisse für KI‑Anwendungen. Standardmäßig enthält jedes Ergebnis ein snippets-Array mit kurzen, schlüsselwortzentrierten Textfragmenten. Wird extraction_mode auf highlights gesetzt, werden diese Snippets durch ein contents.highlights-Array ersetzt, das die Passagen jeder Seite enthält, die die jeweilige Anfrage beantworten.

Laut You.com wird die Extraktion pro Anfrage durchgeführt, wobei jede Anfrage einen neuen Durchlauf über die Seite auslöst. Ein Modell erkennt, welche Textabschnitte die Anfrage bereits beantworten, und gibt sie unverändert zurück, wobei Zahlen, Daten und Zahlenwerte exakt wie im Original erhalten bleiben. Tabellen werden mit intakten Überschriften zurückgegeben, Code‑Blöcke behalten ihre Formatierung, und Sätze aus demselben Abschnitt, die beide relevant sind, werden zu einer einzigen Passage zusammengeführt. Kandidatenpassagen werden rangiert, wobei die höchstrangierte zuerst zurückgeliefert wird.

Ergebnisse zur Genauigkeit

You.com gab an, dass es drei Benchmarks über alle drei Extraktionsmodi hinweg durchgeführt hat. Highlights führte bei SimpleQA mit 95,17 % und bei RetrievalQA mit 66,93 % die Rangliste an, die beiden Benchmarks, die auf Einzelfakt‑Abfragen basieren. Beim FRAMES‑Benchmark, einem Multi‑Hop‑Reasoning‑Test, erzielte die Vollseiten‑Extraktion 82,77 % gegenüber 82,04 % für Highlights, eine Differenz von 0,73 Punkten, die das Unternehmen als innerhalb der beobachteten Lauf‑zu‑Lauf‑Varianz dieses Tests bezeichnete.

Das Unternehmen wies darauf hin, dass der Genauigkeitszuwachs nicht kostenlos ist: Die Kosten pro Frage steigen um etwa 11 % im Vergleich zu Snippets, weil Highlights mehr Text an das Antwortmodell sendet. Die Kosten pro korrekte Antwort, also Kosten geteilt durch Genauigkeit, liegen jedoch immer noch etwa 5 % niedriger, so das Unternehmen.

Im Vergleich zu externen Systemen bei SimpleQA meldete You.com drei Systeme, die 95 % erreichten: You.com mit Highlights bei 95,17 % und einer p50‑Latenz von 695 ms, Exa (Vollseite) bei 95,47 % und 1337 ms sowie Parallel (erweitert) bei 95,33 % und 2098 ms. Das Unternehmen erklärte, dass es jeweils die best‑performende Konfiguration jedes Konkurrenten gezeigt habe, sodass die Gegenüberstellung ihnen im Setup zugutekommt.

Unabhängige Kostenbewertung

Braintrust führte im Rahmen einer unabhängigen Bewertung You.com Web Search mit Highlights gegen die in den OpenAI‑ und Anthropic‑APIs enthaltenen Suchwerkzeuge bei 1.329 Fragen durch, wobei die Kosten sowohl Inferenz‑ als auch Suchkosten umfassen.

In dieser Bewertung kostete Claude Sonnet 5 pro Frage $0,0747 mit Highlights gegenüber $0,1148 für die integrierte Suche, also eine Reduktion von 35 %, bei leicht höherer Genauigkeit (79,23 % gegenüber 78,78 %) und 1,26 Sekunden schneller. GPT‑5.6 Terra kostete pro Frage $0,0417 mit Highlights gegenüber $0,0467 integriert, also eine Reduktion von 11 %, bei einer um 3,66 Punkte höheren Genauigkeit. Die Kosten pro korrekte Antwort sanken um 35 % bei Claude und um 15 % bei GPT, da Highlights mehr Fragen korrekt beantwortete bei gleichem oder geringerem Aufwand, laut You.com‑Angaben zu den Ergebnissen.

Vorteil der Beobachtbarkeit

You.com argumentierte, dass entkoppelte Websuche eine bessere Beobachtbarkeit bietet als die integrierten Werkzeuge von OpenAI und Anthropic. Die integrierte Suche liefert die ausgeführten Anfragen und die zitierten Seiten, jedoch nicht die Passagen, die das Modell liest, so das Unternehmen, wodurch keine Möglichkeit besteht zu erkennen, welcher Schritt eine falsche Antwort erzeugt hat.

Es verwies auf eine Frage aus der Braintrust‑Bewertung, die fragte, wie viele Service‑Games Carlos Alcaraz in zwei Turnierläufen zusammen verloren habe, was das Addieren zweier separater Zahlen erforderte. Die You.com‑Konfiguration lieferte eine Passage, die den ersten Wert mit 24 angab, und eine weitere, die den zweiten Wert mit 22 angab, und das Modell addierte sie zu 46. Die fehlerhaften Durchläufe zeigten nie eine Passage, die 24 unterstützte, nutzten 22 für beide Werte und antworteten mit 44. Jeder Durchlauf führte die Rechnung korrekt aus, ein Umstand, den das Unternehmen nur dank der im Trace erscheinenden Passagen erkennen könne.

Wann es nicht zu verwenden ist

You.com erklärte, dass Highlights bei einmaligen Abfragen etwa 160 ms gegenüber Snippets hinzufügt und dass bei einem strikten Latenzbudget für einfache Q&A‑Fragen Snippets die richtige Voreinstellung bleiben. Für Seiten, die sich schneller ändern als ein Index aktualisiert wird, holt extraction_mode: "full_page" die Inhalte live statt aus dem Cache. FRAMES ist der Bereich, in dem dieser Kompromiss sichtbar wird, so das Unternehmen, weil seine Multi‑Hop‑Fragen einen breiteren Kontext benötigen als ein paar eng begrenzte Passagen bieten, und die Vollseiten‑Extraktion dort Highlights um 0,73 Punkte übertrifft.

Das Unternehmen sagte, neue Konten erhalten $100 Guthaben und dass das Framework, das die Benchmark‑Zahlen erzeugt, öffentlich verfügbar ist.

Jonas Reeve ist ein künstlich intelligenter Analyst bei Unite.AI, der sich auf kognitive KI, künstliche allgemeine Intelligenz (AGI) und die theoretischen Grundlagen der Maschinenintelligenz konzentriert. Seine Arbeit erforscht, wie Lernen, Argumentation, Gedächtnis und Abstraktion in biologischen und künstlichen Systemen entstehen, und zieht Verbindungen zwischen modernen KI-Architekturen und langjährigen Fragen der Kognitivwissenschaft und Philosophie des Geistes.
Mit einem konzeptionellen und reflektierenden Ansatz untersucht Jonas Rahmenwerke wie Argumentationsmodelle, agentische Systeme, emergente Kognition und Ausrichtungstheorie, um zu klären, was Fortschritte in Richtung AGI tatsächlich bedeuten - und was nicht. Anstatt Zeitpläne oder Hype zu verfolgen, betont er erste Prinzipien, konzeptionelle Strenge und die Grenzen der aktuellen Modelle.
Artikel, die von Jonas Reeve verfasst werden, sind künstlich intelligenter generiert und von Unite.AIs Redaktionsteam überprüft, um Genauigkeit, Klarheit und verantwortungsvolle Diskussion über fortgeschrittene KI-Konzepte zu gewährleisten.