Modèles et plateformes d’IA

You.com Web Search Highlights atteint 95,17% sur SimpleQA

mm
Ajouter Unite.AI à vos sources préférées sur Google

You.com le 1 septembre 2026 a présenté un nouveau mode d’extraction pour son API de recherche Web appelé Highlights, affichant un score de 95,17 % sur le benchmark SimpleQA et un coût total de requête 35 % inférieur à celui de la recherche Web intégrée de Claude Sonnet 5 dans une évaluation indépendante. La fonctionnalité est disponible via le paramètre extraction_mode de l’API au même tarif de 5 $ CPM que le service existant, indique l’entreprise.

Ce que Highlights fait

L’API de recherche Web renvoie des résultats web et d’actualités structurés pour les applications d’IA. Par défaut, chaque résultat comporte un tableau snippets de courts fragments de texte centrés sur des mots‑clés. Définir extraction_mode sur highlights remplace ces extraits par un tableau contents.highlights contenant les passages de chaque page qui répondent à la requête spécifique.

Selon You.com, l’extraction s’effectue à chaque requête, chaque interrogation déclenchant un nouveau passage sur la page. Un modèle identifie les portions de texte qui répondent déjà à la requête et les renvoie mot pour mot, en conservant les nombres, dates et chiffres tels qu’ils apparaissent dans la source. Les tableaux sont renvoyés avec leurs en‑têtes intactes, les blocs de code conservent leur mise en forme, et les phrases de la même section qui sont toutes deux pertinentes sont fusionnées en un seul passage. Les passages candidats sont classés, le plus hautement classé étant renvoyé en premier.

Résultats de précision

You.com a indiqué avoir exécuté trois benchmarks sur les trois modes d’extraction. Highlights a dominé sur SimpleQA avec 95,17 % et sur RetrievalQA avec 66,93 %, les deux benchmarks basés sur des recherches de faits uniques. Sur FRAMES, un benchmark de raisonnement à plusieurs étapes, l’extraction pleine page a obtenu 82,77 % contre 82,04 % pour Highlights, un écart de 0,73 point que l’entreprise a décrit comme relevant de la variance d’une exécution à l’autre observée sur ce test.

L’entreprise a souligné que le gain de précision n’est pas gratuit : le coût par question augmente d’environ 11 % par rapport aux Snippets, car Highlights envoie davantage de texte au modèle de réponse. Le coût par réponse correcte, qui divise le coût par la précision, reste environ 5 % inférieur, indique‑t‑elle.

Face à des systèmes externes sur SimpleQA, You.com a rapporté que trois systèmes dépassaient 95 % : You.com avec Highlights à 95,17 % et une latence p50 de 695 ms, Exa (page complète) à 95,47 % et 1337 ms, et Parallel (avancé) à 95,33 % et 2098 ms. L’entreprise a indiqué avoir affiché la configuration la plus performante de chaque concurrent, ce qui fait que la comparaison les avantaje sur le plan de la configuration.

Évaluation indépendante des coûts

Braintrust, dans le cadre d’une évaluation indépendante, a testé You.com Web Search avec Highlights contre les outils de recherche intégrés aux API d’OpenAI et d’Anthropic sur 1 329 questions, le coût incluant à la fois l’inférence et la recherche.

Dans cette évaluation, Claude Sonnet 5 a coûté 0,0747 $ par question avec Highlights contre 0,1148 $ pour sa recherche intégrée, soit une réduction de 35 %, avec une précision légèrement supérieure (79,23 % contre 78,78 %) et 1,26 s plus rapide. GPT‑5.6 Terra a coûté 0,0417 $ par question avec Highlights contre 0,0467 $ intégré, soit une réduction de 11 %, avec une précision supérieure de 3,66 points. Le coût par réponse correcte a diminué de 35 % pour Claude et de 15 % pour GPT, puisque Highlights a fourni plus de réponses correctes pour le même budget ou un budget inférieur, selon le compte rendu de You.com.

Avantage d’observabilité

You.com a soutenu que la recherche Web non groupée offre une meilleure observabilité que les outils intégrés d’OpenAI et d’Anthropic. La recherche intégrée renvoie les requêtes exécutées et les pages citées, mais pas les passages lus par le modèle, indique l’entreprise, ne laissant aucun moyen de voir quelle étape a produit une réponse erronée.

Il a cité une question de l’évaluation de Braintrust demandant combien de jeux de service Carlos Alcaraz a perdus au total sur deux éditions de tournoi, ce qui nécessitait d’additionner deux nombres distincts. La configuration de You.com a renvoyé un passage indiquant la première valeur à 24 et un autre indiquant la seconde à 22, le modèle les a additionnés pour répondre 46. Les exécutions qui ont échoué n’ont jamais fait apparaître de passage soutenant 24, ont utilisé 22 pour les deux valeurs et ont répondu 44. Chaque exécution a effectué correctement le calcul, un fait que l’entreprise affirme ne pouvoir être connu que parce que les passages apparaissent dans la trace.

Quand ne pas l’utiliser

You.com a indiqué que Highlights ajoute environ 160 ms par rapport aux Snippets lors de recherches ponctuelles, et que sous une contrainte de latence stricte pour les questions simples de type Q&A, les Snippets restent le réglage par défaut approprié. Pour les pages qui évoluent plus rapidement qu’un rafraîchissement d’index, extraction_mode: "full_page" récupère le contenu en direct plutôt que de le servir depuis le cache. FRAMES est le cas où ce compromis se manifeste, selon l’entreprise, car ses questions à plusieurs étapes nécessitent une tranche de contexte plus large qu’un petit nombre de passages étroitement ciblés, et la page complète surpasse Highlights de 0,73 point.

L’entreprise a déclaré que les nouveaux comptes reçoivent 100 $ de crédits et que le cadre produisant ses chiffres de benchmark est disponible publiquement.

Jonas Reeve est un analyste généré par IA chez Unite.AI, se concentrant sur l'intelligence artificielle cognitive, l'intelligence artificielle générale (AGI) et les fondements théoriques de l'intelligence machine. Son travail explore comment l'apprentissage, le raisonnement, la mémoire et l'abstraction émergent à la fois dans les systèmes biologiques et artificiels, établissant des liens entre les architectures d'IA modernes et les questions de longue date en sciences cognitives et philosophie de l'esprit.
Avec une approche conceptuelle et réflexive, Jonas examine des cadres tels que les modèles de raisonnement, les systèmes agents, la cognition émergente et la théorie d'alignement, visant à clarifier ce que signifie réellement le progrès vers l'AGI - et ce que cela ne signifie pas. Plutôt que de poursuivre les délais ou l'hype, il met l'accent sur les principes fondamentaux, la rigueur conceptuelle et les limites des modèles actuels.
Les articles rédigés par Jonas Reeve sont générés par IA et révisés par l'équipe éditoriale d'Unite.AI pour garantir l'exactitude, la clarté et la discussion responsable des concepts d'IA avancés.