Modelos y plataformas de IA
Los Destacados de Búsqueda Web de You.com Alcanzan el 95,17% en SimpleQA

You.com el 1 de septiembre de 2026 presentó un nuevo modo de extracción para su API de Búsqueda Web llamado Highlights, reportando una puntuación del 95,17 % en el benchmark SimpleQA y un 35 % menos de costo total por consulta que la búsqueda web integrada de Claude Sonnet 5 en una evaluación independiente. La función está disponible a través del parámetro extraction_mode de la API con el mismo precio de $5 CPM que el servicio existente, según la compañía.
¿Qué hace Highlights?
La API de Búsqueda Web devuelve resultados estructurados de web y noticias para aplicaciones de IA. De forma predeterminada, cada resultado incluye una matriz snippets de fragmentos de texto cortos y centrados en palabras clave. Configurar extraction_mode a highlights reemplaza esos fragmentos por una matriz contents.highlights que contiene los pasajes de cada página que responden a la consulta específica.
Según You.com, la extracción se ejecuta por solicitud, con cada consulta activando una pasada nueva sobre la página. Un modelo identifica qué fragmentos de texto ya responden a la consulta y los devuelve literalmente, preservando números, fechas y cifras tal como aparecen en la fuente. Las tablas se devuelven con sus encabezados intactos, los bloques de código conservan su formato, y las oraciones de la misma sección que son relevantes se combinan en un único pasaje. Los pasajes candidatos se clasifican, devolviéndose primero los de mayor rango.
Resultados de Precisión
You.com informó que ejecutó tres benchmarks en los tres modos de extracción. Highlights lideró en SimpleQA con un 95,17 % y en RetrievalQA con un 66,93 %, los dos benchmarks basados en búsquedas de hechos únicos. En FRAMES, un benchmark de razonamiento multi‑salto, la extracción de página completa obtuvo un 82,77 % frente al 82,04 % de Highlights, una diferencia de 0,73 puntos que la compañía describió como dentro de la variabilidad entre ejecuciones que observa en esa prueba.
La compañía señaló que la mejora en precisión no es gratuita: el costo por pregunta aumenta alrededor de un 11 % respecto a Snippets porque Highlights envía más texto al modelo que responde. El costo por respuesta correcta, que divide el costo entre la precisión, sigue siendo aproximadamente un 5 % menor, según indicó.
Comparado con sistemas externos en SimpleQA, You.com informó que tres sistemas superaron el 95 %: You.com con Highlights en 95,17 % y una latencia p50 de 695 ms, Exa (página completa) en 95,47 % y 1337 ms, y Parallel (avanzado) en 95,33 % y 2098 ms. La compañía afirmó que mostró la configuración de mejor rendimiento de cada competidor, por lo que la comparación les favorece en la configuración.
Evaluación Independiente de Costos
Braintrust, como parte de una evaluación independiente, ejecutó You.com Web Search con Highlights contra las herramientas de búsqueda incluidas en las APIs de OpenAI y Anthropic en 1.329 preguntas, con el costo que incluye tanto la inferencia como la búsqueda.
En esa evaluación, Claude Sonnet 5 costó $0.0747 por pregunta con Highlights frente a $0.1148 por su búsqueda integrada, una reducción del 35 %, con una precisión ligeramente mayor (79,23 % frente a 78,78 %) y 1,26 s más rápido. GPT-5.6 Terra costó $0.0417 por pregunta con Highlights frente a $0.0467 integrado, una reducción del 11 %, con una precisión 3,66 puntos superior. El costo por respuesta correcta disminuyó un 35 % para Claude y un 15 % para GPT, ya que Highlights respondió correctamente a más preguntas con el mismo gasto o menor, según el recuento de resultados de You.com.
Ventaja de Observabilidad
You.com sostuvo que la búsqueda web desacoplada ofrece mejor observabilidad que las herramientas integradas de OpenAI y Anthropic. La búsqueda integrada devuelve las consultas que ejecutó y las páginas que citó, pero no los pasajes que el modelo lee, según la compañía, lo que impide saber qué paso produjo una respuesta incorrecta.
Citó una pregunta de la evaluación de Braintrust que preguntaba cuántos juegos de servicio perdió Carlos Alcaraz en total en dos torneos, lo que requería sumar dos números separados. La configuración de You.com devolvió un pasaje que establecía el primer valor en 24 y otro que establecía el segundo en 22, y el modelo los sumó para responder 46. Las ejecuciones que fallaron nunca mostraron un pasaje que respaldara el 24, usaron 22 para ambos valores y respondieron 44. Cada ejecución realizó la aritmética correctamente, un hecho que la compañía dijo que solo es detectable porque los pasajes aparecen en el rastro.
Cuándo No Usarlo
You.com indicó que Highlights añade aproximadamente 160 ms respecto a Snippets en búsquedas de un solo intento, y que bajo un presupuesto estricto de latencia en preguntas simples de Q&A, Snippets sigue siendo la opción predeterminada adecuada. Para páginas que cambian más rápido de lo que se actualiza un índice, extraction_mode: "full_page" recupera contenido en tiempo real en lugar de servirlo desde la caché. FRAMES es donde se evidencia ese compromiso, según la compañía, porque sus preguntas multi‑salto requieren una porción de contexto más amplia que la que proporcionan unos pocos pasajes estrechamente definidos, y la página completa supera a Highlights allí por 0,73 puntos.
La compañía dijo que las cuentas nuevas reciben $100 en créditos y que el harness que produce sus números de benchmark está disponible públicamente.












