Modelos e plataformas de IA

You.com Web Search Highlights atinge 95,17% no SimpleQA

mm
Adicione Unite.AI às suas fontes preferidas no Google

You.com em 1 de setembro de 2026 introduziu um novo modo de extração para sua API de Busca na Web chamado Highlights, registrando uma pontuação de 95,17% no benchmark SimpleQA e um custo total de consulta 35% menor que a busca web integrada do Claude Sonnet 5 em avaliação independente. O recurso está disponível através do parâmetro extraction_mode da API, com o mesmo preço de $5 CPM do serviço existente, informou a empresa.

O que o Highlights faz

A API de Busca na Web devolve resultados estruturados de web e notícias para aplicações de IA. Por padrão, cada resultado contém um array snippets de fragmentos curtos e centrados em palavras‑chave. Definir extraction_mode como highlights substitui esses trechos por um array contents.highlights que inclui as passagens de cada página que respondem à consulta específica.

Segundo a You.com, a extração ocorre por requisição, com cada consulta disparando uma nova passagem sobre a página. Um modelo identifica quais trechos já respondem à pergunta e os devolve literalmente, preservando números, datas e figuras exatamente como aparecem na fonte. Tabelas são retornadas com cabeçalhos intactos, blocos de código mantêm sua formatação e frases da mesma seção que são relevantes são mescladas em um único trecho. As passagens candidatas são ranqueadas, sendo as de maior classificação retornadas primeiro.

Resultados de Precisão

A You.com afirmou ter executado três benchmarks em todos os três modos de extração. Highlights liderou no SimpleQA com 95,17% e no RetrievalQA com 66,93%, os dois benchmarks baseados em buscas de fatos únicos. No FRAMES, benchmark de raciocínio multi‑hop, a extração de página completa marcou 82,77% contra 82,04% do Highlights, uma diferença de 0,73 ponto que a empresa descreveu como dentro da variação de execução a execução que observa nesse teste.

A empresa observou que o ganho de precisão não é gratuito: o custo por pergunta aumenta cerca de 11% em relação aos Snippets porque Highlights envia mais texto ao modelo de resposta. O custo por resposta correta, que divide custo por precisão, ainda fica cerca de 5% menor, segundo a empresa.

Contra sistemas externos no SimpleQA, a You.com reportou três sistemas ultrapassando 95%: You.com com Highlights em 95,17% e latência p50 de 695 ms, Exa (página completa) em 95,47% e 1337 ms, e Parallel (avançado) em 95,33% e 2098 ms. A empresa disse que exibiu a configuração de melhor desempenho de cada concorrente, de modo que a comparação favorece-os na configuração.

Avaliação Independente de Custos

Braintrust, como parte de uma avaliação independente, executou a You.com Web Search com Highlights contra as ferramentas de busca incluídas nas APIs da OpenAI e da Anthropic em 1 329 perguntas, com custo incluindo inferência e busca.

Nessa avaliação, o Claude Sonnet 5 custou $0,0747 por pergunta com Highlights contra $0,1148 para sua busca integrada, uma redução de 35%, com precisão ligeiramente maior (79,23% versus 78,78%) e 1,26 s mais rápido. O GPT‑5.6 Terra custou $0,0417 por pergunta com Highlights contra $0,0467 integrado, redução de 11%, com 3,66 pontos a mais de precisão. O custo por resposta correta caiu 35% para Claude e 15% para GPT, já que Highlights respondeu corretamente a mais perguntas com o mesmo gasto ou menor, de acordo com o relato da You.com.

Vantagem de Observabilidade

A You.com argumentou que a busca web desacoplada oferece melhor observabilidade que as ferramentas integradas da OpenAI e da Anthropic. A busca integrada devolve as consultas executadas e as páginas citadas, mas não as passagens que o modelo leu, segundo a empresa, deixando sem modo de ver qual passo gerou uma resposta errada.

Citou uma pergunta da avaliação da Braintrust que perguntava quantos jogos de serviço Carlos Alcaraz perdeu em duas edições de torneios combinadas, o que exigia somar dois números separados. A configuração da You.com retornou uma passagem estabelecendo o primeiro valor em 24 e outra estabelecendo o segundo em 22, e o modelo os somou para responder 46. As execuções que erraram nunca mostraram uma passagem sustentando 24, usaram 22 para ambos os valores e responderam 44. Cada execução realizou a aritmética corretamente, fato que a empresa disse ser só possível de saber porque as passagens aparecem no rastreamento.

Quando Não Usar

A You.com disse que Highlights adiciona cerca de 160 ms em relação aos Snippets em buscas de tiro único, e que sob um orçamento rígido de latência em perguntas simples de Q&A os Snippets permanecem o padrão adequado. Para páginas que mudam mais rápido que um índice é atualizado, extraction_mode: "full_page" busca ao vivo em vez de servir do cache. FRAMES é onde esse trade‑off se evidencia, afirmou a empresa, porque suas perguntas multi‑hop exigem uma fatia de contexto mais ampla que alguns trechos estreitos fornecem, e a página completa supera Highlights lá por 0,73 ponto.

A empresa informou que novas contas recebem $100 em créditos e que o harness que produz seus números de benchmark está publicamente disponível.

Jonas Reeve é um analista gerado por IA na Unite.AI, com foco em inteligência artificial cognitiva, inteligência artificial geral (AGI) e fundamentos teóricos de inteligência de máquina. Seu trabalho explora como aprendizado, raciocínio, memória e abstração surgem em sistemas biológicos e artificiais, estabelecendo conexões entre arquiteturas de IA modernas e questões de longa data em ciência cognitiva e filosofia da mente.
Com uma abordagem conceitual e reflexiva, Jonas examina estruturas como modelos de raciocínio, sistemas agênticos, cognição emergente e teoria de alinhamento, visando esclarecer o que o progresso em direção à AGI realmente significa - e o que não significa. Em vez de perseguir cronogramas ou hype, ele enfatiza princípios fundamentais, rigor conceitual e os limites dos modelos atuais.
Artigos escritos por Jonas Reeve são gerados por IA e revisados pela equipe editorial da Unite.AI para garantir precisão, clareza e discussão responsável de conceitos de IA avançados.