Yapay zeka modelleri ve platformları
You.com Web Arama Highlights, SimpleQA’da %95,17 Skor Elde Ediyor

You.com 1 Eylül 2026’da Web Search API’si için Highlights adlı yeni bir çıkarım modunu tanıttı, SimpleQA benchmark’inde %95,17 skor bildirdi ve bağımsız bir değerlendirmede Claude Sonnet 5’in yerleşik web aramasına göre toplam sorgu maliyetini %35 azalttı. Özellik, API’nin extraction_mode parametresi aracılığıyla mevcut hizmetle aynı $5 CPM fiyatlandırmasıyla kullanılabilir, şirket belirtti.
Highlights Ne Yapar
Web Search API, AI uygulamaları için yapılandırılmış web ve haber sonuçları döndürür. Varsayılan olarak, her sonuç kısa, anahtar kelime odaklı metin parçacıklarından oluşan bir snippets dizisi içerir. extraction_mode parametresini highlights olarak ayarlamak, bu snippet’leri, ilgili sorguya yanıt veren sayfalardan alınan pasajları içeren bir contents.highlights dizisiyle değiştirir.
You.com’a göre, çıkarım her istek başına çalışır ve her sorgu sayfa üzerinde yeni bir tarama başlatır. Bir model, metnin hangi bölümlerinin zaten sorguya yanıt verdiğini belirler ve bunları olduğu gibi döndürür; sayılar, tarih ve rakamlar kaynakta göründükleri şekilde korunur. Tablolar başlıklarıyla birlikte döner, kod blokları biçimlendirmesini korur ve aynı bölümden gelen ilgili cümleler tek bir pasajda birleştirilir. Aday pasajlar sıralanır ve en yüksek sıradaki ilk olarak sunulur.
Doğruluk Sonuçları
You.com, üç çıkarım modunun tamamında üç benchmark çalıştırdığını söyledi. Highlights, SimpleQA’da %95,17 ve RetrievalQA’da %66,93 ile lider konumda oldu; bu iki benchmark tek bir gerçek aramaları üzerine kuruludur. Çok aşamalı akıl yürütme benchmark’ı FRAMES’te, tam sayfa çıkarımı %82,77 skor alırken Highlights %82,04 elde etti; şirket bu 0,73 puanlık farkı, testte gözlemlediği çalışmadan çalışmaya değişkenlik içinde olarak nitelendirdi.
Şirket, doğruluk artışının ücretsiz olmadığını belirtti: Highlights, yanıtlayan modele daha fazla metin gönderdiği için soru başına maliyet Snippets’e göre yaklaşık %11 artıyor. Doğru yanıt başına maliyet, maliyetin doğrulukla bölünmesiyle hesaplandığında ise hâlâ yaklaşık %5 daha düşük, dedi.
SimpleQA’da dış sistemlere karşı, You.com üç sistemin %95’i geçtiğini bildirdi: Highlights ile You.com %95,17 ve 695 ms p50 gecikme, Exa (tam sayfa) %95,47 ve 1337 ms, Parallel (gelişmiş) %95,33 ve 2098 ms. Şirket, her rakibin en iyi performans gösteren konfigürasyonunu sergilediğini, bu yüzden karşılaştırmanın kurulum açısından kendilerini avantajlı kıldığını söyledi.
Bağımsız Maliyet Değerlendirmesi
Braintrust, bir bağımsız değerlendirme kapsamında, 1.329 soruda You.com Web Search’i Highlights ile OpenAI ve Anthropic API’lerine dahil edilen arama araçlarına karşı çalıştırdı; maliyet hem çıkarım hem de aramayı içeriyordu.
Bu değerlendirmede, Claude Sonnet 5, Highlights ile soru başına $0,0747 maliyetine sahipken, yerleşik araması $0,1148 idi; bu %35 azalma, hafif daha yüksek doğruluk (%79,23 vs %78,78) ve 1,26 saniye daha hızlı anlamına geliyordu. GPT-5.6 Terra, Highlights ile soru başına $0,0417, yerleşik sürümle $0,0467 maliyetle, %11 azalma ve 3,66 puan daha yüksek doğruluk sağladı. Doğru yanıt başına maliyet, Claude için %35, GPT için %15 azaldı; çünkü Highlights aynı veya daha düşük harcamayla daha fazla soruya doğru yanıt verdi, You.com’un sonuç açıklamasına göre.
Gözlemlenebilirlik Avantajı
You.com, paketlenmemiş web aramasının OpenAI ve Anthropic’in yerleşik araçlarından daha iyi gözlemlenebilirlik sağladığını savundu. Yerleşik arama, çalıştırdığı sorguları ve atıfta bulunduğu sayfaları döndürür, ancak modelin okuduğu pasajları vermez, şirket belirtti; bu da hatalı yanıtın hangi adımda üretildiğini görmenin bir yolunu bırakmaz.
Braintrust’un değerlendirmesinden, Carlos Alcaraz’ın iki turnuva koşusunda toplam kaç servis oyunu kaybettiğini soran bir soruyu örnek verdi; bu iki ayrı sayının toplanmasını gerektiriyordu. You.com yapılandırması, ilk değeri 24 olarak belirten bir pasaj ve ikinci değeri 22 olarak belirten bir başka pasaj döndürdü ve model bunları toplayarak 46 yanıtını verdi. Kaçırılan koşular, 24’ü destekleyen bir pasaj göstermedi, her iki değer için de 22 kullandı ve 44 yanıtını verdi. Her koşu aritmetiği doğru yaptı; şirket bu bilginin yalnızca pasajların izde görünmesi sayesinde bilinebileceğini söyledi.
Ne Zaman Kullanılmamalı
You.com, Highlights’in tek seferlik sorgularda Snippets’e göre yaklaşık 160 ms eklediğini ve basit Soru‑Cevap sorularında katı bir gecikme bütçesi altında Snippets’in doğru varsayılan olmaya devam ettiğini söyledi. İndeks yenilenmesinden daha hızlı değişen sayfalar için extraction_mode: "full_page" önbellekten sunmak yerine canlı olarak alır. Şirket, bu ödünleşimin FRAMES’te ortaya çıktığını belirtti; çünkü çok aşamalı sorular, birkaç dar kapsamlı pasajın sunduğundan daha geniş bir bağlam dilimini gerektirir ve tam sayfa burada Highlights’i 0,73 puanla geçer.
Şirket, yeni hesapların $100 kredi aldığını ve benchmark sayılarını üreten altyapının halka açık olduğunu belirtti.












