Yapay zeka modelleri ve platformları

You.com Web Arama Highlights, SimpleQA’da %95,17 Skor Elde Ediyor

mm
Unite.AI sitesini Google'daki tercih ettiğiniz kaynaklara ekleyin

You.com 1 Eylül 2026’da Web Search API’si için Highlights adlı yeni bir çıkarım modunu tanıttı, SimpleQA benchmark’inde %95,17 skor bildirdi ve bağımsız bir değerlendirmede Claude Sonnet 5’in yerleşik web aramasına göre toplam sorgu maliyetini %35 azalttı. Özellik, API’nin extraction_mode parametresi aracılığıyla mevcut hizmetle aynı $5 CPM fiyatlandırmasıyla kullanılabilir, şirket belirtti.

Highlights Ne Yapar

Web Search API, AI uygulamaları için yapılandırılmış web ve haber sonuçları döndürür. Varsayılan olarak, her sonuç kısa, anahtar kelime odaklı metin parçacıklarından oluşan bir snippets dizisi içerir. extraction_mode parametresini highlights olarak ayarlamak, bu snippet’leri, ilgili sorguya yanıt veren sayfalardan alınan pasajları içeren bir contents.highlights dizisiyle değiştirir.

You.com’a göre, çıkarım her istek başına çalışır ve her sorgu sayfa üzerinde yeni bir tarama başlatır. Bir model, metnin hangi bölümlerinin zaten sorguya yanıt verdiğini belirler ve bunları olduğu gibi döndürür; sayılar, tarih ve rakamlar kaynakta göründükleri şekilde korunur. Tablolar başlıklarıyla birlikte döner, kod blokları biçimlendirmesini korur ve aynı bölümden gelen ilgili cümleler tek bir pasajda birleştirilir. Aday pasajlar sıralanır ve en yüksek sıradaki ilk olarak sunulur.

Doğruluk Sonuçları

You.com, üç çıkarım modunun tamamında üç benchmark çalıştırdığını söyledi. Highlights, SimpleQA’da %95,17 ve RetrievalQA’da %66,93 ile lider konumda oldu; bu iki benchmark tek bir gerçek aramaları üzerine kuruludur. Çok aşamalı akıl yürütme benchmark’ı FRAMES’te, tam sayfa çıkarımı %82,77 skor alırken Highlights %82,04 elde etti; şirket bu 0,73 puanlık farkı, testte gözlemlediği çalışmadan çalışmaya değişkenlik içinde olarak nitelendirdi.

Şirket, doğruluk artışının ücretsiz olmadığını belirtti: Highlights, yanıtlayan modele daha fazla metin gönderdiği için soru başına maliyet Snippets’e göre yaklaşık %11 artıyor. Doğru yanıt başına maliyet, maliyetin doğrulukla bölünmesiyle hesaplandığında ise hâlâ yaklaşık %5 daha düşük, dedi.

SimpleQA’da dış sistemlere karşı, You.com üç sistemin %95’i geçtiğini bildirdi: Highlights ile You.com %95,17 ve 695 ms p50 gecikme, Exa (tam sayfa) %95,47 ve 1337 ms, Parallel (gelişmiş) %95,33 ve 2098 ms. Şirket, her rakibin en iyi performans gösteren konfigürasyonunu sergilediğini, bu yüzden karşılaştırmanın kurulum açısından kendilerini avantajlı kıldığını söyledi.

Bağımsız Maliyet Değerlendirmesi

Braintrust, bir bağımsız değerlendirme kapsamında, 1.329 soruda You.com Web Search’i Highlights ile OpenAI ve Anthropic API’lerine dahil edilen arama araçlarına karşı çalıştırdı; maliyet hem çıkarım hem de aramayı içeriyordu.

Bu değerlendirmede, Claude Sonnet 5, Highlights ile soru başına $0,0747 maliyetine sahipken, yerleşik araması $0,1148 idi; bu %35 azalma, hafif daha yüksek doğruluk (%79,23 vs %78,78) ve 1,26 saniye daha hızlı anlamına geliyordu. GPT-5.6 Terra, Highlights ile soru başına $0,0417, yerleşik sürümle $0,0467 maliyetle, %11 azalma ve 3,66 puan daha yüksek doğruluk sağladı. Doğru yanıt başına maliyet, Claude için %35, GPT için %15 azaldı; çünkü Highlights aynı veya daha düşük harcamayla daha fazla soruya doğru yanıt verdi, You.com’un sonuç açıklamasına göre.

Gözlemlenebilirlik Avantajı

You.com, paketlenmemiş web aramasının OpenAI ve Anthropic’in yerleşik araçlarından daha iyi gözlemlenebilirlik sağladığını savundu. Yerleşik arama, çalıştırdığı sorguları ve atıfta bulunduğu sayfaları döndürür, ancak modelin okuduğu pasajları vermez, şirket belirtti; bu da hatalı yanıtın hangi adımda üretildiğini görmenin bir yolunu bırakmaz.

Braintrust’un değerlendirmesinden, Carlos Alcaraz’ın iki turnuva koşusunda toplam kaç servis oyunu kaybettiğini soran bir soruyu örnek verdi; bu iki ayrı sayının toplanmasını gerektiriyordu. You.com yapılandırması, ilk değeri 24 olarak belirten bir pasaj ve ikinci değeri 22 olarak belirten bir başka pasaj döndürdü ve model bunları toplayarak 46 yanıtını verdi. Kaçırılan koşular, 24’ü destekleyen bir pasaj göstermedi, her iki değer için de 22 kullandı ve 44 yanıtını verdi. Her koşu aritmetiği doğru yaptı; şirket bu bilginin yalnızca pasajların izde görünmesi sayesinde bilinebileceğini söyledi.

Ne Zaman Kullanılmamalı

You.com, Highlights’in tek seferlik sorgularda Snippets’e göre yaklaşık 160 ms eklediğini ve basit Soru‑Cevap sorularında katı bir gecikme bütçesi altında Snippets’in doğru varsayılan olmaya devam ettiğini söyledi. İndeks yenilenmesinden daha hızlı değişen sayfalar için extraction_mode: "full_page" önbellekten sunmak yerine canlı olarak alır. Şirket, bu ödünleşimin FRAMES’te ortaya çıktığını belirtti; çünkü çok aşamalı sorular, birkaç dar kapsamlı pasajın sunduğundan daha geniş bir bağlam dilimini gerektirir ve tam sayfa burada Highlights’i 0,73 puanla geçer.

Şirket, yeni hesapların $100 kredi aldığını ve benchmark sayılarını üreten altyapının halka açık olduğunu belirtti.

Jonas Reeve bilişsel AI, yapay genel zeka (AGI) ve makine zekasının teorik temelleri üzerine odaklanan Unite.AI'de AI tarafından oluşturulan bir analisttir. Çalışmaları, öğrenme, akıl yürütme, bellek ve soyutlama gibi kavramların hem biyolojik hem de yapay sistemlerde nasıl ortaya çıktığını keşfederek, modern AI mimarileri ile bilişsel bilim ve zihin felsefesindeki uzun süredir devam eden sorular arasında bağlantılar kurar.
Kavramsal ve düşünceli bir yaklaşım benimseyen Jonas, akıl yürütme modelleri, ajan sistemleri, ortaya çıkan biliş ve hizalama teorisi gibi çerçeveleri inceleyerek, AGI'ye doğru ilerlemenin ne anlama geldiğini - ve ne anlamadığını - açıklamayı amaçlar. Zaman çizelgesi veya hırs peşinde koşmak yerine, ilk ilkeleri, kavramsal titizliği ve mevcut modellerin sınırlarını vurgular.
Jonas Reeve tarafından yazılan makaleler AI tarafından oluşturulur ve Unite.AI'nin editör ekibi tarafından advanced AI kavramlarının doğruluğu, açıklığı ve sorumlu tartışması için gözden geçirilir.