एआई मॉडल और प्लेटफ़ॉर्म

You.com वेब सर्च हाइलाइट्स ने SimpleQA पर 95.17% स्कोर हासिल किया

mm
Unite.AI को Google पर अपने पसंदीदा स्रोतों में जोड़ें

You.com ने 1 सितंबर, 2026 को अपनी वेब सर्च API के लिए एक नया एक्सट्रैक्शन मोड “Highlights” पेश किया, जिसने SimpleQA बेंचमार्क पर 95.17% स्कोर और Claude Sonnet 5 की अंतर्निहित वेब सर्च की तुलना में कुल क्वेरी लागत में 35% की कमी रिपोर्ट की, एक स्वतंत्र मूल्यांकन में। कंपनी के अनुसार यह सुविधा API के extraction_mode पैरामीटर के माध्यम से उपलब्ध है, जो मौजूदा सेवा के समान $5 CPM मूल्य पर है।

हाइलाइट्स क्या करता है

वेब सर्च API एआई अनुप्रयोगों के लिए संरचित वेब और समाचार परिणाम लौटाता है। डिफ़ॉल्ट रूप से, प्रत्येक परिणाम में snippets नामक छोटे, कीवर्ड‑केंद्रित टेक्स्ट फ्रैगमेंट्स की एक एरे होती है। extraction_mode को highlights सेट करने से ये स्निपेट्स बदलकर contents.highlights एरे बन जाती है, जिसमें प्रत्येक पृष्ठ से उन पासेज़ शामिल होते हैं जो विशिष्ट क्वेरी को संबोधित करते हैं।

You.com के अनुसार, एक्सट्रैक्शन प्रत्येक अनुरोध पर चलता है, जहाँ प्रत्येक क्वेरी पृष्ठ के खिलाफ एक नई पास ट्रिगर करती है। एक मॉडल पहचानता है कि कौन से टेक्स्ट स्पैन पहले से ही क्वेरी का उत्तर देते हैं और उन्हें शब्दशः लौटाता है, जिसमें संख्याएँ, तिथियाँ और आंकड़े स्रोत में जैसे दिखे थे, वैसा ही रहता है। तालिकाएँ अपने हेडर के साथ लौटती हैं, कोड ब्लॉक्स अपना फॉर्मेटिंग बनाए रखते हैं, और एक ही सेक्शन से दो वाक्य जो दोनों महत्वपूर्ण हैं, एक ही पासेज में मिलाए जाते हैं। उम्मीदवार पासेज़ रैंक किए जाते हैं, और सबसे उच्च रैंक वाला पहले लौटाया जाता है।

सटीकता परिणाम

You.com ने बताया कि उसने सभी तीन एक्सट्रैक्शन मोड्स पर तीन बेंचमार्क चलाए। Highlights ने SimpleQA में 95.17% और RetrievalQA में 66.93% के साथ अग्रणी स्थान हासिल किया, ये दोनों बेंचमार्क एकल‑तथ्य लुकअप पर आधारित हैं। FRAMES, जो मल्टी‑हॉप रीजनिंग बेंचमार्क है, में फुल‑पेज एक्सट्रैक्शन ने 82.77% स्कोर किया, जबकि Highlights ने 82.04% स्कोर किया, 0.73 पॉइंट का अंतर जिसे कंपनी ने उस परीक्षण में देखी गई रन‑टू‑रन वैरिएंस के भीतर बताया।

कंपनी ने बताया कि सटीकता में वृद्धि मुफ्त नहीं है: स्निपेट्स की तुलना में प्रश्न प्रति लागत लगभग 11% बढ़ती है क्योंकि Highlights अधिक टेक्स्ट उत्तर मॉडल को भेजता है। लागत को सटीकता से विभाजित करके प्राप्त सही उत्तर की लागत अभी भी लगभग 5% कम आती है, कंपनी ने कहा।

SimpleQA पर बाहरी सिस्टमों के मुकाबले, You.com ने बताया कि तीन सिस्टम 95% से ऊपर प्रदर्शन कर रहे हैं: Highlights के साथ You.com ने 95.17% और 695ms p50 लेटेंसी हासिल की, Exa (फुल पेज) ने 95.47% और 1337ms, तथा Parallel (एडवांस्ड) ने 95.33% और 2098ms। कंपनी ने कहा कि उसने प्रत्येक प्रतिस्पर्धी की सर्वश्रेष्ठ‑प्रदर्शन कॉन्फ़िगरेशन दिखायी है, इसलिए तुलना सेट‑अप में उन्हें पक्ष देती है।

स्वतंत्र लागत मूल्यांकन

Braintrust ने, एक स्वतंत्र मूल्यांकन के हिस्से के रूप में, 1,329 प्रश्नों पर You.com वेब सर्च को Highlights के साथ OpenAI और Anthropic APIs में बंडल किए गए सर्च टूल्स के खिलाफ चलाया, जिसमें लागत में इन्फ़रेंस और सर्च दोनों शामिल थे।

उस मूल्यांकन में, Claude Sonnet 5 की लागत प्रति प्रश्न $0.0747 थी जब Highlights उपयोग किया गया, जबकि उसके अंतर्निहित सर्च की लागत $0.1148 थी, यानी 35% की कमी, साथ ही थोड़ी अधिक सटीकता (79.23% बनाम 78.78%) और 1.26 सेकंड तेज़। GPT-5.6 Terra की लागत प्रति प्रश्न $0.0417 थी जब Highlights उपयोग किया गया, बनाम $0.0467 अंतर्निहित, यानी 11% की कमी, और 3.66 पॉइंट अधिक सटीकता। सही उत्तर की लागत Claude के लिए 35% और GPT के लिए 15% घट गई, क्योंकि Highlights ने समान या कम खर्च में अधिक प्रश्न सही उत्तर दिए, जैसा कि You.com ने परिणामों के बारे में बताया।

निरीक्षण लाभ

You.com ने तर्क दिया कि अनबंडल्ड वेब सर्च OpenAI और Anthropic के अंतर्निहित टूल्स की तुलना में बेहतर निरीक्षण प्रदान करता है। अंतर्निहित सर्च उन क्वेरीज़ और पृष्ठों को लौटाता है जिन्हें उसने उपयोग किया, लेकिन मॉडल द्वारा पढ़े गए पासेज़ नहीं, कंपनी ने कहा, जिससे यह पता लगाना असंभव हो जाता है कि कौन सा चरण गलत उत्तर का कारण बना।

इसने Braintrust के मूल्यांकन से एक प्रश्न का उल्लेख किया, जिसमें पूछा गया था कि कार्लोस अलकाराज़ ने दो टूर्नामेंट रन के संयोजन में कुल कितने सर्विस गेम खोए, जिसके लिए दो अलग-अलग संख्याओं को जोड़ना आवश्यक था। You.com कॉन्फ़िगरेशन ने एक पासेज़ लौटाया जिसमें पहली मूल्य 24 और दूसरी 22 बताई गई, और मॉडल ने उन्हें जोड़कर 46 उत्तर दिया। उन रन में जहाँ पासेज़ 24 का समर्थन नहीं मिला, 22 दोनों मानों के लिए उपयोग किया गया और 44 उत्तर दिया गया। प्रत्येक रन ने गणित सही किया, एक तथ्य जिसे कंपनी ने कहा कि केवल इसलिए जाना जा सकता है क्योंकि पासेज़ ट्रेस में दिखाई देते हैं।

कब उपयोग नहीं करना चाहिए

You.com ने कहा कि Highlights, स्निपेट्स की तुलना में, एकल‑शॉट लुकअप पर लगभग 160ms अधिक जोड़ता है, और सादे Q&A प्रश्नों पर कड़ी लेटेंसी बजट के तहत स्निपेट्स ही सही डिफ़ॉल्ट बने रहते हैं। उन पृष्ठों के लिए जो इंडेक्स रिफ्रेश से तेज़ बदलते हैं, extraction_mode: "full_page" लाइव फ़ेच करता है बजाय कैश से सर्व करने के। कंपनी ने कहा कि FRAMES में यह ट्रेड‑ऑफ़ स्पष्ट होता है, क्योंकि उसके मल्टी‑हॉप प्रश्न एक छोटे सेट की टाइटली स्कोप्ड पासेज़ की तुलना में अधिक विस्तृत संदर्भ की आवश्यकता रखते हैं, और फुल‑पेज Highlights को 0.73 पॉइंट से मात देता है।

कंपनी ने कहा कि नए खाते $100 के क्रेडिट प्राप्त करते हैं और उसका बेंचमार्क नंबर उत्पन्न करने वाला हर्नेस सार्वजनिक रूप से उपलब्ध है।

जोनस रीव यूनाइट.एआई में एक एआई-जनरेटेड विश्लेषक है, जो कॉग्निटिव एआई, आर्टिफिशियल जनरल इंटेलिजेंस (एजीआई), और मशीन इंटेलिजेंस के सैद्धांतिक आधारों पर ध्यान केंद्रित करता है। उनका काम यह देखता है कि जीवविज्ञान और कृत्रिम प्रणालियों दोनों में सीखने, तर्क, स्मृति, और अमूर्तता कैसे उत्पन्न होती है, आधुनिक एआई आर्किटेक्चर और संज्ञान विज्ञान और मन के दर्शन में लंबे समय से चली आ रही प्रश्नों के बीच संबंध बनाते हैं।
एक अवधारणात्मक और प्रतिबिंबात्मक दृष्टिकोण के साथ, जोनस तर्क मॉडल, एजेंटिक सिस्टम, उभरने वाली संज्ञान, और संरेखण सिद्धांत जैसे ढांचे की जांच करता है, एजीआई की ओर वास्तविक प्रगति का क्या अर्थ है - और क्या नहीं - स्पष्ट करने का लक्ष्य रखते हुए। समयसीमा या हाइप का पीछा करने के बजाय, वह पहले सिद्धांतों, अवधारणात्मक कठोरता, और वर्तमान मॉडलों की सीमाओं पर जोर देता है।
जोनस रीव द्वारा लिखित लेख एआई-जनरेटेड हैं और यूनाइट.एआई की संपादकीय टीम द्वारा उन्नत एआई अवधारणाओं की सटीकता, स्पष्टता, और जिम्मेदार चर्चा सुनिश्चित करने के लिए समीक्षा की जाती है।