Модели и платформы ИИ
You.com Highlights в веб‑поиске достигает 95,17% по SimpleQA

You.com 1 сентября 2026 года представил новый режим извлечения для своего Web Search API под названием Highlights, сообщив о результате 95,17 % в бенчмарке SimpleQA и о снижении общей стоимости запросов на 35 % по сравнению со встроенным веб‑поиском Claude Sonnet 5 в независимой оценке. Функция доступна через параметр API extraction_mode по той же цене $5 CPM, что и существующий сервис, заявила компания.
Что делает Highlights
Web Search API возвращает структурированные результаты веб‑ и новостных запросов для AI‑приложений. По умолчанию каждый результат содержит массив snippets из коротких фрагментов текста, ориентированных на ключевые слова. Установка extraction_mode в значение highlights заменяет эти сниппеты массивом contents.highlights, содержащим отрывки со страницы, которые отвечают конкретному запросу.
Согласно You.com, извлечение происходит для каждого запроса отдельно, каждый запрос инициирует новый проход по странице. Модель определяет, какие отрезки текста уже отвечают на запрос, и возвращает их дословно, сохраняя числа, даты и цифры в том виде, в каком они представлены в источнике. Таблицы возвращаются с сохранёнными заголовками, блоки кода сохраняют своё форматирование, а предложения из одного раздела, которые оба имеют значение, объединяются в один отрывок. Кандидатные отрывки ранжируются, при этом сначала возвращается отрывок с наивысшим рангом.
Результаты точности
You.com сообщил, что провёл три бенчмарка по всем трём режимам извлечения. Highlights возглавил SimpleQA с 95,17 % и RetrievalQA с 66,93 %, двумя бенчмарками, построенными вокруг поиска единственного факта. В FRAMES, бенчмарке многократного вывода, полностраничное извлечение получило 82,77 % против 82,04 % у Highlights, разница 0,73 пункта, которую компания охарактеризовала как находящуюся в пределах наблюдаемой дисперсии между запусками теста.
Компания отметила, что прирост точности не бесплатен: стоимость за вопрос возрастает примерно на 11 % по сравнению со Snippets, поскольку Highlights передаёт больше текста модели‑ответчику. Стоимость за правильный ответ, вычисляемая как отношение стоимости к точности, всё‑равно оказывается примерно на 5 % ниже, сообщается в отчёте.
Сравнивая с внешними системами по SimpleQA, You.com сообщил о трёх системах, преодолевших отметку 95 %: You.com с Highlights – 95,17 % и задержка p50 695 мс, Exa (полная страница) – 95,47 % и 1337 мс, Parallel (advanced) – 95,33 % и 2098 мс. Компания заявила, что отобразила лучшую конфигурацию каждого конкурента, поэтому сравнение выгодно в их пользу с точки зрения настройки.
Независимая оценка стоимости
Braintrust в рамках независимой оценки сравнил You.com Web Search с Highlights со средствами поиска, встроенными в API OpenAI и Anthropic, на 1329 вопросах, учитывая стоимость как инференса, так и поиска.
В этой оценке Claude Sonnet 5 стоил $0,0747 за вопрос с Highlights против $0,1148 за встроенный поиск, что составляет снижение на 35 % при слегка более высокой точности (79,23 % против 78,78 %) и ускорении на 1,26 секунды. GPT‑5.6 Terra стоил $0,0417 за вопрос с Highlights против $0,0467 за встроенный поиск, снижение 11 % при повышении точности на 3,66 пункта. Стоимость за правильный ответ упала на 35 % для Claude и на 15 % для GPT, поскольку Highlights отвечал правильно на большее количество вопросов при том же или меньшем расходе, согласно данным You.com.
Преимущество наблюдаемости
You.com утверждает, что отдельный веб‑поиск обеспечивает лучшую наблюдаемость, чем встроенные инструменты OpenAI и Anthropic. Встроенный поиск возвращает только запросы, которые он выполнил, и страницы, которые он процитировал, но не отрывки, прочитанные моделью, сообщает компания, оставляя без возможности увидеть, какой шаг привёл к ошибочному ответу.
В качестве примера была приведена задача из оценки Braintrust, где требовалось определить, сколько сервисных игр потерял Карлос Алкарас в двух турнирах вместе, что требовало сложения двух отдельных чисел. Конфигурация You.com вернула один отрывок, фиксирующий первое значение – 24, и другой, фиксирующий второе – 22, и модель сложила их, получив 46. В запусках, где ошибка возникла, ни один отрывок не подтверждал 24, использовалось 22 для обоих значений, и ответ был 44. Каждый запуск выполнил арифметику правильно, факт, который, по словам компании, можно узнать только благодаря наличию отрывков в трассировке.
Когда не стоит использовать
You.com сообщил, что Highlights добавляет около 160 мс к запросам по сравнению со Snippets при одиночных поисках, и что при жёстком ограничении задержки для простых вопросов‑ответов Snippets остаются предпочтительным вариантом по умолчанию. Для страниц, обновляющихся быстрее, чем происходит переиндексация, extraction_mode: "full_page" получает живой контент, а не обслуживает кэш. FRAMES — это случай, когда такой компромисс проявляется, пояснила компания, поскольку её многократные вопросы требуют более широкого контекста, чем несколько чётко ограниченных отрывков, и полная страница обгоняет Highlights там на 0,73 пункта.
Компания заявила, что новые аккаунты получают $100 кредитов, а набор средств, генерирующий её бенчмарк‑числа, доступен публично.












