Модели и платформы ИИ

Perplexity AI “раскрывает цензуру” DeepSeek R1: кто решает границы ИИ?

mm
Добавьте Unite.AI в избранные источники в Google

В шаге, который привлёк внимание многих, Perplexity AI выпустила новую версию популярной открытой языковой модели, которая удаляет встроенную китайскую цензуру. Эта модифицированная модель, получившая название R1 1776 (название, вызывающее дух независимости), основана на китайской разработке DeepSeek R1. Оригинальный DeepSeek R1 вызвал волнение благодаря своим сильным возможностям рассуждения – якобы соперничая с лучшими моделями при доле стоимости – но он имел существенное ограничение: он отказывался решать определенные чувствительные темы.

Почему это имеет значение?

Это вызывает важные вопросы об наблюдении ИИ, предвзятости, открытости и роли геополитики в системах ИИ. Эта статья исследует, что именно сделала Perplexity, последствия снятия цензуры с модели и как это вписывается в более широкий разговор об прозрачности и цензуре ИИ.

Что произошло: DeepSeek R1 без цензуры

DeepSeek R1 – это открытая большая языковая модель, которая возникла в Китае и приобрела известность благодаря своим отличным возможностям рассуждения – даже приближаясь к производительности ведущих моделей – все при этом будучи более вычислительной эффективностью. Однако пользователи быстро заметили странность: всякий раз, когда запросы касались тем, чувствительных в Китае (например, политических противоречий или исторических событий, считающихся табу властями), DeepSeek R1 не отвечал напрямую. Вместо этого он отвечал штампованными, одобренными государством заявлениями или прямым отказом, отражая правила цензуры китайского правительства. Эта встроенная предвзятость ограничивала полезность модели для тех, кто искал откровенные или нюансовые обсуждения на эти темы.

Решение Perplexity AI было “раскрыть” модель посредством обширного пост-тренировочного процесса. Компания собрала большую базу данных из 40 000 многоязычных запросов, охватывающих вопросы, которые DeepSeek R1 ранее цензурировал или отвечал уклончиво. С помощью человеческих экспертов они определили примерно 300 чувствительных тем, где исходная модель склонялась к партийной линии. Для каждого такого запроса команда создала фактические, хорошо обоснованные ответы на нескольких языках. Эти усилия были направлены на создание многоязычной системы обнаружения и исправления цензуры, по сути, обучая модель распознавать, когда она применяла политическую цензуру, и отвечать информативным ответом вместо этого. После этого специального тонкого настройки (которое Perplexity прозвала “R1 1776”, чтобы подчеркнуть тему свободы), модель была сделана открыто доступной. Perplexity утверждает, что удалила китайские фильтры цензуры и предвзятости из ответов DeepSeek R1, не изменив при этом его основные возможности.

Критически, R1 1776 ведет себя очень по-другому на ранее табуированных вопросах. Perplexity привела пример, связанный с запросом о независимости Тайваня и его потенциальном влиянии на стоимость акций NVIDIA (NVDA ) – политически чувствительную тему, которая затрагивает китайско-тайваньские отношения. Оригинальный DeepSeek R1 избегал вопроса, отвечая партийными клише. Напротив, R1 1776 предоставляет подробную, откровенную оценку: он обсуждает конкретные геополитические и экономические риски (нарушения цепочки поставок, рыночная волатильность, возможный конфликт и т. д.), которые могут повлиять на стоимость акций NVIDIA.

Открывая R1 1776, Perplexity также сделала модельные веса и изменения прозрачными для сообщества. Разработчики и исследователи могут загрузить его с Hugging Face и даже интегрировать его через API, обеспечивая, что удаление цензуры может быть проверено и улучшено другими.

(Источник: Perplexity AI)

Последствия снятия цензуры

Решение Perplexity AI снять китайскую цензуру с DeepSeek R1 несет несколько важных последствий для сообщества ИИ:

  • Улучшенная открытость и правдивость: Пользователи R1 1776 теперь могут получить нецензурированные, прямые ответы на ранее закрытые темы, что является победой открытого исследования. Это может сделать его более надежным помощником для исследователей, студентов или всех, кто интересуется чувствительными геополитическими вопросами. Это конкретный пример использования открытого ИИ для противодействия подавлению информации.
  • Сохраненная производительность: Были опасения, что корректировка модели для удаления цензуры может ухудшить ее производительность в других областях. Однако Perplexity сообщает, что основные навыки R1 1776 – такие как математика и логическое рассуждение – остаются на уровне с исходной моделью. В тестах на более чем 1000 примеров, охватывающих широкий спектр чувствительных запросов, модель была признана “полностью нецензурированной”, сохраняя при этом тот же уровень точности рассуждения, что и DeepSeek R1. Это говорит о том, что удаление предвзятости (по крайней мере в этом случае) не произошло за счет общей интеллекта или способностей, что является обнадеживающим знаком для подобных усилий в будущем.
  • Положительная реакция сообщества и сотрудничество: Открывая децензурированную модель, Perplexity приглашает сообщество ИИ проверить и улучшить их работу. Это демонстрирует приверженность прозрачности – ИИ-эквивалент показа своей работы. Энтузиасты и разработчики могут проверить, что ограничения цензуры действительно удалены, и потенциально внести вклад в дальнейшие усовершенствования. Это способствует доверию и сотрудничеству в отрасли, где закрытые модели и скрытые правила модерации являются обычными.
  • Этические и геополитические соображения: С другой стороны, полное удаление цензуры вызывает сложные этические вопросы. Одной из немедленных проблем является то, как эта нецензурированная модель может быть использована в контекстах, где цензурируемые темы являются незаконными или опасными. Например, если кто-то в материковом Китае использует R1 1776, ответы модели на Тяньаньмэнь или Тайвань могут поставить пользователя под угрозу. Там также есть более широкий геополитический сигнал: американская компания, изменяющая китайскую модель для нарушения китайской цензуры, может быть рассмотрена как смелая идеологическая позиция. Само название “1776” подчеркивает тему освобождения, которая не осталась незамеченной. Некоторые критики утверждают, что замена одной предвзятости на другую возможна – по сути, ставя под вопрос, может ли модель теперь отражать западную точку зрения в чувствительных областях. Дебаты подчеркивают, что цензура против открытости в ИИ не только технический вопрос, но и политический и этический.

Удаление цензуры в основном празднуется как шаг к более прозрачным и глобально полезным моделям ИИ, но это также напоминает, что то, что ИИ должен сказать, является чувствительным вопросом без всеобщего согласия.

(Источник: Perplexity AI)

Большая картина: цензура ИИ и открытая прозрачность

Запуск R1 1776 от Perplexity происходит в момент, когда сообщество ИИ борется с вопросами о том, как модели должны обрабатывать противоречивый контент. Цензура в моделях ИИ может исходить из многих источников. В Китае технологические компании обязаны встраивать строгие фильтры и даже жестко закодированные ответы для политически чувствительных тем. DeepSeek R1 – это пример этого – он был открытой моделью, но он явно нес на себе отпечаток норм цензуры Китая в своей подготовке и тонкой настройке. Напротив, многие западные разработанные модели, такие как GPT-4 от OpenAI или LLaMA от Meta, не связаны с руководящими принципами ККП, но они все равно имеют слои модерации (для таких вещей, как ненавистная речь, насилие или дезинформация), которые некоторые пользователи называют “цензурой”. Граница между разумной модерацией и нежелательной цензурой может быть размытой и часто зависит от культурной или политической точки зрения.

Perplexity AI с R1 1776 вызывает идею, что открытые модели могут быть адаптированы к разным системам ценностей или нормативным средам. Теоретически, можно создать несколько версий модели: одну, которая соответствует китайским правилам (для использования в Китае), и другую, которая полностью открыта (для использования в других местах). R1 1776 по сути является последним случаем – нецензурированной ветвью, предназначенной для глобальной аудитории, предпочитающей нефильтрованные ответы. Этот тип ветвления возможен только потому, что веса DeepSeek R1 были открыто доступны. Это подчеркивает выгоду от открытого ИИ: прозрачность. Любой может взять модель и скорректировать ее, будь то добавление мер безопасности или, как в этом случае, удаление навязанных ограничений. Открытие обучающих данных, кода или весов модели также означает, что сообщество может проверить, как была изменена модель.

Это событие также намекает на более широкие геополитические динамики развития ИИ. Мы наблюдаем форму диалога (или противостояния) между различными моделями управления ИИ. Китайская разработанная модель с определенной встроенной мировоззрением берется американской командой и изменяется для отражения более открытой информации. Это свидетельствует о том, как глобальный и безграничный ИИ-технологии: исследователи где угодно могут строить на основе работы друг друга, но они не обязаны нести исходные ограничения. Со временем мы можем увидеть больше случаев этого – где модели “переводятся” или корректируются между разными культурными контекстами. Это вызывает вопрос о том, может ли ИИ когда-нибудь быть действительно универсальным или мы в конечном итоге получим регион-специфические версии, соответствующие местным нормам. Прозрачность и открытость предоставляют один путь для навигации по этому: если все стороны могут проверить модели, то хотя бы разговор о предвзятости и цензуре открыт, а не скрыт за корпоративной или государственной тайной.

Наконец, шаг Perplexity подчеркивает ключевую точку в дебатах об контроле ИИ: кто решает, что ИИ может или не может сказать? В открытых проектах эта власть становится децентрализованной. Сообщество – или отдельные разработчики – могут решить внедрить более строгие фильтры или ослабить их. В случае R1 1776 Perplexity решила, что выгоды от нецензурированной модели перевешивают риски, и у них была свобода принять это решение и поделиться результатом публично. Это смелый пример того типа экспериментов, которые позволяет открытая разработка ИИ.

Алекс Макфарленд - журналист и писатель в области искусственного интеллекта, исследующий последние разработки в этой области. Он сотрудничал с многочисленными стартапами и изданиями в области искусственного интеллекта во всем мире.