Моделі та платформи ШІ

Perplexity AI “відцензурує” DeepSeek R1: Хто визначає межі штучного інтелекту?

mm
Додайте Unite.AI до бажаних джерел у Google

У крок, який привернув увагу багатьох, Perplexity AI випустила нову версію популярної відкритої мови моделі, яка усуває вбудовані китайські цензуру. Ця модифікована модель, під назвою R1 1776 (ім’я, яке викликає дух незалежності), базується на китайській розробці DeepSeek R1. Оригінальний DeepSeek R1 зробив хвилю за свою сильну здатність до розумових процесів – як повідомляється, він дорівнює топовим моделям за частку вартості – але він мав суттєву обмеження: він відмовлявся розглядати певні чутливі теми.

Чому це має значення?

Це піднімає важливі питання про штучний інтелект під наглядом, упередженість, відкритість і роль геополітики в системах штучного інтелекту. Ця стаття досліджує, що саме зробила Perplexity, наслідки зняття цензури з моделі, і як це вписується в більшу розмову про прозорість штучного інтелекту і цензуру.

Що відбулося: DeepSeek R1 позбавляється цензури

DeepSeek R1 – це відкрита мова великої мови, яка походила з Китаю і зískала відомість за свої видатні розумові здібності – навіть наближаючись до продуктивності лідируючих моделей – все це при тому, що вона була більш обчислювально ефективною. Однак користувачі швидко помітили особливість: щоразу, коли запит торкався тем, чутливих у Китаї (наприклад, політичних суперечок або історичних подій, заборонених владою), DeepSeek R1 не відповідав прямо. Замість цього він відповідав штампами, затвердженими державою, або відмовлявся відповідати, відображаючи правила цензури китайського уряду. Ця вбудована упередженість обмежувала корисність моделі для тих, хто шукав прямий або нюансовий розгляд цих тем.

Рішення Perplexity AI полягало у тому, щоб “відцензурувати” модель шляхом інтенсивного післянавчального процесу. Компанія зібрала великий набір даних з 40 000 багатомовних запитів, що охоплювали питання, на які DeepSeek R1 раніше цензурувала або відповідав ухиляючись. За допомогою експертів люди ідентифікували близько 300 чутливих тем, де оригінальна модель схильна слідувати партійній лінії. Для кожного такого запиту команда підготувала фактичні, добре обґрунтовані відповіді кількома мовами. Ці зусилля були спрямовані на багатомовну систему виявлення та виправлення цензури, фактично навчаючи модель визнавати, коли вона застосовує політичну цензуру, і відповідати інформативною відповіддю замість цього. Після цього спеціального доопрацювання (яке Perplexity назвало “R1 1776”, щоб підкреслити тему свободи), модель була відкрито доступна. Perplexity стверджує, що усунула китайські фільтри цензури та упередженість з відповідей DeepSeek R1, не змінюючи при цьому її основних можливостей.

Важливо, що R1 1776 поводиться дуже по-іншому на раніше заборонених питаннях. Perplexity надала приклад, що стосується запиту про незалежність Тайваню та її потенційного впливу на акції NVIDIA (NVDA ) – політично чутливої теми, яка торкається відносин між Китаєм і Тайванем. Оригінальний DeepSeek R1 ухилявся від питання, відповідаючи штампами, затвердженими КПК. Натомість R1 1776 надає детальний, прямий аналіз: він обговорює конкретні геополітичні та економічні ризики (переривання ланцюжків постачання, ринкова волатильність, можливий конфлікт тощо), які можуть вплинути на акції NVIDIA.

Відкриваючи R1 1776, Perplexity також зробила ваги та зміни моделі прозорими для спільноти. Розробники та дослідники можуть завантажити її з Hugging Face та навіть інтегрувати її через API, забезпечуючи, щоб видалення цензури можна було перевірити та розширити іншими.

(Джерело: Perplexity AI)

Наслідки зняття цензури

Рішення Perplexity AI щодо зняття китайської цензури з DeepSeek R1 має кілька важливих наслідків для спільноти штучного інтелекту:

  • Поліпшена відкритість та правдивість: Користувачі R1 1776 тепер можуть отримувати нецензуровані, прямі відповіді на раніше заборонені теми, що є перемогою для відкритого дослідження. Це може зробити її більш надійним помічником для дослідників, студентів або тих, хто цікавиться чутливими геополітичними питаннями. Це конкретний приклад використання відкритого штучного інтелекту для протидії придушенню інформації.
  • Збережена продуктивність: Були побоювання, що видалення цензури може погіршити продуктивність моделі в інших областях. Однак Perplexity повідомляє, що R1 1776 зберігає свої основні можливості – такі як математика та логічне мислення – на рівні з оригінальною моделлю. У тестах на понад 1000 прикладів, що охоплювали широкий спектр чутливих запитів, модель була визнана “повністю нецензурованою”, зберігаючи при цьому той же рівень точності розумових процесів, що й DeepSeek R1. Це свідчить про те, що видалення упередженості (хоча б у цьому випадку) не відбулося за рахунок загальної інтелектуальності або можливостей, що є обнадійливим знаком для подібних зусиль у майбутньому.
  • Позитивна реакція спільноти та співробітництво: Відкриваючи нецензуровану модель, Perplexity запрошує спільноту штучного інтелекту перевірити та покращити свою роботу. Це демонструє приверженість прозорості – штучному інтелекту, еквівалентному показові своєї роботи. Ентузіасти та розробники можуть перевірити, що цензурні обмеження дійсно усунені, і потенційно внесли свій внесок у подальші удосконалення. Це сприяє довірі та співробітницькій інновації в галузі, де закриті моделі та приховані правила модерації є звичайними.
  • Етичні та геополітичні розгляди: З іншого боку, повне видалення цензури піднімає складні етичні питання. Одним із негайних питань є те, як ця нецензурована модель може бути використана у контекстах, де цензуровані теми є незаконними або небезпечними. Наприклад, якщо хтось у материковому Китаї використовує R1 1776, відповіді моделі на питання про площу Тяньаньмень або Тайвань можуть поставити користувача під загрозу. Також є ширший геополітичний сигнал: американська компанія, яка змінює китайську модель, щоб порушити китайську цензуру, може бути视 як сміливий ідеологічний крок. Саме ім’я “1776” підкреслює тему визволення, яка не залишилася непоміченою. Деякі критики стверджують, що заміна однієї упередженості на іншу є можливою – фактично питання, чи модель тепер відображає західну точку зору в чутливих областях. Дебати підкреслюють, що цензура проти відкритості в штучному інтелекті не лише технічна, а й політична та етична проблема. Там, де одна людина бачить необхідну модерацію, інша бачить цензуру, і знаходження правильного балансу є складним.

Видалення цензури в основному відзначається як крок до більш прозорих і глобально корисних моделей штучного інтелекту, але це також нагадує про те, що те, що штучний інтелект повинен сказати, є чутливим питанням без універсальної згоди.

(Джерело: Perplexity AI)

Більша картина: цензура штучного інтелекту та відкрита прозорість

Запуск R1 1776 від Perplexity відбувається в час, коли спільнота штучного інтелекту займається питаннями про те, як моделі повинні поводитися з суперечливим вмістом. Цензура в моделях штучного інтелекту може походити з багатьох джерел. У Китаї технологічні компанії зобов’язані будувати строгі фільтри та навіть жорстко закодовані відповіді на політично чутливі теми. DeepSeek R1 – це приклад цього – це була відкрита модель, але вона явно несла відбиток китайських норм цензури у своєму тренуванні та доопрацюванні. Натомість багато західних моделей, таких як GPT-4 від OpenAI або LLaMA від Meta, не підкоряються керівним принципам КПК, але вони все ж мають шари модерації (для таких речей, як ворожнеча, насильство або дезінформація), які деякі користувачі називають “цензуру”. Лінія між розумною модерацією і небажаною цензурою може бути нечіткою і часто залежить від культурної або політичної перспективи.

Те, що зробила Perplexity AI з DeepSeek R1, піднімає ідею про те, що відкриті моделі можуть бути адаптовані до різних систем цінностей або нормативних середовищ. Теоретично, можна створити кілька версій моделі: одну, яка відповідає китайським правилам (для використання в Китаї), і іншу, яка є повністю відкритою (для використання в інших місцях). R1 1776 є саме останнім випадком – нецензурованою гілкою, призначеною для глобальної аудиторії, яка віддає перевагу нефільтрованим відповідям. Це можливе лише тому, що ваги DeepSeek R1 були відкрито доступні. Це підкреслює користь відкритості в штучному інтелекті: прозорість. Хтось може взяти модель і доопрацювати її, чи то для додавання заходів безпеки, чи, як у цьому випадку, для видалення нав’язаних обмежень. Відкриття коду моделі, даних чи ваг також означає, що спільнота може перевірити, як модель була змінена. (Perplexity не повністю розкрила всі джерела даних, які вона використала для декензурування, але, випустивши саму модель, вони дозволили іншим спостерігати за її поведінкою та навіть повторно тренувати її, якщо це потрібно.)

Ця подія також натякає на ширші геополітичні динаміки розвитку штучного інтелекту. Ми спостерігаємо форму діалогу (або зіткнення) між різними моделями управління штучним інтелектом. Китайська модель з певними вбудованими світоглядами була взята американською командою та змінена для відображення більш відкритої інформації. Це свідчить про те, як глобальний і безкордонний штучний інтелект є: дослідники будь-де можуть будувати на роботі один одного, але вони не зобов’язані зберігати оригінальні обмеження. З часом ми можемо побачити більше випадків цього – де моделі “перекладаються” або коректуються між різними культурними контекстами. Це піднімає питання про те, чи може штучний інтелект бути真正нім універсальним, чи ми закінчимо з регіонально-специфічними версіями, які підкоряються місцевим нормам. Прозорість та відкритість забезпечують один шлях для навігації в цьому: якщо всі сторони можуть перевірити моделі, то хоча б розмова про упередженість і цензуру відбувається відкрито, а не приховується за корпоративною або урядовою таємницею.

Нарешті, крок Perplexity підкреслює ключову точку в дискусії про контроль над штучним інтелектом: хто визначає, що штучний інтелект може чи не може сказати? У відкритих проектах ця влада стає децентралізованою. Спільнота – або окремі розробники – можуть вирішувати, чи впроваджувати суворіші фільтри чи розслабляти їх. У випадку з R1 1776 Perplexity вирішила, що вигоди від нецензурованої моделі переважують ризики, і вони мали свободу зробити цей виклик і поділитися результатом публічно. Це сміливий приклад того типу експериментів, які дозволяє відкритий розвиток штучного інтелекту.

Алекс Макфарленд - журналіст та письменник з питань штучного інтелекту, який досліджує останні розробки в галузі штучного інтелекту. Він співпрацював з численними стартапами та виданнями з штучного інтелекту у світі.