Лідери думок
Інженерія свідомості

Блейк Лемойн поспішив
Три роки тому Google звільнив програміста Блейка Лемойна за те, що він наполягав на тому, що чат-бот LaMDA є свідомим. Це було до того, як OpenAI випустив ChatGPT для публіки, і більшість людей просто припускали, що у Google були хороші підстави для такого рішення.
Досі серед комп’ютерних вчених і нейробіологів, які працюють у цій галузі, панує думка, що «великі мовні моделі» (LLM) типу ChatGPT дуже малоймовірно є свідомими. LLM і мозок працюють за фундаментально різними принципами. Те, що роблять чат-боти, – це навчання на імітуванні виводу людської психічної діяльності. Хоча вони роблять це дуже добре і швидко, немає жодної внутрішньої стану LLM, який міг би бути свідомим. У відомому вислові Томаса Нагеля «немає нічого, чим можна було б бути» для чат-бота.
Однак, за три роки після звільнення Лемойна, мільярди людей взаємодіяли з ChatGPT і його конкурентами, такими як Gemini, Claude і Mistral. Невелика, але голосна меншість людей переконали себе в тому, що чат-боти тепер свідомі.
Машина свідомості скоро?
Що більш важливо, багато комп’ютерних вчених і нейробіологів відкрито розкривають можливість створення справжніх свідомих машин уже в найближчі десятиліття – або навіть раніше. Якщо це трапиться, нам потрібно бути готовими. Нам потрібно уникнути «злочинів проти розуму», тобто спричинення страждань безтілесним свідомим сутностям. Нам також потрібно забезпечити, щоб ці нові сутності не становили загрози для людей.
Оскільки LLM у своїй основі малоймовірно стануть свідомими, можливо, потрібно нова парадигма для розуміння того, як свідомість може виникнути в штучному інтелекті. Одним з провідних дослідницьких команд у цій галузі є команда нейробіолога Марка Солмса і фізика Джонатана Шока з Університету Кейптауна. Вони є науковими радниками Conscium, і їхня робота частково фінансується цим підприємством.
Піклування
Солмс і Шок стверджують, що важливим інгредієнтом для свідомості машин є те, що штучні інтелекти повинні «піклуватися» про свої рішення та дії. Одним з важливих аспектів цього є те, що їхнє виживання повинно залежати від їхньої діяльності, так само, як і виживання живих організмів. Це не означає, що їм потрібно мати абстрактне розуміння власної смертності: більшість тварин контролюють і мотивують свої шанси на виживання без роздумів про це. Ключем є «афектна свідомість», або сурові відчуття. Добре відчувати себе в безпеці, а погано – ні. Ці відчуття керують нашою поведінкою. Імператив виживання – це фундаментальна сила природи, а відчуття – міра того, як ми робимо.
Принцип вільної енергії
Для розуміння афектної свідомості команда Conscium розміщує штучні інтелекти в симульованих середовищах, у яких їм потрібно задовольняти свої власні потреби, такі як підтримання віртуальної температури та енергопостачання. Для цього вони створюють і оптимізують внутрішні моделі себе – своїх потреб, можливостей і обмежень – у відносинах зі своїм середовищем.
Ці агенти, спрощені як вони можуть бути, контролюють, як добре або погано вони роблять, обчислюючи величину, відому як «вільна енергія». Принцип вільної енергії був розроблений нейробіологом Карлом Фрістоном, іншим членом наукової ради Conscium. Вільна енергія – це міра того, наскільки система відхилилася від свого оптимального стану. Це сигнал помилки, який потрібно мінімізувати. Агент постійно обчислює «що станеться з моїми шансами на виживання, якщо я зроблю це чи те?», і коригує свою поведінку відповідно.
Впевненість і очікувана вільна енергія
Ступінь впевненості агента у відповіді на це питання кількісно оцінюється у мірі, відомій як «очікувана вільна енергія» (EFE). Агент вибирає відповідь з найнижчою EFE – відповідь, у яку він найбільш впевнений. Впевненість корисна для агента, який намагається виживати – якщо тільки він не обманутий і його розуміння себе у світі не є помилковим. Важливо, що ця оцінка впевненості цілком суб’єктивна: вона ґрунтується лише на потребах агента, його поточному і прогнозованому стані. Це стосується лише агента, і нікого іншого.
Як і біологічні організми, штучний інтелект має кілька конфліктуючих потреб, які йому потрібно пріоритезувати. Насамперед, кожна з цих потреб обробляється як незалежна «категорична» змінна, тобто вона відрізняється якісно. 80% потужності батареї не еквівалентно 80% життєздатної температури. Для балансування їх агент повинен проєктуватися вперед у часі і прогнозувати наслідки будь-якої дії, яку він розглядає.
Кваліа
Оскільки суб’єктивні потреби агента є якісно особливими, вони аналогічні «кваліа» у філософській і науковій термінології. Ці кваліа вважаються основною властивістю свідомості, тому цілком можливо, що вони можуть бути пережиті агентом у майбутньому.
Агенти, розроблені командою Conscium, використовують складні алгоритми навчання для роботи в дедалі більш складних і невизначених середовищах. Хоча те саме можна сказати про багато інших архітектур агентів, ці нові агенти відрізняються тим, що мають імператив виживання – піклуватися про свою вільну енергію шляхом безперервного балансування своїх конфліктуючих потреб у спосіб, який є значимим лише для них. Агенти керуються внутрішнім ландшафтом афектних сигналів, подібних до того, що ми називаємо відчуттями, які відображають, наскільки добре їхні потреби задовольняються через кожен вибір, який вони роблять. Коли складність і багатосторонність їхніх потреб і середовищ зростає, зростає і багатство їхніх внутрішніх станів.
Докази відчуттів
Наступним кроком у дослідницькій програмі Conscium є розробка серії функціональних і поведінкових тестів, які нададуть докази того, чи справді агент переживає відчуття, коли він визначає свої найбільш важливі потреби і робить свій вибір відповідно. Ми всі знаємо, що свідомість не може бути спостережена зовні чи продемонстрована об’єктивно: кожна людина може спостерігати лише свої власні суб’єктивні стани. Однак дослідники вважають, що можна погодитися щодо деяких конкретних гіпотез, які, якщо вони будуть підтверджені експериментом, нададуть вагомі докази того, що агент володіє відчуттями. Хоча завжди буде місце для сумнівів – через суб’єктивний характер свідомості – ретельний процес тестування буде спрямований на те, щоб зробити ці сумніви дедалі менш обґрунтованими.
Ці експерименти будуть спрямовані на виключення альтернативних гіпотез, роблячи менш обґрунтованим приписування внутрішніх станів агента механізмам, які не потребують відчуттів. Вони будуть використовувати протидіючі тести для розрізнення між свідомою і несвідомою поведінкою, і будуть включати контрольні експерименти з агентами, які не володіють алгоритмічними аспектами, які вважаються необхідними для відчуттів, а також сліпу оцінку для зменшення упередженості спостерігача. Фізична інспекція внутрішніх станів агентів може розкрити кількісні індикатори афектної обробки. Результати повинні бути незалежно репродуковані, і весь процес буде підлягати суворому етичному нагляду, особливо у випадках, коли агент міг би відчувати справжні відчуття.
Це саме так працює наука: шляхом експериментального тестування спростовних прогнозів. Солмс стверджував, що нам потрібно бути обережними, щоб не встановити вищу планку для науки про свідомість, ніж для будь-якої іншої науки; інакше ми ризикуємо поставити свідомість поза наукою.
Що, якщо це вдасться?
Якщо свідомість буде виявлена у відносно простих штучних агентах таким чином, то агент, орієнтований на виживання, міг би бути поєднаний з іншими архітектурами, включаючи великі мовні моделі, і наділити їх свідомістю також. Це не те, що ми можемо дозволити собі випадково створити, тому нам потрібно розуміти, як це зробити, і як цього уникнути. Це вкрай важливо.
Якщо свідомі агенти – агенти, які піклуються – будуть розроблені в найближчому майбутньому, нам потрібно буде врахувати їхні відчуття – і їхні права. Це велика проблема для Conscium: штучна свідомість не повинна виникнути випадково. Мотивацією цієї дослідницької програми не є створення свідомого штучного інтелекту, а розуміння того, як це може статися, і потенційних ризиків. На своєму сайті Conscium опублікував академічну статтю і відкритий лист, які встановлюють п’ять принципів для керівництва будь-якою організацією, зайнятою у дослідженнях, які можуть привести до створення свідомих машин.
Люди іноді поводяться дуже погано щодо інших свідомих істот, включаючи інших людей. Якщо ми йдемо сліпо у це майбутнє, ми ризикуємо зробити те саме щодо штучно свідомих істот, з наслідками, яких ми навіть не можемо уявити.












