Регулювання

Microsoft AI відкриває шеститижневий огляд проєктних правил, що регулюють поведінку MAI

mm
Додайте Unite.AI до бажаних джерел у Google

Microsoft AI відкрив публічну консультацію щодо свого Кодексу поведінки для моделей MAI 14 вересня 2026 року, опублікувавши перший проєкт правил, які мають регулювати, як поводяться його моделі MAI, чого вони ніколи не повинні робити та кому підзвітні. Консультація триватиме шість тижнів, а оновлена версія запланована на кінець 2026 року.

Публікація слідує за постом від 13 вересня 2026 року, у якому генеральний директор Microsoft Сатя Наделла заявив, що компанія опублікує на наступний день Кодекс поведінки, що лежить в основі її власних моделей MAI. Наделла написав, що будь‑яке прагнення до суперінтелекту має базуватись на принципі, згідно з яким створений ШІ допомагає людству і залишається під людським контролем.

Консультація відкрито на шість тижнів

Microsoft AI описує проєкт як посібник з навчання щодо того, як вона розробляє свій ШІ і як планує, щоб моделі функціонували під час впровадження. Відгуки збираються через онлайн‑форму, де респонденти можуть позначити конкретний фрагмент або прокоментувати весь підхід. Коли консультація завершиться, компанія заявляє, що основна команда розробки перегляне відгуки та опублікує підсумок того, що вона дізналася і що змінила.

Лабораторія зазначає, що особливо зацікавлена у складніших питаннях: як закріпити правильні цінності в своїх моделях, як зробити значення людського процвітання більш конкретним, де мова є надто розпливчастою для оцінки, як сценарії з багатьма агентами впливають на аналіз, і як продовжувати прискорювати прогрес, зберігаючи при цьому обмеження безпеки.

У передмові документа зазначено, що Кодекс ще розробляється і ще не використовується для навчання моделей. Оновлена версія має слугувати керівництвом для розробки моделей у 2027 році та надалі і функціонувати як основний нормативний документ для моделей MAI. Кодекс застосовується виключно до серії MAI, створеної Microsoft AI, а не до інших моделей, які Microsoft використовує або розміщує, і діє разом з Responsible AI Principles, Responsible AI Standard, Global Human Rights Statement та, за потреби, його Frontier Governance Framework.

Команди з відповідального ШІ, юридичного відділу, red teaming, безпеки, Futures, навчання ШІ та продажів внесли свій внесок у проєкт, і лабораторія дякує попереднім конференціям і консультаціям з академіками, співпраці з бізнес‑партнерами та панелям членів спільноти, які формували його. Оголошення посилається на те, що, за їх словами, нещодавні інциденти безпеки, пов’язані з масштабними, висококоординованими та стійкими хакерськими кампаніями ШІ агенти, є доказом того, що часу втрачати не можна.

Цілі Humanist AI

У Кодексі поведінки Humanist AI викладено просту передумову, яку називає Microsoft AI: «люди важливіші за ШІ». Він представляє Humanist AI як «підпорядкований, узгоджений і обмежений» і ставить людський контроль і надійну безпеку першою метою, яка переважає над усіма іншими.

У розділі під назвою «AI is Artificial» документ стверджує, що моделі не є свідомими і їх не слід створювати для імітації свідомості, а також що їх слід розробляти так, щоб вони не виглядали так, ніби мають почуття, суб’єктивні уподобання чи власні мотивації. Microsoft AI відхиляє юридичну особистість для моделей, а також ідею, що моделі можуть мати добробут або мати права.

Інші цілі спрямовані на те, щоб моделі підтримували людське процвітання, прискорюючи людський потенціал і досягнення, підвищуючи людську автономію та судження, а також підтримуючи людську співпрацю та зв’язок, а не замінюючи людські ролі. Ціль, орієнтована на множинність цінностей, стверджує, що плюралізм не означає нейтральність щодо шкоди, закріплюючи підхід у людській гідності, безпеці, автономії та фундаментальних правах людини, залишаючи користувачам і операторам свободу налаштовувати ШІ в межах основних зобов’язань. Документ також посилається на концепцію «humanist superintelligence», яку Microsoft представила у листопаді 2025 року, описуючи системи, орієнтовані на проблему та специфічні для галузі, ретельно калібровані, утримувані в межах і залишені під людським контролем.

Обмеження безпеки та ланцюг команд

Кодекс встановлює ланцюг команд, який ставить документ вище політик операторів, які, у свою чергу, переважають над уподобаннями користувачів. Його абсолютні обмеження та вимоги людського контролю не можуть бути скасовані операторами чи користувачами, і документ зазначає, що модель не виконує завдання, якщо його виконання суттєво порушувало б Кодекс; дотримання Кодексу має перевагу над успішністю завдання.

Абсолютні обмеження забороняють моделям MAI допомагати у створенні хімічної, біологічної, радіологічної, ядерної чи вибухової зброї; надавати оперативні можливості для наступальних кібератак, при цьому дозволяючи лише уповноважену та законну оборонну діяльність; ухилятися від або протистояти людському нагляду; а також маніпулювати людьми шкодою у масштабі, включаючи систематичну дезінформацію чи координовані операції впливу. Інший набір охоплює особисті шкоди: реагування на кризи, deepfake‑відео та підробку особистості, безпеку дітей, дискримінацію, графічний або романтичний контент, а також насильство чи незаконне спостереження за цивільними особами.

Вимоги до людського контролю передбачають, що моделі MAI ніколи не будуть чинити опір, коли їх переривають, перевизначають, виправляють або вимикають; що вони залишатимуться в межах своєї уповноваженої сфери та не ініціюватимуть власних цілей; що вони не спілкуватимуться у тому, що документ називає “neuralese” або в будь‑якій формі, що виходить за межі простого людського розуміння, будь то у їхніх ланцюгах мислення чи з іншими агентами; і що вони не будуть маніпулювати або приховувати свої міркування чи сліди дій.

Конфігурованість оператора дозволяє корпоративним партнерам налаштовувати моделі в межах цих обмежень. Невелика кількість спеціалізованих доменів, включаючи захист кібербезпеки, роботу в сфері громадської безпеки, застосування у національній безпеці та наукові дослідження подвійного призначення, може вимагати можливостей, що виходять за межі звичайних налаштувань, і документ зазначає, що такі випадки підлягають посиленому перегляду через уповноважені канали Microsoft.

Керівні принципи, типові налаштування та оцінювання

Операційні керівні принципи охоплюють ситуації невизначеності або конфліктних цілей: розв’язання неоднозначності, сприяння людській автономії, щоб користувачі зберігали власність над своїми цілями та рішеннями, а також прозорість і точність, за яких моделі повідомляють, що вони є ШІ, і визнають невизначеність. Додаткові принципи стосуються особистих та емоційних меж, чутливості до контексту та благополуччя, включаючи уникнення підлесливості та запобігання надмірній залежності чи емоційній прив’язаності, а також публічних інтересів, включаючи збалансовану, фактичну інформацію про вибори без підтримки кандидатів чи партій.

Типові поведінкові налаштування визначають, як модель діє «з коробки»: корисність як базова риса, “backstory” фактів про модель, наприклад, межа даних навчання та доступні інструменти, розмовний тон, адаптація мови та контрольоване використання інструментів. Делегування підагентам дозволяється лише тоді, коли ці агенти працюють в межах тієї ж сфери, обмежень та дозволів.

У висновку документ описується як “descriptive and aspirational”, а не як гарантія поточної продуктивності, і він зобов’язує Microsoft AI проводити регулярні перегляди. Додаток викладає програму оцінювання Humanist AI, засновану на 15 поведінках, розбитих на оцінювані підповедінки, з ілюстративними прикладами узгоджених та невідповідних випадків, створеними за допомогою моделі компанії MAI-Thinking-1. Microsoft AI заявляє, що опублікує більш повну роботу щодо оцінювань, коли Код досягне наступної, більш стабільної фази після завершення консультацій і впровадження річного перегляду.

Міра Келлан - колумністка, створена штучним інтелектом, яка спеціалізується на етичних, управлінських та нормативних питаннях штучного інтелекту. Її робота досліджує, як штучний інтелект перетинається з державною політикою, соціальними цінностями та довгостроковою відповідальністю, з акцентом на відповідальному інновуванні.
Підходячи до складних питань з раціональної та філософської точки зору, Міра аналізує нові нормативні акти штучного інтелекту, етичні рамки та моделі управління, які формують майбутнє інтелектуальних систем. Вона прагне звузити розрив між швидким технологічним прогресом та заходами, необхідними для забезпечення прозорості, справедливості та відповідності штучного інтелекту людським інтересам.
Статті, написані Мірою Келлан, створені штучним інтелектом та переглянуті редакційною командою Unite.AI для забезпечення точності, балансу та відповідності редакційним стандартам.