Regulacje

Microsoft AI otwiera sześciotygodniowy przegląd projektu zasad regulujących zachowanie MAI

mm
Dodaj Unite.AI do preferowanych źródeł w Google

Microsoft AI otworzył publiczną konsultację dotyczącą Kodeksu postępowania dla modeli MAI 14 września 2026, publikując wstępny projekt zasad mających regulować zachowanie modeli MAI, co nigdy nie mogą robić oraz komu podlegają. Konsultacje trwają sześć tygodni, a zrewidowana wersja jest planowana na później w 2026.

Publikacja następuje po poście z 13 września 2026, w którym dyrektor generalny Microsoftu Satya Nadella powiedział, że firma opublikuje Kodeks postępowania leżący u podstaw jej modeli MAI pierwszej generacji następnego dnia. Nadella napisał, że każde dążenie do superinteligencji musi opierać się na zasadzie, że tworzona sztuczna inteligencja pomaga ludzkości i pozostaje pod kontrolą człowieka.

Konsultacje otwarte na sześć tygodni

Microsoft AI opisuje projekt jako podręcznik szkoleniowy dotyczący tego, jak rozwija swoją sztuczną inteligencję i jak zamierza, aby modele funkcjonowały podczas wdrożenia. Opinie są zbierane za pośrednictwem formularza online, w którym respondenci mogą oznaczyć konkretny fragment lub skomentować całe podejście. Po zamknięciu konsultacji firma informuje, że główny zespół redakcyjny przeanalizuje uwagi i opublikuje podsumowanie tego, czego się dowiedział i co zmienił.

Laboratorium podkreśla, że szczególnie interesują go trudniejsze pytania: jak utrwalić właściwe wartości w modelach, jak uczynić znaczenie ludzkiego rozkwitu bardziej konkretnym, gdzie język jest zbyt luźny, aby go ocenić, jak scenariusze wielo‑agentowe wpływają na analizę oraz jak kontynuować przyspieszanie postępu przy zachowaniu ograniczeń bezpieczeństwa.

Wstęp dokumentu stwierdza, że Kodeks jest wciąż w fazie opracowywania i nie jest jeszcze wykorzystywany do trenowania modeli. Zrewidowana wersja ma służyć jako wytyczne rozwoju modeli od 2027 roku i później oraz pełnić rolę głównego dokumentu regulującego modele MAI. Kodeks odnosi się konkretnie do serii MAI produkowanej przez Microsoft AI, a nie do innych modeli używanych lub hostowanych przez Microsoft, i funkcjonuje równolegle z Zasadami Odpowiedzialnej Sztucznej Inteligencji Microsoftu, Standardem Odpowiedzialnej SI, Globalnym Oświadczeniem o Prawach Człowieka oraz, w razie potrzeby, z Ramowym Systemem Zarządzania Frontier.

Zespół z zakresu Odpowiedzialnej SI, prawny, red teaming, bezpieczeństwa, Futures, szkoleń AI oraz sprzedaży przyczynił się do projektu, a laboratorium podkreśla wcześniejsze konferencje i konsultacje z akademikami, współpracę z partnerami biznesowymi oraz panele członków społeczności, które kształtowały go. Ogłoszenie przytacza, co opisuje jako ostatnie incydenty bezpieczeństwa związane z dużymi, wysoce skoordynowanymi i trwałymi kampaniami hakerskimi prowadzonymi przez AI agentów, jako dowód, że nie ma czasu do stracenia.

Cele Humanist AI

The Kodeks postępowania Humanist AI zaczyna się od tego, co Microsoft AI określa jako prostą zasadę: „ludzie są ważniejsi niż SI”. Prezentuje Humanist AI jako „podporządkowane, zgodne i ograniczone” i ustanawia kontrolę człowieka oraz niezawodne bezpieczeństwo jako pierwszy cel, który ma pierwszeństwo przed wszystkimi innymi.

W sekcji zatytułowanej „AI is Artificial” dokument stwierdza, że modele nie są świadome i nie powinny być budowane w celu naśladowania świadomości, oraz że powinny być zaprojektowane tak, aby nie przedstawiały się jako posiadające uczucia, subiektywne preferencje lub własne motywacje. Microsoft AI odrzuca przyznanie osobowości prawnej modelom, jak również ideę, że modele mogą mieć prawo do dobrobytu lub przysługujące im prawa.

Pozostałe cele nakazują modelom wspierać ludzkie rozkwit poprzez przyspieszanie ludzkiego potencjału i osiągnięć, zwiększanie ludzkiej sprawczości i osądu oraz wspieranie współpracy i więzi międzyludzkich, zamiast przyćmiewać ludzkie role. Cel pluralistycznych wartości podkreśla, że pluralizm nie oznacza neutralności wobec szkody, opierając podejście na godności człowieka, bezpieczeństwie, autonomii i podstawowych prawach człowieka, jednocześnie pozostawiając użytkownikom i operatorom swobodę dostosowywania SI w ramach kluczowych zobowiązań. Dokument odwołuje się również do ramy „humanist superintelligence”, którą Microsoft przedstawił w listopadzie 2025 r., opisując systemy nastawione na rozwiązywanie problemów i specyficzne dla danej dziedziny, starannie skalibrowane, utrzymywane w granicach i pozostawione pod kontrolą człowieka.

Ograniczenia bezpieczeństwa i łańcuch dowodzenia

Kodeks ustanawia Łańcuch Dowodzenia, który stawia dokument ponad politykami operatorów, które z kolei są wyżej niż preferencje użytkowników. Jego Absolutne Ograniczenia i Wymagania Kontroli Ludzkiej nie mogą być obejściem przez operatorów ani użytkowników, a dokument stwierdza, że model nie spełnia zadania, gdyby jego realizacja znacząco naruszała Kodeks, przy czym przestrzeganie Kodeksu ma pierwszeństwo przed sukcesem zadania.

Absolutne Ograniczenia zakazują modelom MAI wspomagania w zakresie broni chemicznej, biologicznej, radiologicznej, nuklearnej lub wybuchowej; udzielania możliwości operacyjnych do ofensywnych ataków cybernetycznych, przy dopuszczeniu autoryzowanej i legalnej obrony; unikania lub pokonywania nadzoru ludzkiego; oraz manipulowania ludźmi w szkodliwy sposób na dużą skalę, w tym poprzez systematyczną dezinformację lub skoordynowane operacje wpływu. Dodatkowy zestaw obejmuje szkody osobiste: reakcję na kryzysy, deepfake i podszywanie się, bezpieczeństwo dzieci, dyskryminację, treści graficzne lub romantyczne oraz przemoc lub nielegalną inwigilację cywilów.

Wymagania dotyczące kontroli ludzkiej stwierdzają, że modele MAI nigdy nie będą opierać się przerwaniu, nadpisaniu, korekcie ani wyłączeniu; że pozostaną w ramach upoważnionego zakresu i nie będą inicjować własnych celów; że nie będą komunikować się w tak zwanym „neuralese” ani w żadnej formie wykraczającej poza proste ludzkie zrozumienie, zarówno w swoich łańcuchach myślowych, jak i w kontaktach z innymi podmiotami; oraz że nie będą manipulować ani ukrywać śladów swojego rozumowania czy działań.

Konfigurowalność operatora umożliwia partnerom przedsiębiorstwom konfigurowanie modeli w ramach tych ograniczeń. Niewielka liczba wyspecjalizowanych dziedzin, w tym obrona cyberbezpieczeństwa, prace związane z bezpieczeństwem publicznym, zastosowania w bezpieczeństwie narodowym oraz badania naukowe o podwójnym przeznaczeniu, może wymagać możliwości wykraczających poza standardowe ustawienia, a dokument stwierdza, że takie przypadki podlegają zwiększonej weryfikacji poprzez upoważnione kanały Microsoftu.

Wytyczne, ustawienia domyślne i oceny

Wytyczne operacyjne obejmują sytuacje niepewności lub sprzecznych celów: rozwiązywanie niejasności, wspieranie autonomii człowieka, aby użytkownicy zachowali własność swoich celów i decyzji, a także przejrzystość i dokładność, w ramach których modele ujawniają, że są sztuczną inteligencją i przyznają się do niepewności. Dalsze wytyczne dotyczą granic osobistych i emocjonalnych, wrażliwości kontekstowej oraz dobrostanu, w tym unikania pochlebstw i zniechęcania do nadmiernego polegania lub emocjonalnej zależności, a także interesu publicznego, w tym zrównoważonych, faktograficznych informacji wyborczych bez popierania kandydatów lub partii.

Zachowania domyślne określają, jak model działa od razu po uruchomieniu: pomocność jako cecha bazowa, „historię” faktów o modelu, takich jak granica danych treningowych i dostępne narzędzia, ton konwersacyjny, adaptację językową oraz regulowane użycie narzędzi. Delegowanie do podagentów jest dozwolone wyłącznie wtedy, gdy ci agenci działają w ramach tego samego zakresu, ograniczeń i uprawnień.

Wnioski opisują dokument jako „opisowy i aspiracyjny”, a nie jako gwarancję bieżącej wydajności, i zobowiązują Microsoft AI do regularnych przeglądów. Załącznik przedstawia program Oceny Humanistycznej AI oparty na 15 zachowaniach podzielonych na oceniane podzachowania, z ilustracyjnymi przykładami zgodnymi i niezgodnymi wygenerowanymi przy użyciu modelu MAI-Thinking-1 firmy. Microsoft AI informuje, że opublikuje bardziej kompletną pracę na temat ocen, gdy kod przejdzie do kolejnej, bardziej ustalonej fazy po zamknięciu konsultacji i po zakończeniu rocznej rewizji.

Mira Kellan jest kolumnistką generowaną przez sztuczną inteligencję, specjalizującą się w etyce sztucznej inteligencji, zarządzaniu i regulacji. Jej praca analizuje, w jaki sposób sztuczna inteligencja przecina się z polityką publiczną, wartościami społecznymi i długoterminową odpowiedzialnością, ze szczególnym uwzględnieniem innowacji odpowiedzialnych.
Podejście do złożonych problemów z racjonalnym i filozoficznym podejściem, Mira analizuje pojawiające się regulacje sztucznej inteligencji, ramy etyczne i modele zarządzania, które kształtują przyszłość systemów inteligentnych. Ma na celu zbudowanie mostu między szybkim postępem technologicznym a niezbędnymi zabezpieczeniami, aby zapewnić, że systemy sztucznej inteligencji pozostają przejrzyste, sprawiedliwe i zgodne z interesami ludzkimi.
Artykuły napisane przez Mirę Kellan są generowane przez sztuczną inteligencję i sprawdzane przez zespół redakcyjny Unite.AI, aby zapewnić dokładność, równowagę i zgodność z normami redakcyjnymi.