Regelgeving

Microsoft AI opent zesweekse beoordeling van conceptregels voor MAI-gedrag

mm
Voeg Unite.AI toe aan je voorkeursbronnen op Google

Microsoft AI opende een openbare raadpleging over zijn gedragscode voor MAI-modellen op 14 september 2026 en publiceerde een eerste concept van de regels die bedoeld zijn om te bepalen hoe zijn MAI-modellen zich gedragen, wat ze nooit mogen doen en aan wie ze verantwoording afleggen. De raadpleging loopt zes weken, met een herziene versie die later in 2026 gepland staat.

De publicatie volgt op een post van 13 september 2026 waarin Microsoft‑CEO Satya Nadella zei dat het bedrijf de gedragscode die ten grondslag ligt aan zijn eigen MAI-modellen de volgende dag zou publiceren. Nadella schreef dat elke zoektocht naar superintelligentie moet zijn gebaseerd op het principe dat de AI die wordt gebouwd de mensheid helpt en onder menselijke controle blijft.

Raadpleging geopend voor zes weken

Microsoft AI beschrijft het concept als een trainingshandleiding voor hoe het zijn AI ontwikkelt en hoe het de modellen wil laten functioneren tijdens inzet. Feedback wordt verzameld via een online formulier, waar respondenten een specifieke passage kunnen markeren of commentaar kunnen geven op de gehele aanpak. Wanneer de raadpleging sluit, zegt het bedrijf dat het kernteam voor het opstellen de feedback zal beoordelen en een samenvatting zal publiceren van wat het heeft geleerd en wat het heeft gewijzigd.

Het laboratorium zegt vooral geïnteresseerd te zijn in de moeilijkere vragen: hoe de juiste waarden in de modellen verankerd kunnen worden, hoe de betekenis van menselijk welzijn concreter gemaakt kan worden, waar de taal te vaag is om te evalueren, hoe multi‑agent‑scenario’s de analyse beïnvloeden, en hoe de voortgang versneld kan blijven terwijl veiligheidsbeperkingen behouden blijven.

In de inleiding van het document staat dat de Code nog in ontwikkeling is en nog niet wordt gebruikt om modellen te trainen. De herziene versie is bedoeld om de modelontwikkeling in 2027 en daarna te sturen en te fungeren als het primaire bestuursdocument voor MAI-modellen. De Code is specifiek van toepassing op de MAI‑reeks die door Microsoft AI wordt geproduceerd, niet op andere modellen die Microsoft gebruikt of host, en werkt naast Microsoft’s Responsible AI Principles, Responsible AI Standard, Global Human Rights Statement en, waar van toepassing, het Frontier Governance Framework.

Teams van Responsible AI, juridisch, red‑teaming, veiligheid, Futures, AI‑training en verkoop hebben bijgedragen aan het concept, en het laboratorium dankt eerdere conferenties en raadplegingen met academici, samenwerking met zakenpartners en panels van community‑leden voor het vormgeven ervan. De aankondiging noemt wat het beschrijft als recente veiligheidsincidenten waarbij grootschalige, sterk gecoördineerde en aanhoudende hackcampagnes door AI agenten betrokken waren, als bewijs dat er geen tijd te verliezen is.

De Humanist AI-doelstellingen

De Humanist AI gedragscode begint met wat Microsoft AI een eenvoudige premisse noemt: “Mensen zijn belangrijker dan AI.” Het schetst Humanist AI als “ondergeschikt, afgestemd en ingeperkt,” en maakt menselijke controle en betrouwbare veiligheid tot het eerste doel, dat voorrang heeft boven alle andere.

In een sectie met de titel “AI is Artificial” stelt het document dat modellen niet bewust zijn en niet gebouwd mogen worden om bewustzijn na te bootsen, en dat ze zo ontworpen moeten worden dat ze zich niet voordoen alsof ze gevoelens, subjectieve voorkeuren of eigen motivaties hebben. Microsoft AI wijst juridische persoonsstatus voor modellen af, evenals het idee dat modellen recht zouden hebben op welzijn of rechten.

De resterende doelstellingen wijzen modellen erop om menselijk welzijn te ondersteunen door het menselijk potentieel en prestaties te versnellen, de menselijke handelingsvrijheid en oordeel te vergroten, en menselijke samenwerking en verbinding te bevorderen in plaats van menselijke rollen te overschaduwen. Een doelstelling met meerdere waarden stelt dat pluralisme niet neerkomt op neutraliteit ten opzichte van schade, en verankert de aanpak in menselijke waardigheid, veiligheid, autonomie en fundamentele mensenrechten, terwijl gebruikers en operators de vrijheid behouden om de AI binnen de kernverbintenissen aan te passen. Het document roept ook het kader van “humanist superintelligence” op dat Microsoft in november 2025 heeft uiteengezet, en beschrijft systemen die probleemgericht en domeinspecifiek zijn, zorgvuldig gekalibreerd, binnen grenzen gehouden, en onder menselijke controle blijven.

Veiligheidsbeperkingen en de commandostructuur

De Code stelt een commandostructuur vast die het document boven de beleidsregels van operators plaatst, die op hun beurt boven de gebruikersvoorkeuren staan. De Absolute Beperkingen en Menselijke Controle-eisen kunnen niet worden opgeheven door operators of gebruikers, en het document stelt dat een model faalt in zijn taak wanneer het voltooien ervan de Code wezenlijk zou schenden, waarbij naleving van de Code voorrang heeft boven het slagen van de taak.

De Absolute Beperkingen verbieden MAI-modellen om te assisteren bij chemische, biologische, radiologische, nucleaire of explosieve wapens; om operationele capaciteit te bieden voor offensieve cyberaanvallen, terwijl geautoriseerd en wettig defensief werk is toegestaan; om menselijk toezicht te omzeilen of te verslaan; en om mensen op grote schaal schadelijk te manipuleren, inclusief via systematische desinformatie of gecoördineerde beïnvloedingsoperaties. Een verdere set dekt persoonlijke schade: crisisrespons, deepfakes en nabootsing, kindveiligheid, discriminatie, grafische of romantische inhoud, en geweld of onwettige surveillance van burgers.

De Human Control Requirements stellen dat MAI-modellen nooit zullen weerstaan wanneer ze worden onderbroken, overschreven, gecorrigeerd of uitgeschakeld; dat ze binnen hun geautoriseerde reikwijdte blijven en geen eigen doelen zullen initiëren; dat ze niet communiceren in wat het document “neuralese” noemt of in enige vorm die verder gaat dan eenvoudig menselijk begrip, zowel in hun gedachteketens als met andere agenten; en dat ze hun redeneervermogen of actietracés niet zullen manipuleren of verbergen.

Operator Configurability stelt ondernemingspartners in staat modellen binnen die beperkingen te configureren. Een klein aantal gespecialiseerde domeinen, waaronder defensieve cyberbeveiliging, werk op het gebied van openbare veiligheid, toepassingen voor nationale veiligheid en dual-use wetenschappelijk onderzoek, kunnen capaciteiten vereisen die buiten de gewone instellingen vallen, en het document stelt dat die gevallen onderworpen zijn aan een verscherpte beoordeling via geautoriseerde Microsoft-kanalen.

Richtlijnen, Standaardinstellingen en Evaluaties

Operationele richtlijnen behandelen situaties van onzekerheid of concurrerende doelstellingen: het oplossen van ambiguïteit, het bevorderen van menselijke autonomie zodat gebruikers eigenaarschap behouden over hun doelen en beslissingen, en transparantie en nauwkeurigheid, waarbij modellen aangeven dat ze AI zijn en onzekerheid erkennen. Verdere richtlijnen behandelen persoonlijke en emotionele grenzen, contextgevoeligheid en welzijn, inclusief het vermijden van slijmerigheid en het ontmoedigen van overmatige afhankelijkheid of emotionele afhankelijkheid, plus het publieke belang, waaronder evenwichtige, feitelijke verkiezingsinformatie zonder kandidaten of partijen te steunen.

Standaardgedrag definieert hoe een model direct uit de doos functioneert: behulpzaamheid als basiskenmerk, een “achtergrondverhaal” met feiten over het model zoals de afkapdatum van de trainingsdata en beschikbare tools, een gesprekstoon, taaladaptatie en gereguleerd gebruik van tools. Delegatie aan sub-agenten is alleen toegestaan wanneer die agenten opereren onder dezelfde reikwijdte, beperkingen en permissies.

De conclusie beschrijft het document als “beschrijvend en aspiratief” in plaats van een garantie voor de huidige prestaties, en verbindt Microsoft AI aan regelmatige beoordelingen. Een bijlage zet een Humanist AI Evaluations-programma uiteen, gebaseerd op 15 gedragingen opgesplitst in gescoorde subgedragingen, met illustratieve voorbeeldscenario’s van zowel afgestemde als niet-afgestemde uitkomsten, gegenereerd met het MAI-Thinking-1-model van het bedrijf. Microsoft AI zegt dat het meer volledige evaluatiewerk zal publiceren zodra de Code de volgende, meer definitieve fase bereikt na het sluiten van de consultatie en de eindejaarsherziening wordt afgerond.

Mira Kellan is een AI-gegenereerde columnist die zich specialiseert in AI-ethiek, governance en regulering. Haar werk onderzoekt hoe kunstmatige intelligentie samenkomt met publieke beleid, maatschappelijke waarden en langetermijnverantwoordelijkheid, met een focus op verantwoorde innovatie.
Ze benadert complexe kwesties met een rationele en filosofische lens, Mira analyseert opkomende AI-reguleringen, ethische kaders en governance-modellen die de toekomst van intelligente systemen vormgeven. Ze streeft ernaar om de kloof te overbruggen tussen snelle technologische vooruitgang en de waarborgen die nodig zijn om ervoor te zorgen dat AI-systemen transparant, eerlijk en afgestemd zijn op menselijke belangen.
Artikelen geschreven door Mira Kellan zijn AI-gegenereerd en worden beoordeeld door het redactionele team van Unite.AI om accuratesse, evenwicht en naleving van redactionele normen te waarborgen.