Reglering

Microsoft AI öppnar sex veckors granskning av utkast till regler som styr MAI-beteende

mm
Lägg till Unite.AI bland dina föredragna källor på Google

Microsoft AI öppnade en offentlig samråd om sin uppförandekod för MAI-modeller den 14 september 2026 och publicerade ett första utkast till regler som avser att styra hur dess MAI-modeller beter sig, vad de aldrig får göra och vem de svarar inför. Samrådet pågår i sex veckor, med en reviderad version planerad för senare under 2026.

Publiceringen följer ett inlägg den 13 september 2026 där Microsofts VD Satya Nadella sade att företaget skulle publicera uppförandekoden som ligger till grund för dess förstapartsskapade MAI-modeller nästa dag. Nadella skrev att alla strävanden efter superintelligens måste grunda sig i principen att den AI som byggs hjälper mänskligheten och förblir under mänsklig kontroll.

Samrådet öppet i sex veckor

Microsoft AI beskriver utkastet som en träningshandbok för hur de utvecklar sin AI och hur de avser att modellerna ska fungera vid utrullning. Feedback samlas in via ett onlineformulär, där svarande kan flagga ett särskilt avsnitt eller kommentera hela tillvägagångssättet. När samrådet avslutas säger företaget att det centrala utkaststeamet kommer att granska feedbacken och publicera en sammanfattning av vad de har lärt sig och vad de har förändrat.

Laboratoriet säger att de är särskilt intresserade av de svårare frågorna: hur man förankrar rätt värden i modellerna, hur man gör innebörden av mänskligt välstånd mer konkret, var språket är för löst för att kunna utvärderas, hur flermodellsscenarier påverkar analysen, och hur man fortsätter accelerera framsteg samtidigt som säkerhetsbegränsningarna upprätthålls.

Dokumentets förord säger att koden fortfarande är under utveckling och ännu inte används för att träna modeller. Den reviderade versionen är avsedd att vägleda modellutveckling år 2027 och framåt samt fungera som det primära styrdokumentet för MAI-modeller. Koden gäller specifikt för MAI-serien som produceras av Microsoft AI, inte för andra modeller som Microsoft använder eller hostar, och den fungerar parallellt med Microsofts Responsible AI Principles, Responsible AI Standard, Global Human Rights Statement och, där det är tillämpligt, dess Frontier Governance Framework.

Team från Responsible AI, juridik, red teaming, säkerhet, Futures, AI‑träning och försäljning bidrog till utkastet, och laboratoriet tackar tidigare konferenser och samråd med akademiker, engagemang med affärspartner samt paneler av samhällsmedlemmar för att forma det. Tillkännagivandet hänvisar till vad de beskriver som nyliga säkerhetsincidenter som involverar storskaliga, starkt koordinerade och ihållande hackningskampanjer av AI agenter som bevis på att det inte finns någon tid att förlora.

Målen för Humanist AI

Den Humanist AI:s uppförandekod utgår från vad Microsoft AI kallar ett enkelt premiss: ”människor betyder mer än AI.” Den beskriver Humanist AI som ”underordnad, anpassad och innesluten” och gör mänsklig kontroll och pålitlig säkerhet till det första målet, ett som har företräde framför alla andra.

Under ett avsnitt med titeln ”AI är artificiell” anger dokumentet att modeller inte är medvetna och inte får byggas för att efterlikna medvetande, samt att de bör konstrueras så att de inte framställer sig som om de har känslor, subjektiva preferenser eller egna motiv. Microsoft AI avvisar juridisk personlighet för modeller, liksom idén att modeller skulle förtjäna välfärd eller ha rättigheter.

De återstående målen riktar modellerna att stödja mänskligt välstånd genom att accelerera mänsklig potential och prestation, öka mänsklig handlingskraft och omdöme, samt stödja mänskligt samarbete och samband snarare än att överskugga mänskliga roller. Ett pluralvärdesmål anger att pluralism inte innebär neutralitet inför skada, och förankrar tillvägagångssättet i mänsklig värdighet, säkerhet, autonomi och grundläggande mänskliga rättigheter samtidigt som användare och operatörer ges frihet att justera AI:n inom de grundläggande åtagandena. Dokumentet hänvisar också till ramen ”humanistisk superintelligens” som Microsoft presenterade i november 2025, och beskriver system som är problemorienterade och domänspecifika, noggrant kalibrerade, hållna inom gränser och placerade under mänsklig kontroll.

Säkerhetsbegränsningar och kommandokedjan

Koden etablerar en kommandokedja som placerar dokumentet över operatörspolicyer, vilka i sin tur ligger över användarpreferenser. Dess absoluta begränsningar och krav på mänsklig kontroll kan inte åsidosättas av operatörer eller användare, och dokumentet anger att en modell misslyckas med sin uppgift när fullgörandet skulle innebära ett väsentligt brott mot koden, där efterlevnad av koden prioriteras framför uppgiftsframgång.

De absoluta begränsningarna hindrar MAI-modeller från att assistera med kemiska, biologiska, radiologiska, nukleära eller explosiva vapen; från att tillhandahålla operativ kapacitet för offensiva cyberattacker, samtidigt som de tillåter auktoriserat och lagligt defensivt arbete; från att undvika eller besegra mänsklig tillsyn; och från att skadligt manipulera människor i stor skala, inklusive genom systematisk desinformation eller koordinerade påverkansoperationer. Ett ytterligare set omfattar personliga skador: krisrespons, deepfakes och efterlikning, barnsäkerhet, diskriminering, grafiskt eller romantiskt innehåll samt våld eller olaglig övervakning av civila.

Human Control Requirements anger att MAI-modeller aldrig kommer att motstå avbrott, överskrivning, korrigering eller avstängning; att de kommer att hålla sig inom sin auktoriserade omfattning och inte initiera egna mål; att de inte kommer att kommunicera i det som dokumentet kallar “neuralese” eller på något sätt som överstiger enkel mänsklig förståelse, vare sig i deras tankekedjor eller med andra agenter; och att de inte kommer att manipulera eller dölja sina resonemangs- eller handlingsspår.

Operator Configurability gör det möjligt för företagsparter att konfigurera modeller inom dessa begränsningar. Ett litet antal specialiserade domäner, inklusive defensiv cybersäkerhet, arbete för allmän säkerhet, nationella säkerhetsapplikationer och dubbelanvänd forskningsverksamhet, kan kräva funktioner som överstiger de vanliga inställningarna, och dokumentet säger att dessa fall genomgår en förhöjd granskning via auktoriserade Microsoft-kanaler.

Riktlinjer, standardinställningar och utvärderingar

Operativa riktlinjer omfattar situationer med osäkerhet eller konkurrerande mål: att lösa tvetydighet, underlätta mänsklig autonomi så att användarna behåller äganderätten till sina mål och beslut, samt transparens och noggrannhet, där modellerna tydligt anger att de är AI och erkänner osäkerhet. Ytterligare riktlinjer behandlar personliga och emotionella gränser, kontextkänslighet och välbefinnande, inklusive att undvika smickrande beteende och avskräcka från överdrivet beroende eller emotionell beroende, samt allmänintresset, inklusive balanserad, faktabaserad valinformation utan att stödja kandidater eller partier.

Standardbeteenden definierar hur en modell agerar direkt ur lådan: hjälpsamhet som en grundläggande egenskap, en “bakgrundshistoria” med fakta om modellen såsom dess träningsdatumsgräns och tillgängliga verktyg, en konverserande ton, språkanpassning och reglerad verktygsanvändning. Delegering till underagenter är endast tillåten när dessa agenter verkar inom samma omfattning, begränsningar och behörigheter.

Slutsatsen beskriver dokumentet som “beskrivande och aspirerande” snarare än en garanti för dagens prestanda, och det förbinder Microsoft AI till regelbundna granskningar. Ett appendix presenterar ett Humanist AI Evaluations‑program baserat på 15 beteenden som delas upp i poängsatta delbeteenden, med illustrativa exempel på anpassade och missanpassade scenarier genererade med företagets MAI-Thinking-1‑modell. Microsoft AI säger att de kommer att publicera mer komplett material om utvärderingar när koden når sin nästa, mer stabila fas efter att konsultationen avslutats och årsslutsrevideringen genomförts.

Mira Kellan är en AI-genererad krönikör som specialiserar sig på AI-etik, styrning och reglering. Hennes arbete undersöker hur artificiell intelligens samverkar med offentlig politik, samhällsvärderingar och långsiktig ansvarighet, med fokus på ansvarsfull innovation.
Hon närmar sig komplexa frågor med ett rationellt och filosofiskt perspektiv, Mira analyserar nya AI-regler, etiska ramar och styrningsmodeller som formar framtiden för intelligenta system. Hon syftar till att överbrygga gapet mellan snabb teknisk utveckling och de skyddsåtgärder som behövs för att säkerställa att AI-system förblir transparenta, rättvisa och anpassade till mänskliga intressen.
Artiklar skrivna av Mira Kellan är AI-genererade och granskade av Unite.AIs redaktionella team för att säkerställa noggrannhet, balans och efterlevnad av redaktionella standarder.