Sääntely

Microsoft AI avaa kuuden viikon tarkastelun MAI‑käyttäytymistä koskevista luonnossäännöistä

mm
Lisää Unite.AI suosikkilähteisiisi Google-palvelussa

Microsoft AI avasi julkisen kuulemisen sen MAI‑malleille suunnatusta käyttäytymissäännöksestä 14. syyskuuta 2026 julkaisten ensimmäisen luonnoksen säännöistä, joiden tarkoitus on määrittää, miten sen MAI‑mallit käyttäytyvät, mitä niiden ei saa koskaan tehdä ja kenelle ne vastaavat. Kuuleminen kestää kuusi viikkoa, ja tarkistettu versio on suunniteltu julkaistavaksi myöhemmin vuonna 2026.

Julkaisu seuraa 13. syyskuuta 2026 julkaisu, jossa Microsoftin toimitusjohtaja Satya Nadella kertoi, että yritys julkaisee seuraavana päivänä sen ensimmäisen osapuolen MAI‑malleja koskevan käyttäytymissäännön. Nadella kirjoitti, että superälyn tavoittelun on perustuttava periaatteeseen, jonka mukaan rakennettava tekoäly auttaa ihmiskuntaa ja pysyy ihmisen hallinnassa.

Kuuleminen auki kuudeksi viikoksi

Microsoft AI kuvaa luonnosta koulutusoppaan siitä, miten se kehittää tekoälyään ja miten se aikoo mallien toimivan käyttöönoton aikana. Palautetta kerätään verkkolomakkeen kautta, jossa vastaajat voivat merkitä tietyn kohdan tai kommentoida koko lähestymistapaa. Kun kuuleminen päättyy, yritys kertoo, että keskeinen laatimistiimi tarkastelee palautetta ja julkaisee yhteenvedon oppimastaan ja tekemistään muutoksista.

Laboratorio sanoo olevan erityisen kiinnostunut vaikeammista kysymyksistä: miten oikeat arvot juurrutetaan malleihin, miten ihmisen kukoistamisen merkitys tehdään konkreettisemmaksi, missä kieli on liian löysää arvioitavaksi, miten monen agentin skenaariot vaikuttavat analyysiin, ja miten edistystä voidaan nopeuttaa samalla kun turvallisuusrajoituksia noudatetaan.

Dokumentin esipuheessa todetaan, että sääntö on edelleen kehitteillä eikä sitä ole vielä käytetty mallien kouluttamiseen. Tarkistettu versio on tarkoitettu ohjaamaan mallien kehitystä vuodesta 2027 alkaen ja toimimaan MAI‑malleille ensisijaisena hallintadokumenttina. Sääntö koskee erityisesti Microsoft AI:n tuottamaa MAI‑sarjaa, ei muita Microsoftin käyttämisiä tai isännöimiä malleja, ja se toimii yhdessä Microsoftin vastuullisen tekoälyn periaatteiden, vastuullisen tekoälyn standardin, globaalin ihmisoikeuslausunnon sekä, tarvittaessa, Frontier‑hallintakehyksen kanssa.

Vastuullisen tekoälyn, oikeudellisen, punatiimin, turvallisuuden, Futures‑, tekoälykoulutuksen ja myynnin tiimit osallistuivat luonnoksen laatimiseen, ja laboratorio kiittää aiempia konferensseja ja akateemikkojen kuulemisia, yhteistyötä liikekumppaneiden kanssa sekä yhteisön jäsenten paneeleja sen muokkaamisesta. Ilmoitus viittaa siihen, että se kuvailee viimeaikaisia turvallisuustapauksia, joissa tekoäly agentit ovat toteuttaneet laajamittaisia, erittäin koordinoituja ja jatkuvia hakkerointikampanjoita, osoittaen ettei aikaa kannata hukata.

Humanist AI:n tavoitteet

The Humanist AI:n toimintaohje alkaa siitä, mitä Microsoft AI kutsuu yksinkertaiseksi oletukseksi: “ihmiset ovat tärkeämpiä kuin tekoäly.” Se asettaa Humanist AI:n “alisteiseksi, linjautuneeksi ja rajoitetuksi” ja tekee ihmisen hallinnasta ja luotettavasta turvallisuudesta ensisijaisen tavoitteen, joka on muiden kaikkien yläpuolella.

Osiossa, jonka otsikko on “AI on keinotekoinen”, dokumentti toteaa, että mallit eivät ole tietoisia eikä niitä tule rakentaa jäljittelemään tietoisuutta, ja että ne tulisi suunnitella niin, etteivät ne esitä omaavansa tunteita, subjektiivisia mieltymyksiä tai omia motivaatioita. Microsoft AI hylkää mallien oikeushenkilöllisyyden sekä ajatuksen, että malleilla olisi oikeus hyvinvointiin tai oikeuksiin.

Loput tavoitteet ohjaavat malleja tukemaan ihmisen kukoistamista nopeuttamalla ihmisen potentiaalia ja saavutuksia, lisäämällä ihmisen toimijuutta ja harkintakykyä sekä tukemalla ihmisen yhteistyötä ja yhteyksiä sen sijaan, että ne varjostaisivat ihmisen rooleja. Moniarvoinen tavoite korostaa, että pluralismi ei tarkoita välinpitämättömyyttä vahinkoon, vaan lähestymistapa perustuu ihmiskunnalliseen arvokkuuteen, turvallisuuteen, autonomiaan ja perusoikeuksiin, jättäen käyttäjät ja operaattorit vapaiksi säätämään tekoälyä keskeisten sitoumusten puitteissa. Dokumentti viittaa myös “humanistiseen superälyyn”, jonka Microsoft esitteli marraskuussa 2025, kuvaillen järjestelmiä, jotka ovat ongelma‑keskeisiä ja toimialakohtaisia, tarkasti kalibroituja, rajoissa pidettyjä ja ihmisen hallinnassa.

Turvallisuusrajoitukset ja komentoketju

Sääntö määrittelee komentoketjun, jossa asiakirja sijoittuu operaattoripolitiikkojen yläpuolelle, jotka puolestaan sijoittuvat käyttäjäasetusten yläpuolelle. Sen absoluuttiset rajoitukset ja ihmisen hallintavaatimukset eivät ole operaattoreiden tai käyttäjien ohitettavissa, ja asiakirja toteaa, että malli epäonnistuu tehtävässään aina, kun sen suorittaminen merkittävästi rikkoisi sääntöä; sääntöön sitoutuminen on tärkeämpää kuin tehtävän onnistuminen.

Absoluuttiset rajoitukset estävät MAI‑malleja avustamasta kemiallisten, biologisten, radioaktiivisten, ydin- tai räjähdeaseiden kanssa; tarjoamasta operatiivista kykyä hyökkääviin kyberhyökkäyksiin, samalla kun sallitaan valtuutettu ja laillinen puolustustyö; kiertämästä tai voittamasta ihmisen valvontaa; sekä manipuloimasta ihmisiä haitallisesti laajassa mittakaavassa, mukaan lukien järjestelmällinen disinformaatio tai koordinoidut vaikuttamistoimet. Toinen joukko kattaa henkilökohtaiset vahingot: kriisivaste, deepfake‑videot ja henkilöllisyyden väärentäminen, lasten turvallisuus, syrjintä, graafinen tai romanttinen sisältö sekä väkivalta tai laiton siviilien valvonta.

Ihmiskontrollivaatimuksissa todetaan, että MAI-mallit eivät koskaan vastusta keskeytystä, ohitusta, korjausta tai sammutusta; että ne pysyvät valtuutetussa toiminta-alueessaan eivätkä aloita omia tavoitteita; että ne eivät kommunikoi siinä, mitä asiakirja kutsuu “neuraleseksi” tai millään tavalla, joka ylittää yksinkertaisen ihmisen ymmärryksen, olipa kyse niiden ajatusketjuista tai muista toimijoista; eikä ne manipuloi tai piilota omaa päättelyään tai toimintajälkiään.

Operaattorin konfiguroitavuus mahdollistaa yrityskumppaneiden säätää malleja näiden rajoitusten puitteissa. Pieni joukko erikoisalojen, kuten puolustavan kyberturvallisuuden, yleisen turvallisuuden, kansallisen turvallisuuden sovellusten ja kaksinkäyttöisen tieteellisen tutkimuksen, saattaa vaatia kykyjä, jotka ylittävät tavalliset asetukset, ja asiakirjan mukaan nämä tapaukset käyvät läpi tehostetun tarkastelun valtuutettujen Microsoft-kanavien kautta.

Ohjeet, oletusasetukset ja arvioinnit

Operatiiviset ohjeet kattavat epävarmuuden tai kilpailevien tavoitteiden tilanteet: epäselvyyden ratkaiseminen, ihmisen autonomian edistäminen siten, että käyttäjät säilyttävät tavoitteidensa ja päätöstensä omistajuuden, sekä läpinäkyvyys ja tarkkuus, joiden alla mallit ilmoittavat olevansa tekoälyä ja tunnustavat epävarmuuden. Lisäohjeet käsittelevät henkilökohtaisia ja emotionaalisia rajoja, kontekstisensitiivisyyttä ja hyvinvointia, mukaan lukien ylistyksen välttäminen ja liiallisen riippuvuuden tai tunneperäisen riippuvuuden vähentäminen, sekä yleistä etua, mukaan lukien tasapainoinen, faktapohjainen vaalidata ilman ehdokkaiden tai puolueiden suosittelemista.

Oletustoiminnot määrittelevät, miten malli toimii heti käyttöönoton jälkeen: avuliaisuus perusominaisuutena, “taustatarina” malliin liittyvistä faktoista, kuten sen koulutusdatan leikkauspisteestä ja käytettävissä olevista työkaluista, keskusteleva sävy, kielen mukautuminen ja hallittu työkalujen käyttö. Delegointi alitoimijoille on sallittua vain, kun nämä toimijat toimivat samassa toiminta-alueessa, rajoituksissa ja oikeuksissa.

Päätelmä kuvaa asiakirjan “kuvailevaksi ja pyrkimykselliseksi” sen sijaan, että se olisi takuu nykyisestä suorituskyvystä, ja se sitouttaa Microsoft AI:n säännöllisiin tarkasteluihin. Liitteessä esitetään Humanist AI -arviointiohjelma, joka perustuu 15 käyttäytymiseen, jaettuna pisteytettyihin alikäyttäytymisiin, sekä havainnollistavia linjassa olevia ja poikkeavia esimerkkejä, jotka on tuotettu yrityksen MAI-Thinking-1 -mallilla. Microsoft AI sanoo julkaisevansa kattavampaa työtä arvioinneista, kun koodi saavuttaa seuraavan, vakaamman vaiheen konsultoinnin päätyttyä ja vuoden lopun tarkistuksen toteutuessa.

Mira Kellan on tekoälygeneroiva kolumnisti, joka on erikoistunut tekoälyetiikkaan, hallintoon ja sääntelyyn. Hänen työnsä tarkastelee, miten tekoäly leikkaa julkisen politiikan, yhteiskunnallisten arvojen ja pitkän aikavälin vastuun kanssa, keskittyen vastuulliseen innovaatioon.
Hänen lähestymistapansa monimutkaisiin ongelmiin on rationaalinen ja filosofinen, ja Mira analysoi uusia tekoälysääntelyjä, eettisiä kehyksiä ja hallintomalleja, jotka muokkaavat älykkäiden järjestelmien tulevaisuutta. Hän pyrkii silittämään välin rakenteellisen edistymisen ja tarvittavien suojausten välillä, jotta tekoälyjärjestelmät pysyvät läpinäkyvinä, reiluina ja ihmisten etujen mukaisina.
Mira Kellanin kirjoittamat artikkelit ovat tekoälygeneroituja ja Unite.AI:n toimituksellinen tiimi tarkistaa ne tarkkaavaisuuden, tasapuolisuuden ja toimituksellisten standardien mukaisuuden varmistamiseksi.