Ajatusjohtajat
Tekoäly edellä tarkoittaa turvallisuutta ensin

Osta lapselle uusi polkupyörä, ja polkupyörä saa kaiken huomion – ei niin paljon uutta kypärää, joka tulee mukana. Mutta vanhemmat arvostavat kypärää.
Pelkään, että useimmat meistä ovat tällä hetkellä kuin lapset, kun on kyse tekoälystä. Olemme keskittyneitä siihen, kuinka hienoa se on ja kuinka nopeasti voimme sen kanssa edetä. Emme niin paljon siihen, mitä voimme tehdä, jotta pysymme turvassa sen käytön aikana. Se on harmi, koska et voi hyötyä toisesta ilman toista.
Yksinkertaisesti sanottuna, tekoälyn soveltaminen ilman huolellista turvallisuuden suunnittelua ei ole vain riskialtista. Se on suora tie rotkoon.
Mikä tekoälyn turvallisuus tarkoittaa?
Tekoälyn turvallisuus käsittää joukon toimia. Mutta ehkä tärkein tekijä on milloin niitä toteutetaan. Jotta tekoälyn turvallisuus olisi tehokas, se on oltava suunniteltu.
Se tarkoittaa, että meidän on mietittävä, miten estämme vahinkoa ennen kuin otamme sen kokeiluun. Meidän on selvitettävä, miten varmistamme, että tekoäly toimii ja tuottaa tuloksia, jotka ovat linjassa arvojemme ja sosiaalisten odostusten kanssa, ennen kuin saamme jotain kauheaa tulosta.
Tekoälyn turvallisuuden suunnittelu sisältää myös sen, miten tehdä siitä kestävä, eli kykenevä toimimaan ennustettavasti jopa epäedullisissa tilanteissa. Se tarkoittaa myös tekoälyn läpinäkyvyyttä, jotta tekoälyn tekemät päätökset ovat ymmärrettävissä, tarkastettavissa ja puolueettomia.
Se sisältää myös sen, että tarkastelemme maailmaa, jossa tekoäly toimii. Mitkä institutionaaliset ja oikeudelliset turvallisuusjärjestelyt tarvitaan, erityisesti jotta voimme noudattaa sovellettavia hallituksen sääntöjä? Ja en voi korostaa liikaa ihmisten osuutta: Mitkä vaikutukset tekoälyn käytöllä on ihmisille, jotka vuorovaikuttavat sen kanssa?
Turvallisuuden suunnittelu tarkoittaa tekoälyn turvallisuuden upottamista kaikkiin prosessiemme, työnkulkuun ja toimintoihin ennen kuin kirjoitamme ensimmäisen ohjauksen.
Riskit ylittävät huolen
Kaikki eivät ole samaa mieltä. Kun he kuulevat “turvallisuus ensin”, jotkut kuulevat “ota askel niin varovasti ja hitaasti, että jäämme jälkeen.” Tietysti, se ei ole, mitä turvallisuus ensin tarkoittaa. Se ei tarvitse tukahduttaa innovaatiota tai hidastaa markkinoille menoa. Ja se ei tarkoita loputonta joukkoa koekäyttöjä, jotka eivät koskaan laajene. Päinvastoin.
Se tarkoittaa ymmärtämistä siitä, mitä tekoälyn turvallisuuden suunnittelun puute voi aiheuttaa. Mieti vain muutamia.
- Deloitte Center for Financial Services ennustaa, että GenAI voi olla vastuussa petosvahinkojen kasvusta 40 miljardiin Yhdysvaltain dollariin Yhdysvalloissa vuoteen 2027 mennessä, 12,3 miljardista Yhdysvaltain dollarista vuonna 2023, 32 prosentin vuosikasvuvauhdilla.
- Harhaiset päätökset. Tutkimukset harhaisen lääketieteellisen hoidon vuoksi tekoälyä, joka oli koulutettu harhaista dataa.
- Huonot päätökset, jotka innoittavat lisää huonoja päätöksiä. Pahempaa kuin alkuperäinen huono päätös, joka on kiihdytetty viallisella tekoälyllä, tutkimukset osoittavat, että nämä virheelliset päätökset voivat muodostua osaksi siitä, miten ajattelemme ja teemme tulevaisuuden päätöksiä.
- Todelliset seuraukset. Tekoäly, joka antaa huonoa lääketieteellistä neuvontaa, on ollut vastuussa kuolemaksi johtaneista potilastuloksista. Oikeudelliset ongelmat ovat seuranneet tekoälyn harhaisen väitteen siteeraamisesta oikeudellisena esimerkkinä. Ohjelmistovirheet, jotka johtuvat tekoälyavustajan antamasta virheellisestä tietoa, ovat tahrineet yhtiön tuotteita ja mainetta ja johtaneet laajaan käyttäjien tyytymättömyyteen.
Ja asiat ovat vielä mielenkiintoisempia.
Tekoälyagenttien, tekoälyn, joka voi toimia itsenäisesti ja tehdä päätöksiä, joita se on tehnyt, kehittyminen ja nopea omaksuminen tulevat korostamaan tekoälyn turvallisuuden suunnittelun tärkeyttä.
Tekoälyagentti, joka voi toimia puolestasi, voi olla erittäin hyödyllinen. Sen sijaan, että se kertoo sinulle parhaat lennot matkalle, se voi löytää ne ja varata ne puolestasi. Jos haluat palauttaa tuotteen, yhtiön tekoälyagentti voi kertoa sinulle palautuspolitiikasta ja siitä, miten haetaan palautusta, ja myös käsitellä koko transaktion puolestasi.
Hienoa – kunhan agentti ei harhaise lentoa tai käsittele taloudellista tietoa väärin. Tai yhtiön palautuspolitiikkaa väärin ja kieltäytyy hyväksymästä voimassa olevia palautuksia.
On helppo nähdä, miten nykyiset tekoälyn turvallisuuden riskit voivat helposti kasautua joukon tekoälyagenttien kanssa, jotka tekevät päätöksiä ja toimivat, erityisesti koska ne eivät todennäköisesti toimisi yksin. Suurin osa tekoälyagenttien todellisesta arvosta tulee agenttien joukoista, joissa yksittäiset agentit käsittelevät tehtävien osia ja tekevät yhteistyötä – agentti kohtaa agentin – saadakseen työn tehtyä.
Miten voit omaksua tekoälyn turvallisuuden ilman, että se hidastaa innovaatiota ja tappaa sen potentiaalisen arvon?
Turvallisuus suunnittelussa
Ad hoc -turvallisuustarkastukset eivät ole vastaus. Mutta turvallisuuden käytäntöjen integroiminen jokaiseen tekoälyn toteutusvaiheeseen on.
Aloita datalla. Varmista, että data on merkitty, annotoitu tarvittaessa, puolueeton ja laadukas. Tämä on erityisen tärkeää koulutusdataa varten.
Kouluta malleja ihmisten palautteella, koska ihmisten arviointi on välttämätöntä muotoilla mallin käyttäytymistä. Vahvistusoppiminen ihmisten palautteella (RLHF) ja muut samankaltaiset tekniikat sallivat annotaattorien arvioida ja ohjata vastauksia, auttaen suurkielisiä malleja tuottamaan tuloksia, jotka ovat turvallisia ja linjassa ihmisten arvojen kanssa.
Sitten, ennen kuin julkaiset mallin, testaa se. Punaiset tiimit, jotka yrittävät herättää turvattomia käyttäytymisiä vihamielisillä ohjauksilla, reunatapauksilla ja yrittäen murtaa vankilaa, voivat paljastaa haavoittuvuuksia. Korjaaminen niistä ennen kuin ne pääsevät julki pitää asiat turvallisina ennen kuin ongelmaa on.
Samalla tavalla kuin tämä testaus varmistaa, että tekoälymallit ovat kestäviä, jatkuvasti seurata mallien kehittymistä silmällä pidettäväksi uusista uhista ja sopeutumistarpeista, jotka saattavat olla tarpeen.
Samalla tavoin on tärkeää jatkuvasti seurata sisällön lähteitä ja digitaalista vuorovaikutusta petosten merkkien varalta. Kriittisesti, käytä tekoäly-ihmisen yhdistelmää, jossa tekoäly-automatiikka huolehtii suuresta tietomäärästä, jota on seurattava, ja koulutetut ihmiset käsittelevät tarkastukset valvontaa ja varmistamista varten.
Agenteille tekoälyn soveltaminen vaatii vieläkin enemmän huolellisuutta. Perusvaatimus: kouluta agentti tietämään rajoituksensa. Kun se kohtaa epävarmuutta, eettisiä dilemmatiikkaa, uusia tilanteita tai erityisen korkean panoksen päätöksiä, varmista, että se tietää, miten pyytää apua.
Lisäksi suunnittele jäljitettävyys agentteihin. Tämä on erityisen tärkeää, jotta niiden vuorovaikutus tapahtuu vain vahvistettujen käyttäjien kanssa, jotta petolliset toimijat eivät voi vaikuttaa agentin toimintaan.
Jos ne näyttävät toimivan tehokkaasti, voi olla houkuttelevaa antaa heidän toimia vapaasti ja antaa heidän tehdä asiansa. Kokemuksemme sanoo, että on syytä jatkaa heidän seuraamista ja tehtävien valvontaa virheiden tai odottamattoman käyttäytymisen havaitsemiseksi. Käytä sekä automaattisia tarkastuksia että ihmisten tarkastusta.
Todella, tekoälyn turvallisuuden olennainen osa on säännöllinen ihmisten osallistuminen. Ihmisten on tarkoitus osallistua tietoisesti kriittisiin arviointeihin, empatiaan tai hienovaraisuuteen ja epäselvyyksiin liittyvissä päätöksissä tai toimissa.
Uudelleen, selkeästi, nämä kaikki ovat käytäntöjä, jotka rakennetaan tekoälyn toteutukseen etukäteen, suunnittelun kautta. Ne eivät ole seurausta siitä, että jotain menee pieleen ja sitten ryntää keksimään, miten vahingoittaa vahinkoa.
Toimiko se?
Olemme soveltaneet “Tekoälyn turvallisuus ensin” -filosofiaa ja “suunnittelun kautta” -kehystä asiakkaidemme kanssa koko GenAI:n kehityksen ajan ja nyt nopeasti agenteille tekoälyyn. Havaitsemme, että vastoin sitä, mitä pelätään hidastavan asioita, se itse asiassa auttaa niiden kiihdyttämistä.
Agenteille tekoälyllä on potentiaalia laskea asiakastukea 25-50 prosentilla esimerkiksi asiakastyytyväisyyden parantamiseksi. Mutta se riippuu luottamuksesta.
Ihmisten on luotettava tekoälyyn, ja asiakkaat, jotka vuorovaikuttavat tekoälyä käyttävien ihmisten tai itse tekoälyagenttien kanssa, eivät voi kokea yhtään vuorovaikutusta, joka horjuttaisi heidän luottamustaan brändiin.
Emme luota siihen, mitä ei ole turvallista. Joten, kun rakennamme turvallisuuden jokaiseen tekoälykerrokseen, jota olemme valmiit julkaisemaan, voimme tehdä sen luottamuksella. Ja kun olemme valmiit laajentamaan sen, voimme tehdä sen nopeasti – luottamuksella.
Vaikka tekoälyn turvallisuuden priorisoinnin käyttäminen käytännössä voi tuntua ylivoimaiselta, et ole yksin. On monia asiantuntijoita, jotka voivat auttaa, ja kumppaneita, jotka voivat jakaa, mitä he ovat oppineet ja mitä he ovat oppimassa, jotta voit hyödyntää tekoälyn arvoa turvallisesti ilman, että hidastat.
Tekoäly on ollut jännittävä matka tähän asti, ja kun matka kiihtyy, se on hurja. Mutta olen myös iloinen, että olen päässä kypäräni.












