Ajatusjohtajat

TekoÃĪly edellÃĪ tarkoittaa turvallisuutta ensin

mm
LisÃĪÃĪ Unite.AI suosikkilÃĪhteisiisi Google-palvelussa

Osta lapselle uusi polkupyÃķrÃĪ, ja polkupyÃķrÃĪ saa kaiken huomion – ei niin paljon uutta kypÃĪrÃĪÃĪ, joka tulee mukana. Mutta vanhemmat arvostavat kypÃĪrÃĪÃĪ.

PelkÃĪÃĪn, ettÃĪ useimmat meistÃĪ ovat tÃĪllÃĪ hetkellÃĪ kuin lapset, kun on kyse tekoÃĪlystÃĪ. Olemme keskittyneitÃĪ siihen, kuinka hienoa se on ja kuinka nopeasti voimme sen kanssa edetÃĪ. Emme niin paljon siihen, mitÃĪ voimme tehdÃĪ, jotta pysymme turvassa sen kÃĪytÃķn aikana. Se on harmi, koska et voi hyÃķtyÃĪ toisesta ilman toista.

Yksinkertaisesti sanottuna, tekoÃĪlyn soveltaminen ilman huolellista turvallisuuden suunnittelua ei ole vain riskialtista. Se on suora tie rotkoon.

MikÃĪ tekoÃĪlyn turvallisuus tarkoittaa?

TekoÃĪlyn turvallisuus kÃĪsittÃĪÃĪ joukon toimia. Mutta ehkÃĪ tÃĪrkein tekijÃĪ on milloin niitÃĪ toteutetaan. Jotta tekoÃĪlyn turvallisuus olisi tehokas, se on oltava suunniteltu.

Se tarkoittaa, ettÃĪ meidÃĪn on mietittÃĪvÃĪ, miten estÃĪmme vahinkoa ennen kuin otamme sen kokeiluun. MeidÃĪn on selvitettÃĪvÃĪ, miten varmistamme, ettÃĪ tekoÃĪly toimii ja tuottaa tuloksia, jotka ovat linjassa arvojemme ja sosiaalisten odostusten kanssa, ennen kuin saamme jotain kauheaa tulosta.

TekoÃĪlyn turvallisuuden suunnittelu sisÃĪltÃĪÃĪ myÃķs sen, miten tehdÃĪ siitÃĪ kestÃĪvÃĪ, eli kykenevÃĪ toimimaan ennustettavasti jopa epÃĪedullisissa tilanteissa. Se tarkoittaa myÃķs tekoÃĪlyn lÃĪpinÃĪkyvyyttÃĪ, jotta tekoÃĪlyn tekemÃĪt pÃĪÃĪtÃķkset ovat ymmÃĪrrettÃĪvissÃĪ, tarkastettavissa ja puolueettomia.

Se sisÃĪltÃĪÃĪ myÃķs sen, ettÃĪ tarkastelemme maailmaa, jossa tekoÃĪly toimii. MitkÃĪ institutionaaliset ja oikeudelliset turvallisuusjÃĪrjestelyt tarvitaan, erityisesti jotta voimme noudattaa sovellettavia hallituksen sÃĪÃĪntÃķjÃĪ? Ja en voi korostaa liikaa ihmisten osuutta: MitkÃĪ vaikutukset tekoÃĪlyn kÃĪytÃķllÃĪ on ihmisille, jotka vuorovaikuttavat sen kanssa?

Turvallisuuden suunnittelu tarkoittaa tekoÃĪlyn turvallisuuden upottamista kaikkiin prosessiemme, tyÃķnkulkuun ja toimintoihin ennen kuin kirjoitamme ensimmÃĪisen ohjauksen.

Riskit ylittÃĪvÃĪt huolen

Kaikki eivÃĪt ole samaa mieltÃĪ. Kun he kuulevat “turvallisuus ensin”, jotkut kuulevat “ota askel niin varovasti ja hitaasti, ettÃĪ jÃĪÃĪmme jÃĪlkeen.” Tietysti, se ei ole, mitÃĪ turvallisuus ensin tarkoittaa. Se ei tarvitse tukahduttaa innovaatiota tai hidastaa markkinoille menoa. Ja se ei tarkoita loputonta joukkoa koekÃĪyttÃķjÃĪ, jotka eivÃĪt koskaan laajene. PÃĪinvastoin.

Se tarkoittaa ymmÃĪrtÃĪmistÃĪ siitÃĪ, mitÃĪ tekoÃĪlyn turvallisuuden suunnittelun puute voi aiheuttaa. Mieti vain muutamia.

  • Deloitte Center for Financial Services ennustaa, ettÃĪ GenAI voi olla vastuussa petosvahinkojen kasvusta 40 miljardiin Yhdysvaltain dollariin Yhdysvalloissa vuoteen 2027 mennessÃĪ, 12,3 miljardista Yhdysvaltain dollarista vuonna 2023, 32 prosentin vuosikasvuvauhdilla.
  • Harhaiset pÃĪÃĪtÃķkset. Tutkimukset harhaisen lÃĪÃĪketieteellisen hoidon vuoksi tekoÃĪlyÃĪ, joka oli koulutettu harhaista dataa.
  • Huonot pÃĪÃĪtÃķkset, jotka innoittavat lisÃĪÃĪ huonoja pÃĪÃĪtÃķksiÃĪ. Pahempaa kuin alkuperÃĪinen huono pÃĪÃĪtÃķs, joka on kiihdytetty viallisella tekoÃĪlyllÃĪ, tutkimukset osoittavat, ettÃĪ nÃĪmÃĪ virheelliset pÃĪÃĪtÃķkset voivat muodostua osaksi siitÃĪ, miten ajattelemme ja teemme tulevaisuuden pÃĪÃĪtÃķksiÃĪ.
  • Todelliset seuraukset. TekoÃĪly, joka antaa huonoa lÃĪÃĪketieteellistÃĪ neuvontaa, on ollut vastuussa kuolemaksi johtaneista potilastuloksista. Oikeudelliset ongelmat ovat seuranneet tekoÃĪlyn harhaisen vÃĪitteen siteeraamisesta oikeudellisena esimerkkinÃĪ. Ohjelmistovirheet, jotka johtuvat tekoÃĪlyavustajan antamasta virheellisestÃĪ tietoa, ovat tahrineet yhtiÃķn tuotteita ja mainetta ja johtaneet laajaan kÃĪyttÃĪjien tyytymÃĪttÃķmyyteen.

Ja asiat ovat vielÃĪ mielenkiintoisempia.

TekoÃĪlyagenttien, tekoÃĪlyn, joka voi toimia itsenÃĪisesti ja tehdÃĪ pÃĪÃĪtÃķksiÃĪ, joita se on tehnyt, kehittyminen ja nopea omaksuminen tulevat korostamaan tekoÃĪlyn turvallisuuden suunnittelun tÃĪrkeyttÃĪ.

TekoÃĪlyagentti, joka voi toimia puolestasi, voi olla erittÃĪin hyÃķdyllinen. Sen sijaan, ettÃĪ se kertoo sinulle parhaat lennot matkalle, se voi lÃķytÃĪÃĪ ne ja varata ne puolestasi. Jos haluat palauttaa tuotteen, yhtiÃķn tekoÃĪlyagentti voi kertoa sinulle palautuspolitiikasta ja siitÃĪ, miten haetaan palautusta, ja myÃķs kÃĪsitellÃĪ koko transaktion puolestasi.

Hienoa – kunhan agentti ei harhaise lentoa tai kÃĪsittele taloudellista tietoa vÃĪÃĪrin. Tai yhtiÃķn palautuspolitiikkaa vÃĪÃĪrin ja kieltÃĪytyy hyvÃĪksymÃĪstÃĪ voimassa olevia palautuksia.

On helppo nÃĪhdÃĪ, miten nykyiset tekoÃĪlyn turvallisuuden riskit voivat helposti kasautua joukon tekoÃĪlyagenttien kanssa, jotka tekevÃĪt pÃĪÃĪtÃķksiÃĪ ja toimivat, erityisesti koska ne eivÃĪt todennÃĪkÃķisesti toimisi yksin. Suurin osa tekoÃĪlyagenttien todellisesta arvosta tulee agenttien joukoista, joissa yksittÃĪiset agentit kÃĪsittelevÃĪt tehtÃĪvien osia ja tekevÃĪt yhteistyÃķtÃĪ â€“ agentti kohtaa agentin – saadakseen tyÃķn tehtyÃĪ.

Miten voit omaksua tekoÃĪlyn turvallisuuden ilman, ettÃĪ se hidastaa innovaatiota ja tappaa sen potentiaalisen arvon?

Turvallisuus suunnittelussa

Ad hoc -turvallisuustarkastukset eivÃĪt ole vastaus. Mutta turvallisuuden kÃĪytÃĪntÃķjen integroiminen jokaiseen tekoÃĪlyn toteutusvaiheeseen on.

Aloita datalla. Varmista, ettÃĪ data on merkitty, annotoitu tarvittaessa, puolueeton ja laadukas. TÃĪmÃĪ on erityisen tÃĪrkeÃĪÃĪ koulutusdataa varten.

Kouluta malleja ihmisten palautteella, koska ihmisten arviointi on vÃĪlttÃĪmÃĪtÃķntÃĪ muotoilla mallin kÃĪyttÃĪytymistÃĪ. Vahvistusoppiminen ihmisten palautteella (RLHF) ja muut samankaltaiset tekniikat sallivat annotaattorien arvioida ja ohjata vastauksia, auttaen suurkielisiÃĪ malleja tuottamaan tuloksia, jotka ovat turvallisia ja linjassa ihmisten arvojen kanssa.

Sitten, ennen kuin julkaiset mallin, testaa se. Punaiset tiimit, jotka yrittÃĪvÃĪt herÃĪttÃĪÃĪ turvattomia kÃĪyttÃĪytymisiÃĪ vihamielisillÃĪ ohjauksilla, reunatapauksilla ja yrittÃĪen murtaa vankilaa, voivat paljastaa haavoittuvuuksia. Korjaaminen niistÃĪ ennen kuin ne pÃĪÃĪsevÃĪt julki pitÃĪÃĪ asiat turvallisina ennen kuin ongelmaa on.

Samalla tavalla kuin tÃĪmÃĪ testaus varmistaa, ettÃĪ tekoÃĪlymallit ovat kestÃĪviÃĪ, jatkuvasti seurata mallien kehittymistÃĪ silmÃĪllÃĪ pidettÃĪvÃĪksi uusista uhista ja sopeutumistarpeista, jotka saattavat olla tarpeen.

Samalla tavoin on tÃĪrkeÃĪÃĪ jatkuvasti seurata sisÃĪllÃķn lÃĪhteitÃĪ ja digitaalista vuorovaikutusta petosten merkkien varalta. Kriittisesti, kÃĪytÃĪ tekoÃĪly-ihmisen yhdistelmÃĪÃĪ, jossa tekoÃĪly-automatiikka huolehtii suuresta tietomÃĪÃĪrÃĪstÃĪ, jota on seurattava, ja koulutetut ihmiset kÃĪsittelevÃĪt tarkastukset valvontaa ja varmistamista varten.

Agenteille tekoÃĪlyn soveltaminen vaatii vielÃĪkin enemmÃĪn huolellisuutta. Perusvaatimus: kouluta agentti tietÃĪmÃĪÃĪn rajoituksensa. Kun se kohtaa epÃĪvarmuutta, eettisiÃĪ dilemmatiikkaa, uusia tilanteita tai erityisen korkean panoksen pÃĪÃĪtÃķksiÃĪ, varmista, ettÃĪ se tietÃĪÃĪ, miten pyytÃĪÃĪ apua.

LisÃĪksi suunnittele jÃĪljitettÃĪvyys agentteihin. TÃĪmÃĪ on erityisen tÃĪrkeÃĪÃĪ, jotta niiden vuorovaikutus tapahtuu vain vahvistettujen kÃĪyttÃĪjien kanssa, jotta petolliset toimijat eivÃĪt voi vaikuttaa agentin toimintaan.

Jos ne nÃĪyttÃĪvÃĪt toimivan tehokkaasti, voi olla houkuttelevaa antaa heidÃĪn toimia vapaasti ja antaa heidÃĪn tehdÃĪ asiansa. Kokemuksemme sanoo, ettÃĪ on syytÃĪ jatkaa heidÃĪn seuraamista ja tehtÃĪvien valvontaa virheiden tai odottamattoman kÃĪyttÃĪytymisen havaitsemiseksi. KÃĪytÃĪ sekÃĪ automaattisia tarkastuksia ettÃĪ ihmisten tarkastusta.

Todella, tekoÃĪlyn turvallisuuden olennainen osa on sÃĪÃĪnnÃķllinen ihmisten osallistuminen. Ihmisten on tarkoitus osallistua tietoisesti kriittisiin arviointeihin, empatiaan tai hienovaraisuuteen ja epÃĪselvyyksiin liittyvissÃĪ pÃĪÃĪtÃķksissÃĪ tai toimissa.

Uudelleen, selkeÃĪsti, nÃĪmÃĪ kaikki ovat kÃĪytÃĪntÃķjÃĪ, jotka rakennetaan tekoÃĪlyn toteutukseen etukÃĪteen, suunnittelun kautta. Ne eivÃĪt ole seurausta siitÃĪ, ettÃĪ jotain menee pieleen ja sitten ryntÃĪÃĪ keksimÃĪÃĪn, miten vahingoittaa vahinkoa.

Toimiko se?

Olemme soveltaneet “TekoÃĪlyn turvallisuus ensin” -filosofiaa ja “suunnittelun kautta” -kehystÃĪ asiakkaidemme kanssa koko GenAI:n kehityksen ajan ja nyt nopeasti agenteille tekoÃĪlyyn. Havaitsemme, ettÃĪ vastoin sitÃĪ, mitÃĪ pelÃĪtÃĪÃĪn hidastavan asioita, se itse asiassa auttaa niiden kiihdyttÃĪmistÃĪ.

Agenteille tekoÃĪlyllÃĪ on potentiaalia laskea asiakastukea 25-50 prosentilla esimerkiksi asiakastyytyvÃĪisyyden parantamiseksi. Mutta se riippuu luottamuksesta.

Ihmisten on luotettava tekoÃĪlyyn, ja asiakkaat, jotka vuorovaikuttavat tekoÃĪlyÃĪ kÃĪyttÃĪvien ihmisten tai itse tekoÃĪlyagenttien kanssa, eivÃĪt voi kokea yhtÃĪÃĪn vuorovaikutusta, joka horjuttaisi heidÃĪn luottamustaan brÃĪndiin.

Emme luota siihen, mitÃĪ ei ole turvallista. Joten, kun rakennamme turvallisuuden jokaiseen tekoÃĪlykerrokseen, jota olemme valmiit julkaisemaan, voimme tehdÃĪ sen luottamuksella. Ja kun olemme valmiit laajentamaan sen, voimme tehdÃĪ sen nopeasti – luottamuksella.

Vaikka tekoÃĪlyn turvallisuuden priorisoinnin kÃĪyttÃĪminen kÃĪytÃĪnnÃķssÃĪ voi tuntua ylivoimaiselta, et ole yksin. On monia asiantuntijoita, jotka voivat auttaa, ja kumppaneita, jotka voivat jakaa, mitÃĪ he ovat oppineet ja mitÃĪ he ovat oppimassa, jotta voit hyÃķdyntÃĪÃĪ tekoÃĪlyn arvoa turvallisesti ilman, ettÃĪ hidastat.

TekoÃĪly on ollut jÃĪnnittÃĪvÃĪ matka tÃĪhÃĪn asti, ja kun matka kiihtyy, se on hurja. Mutta olen myÃķs iloinen, ettÃĪ olen pÃĪÃĪssÃĪ kypÃĪrÃĪni.

Joe Anderson on Senior Director of Consulting and Digital Transformation TaskUsissa, jossa hÃĪn johtaa markkinointistrategiaa ja innovaatioita. HÃĪn keskittyy tekoÃĪlyjen, asiakaskokemusten ja digitaalisten operaatioiden leikkauskohdassa ja johtaa TaskUsin uutta agenssia tekoÃĪlykonsultointipalvelua.