Tankeledare
AI-fÃķrst betyder sÃĪkerhet-fÃķrst

KÃķp en ny cykel till ett barn, och cykeln kommer att fÃĨ all uppmÃĪrksamhet â inte den blanka hjÃĪlmen som fÃķljer med den. Men fÃķrÃĪldrar uppskattar hjÃĪlmen.
Jag ÃĪr rÃĪdd fÃķr att mÃĨnga av oss idag ÃĪr mer som barn nÃĪr det gÃĪller AI. Vi ÃĪr fokuserade pÃĨ hur coolt det ÃĪr och hur fort vi kan gÃĨ med det. Inte sÃĨ mycket pÃĨ vad vi kan gÃķra fÃķr att hÃĨlla oss sÃĪkra medan vi anvÃĪnder det. Det ÃĪr synd, fÃķr du kan inte ha fÃķrdelarna med en sak utan den andra.
Det ÃĪr enkelt uttryckt, att applicera AI utan att noggrant planera fÃķr sÃĪkerhet fÃķrst ÃĪr inte bara riskabelt. Det ÃĪr en rak vÃĪg nerfÃķr ett stup.
Vad betyder AI-sÃĪkerhet egentligen?
AI-sÃĪkerhet innefattar en mÃĪngd steg. Men kanske det viktigaste elementet ÃĪr nÃĪr man tar dem. FÃķr att vara effektiv mÃĨste AI-sÃĪkerhet vara genom design.
Det betyder att vi ÃķvervÃĪger hur vi kan fÃķrhindra skada innan vi tar det fÃķr en testtur. Vi figurerar ut hur vi kan se till att AI fungerar och genererar resultat i linje med vÃĨra vÃĪrderingar och sociala fÃķrvÃĪntningar fÃķrst â inte efter att vi fÃĨr nÃĨgra fÃķrskrÃĪckliga resultat.
Att designa fÃķr AI-sÃĪkerhet innefattar ocksÃĨ att tÃĪnka pÃĨ hur man kan gÃķra det robust, eller kunna fungera fÃķrutsÃĪgbart ÃĪven i ogynnsamma situationer. Det betyder att gÃķra AI transparent, sÃĨ att besluten AI fattar ÃĪr fÃķrstÃĨeliga, granskbara och obeflÃĪckade.
Men det innefattar ocksÃĨ att titta pÃĨ den vÃĪrld dÃĪr AI kommer att fungera. Vilka institutionella och juridiska skydd behÃķver vi, sÃĪrskilt fÃķr att fÃķlja tillÃĪmpliga regeringars regler? Och jag kan inte Ãķverbetona mÃĪnniskokomponenten: Vad kommer pÃĨverkan av AI-anvÃĪndningen att vara pÃĨ de mÃĪnniskor som interagerar med det?
SÃĪkerhet genom design betyder att integrera AI-sÃĪkerhet i alla vÃĨra processer, arbetsflÃķden och operationer innan vi skriver vÃĨr fÃķrsta prompt.
Riskerna ÃķvervÃĪger bekymmer
Inte alla ÃĪr Ãķverens. NÃĪr de hÃķr âsÃĪkerhet fÃķrstâ, hÃķr vissa âgÃĨ sÃĨ fÃķrsiktigt och lÃĨngsamt att du blir lÃĪmnad efterâ. Naturligtvis ÃĪr det inte vad sÃĪkerhet fÃķrst betyder. Det behÃķver inte kvÃĪva innovation eller sakta ner tid till marknad. Och det betyder inte en ÃĪndlÃķs strÃķm av piloter som aldrig skalas. TvÃĪrtom.
Det betyder att fÃķrstÃĨ riskerna med inte att designa sÃĪkerhet in i AI. TÃĪnk pÃĨ bara nÃĨgra.
- Deloittes Center for Financial Services fÃķrutspÃĨr att GenAI kan vara ansvarig fÃķr bedrÃĪgerifÃķrluster pÃĨ 40 miljarder dollar i USA ensam till 2027, frÃĨn 12,3 miljarder dollar 2023, en Ãķkning pÃĨ 32% per ÃĨr.
- Partiska beslut. Fall dokumenterar partisk medicinsk vÃĨrd pÃĨ grund av AI som hade trÃĪnats pÃĨ partiska data.
- DÃĨliga beslut som inspirerar fler dÃĨliga beslut. VÃĪrre ÃĪn ett initialt dÃĨligt beslut som utlÃķsts av felaktig AI, studier tyder pÃĨ att dessa felaktiga beslut kan bli en del av hur vi tÃĪnker och fattar beslut i framtiden.
- Verkliga konsekvenser. AI som ger dÃĨlig medicinsk rÃĨdgivning har varit ansvarig fÃķr dÃķdliga patientutfall. Juridiska problem har uppstÃĨtt pÃĨ grund av att en AI:s hallucination citerades som juridisk prejudikat. Och programvarufel som orsakats av en AI-assistent som gav felaktig information har fÃķrorenat fÃķretagsprodukter och deras rykte och lett till omfattande anvÃĪndarmissnÃķje.
Och saker ÃĪr pÃĨ vÃĪg att bli ÃĪnnu mer intressanta.
Introduktionen och snabba antagandet av agenter AI, AI som kan fungera autonomt fÃķr att fatta beslut baserat pÃĨ beslut de har fattat, kommer att fÃķrstora betydelsen av att designa fÃķr AI-sÃĪkerhet.
En AI-agent som kan agera pÃĨ din vÃĪgnar kan vara oerhÃķrt anvÃĪndbar. IstÃĪllet fÃķr att den berÃĪttar fÃķr dig om de bÃĪsta flygen fÃķr en resa, kan den hitta dem och boka dem ÃĨt dig. Om du vill returnera en produkt, kan ett fÃķretags AI-agent inte bara berÃĪtta fÃķr dig om returpolicyn och hur du kan returnera den, utan ocksÃĨ hantera hela transaktionen ÃĨt dig.
Storartat â sÃĨ lÃĪnge agenten inte hallucinerar ett flyg eller hanterar dina finansiella uppgifter felaktigt. Eller fÃĨr fÃķretagets returpolicy fel och vÃĪgrar giltiga returer.
Det ÃĪr inte svÃĨrt att se hur de nuvarande AI-sÃĪkerhetsriskerna lÃĪtt kan kaskada med en mÃĪngd AI-agenter som fattar beslut och agerar, sÃĪrskilt eftersom de inte kommer att agera ensamma. Mycket av det verkliga vÃĪrdet i agenter AI kommer frÃĨn team av agenter, dÃĪr enskilda agenter hanterar delar av uppgifter och samarbetar â agent till agent â fÃķr att fÃĨ jobbet gjort.
SÃĨ hur kan du omfamna AI-sÃĪkerhet genom design utan att hÃĪmma innovation och dÃķda dess potential?
SÃĪkerhet genom design i aktion
Ad hoc-sÃĪkerhetskontroller ÃĪr inte svaret. Men att integrera sÃĪkerhetspraxis i varje fas av en AI-implementering ÃĪr.
BÃķrja med data. Se till att data ÃĪr mÃĪrkt, annoterad dÃĪr det behÃķvs, partiskt fritt och av hÃķg kvalitet. Detta ÃĪr sÃĪrskilt sant fÃķr trÃĪningsdata.
TrÃĪna dina modeller med mÃĪnsklig feedback, eftersom mÃĪnsklig bedÃķmning ÃĪr avgÃķrande fÃķr att forma modellbeteende. FÃķrstÃĪrkt inlÃĪrning med mÃĪnsklig feedback (RLHF) och liknande tekniker tillÃĨter annotatorer att betygsÃĪtta och vÃĪgleda svar, vilket hjÃĪlper LLM att generera utdata som ÃĪr sÃĪkra och anpassade till mÃĪnskliga vÃĪrderingar.
Sedan, innan du slÃĪpper en modell, utsÃĪtt den fÃķr stress. RÃķda lag som fÃķrsÃķker provocera osÃĪkert beteende genom att anvÃĪnda motstridiga prompter, grÃĪnsfall och fÃķrsÃķk att bryta ut kan avslÃķja sÃĨrbarheter. Att ÃĨtgÃĪrda dem innan de nÃĨr allmÃĪnheten hÃĨller saker sÃĪkra innan det finns ett problem.
Medan denna testning ser till att dina AI-modeller ÃĪr robusta, fortsÃĪtt att Ãķvervaka dem med ett Ãķga pÃĨ nya hot och justeringar som kan behÃķvas fÃķr modellerna.
PÃĨ samma sÃĪtt, Ãķvervaka regelbundet innehÃĨllskÃĪllor och digitala interaktioner fÃķr tecken pÃĨ bedrÃĪgeri. Kritiskt, anvÃĪnd en hybrid AI-mÃĪnsklig approach, lÃĨt AI-automatisering ta hand om den enorma mÃĪngden data som ska Ãķvervakas, och utbildade mÃĪnniskor hanterar granskningar fÃķr verkstÃĪllighet och fÃķr att sÃĪkerstÃĪlla noggrannhet.
Att applicera agenter AI krÃĪver ÃĪnnu mer omsorg. En grundlÃĪggande krav: trÃĪna agenten att kÃĪnna till dess begrÃĪnsningar. NÃĪr den mÃķter osÃĪkerhet, etiska dilemman, nya situationer eller sÃĪrskilt hÃķgriskbeslut, se till att den vet hur den ska be om hjÃĪlp.
Designa ocksÃĨ spÃĨrbarhet i dina agenter. Detta ÃĪr sÃĪrskilt viktigt sÃĨ att deras interaktioner endast sker med verifierade anvÃĪndare, fÃķr att undvika bedragare som pÃĨverkar en agents handlingar.
Om de verkar fungera effektivt, kan det vara frestande att slÃĪppa loss agenterna och lÃĨta dem gÃķra sin sak. VÃĨr erfarenhet sÃĪger att vi ska fortsÃĪtta att Ãķvervaka dem och de uppgifter de utfÃķr fÃķr att se till att det inte finns nÃĨgra fel eller ovÃĪntat beteende. AnvÃĪnd bÃĨde automatiserade kontroller och mÃĪnsklig granskning.
I sjÃĪlva verket ÃĪr en avgÃķrande komponent i AI-sÃĪkerhet regelbunden mÃĪnsklig inblandning. MÃĪnniskor bÃķr medvetet engageras dÃĪr kritisk bedÃķmning, empati eller nyans och tvetydighet ÃĪr inblandade i ett beslut eller handling.
Igen, fÃķr att vara tydlig, ÃĪr dessa alla praxis som du bygger in i AI-implementeringen i fÃķrvÃĪg, genom design. De ÃĪr inte resultatet av att nÃĨgot gÃĨr fel och sedan skyndar man sig fÃķr att komma pÃĨ hur man kan minimera skadan.
Fungerar det?
Vi har tillÃĪmpat en AI-sÃĪkerhetsfilosofi och âgenom designâ-ramverk med vÃĨra kunder under utvecklingen av GenAI och nu pÃĨ den snabba banan till agenter AI. Vi upptÃĪcker att, till skillnad frÃĨn farhÃĨgor om att det kommer att sakta ner saker, det faktiskt hjÃĪlper till att pÃĨskynda dem.
Agenter AI har potentialen att sÃĪnka kundsupportkostnaderna med 25-50%, till exempel, samtidigt som de Ãķkar kundnÃķjdheten. Men det beror allt pÃĨ fÃķrtroende.
MÃĪnniskor som anvÃĪnder AI mÃĨste lita pÃĨ det, och kunder som interagerar med AI-aktiverade mÃĪnskliga agenter eller med faktiska AI-agenter kan inte uppleva en enda interaktion som skulle undergrÃĪva deras fÃķrtroende. En dÃĨlig upplevelse kan utplÃĨna fÃķrtroendet fÃķr ett varumÃĪrke.
Vi litar inte pÃĨ det som inte ÃĪr sÃĪkert. SÃĨ nÃĪr vi bygger sÃĪkerhet in i varje lager av AI som vi ÃĪr pÃĨ vÃĪg att lansera, kan vi gÃķra det med fÃķrtroende. Och nÃĪr vi ÃĪr redo att skala upp det, kan vi gÃķra det snabbt â med fÃķrtroende.
Medan att sÃĪtta AI-sÃĪkerhet fÃķrst i praktiken kan tyckas ÃķvervÃĪldigande, ÃĪr du inte ensam. Det finns mÃĨnga experter som kan hjÃĪlpa och partners som kan dela vad de har lÃĪrt sig och vad de lÃĪr sig sÃĨ att du kan ta del av AI-vÃĪrdet pÃĨ ett sÃĪkert sÃĪtt utan att sakta ner dig.
AI har varit en spÃĪnnande resa hittills, och nÃĪr resan accelererar, tycker jag att det ÃĪr spÃĪnnande. Men jag ÃĪr ocksÃĨ glad att jag har min hjÃĪlm.












