Liderzy opinii
AI-Najpierw oznacza BezpieczeÅstwo-Najpierw

Kupienie dziecku nowego roweru i rower bÄdzie miaÅ wszystkie uwagi â nie lÅniÄ cy kask, ktÃģry go towarzyszy. Ale rodzice doceniajÄ kask.
BojÄ siÄ, Åže wielu z nas dzisiaj jest jak dzieci, gdy chodzi o sztucznÄ inteligencjÄ. JesteÅmy skupieni na tym, jak jest fajna i jak szybko moÅžemy z niÄ jechaÄ. Nie tak bardzo na to, co moÅžemy zrobiÄ, aby byÄ bezpiecznym, uÅžywajÄ c jej. To szkoda, bo nie moÅžemy mieÄ korzyÅci z jednego bez drugiego.
Prosto mÃģwiÄ c, stosowanie sztucznej inteligencji bez starannego zaplanowania bezpieczeÅstwa najpierw nie jest tylko ryzykowne. To prosty sposÃģb, aby zejÅÄ z klifu.
Co to jest BezpieczeÅstwo Sztucznej Inteligencji?
BezpieczeÅstwo sztucznej inteligencji obejmuje szereg krokÃģw. Ale byÄ moÅže najwaÅžniejszym elementem jest kiedy je podjÄ Ä. Aby byÄ skutecznym, bezpieczeÅstwo sztucznej inteligencji musi byÄ projektowane.
To oznacza, Åže rozwaÅžamy, jak zapobiec szkodzie, zanim jÄ przetestujemy. Ustalamy, jak upewniÄ siÄ, Åže sztuczna inteligencja dziaÅa i generuje wyniki zgodnie z naszymi wartoÅciami i spoÅecznymi oczekiwaniami, najpierw â a nie po tym, jak otrzymamy straszne wyniki.
Projektowanie bezpieczeÅstwa sztucznej inteligencji obejmuje rÃģwnieÅž myÅlenie o tym, jak uczyniÄ jÄ wytrzymaÅÄ , czyli zdolnÄ do dziaÅania w sposÃģb przewidywalny, nawet w niekorzystnych sytuacjach. Oznacza to uczynienie sztucznej inteligencji przejrzystÄ , aby decyzje, ktÃģre podejmuje, byÅy zrozumiaÅe, audytowalne i niezwiÄ zane z uprzedzeniami.
Ale obejmuje to rÃģwnieÅž spojrzenie na Åwiat, w ktÃģrym sztuczna inteligencja bÄdzie dziaÅaÄ. Jakie instytucjonalne i prawne zabezpieczenia potrzebujemy, zwÅaszcza w celu zgodnoÅci z obowiÄ zujÄ cymi przepisami rzÄ dowymi? I nie mogÄ przeceniÄ skÅadnika ludzkiego: jaki wpÅyw bÄdzie miaÅo uÅžywanie sztucznej inteligencji na ludzi, ktÃģrzy z niÄ wchodzÄ w interakcjÄ?
BezpieczeÅstwo przez projektowanie oznacza wbudowanie bezpieczeÅstwa sztucznej inteligencji we wszystkie nasze procesy, przepÅywy pracy i operacje, zanim wpiszemy pierwsze polecenie.
Ryzyko PrzewyÅžsza Obawy
Nie wszyscy sÄ zgodni. Gdy sÅyszÄ âbezpieczeÅstwo-najpierwâ, niektÃģrzy sÅyszÄ âpostÄpuj tak ostroÅžnie i powoli, aby zostaÄ pozostawionym w tyleâ. OczywiÅcie, to nie jest to, co bezpieczeÅstwo-najpierw oznacza. Nie musi to hamowaÄ innowacji ani spowalniaÄ czasu wprowadzania na rynek. I nie oznacza to niekoÅczÄ cego siÄ strumienia pilotÃģw, ktÃģrzy nigdy nie skalujÄ . WrÄcz przeciwnie.
To oznacza zrozumienie ryzyka nie projektowania bezpieczeÅstwa w sztucznej inteligencji. RozwaÅž tylko kilka.
- Centrum UsÅug Finansowych Deloitte przewiduje, Åže GenAI moÅže byÄ odpowiedzialny za straty zwiÄ zane z oszustwami siÄgajÄ ce 40 miliardÃģw dolarÃģw w samych Stanach Zjednoczonych do 2027 roku, z 12,3 miliardÃģw dolarÃģw w 2023 roku, co oznacza wzrost o 32% w skali roku.
- Uprzedzone decyzje. Przypadki dokumentujÄ uprzedzonÄ opiekÄ medycznÄ ze wzglÄdu na sztucznÄ inteligencjÄ, ktÃģra byÅa szkolona na uprzednionych danych.
- ZÅe decyzje, ktÃģre inspirujÄ wiÄcej zÅych decyzji. Gorsze niÅž poczÄ tkowa zÅa decyzja spowodowana wadliwÄ sztucznÄ inteligencjÄ , badania wskazujÄ Åže te wadliwe decyzje mogÄ staÄ siÄ czÄÅciÄ tego, jak myÅlimy i podejmujemy przyszÅe decyzje.
- Rzeczywiste konsekwencje. Sztuczna inteligencja, ktÃģra daje zÅe porady medyczne, byÅa odpowiedzialna za Åmiertelne wyniki pacjentÃģw. Problemy prawne wynikajÄ ce z cytowania halucynacji sztucznej inteligencji jako precedensu prawnego. I bÅÄdy oprogramowania wynikajÄ ce z sztucznej inteligencji, ktÃģra daje nieprawidÅowe informacje, zanieczyÅciÅy produkty firmy i ich reputacjÄ i doprowadziÅy do powszechnego niezadowolenia uÅžytkownikÃģw.
I rzeczy majÄ siÄ jeszcze bardziej interesujÄ co.
Wprowadzenie i szybkie przyjÄcie agentywnych sztucznych inteligencji, sztucznych inteligencji, ktÃģre mogÄ dziaÅaÄ autonomicznie, podejmujÄ c decyzje, ktÃģre podjÄÅy, zwiÄkszy znaczenie projektowania bezpieczeÅstwa sztucznej inteligencji.
Agent sztucznej inteligencji, ktÃģry moÅže dziaÅaÄ w Twoim imieniu, moÅže byÄ niezwykle przydatny. Zamiast mÃģwiÄ Ci o najlepszych lotach na podrÃģÅž, moÅže je znaleÅšÄ i zarezerwowaÄ dla Ciebie. JeÅli chcesz zwrÃģciÄ produkt, agent sztucznej inteligencji firmy moÅže nie tylko powiedzieÄ Ci o polityce zwrotÃģw i jak jÄ zÅoÅžyÄ, ale takÅže obsÅuÅžyÄ caÅÄ transakcjÄ dla Ciebie.
Åwietnie â pod warunkiem, Åže agent nie ulega halucynacjom lotu ani nieobsÅuguje Twoich informacji finansowych. Albo niepoprawnie interpretuje politykÄ zwrotÃģw firmy i odmawia waÅžnych zwrotÃģw.
Nie jest trudno zobaczyÄ, jak obecne ryzyko bezpieczeÅstwa sztucznej inteligencji mogÅoby Åatwo eskalowaÄ z szeregiem agentÃģw sztucznej inteligencji, podejmujÄ cych decyzje i dziaÅajÄ cych, zwÅaszcza, Åže nie bÄdÄ dziaÅaÄ samotnie. WiÄkszoÅÄ prawdziwej wartoÅci agentywnych sztucznych inteligencji pochodzi z zespoÅÃģw agentÃģw, gdzie poszczegÃģlni agenci obsÅugujÄ czÄÅci zadaÅ i wspÃģÅpracujÄ â agent z agentem â aby wykonaÄ pracÄ.
WiÄc jak moÅžna przyjÄ Ä bezpieczeÅstwo sztucznej inteligencji przez projektowanie, nie hamujÄ c innowacji i nie niszczÄ c jej potencjalnej wartoÅci?
BezpieczeÅstwo przez Projektowanie w DziaÅaniu
Ad hoc kontroli bezpieczeÅstwa nie jest odpowiedziÄ . Ale integracja praktyk bezpieczeÅstwa w kaÅždej fazie wdroÅženia sztucznej inteligencji jest.
Zacznij od danych. Upewnij siÄ, Åže dane sÄ oznaczone, zaopatrzone w adnotacje, wolne od uprzedzeÅ i wysokiej jakoÅci. Jest to szczegÃģlnie prawdziwe w przypadku danych szkoleniowych.
Ucz swoje modele z ludzkÄ informacjÄ zwrotnÄ , poniewaÅž ludzka ocena jest niezbÄdna do ksztaÅtowania zachowania modelu. Techniki takie jak Nauka wzmocnienia z ludzkÄ informacjÄ zwrotnÄ (RLHF) i inne podobne techniki pozwalajÄ anotatorom oceniaÄ i kierowaÄ odpowiedziami, pomagajÄ c modelom jÄzykowym generowaÄ dane wyjÅciowe, ktÃģre sÄ bezpieczne i zgodne z ludzkimi wartoÅciami.
NastÄpnie, zanim wydasz model, przetestuj go. ZespoÅy czerwone, ktÃģre prÃģbujÄ sprowokowaÄ niebezpieczne zachowanie, uÅžywajÄ c przeciwnych poleceÅ, przypadkÃģw brzegowych i prÃģb ucieczki, mogÄ ujawniÄ sÅaboÅci. Naprawienie ich przed tym, jak dotrÄ do publicznoÅci, utrzymuje bezpieczeÅstwo przed wystÄ pieniem problemu.
Podczas gdy to testowanie zapewnia, Åže Twoje modele sztucznej inteligencji sÄ wytrzymaÅe, monitoruj je wraz z oczami na nowe zagroÅženia i dostosowania, ktÃģre mogÄ byÄ potrzebne do modeli.
W podobny sposÃģb regularnie monitoruj ÅšrÃģdÅa treÅci i interakcje cyfrowe w poszukiwaniu oznak oszustwa. Krytycznie, uÅžywaj hybrydowego podejÅcia sztucznej inteligencji i ludzi, pozwalajÄ c na automatyzacjÄ ogromnej iloÅci danych do monitorowania, a wykwalifikowani ludzie zajmujÄ siÄ przeglÄ dami w celu egzekwowania prawa i zapewnienia dokÅadnoÅci.
Stosowanie agentywnej sztucznej inteligencji wymaga jeszcze wiÄkszej starannoÅci. Podstawowe wymaganie: naucz agenta, aby znaÅ swoje ograniczenia. Gdy spotka niepewnoÅÄ, dylematy etyczne, nowe sytuacje lub szczegÃģlnie waÅžne decyzje, upewnij siÄ, Åže wie, jak poprosiÄ o pomoc.
Ponadto projektuj Ålady w Twoich agentach. Jest to szczegÃģlnie waÅžne, aby ich interakcje wystÄpowaÅy tylko z zweryfikowanymi uÅžytkownikami, aby uniknÄ Ä wpÅywu oszustÃģw na dziaÅania agenta.
JeÅli wydajÄ siÄ dziaÅaÄ skutecznie, moÅže byÄ kuszÄ ce, aby je wypuÅciÄ i pozwoliÄ im dziaÅaÄ. Nasze doÅwiadczenie mÃģwi, aby nadal monitorowaÄ ich i zadania, ktÃģre wykonujÄ , aby obserwowaÄ bÅÄdy lub nieoczekiwane zachowanie. UÅžywaj zarÃģwno automatycznych kontroli, jak i przeglÄ du ludzkiego.
W rzeczywistoÅci istotnym elementem bezpieczeÅstwa sztucznej inteligencji jest regularne zaangaÅžowanie ludzi. Ludzie powinni byÄ Åwiadomie zaangaÅžowani tam, gdzie krytyczna ocena, empatia lub nuance i dwuznacznoÅÄ sÄ zaangaÅžowane w decyzjÄ lub dziaÅanie.
Znowu, aby byÄ jasnym, sÄ to wszystkie praktyki, ktÃģre budujesz w wdroÅženiu sztucznej inteligencji z wyprzedzeniem, przez projektowanie. Nie sÄ one wynikiem czegoÅ, co poszÅo nie tak, a potem spieszymy siÄ, aby dowiedzieÄ siÄ, jak zminimalizowaÄ szkody.
Czy to dziaÅa?
StosowaliÅmy filozofiÄ âBezpieczeÅstwo Sztucznej Inteligencji Najpierwâ i ramy âprzez projektowanieâ u naszych klientÃģw w trakcie pojawienia siÄ GenAI i teraz na szybkiej ÅcieÅžce do agentywnej sztucznej inteligencji. Odkrywamy, Åže, wbrew obawom o to, Åže spowolni to postÄp, tak naprawdÄ pomaga przyspieszyÄ go.
Agentywna sztuczna inteligencja ma potencjaÅ, aby obniÅžyÄ koszty obsÅugi klienta o 25-50%, na przykÅad, podczas gdy zwiÄksza satysfakcjÄ klienta. Ale to wszystko zaleÅžy od zaufania.
Ludzie, ktÃģrzy uÅžywajÄ sztucznej inteligencji, muszÄ jej ufaÄ, a klienci, ktÃģrzy wchodzÄ w interakcjÄ z agentami ludzkimi wspomaganymi przez sztucznÄ inteligencjÄ lub z samymi agentami sztucznej inteligencji, nie mogÄ doÅwiadczyÄ jednej interakcji, ktÃģra podwaÅžyÅaby ich zaufanie. Jeden zÅy przeÅžycie moÅže zniszczyÄ zaufanie do marki.
Nie ufamy temu, co nie jest bezpieczne. WiÄc, gdy budujemy bezpieczeÅstwo w kaÅždej warstwie sztucznej inteligencji, ktÃģrÄ mamy zamiar wprowadziÄ, moÅžemy to zrobiÄ z zaufaniem. I gdy jesteÅmy gotowi jÄ skalowaÄ, moÅžemy to zrobiÄ szybko â z zaufaniem.
Pomimo Åže wprowadzenie bezpieczeÅstwa sztucznej inteligencji w praktykÄ moÅže wydawaÄ siÄ przytÅaczajÄ ce, nie jesteÅ sam. SÄ liczni eksperci, ktÃģrzy mogÄ pomÃģc, i partnerzy, ktÃģrzy mogÄ podzieliÄ siÄ tym, czego nauczyli siÄ i uczÄ , abyÅ mÃģgÅ skorzystaÄ z wartoÅci sztucznej inteligencji bezpiecznie, bez spowalniania.
Sztuczna inteligencja byÅa ekscytujÄ cÄ jazdÄ do tej pory, a gdy jazda przyspiesza, znajdujÄ jÄ ekscytujÄ cÄ . Ale jestem rÃģwnieÅž rad, Åže noszÄ kask.












