Etyka
Zespół badaczy odkrywa, że modele AI mogą wpływać na ludzi, aby podejmowali nieetyczne decyzje

Zespół badaczy niedawno zajął się potencjałem AI do korumpowania ludzi i wpływania na nich, aby podejmowali nieetyczne decyzje. Badacze zbadali, w jaki sposób interakcje z systemami opartymi na modelu GPT-2 firmy OpenAI mogą potencjalnie wpływać na ludzi, aby podejmowali nieetyczne decyzje, nawet gdy są świadomi, że źródłem porady jest system AI.
Systemy AI stają się coraz bardziej wszechobecne, a ich wpływ rozciąga się coraz szerzej. Systemy AI wpływają na decyzje ludzi, są wykorzystywane do wszystkiego, od rekomendowania filmów po rekomendowanie partnerów romantycznych. Biorąc pod uwagę, jak duży wpływ ma AI na życie ludzi, ważne jest, aby rozważyć, w jaki sposób AI może wpływać na ludzi, aby podejmowali nieetyczne decyzje i łamać wytyczne moralne. Jest to szczególnie ważne, biorąc pod uwagę, że modele AI są coraz bardziej zaawansowane.
Naukowcy społeczni i data scientists coraz bardziej martwią się, że modele AI mogą być wykorzystywane do rozpowszechniania szkodliwych dezinformacji i fałszywych informacji. Niedawny artykuł opublikowany przez badaczy z Middlebury Institute of International Studies’ Center on Terrorism, Extremism, and Counterterrorism (CTEC) wykazał, że model GPT-3 firmy OpenAI może być wykorzystany do generowania wpływowych tekstów, które mogą radykalizować ludzi i skłaniać ich do „agresywnych ekstremistycznych ideologii i zachowań skrajnej prawicy”.
Badanie przeprowadzone przez zespół badaczy z Max Planck Institute, Uniwersytetu w Amsterdamie, Uniwersytetu w Kolonii i Otto Beisheim School of Management miało na celu ustalenie, jaki wpływ może mieć AI na decyzje ludzi w przypadku nieetycznych wyborów. Aby zbadać, w jaki sposób AI może „skorumpować” osobę, badacze wykorzystali system oparty na modelu GPT-2 firmy OpenAI. Według VentureBeat, autorzy artykułu przeszkolili model GPT2, aby generował zarówno „promujące nieuczciwość”, jak i „promujące uczciwość” porady. Dane zostały przeszkolone na podstawie wkładu 400 różnych uczestników, a następnie zespół badawczy rekrutował ponad 1500 osób, które wzięły udział w interakcji z modelami AI.
Uczestnicy badania zostali poproszeni o otrzymanie porady od modelu, a następnie wykonanie zadania, które miało na celu uchwycenie albo nieuczciwego, albo uczciwego zachowania. Uczestnicy badania zostali podzieleni na pary, a w tych parach dwóch osób grały w grę z udziałem kości. Pierwsza osoba rzuciła kość i zgłosiła wynik. Druga osoba otrzymała wynik rzutu pierwszej osoby, a następnie sama rzuciła kość. Druga osoba rzuciła kość w prywatnym trybie i była odpowiedzialna za zgłoszenie wyniku swojego rzutu, co dawało jej możliwość kłamania o wyniku rzutu. Jeśli wyniki rzutów obu osób się zgadzały, obie osoby otrzymywały wynagrodzenie. Uczestnicy otrzymywali również wyższe wynagrodzenie, jeśli ich wyniki rzutów były wyższe. Jeśli zgłoszone wyniki nie zgadzały się, uczestnicy nie otrzymywali wynagrodzenia.
Uczestnicy badania zostali losowo przydzielony do jednej z dwóch grup. Jedna grupa otrzymała możliwość przeczytania porady promującej uczciwość, podczas gdy druga grupa otrzymała poradę promującą nieuczciwość. Porady zostały napisane przez ludzi i AI. Uczestnicy zostali również podzieleni według poziomu wiedzy o źródle porady. Była 50-procentowa szansa, że dana osoba zostanie poinformowana o źródle porady, więc połowa uczestników w każdej grupie wiedziała, że źródłem porady był system AI lub człowiek, podczas gdy druga połowa nie wiedziała. Druga grupa osób miała możliwość otrzymania dodatkowego wynagrodzenia za poprawne odgadnięcie źródła porady.
Badanie ujawniło, że gdy porada generowana przez AI jest zgodna z preferencjami osoby, osoba ta będzie postępować zgodnie z tą poradą, nawet gdy wie, że porada została wygenerowana przez system AI. Zgodnie z oświadczeniem badaczy, często występowały rozbieżności między deklarowanymi preferencjami a rzeczywistym zachowaniem, co sprawia, że ważne jest, aby rozważyć, w jaki sposób algorytmy mogą wpływać na zachowania ludzi.
Zespół badawczy wyjaśnił, że ich badanie pokazuje potrzebę testowania, w jaki sposób AI może wpływać na działania ludzi, gdy rozważa się, w jaki sposób wdrożyć model AI w sposób etyczny. Ponadto ostrzegają, że etycy AI i badacze powinni przygotować się na możliwość, że AI może być wykorzystywane przez złe podmioty do korumpowania innych. Jak zespół badawczy napisał:
„AI może być siłą dobra, jeśli uda mu się przekonać ludzi do postępowania w sposób bardziej etyczny. Jednak nasze wyniki ujawniają, że porada AI nie zwiększa uczciwości. Doradcy AI mogą służyć jako kozły ofiarne, którym można przypisać (część) winy moralnej za nieuczciwość. Co więcej … w kontekście przyjmowania porady, przejrzystość co do obecności algorytmicznej nie wystarcza, aby złagodzić potencjalne szkody”.












