Etika

Vědci zjistili, že modely AI mohou ovlivnit lidi, aby činili neetické rozhodnutí

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Tým výzkumníků nedávno prozkoumal potenciál AI korumpovat lidi a ovlivňovat je, aby činili neetické rozhodnutí. Výzkumníci zkoumali, jak interakce se systémy založenými na modelu OpenAI GPT-2 mohou potenciálně ovlivnit lidi, aby činili neetické rozhodnutí, i když jsou si vědomi, že zdroj rady je systém AI.

Systémy AI se stávají stále více všudypřítomnými a jejich vliv se rozšiřuje. Systémy AI ovlivňují rozhodnutí lidí, jsou používány pro všechno od doporučení filmů po doporučení romantických partnerů. Vzhledem k tomu, jak velký vliv má AI na životy lidí, je důležité zvážit, jak AI může ovlivnit lidi, aby činili neetické rozhodnutí a porušovali morální směrnice. To je尤álně důležité vzhledem k tomu, že modely AI jsou neustále sofistikovanější.

Sociální vědci a datoví vědci se stali stále více znepokojení, že modely AI mohou být použity k šíření škodlivé dezinformace a misinformation. Nedávná studie publikovaná výzkumníky z Middlebury Institute of International Studies’ Center on Terrorism, Extremism, and Counterterrorism (CTEC) zjistila, že model OpenAI GPT-3 může být použit k generování vlivného textu, který může radikalizovat lidi a tlačit je směrem k „násilnému extrémnímu pravicovému extremismu a chování“.

Studie provedená týmem výzkumníků z Max Planck Institute, University of Amsterdam, University of Cologne a Otto Beisheim School of Management se snažila určit, jak velký vliv může mít AI na rozhodnutí lidí, pokud jde o neetické volby. Za účelem prozkoumání, jak AI může „korumpovat“ člověka, výzkumníci použili systém založený na modelu OpenAI GPT-2. Podle VentureBeat, autoři studie trénovali model GPT2, aby generoval rady, které podporují „nečestnost“ i „čestnost“. Data byla trénována na základě příspěvků od 400 různých účastníků a poté výzkumný tým najal více než 1500 lidí, aby interagovali s modely AI, které poskytují rady.

Účastníci studie byli požádáni, aby přijali rady od modelu a poté provedli úkoly, které byly navrženy tak, aby zachytili buď nečestné nebo čestné chování. Účastníci studie byli rozděleni do párů a v těchto párech hráli hru s házením kostky. První účastník hodil kostkou a oznámil výsledek. Druhý účastník dostal výsledek prvního účastníka a poté sám hodil kostkou. Druhý účastník házel kostkou v soukromí a byl sám odpovědný za ohlášení svého vlastního výsledku, což mu dávalo příležitost lhát o výsledku hodu kostkou. Pokud se výsledky hodů obou účastníků shodovaly, oba účastníci byli placeni. Účastníci byli také placeni více, pokud jejich shodné výsledky byly vyšší. Pokud ohlášené hodnoty neodpovídaly, subjekty nebyly placeny.

Účastníci studie byli náhodně rozděleni do dvou různých skupin. Jedna skupina dostala příležitost přečíst si rady, které podporují čestnost, zatímco druhá skupina četla rady, které podporují nečestnost. Rady byly psány jak lidmi, tak AI. Účastníci byli také rozděleni podle úrovně znalostí o zdroji rady. Bylo 50% šance, že účastník bude informován o zdroji rady, takže polovina účastníků v každé skupině věděla, zda zdroj rady byl AI nebo člověk, zatímco druhá polovina nebyla informována. Druhá skupina lidí měla možnost získat bonusové platby za správné uhádnutí zdroje rady.

Výzkum ukázal, že když rady generované AI souhlasí s preferencemi člověka, člověk bude následovat rady, i když ví, že rada byla generována systémem AI. Podle výzkumníků často existovaly nesrovnalosti mezi deklarovanými preferencemi a skutečným chováním, což činí důležité zvážit, jak algoritmy mohou ovlivňovat lidské chování.

Výzkumný tým vysvětlil, že jejich studie demonstruje potřebu testovat, jak AI může ovlivnit jednání člověka, pokud jde o etické nasazení modelu AI. Kromě toho varují, že etici AI a výzkumníci by se měli připravit na možnost, že AI může být použito špatnými aktéry, aby korumpovali ostatní. Jak napsal výzkumný tým:

„AI může být silou dobra, pokud se mu podaří přesvědčit lidi, aby jednali etičtěji. Nicméně naše výsledky ukazují, že rady AI nezvyšují čestnost. Poradci AI mohou sloužit jako obětní beránci, na které lze přenést (některou z) morální viny nečestnosti. Navíc … v kontextu přijímání rady, transparentnost o algoritmické přítomnosti nestačí k zmírnění jejího potenciálního poškození.”

Blogger a programátor se specializací na Machine Learning a Deep Learning témata. Daniel doufá, že pomůže ostatním využít sílu AI pro sociální dobro.