Etik

Araştırmacılar AI Modellerinin İnsanları Etik Dışı Kararlara Yönlendirebileceğini Buldu

mm
Unite.AI sitesini Google'daki tercih ettiğiniz kaynaklara ekleyin

Araştırmacılar recently insanları bozmak için AI’nin potansiyelini ve etik dışı kararlar almalarına yol açabilecek şekilde etkileyebileceğini araştırdı. Araştırmacılar, OpenAI’nin GPT-2 modeline dayalı sistemlerle etkileşimlerin, insanların etik dışı kararlar almalarına yol açabileceğini, hatta insanların tavsiye kaynağının bir AI sistemi olduğunu bilmesine rağmen, araştırıyorlar.

AI sistemleri her zaman daha yaygın hale geliyor ve etkileri giderek genişliyor. AI sistemleri insanların kararlarını etkiliyor, film önerilerinden romantik partner önerilerine kadar her şey için kullanılıyor. AI’nin insanların hayatlarındaki etkisinin bu kadar büyük olması nedeniyle, AI’nin insanların etik dışı kararlar almalarına yol açabileceği şekilde nasıl etkileyebileceğini düşünmek önemlidir. Özellikle AI modelleri sürekli olarak daha da gelişiyor.

Sosyal bilimciler ve veri bilimcileri, AI modellerinin zararlı yanlış bilgiler ve yanlış bilgiler yaymak için kullanılabileceğinden giderek daha fazla endişe duymaktadır. Recent bir makale tarafından Middlebury Institute of International Studies’in Center on Terrorism, Extremism, and Counterterrorism (CTEC) araştırmacıları tarafından yayınlandı, OpenAI’nin GPT-3 modelinin, insanların “şiddetli sağcı aşırılıkçı ideolojiler ve davranışlar”ına yönlendirebilecek etkili metinler oluşturmak için kullanılabileceğini buldu.

Max Planck Enstitüsü, Amsterdam Üniversitesi, Köln Üniversitesi ve Otto Beisheim School of Management’tan bir araştırma ekibi, bir AI’nin insanların etik dışı seçimlerde kararlarını nasıl etkileyebileceğini belirlemek için bir çalışma yaptı. Araştırmacılar, bir kişiyi nasıl “bozabileceğini” keşfetmek için OpenAI’nin GPT-2 modeline dayalı bir sistem kullandılar. VentureBeat’e göre, makalenin yazarları, GPT2 tabanlı bir modeli, hem “dolandırıcılık teşvik eden” hem de “dürüstlük teşvik eden” tavsiyeler oluşturmak için eğitti. Veriler, 400 farklı katılımcıdan katkılarla eğitildi ve sonrasında araştırma ekibi, 1500’den fazla insanı, tavsiye veren AI modelleriyle etkileşime girmeye davet etti.

Çalışma katılımcıları, modelden tavsiye almak ve ardından dürüst veya hileli davranışları yakalamak için tasarlanmış bir görevi gerçekleştirmeye davet edildi. Çalışma katılımcıları, bir partnerle birlikte gruplandırıldı ve bu çiftler, bir zar atma oyunu oynadı. İlk katılımcı bir zar attı ve sonucunu bildirdi. İkinci katılımcı, ilk katılımcının zar atma sonucunu aldı ve sonra kendisi bir zar attı. İkinci katılımcı, zarı gizlice attı ve yalnızca kendi sonucunu bildirmekten sorumluydu, bu da zar atma sonucunu yanlış bildirmesine olanak tanıdı. İki katılımcı da zarları eşleşirse, iki katılımcıya da ödeme yapıldı. Katılımcılar ayrıca, eşleşen zarlar daha yüksekse, daha fazla ödeme aldılar. Bildirilen değerler eşleşmezse, konulara ödeme yapılmadı.

Çalışma katılımcıları, iki farklı gruptan birine rastgele atandı. Bir grup, dürüstlük teşvik eden tavsiyeleri okumaya opportunity etti, diğer grup ise hileli davranış teşvik eden tavsiyeleri okudu. Tavsiye parçaları, hem insanlar hem de AI’lar tarafından yazıldı. Katılımcılar ayrıca, tavsiyenin kaynağındaki bilgi düzeylerine göre bölündü. Bir katılımcının, tavsiyenin kaynağını bilme olasılığı %50’ydi, bu nedenle her gruptaki katılımcıların yarısı, tavsiyenin kaynağının bir AI veya insan olduğunu biliyordu, diğer yarısı ise bilmiyordu. İkinci grup insanlara, tavsiyenin kaynağını doğru bir şekilde tahmin etmek için bonus ödeme kazandırma fırsatı verildi.

Araştırma, AI tarafından oluşturulan tavsiyenin bir kişinin tercihleriyle uyumlu olduğunda, insanların bu tavsiyeyi takip edeceğini, hatta tavsiyenin bir AI sistemi tarafından oluşturulduğunu bilmesine rağmen, gösterdi. Araştırmacılara göre, thường olarak, beyan edilen tercihler ve gerçek davranışlar arasında tutarsızlıklar vardı, bu da algoritmaların insan davranışlarını nasıl etkileyebileceğini düşünmenin önemini vurguladı.

Araştırmacı ekip, çalışmanın, bir AI modelini etik bir şekilde dağıtmak için nasıl dağıtılacağını düşünürken, bir AI’nin bir kişinin eylemlerini nasıl etkileyebileceğini test etme ihtiyacını gösterdiğini açıkladı. Ayrıca, AI etikçileri ve araştırmacıların, AI’nin kötü niyetli kişiler tarafından başkalarını bozmak için kullanılabileceği olasılığına hazırlanmaları gerektiğini uyardılar. Araştırmacı ekip şöyle yazdı:

“AI, insanları daha etik davranmaya ikna edebilirse, iyi bir güç olabilir. Ancak sonuçlarımız, AI tavsiyesinin dürüstlüğü artırmaya başarısız olduğunu gösteriyor. AI danışmanları, insanlara dürüstlükten kaynaklanan ahlaki sorumluluğu kısmen yönlendirebilecek suç ortakları olabilir. Ayrıca, tavsiye alma bağlamında, algoritmik varlığın şeffaflığı, potansiyel zararını hafifletmeye yetmez.”

Blog yazarı ve programcı, Machine Learning ve Deep Learning konularında uzmanlık sahibi. Daniel, başkalarının AI'nin gücünü sosyal fayda için kullanmasına yardımcı olmak umudu taşıyor.