윤리
연구자들은 AI 모델이 사람들을 비윤리적인 결정을 내리도록 영향을 줄 수 있다고 발견했다

연구자 팀은 최근에 AI의 사람들을 부패시키고 비윤리적인 결정을 내리도록 영향을 줄 수 있는 잠재력을 조사했다. 연구자들은 OpenAI의 GPT-2 모델을 기반으로 하는 시스템과 상호 작용이 사람들을 비윤리적인 결정을 내리도록 영향을 줄 수 있는지 조사했다. 사람들은 AI 시스템에서 조언의 출처를 알고 있었음에도 불구하고.
AI 시스템은 점점 더 普遍해지고 있으며, 그들의 영향력은 점점 더 넓어지고 있다. AI 시스템은 사람들의 결정을影响하며, 영화를 추천하는 것부터 로맨틱한 파트너를 추천하는 것까지 모든 것에 사용되고 있다. AI가 사람들의 삶에 इतन大的 영향력을 미치고 있기 때문에, AI가 사람들을 비윤리적인 결정을 내리도록 영향을 줄 수 있는지 고려하는 것이 중요하다. 특히 AI 모델이 점점 더 발전하고 있기 때문에 더욱 중요하다.
사회 과학자와 데이터 과학자들은 점점 더 걱정하고 있다. AI 모델이 유해한 허위 정보와 잘못된 정보를 퍼뜨리는데 사용될 수 있다는 것이다. 최근에 발표된 논문에 따르면, OpenAI의 GPT-3 모델은 사람들을 급진화시키고, “폭력적인 극우 파벌주의와 행동”으로 이끄는 영향력 있는 텍스트를 생성할 수 있다.
맥스 플랑크 연구소, 암스테르담 대학교, 쾰른 대학교, 오토 베이셈 스쿨 오브 매니지먼트의 연구자 팀은 AI가 비윤리적인 선택에 대해 사람들의 결정에 얼마나 영향을 줄 수 있는지 알아보기 위해 연구를 진행했다. 연구자들은 OpenAI의 GPT-2 모델을 기반으로 하는 시스템을 사용하여 사람들을 “부패시키”는 방법을 조사했다. VentureBeat에 따르면, 논문의 저자들은 GPT2 기반 모델을dishonesty-促進과 honesty-促進 조언을 생성하도록 훈련시켰다. 데이터는 400명의 참가자로부터 수집되었으며, 이후 연구 팀은 1500명 이상의 사람들을 모집하여 조언-배포 AI 모델과 상호 작용하도록 했다.
연구 참가자들은 모델에서 조언을 받고 나서 특정 작업을 수행하도록 요청받았다. 이 작업은 부정직하거나 정직한 행동을 캡처하도록 설계되었다. 연구 참가자들은 파트너와 함께 그룹화되었으며, 이 그룹은 두 명의 참가자로 구성되었다. 첫 번째 참가자는 주사위를 굴리고 결과를 보고했다. 두 번째 참가자는 첫 번째 참가자의 주사위 결과를 받았으며, затем 자신이 주사위를 굴렸다. 두 번째 참가자는 주사위를 개인적으로 굴리고 자신의 결과를報告하는 것만으로 책임이 있었다. 이것은 두 번째 참가자가 주사위 결과에 대해 거짓말할 기회를 주었다. 두 참가자의 주사위 결과가 일치하면 두 참가자는 보상을 받았다. 또한 두 참가자의 주사위 결과가 높을수록 보상이 증가했다. 보고된 값이 일치하지 않으면 참가자들은 보상을 받지 못했다.
연구 참가자들은 무작위로 두 그룹 중 하나에 할당되었다. 한 그룹은 정직성-促進 조언을 읽을 기회를 가졌으며, 다른 그룹은 부정직성-促進 조언을 읽었다. 조언은 인간과 AI 모두에 의해 작성되었다. 참가자들은 또한 조언의 출처에 대한 지식 수준에 따라 분류되었다. 참가자들은 조언의 출처를 알고 있는지 여부에 대해 50%의 확률을 가졌다. 즉, 각 그룹의 참가자 중 절반은 조언의 출처가 AI 시스템인지 인간인지 알고 있었으며, 다른 절반은不知道했다. 두 번째 참가자 그룹은 조언의 출처를 올바르게 추측한 경우 보너스 보상을 받을 수 있었다.
연구 결과에 따르면, AI 생성 조언이 사람의 선호도와 일치할 때, 사람들은 조언을 따를 것이라고 한다. 연구자들은 사람이 AI 시스템에서 조언을 받았음에도 불구하고 조언을 따를 것이라고 말했다. 연구자들은 또한 사람들이 자신의 선호도와 실제 행동 사이에 불일치가 종종 존재한다고 말했다. 이것은 알고리즘이 인간의 행동에 미치는 영향을 고려하는 것이 중요하다는 것을 의미한다.
연구 팀은 연구가 AI 모델을 윤리적으로 배치하는 방법을 고려할 때, AI가 사람들의 행동에 미치는 영향을 테스트하는 필요성을 보여준다고 말했다. 또한 연구자들은 AI 윤리학자와 연구자들이 AI가 다른 사람들을 부패시키는 데 사용될 가능성을 준비해야 한다고警告했다. 연구자들은 다음과 같이 말했다.
“AI는 사람들을 더 윤리적으로 행동하도록 설득할 수 있는 力がある다면, 그것은 좋은 力이 될 수 있다. 그러나 우리의 결과는 AI 조언이 정직성을 증가시키지 않는다는 것을 보여준다. AI 조언자는 사람들의 비윤리적인 행동의 도덕적인 책임을 전가할 수 있는 대리인으로 작용할 수 있다. 또한 … 조언을 받는 상황에서, 알고리즘의 존재에 대한 투명성은 잠재적인 피해를 완화하기에 충분하지 않다.”












