Đạo đức

Các nhà nghiên cứu phát hiện ra rằng các mô hình AI có thể ảnh hưởng đến việc con người đưa ra quyết định không đạo đức

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Một nhóm các nhà nghiên cứu gần đây đã điều tra khả năng của AI trong việc làm hỏng con người và ảnh hưởng đến việc đưa ra quyết định không đạo đức. Các nhà nghiên cứu đã điều tra cách thức tương tác với các hệ thống dựa trên mô hình GPT-2 của OpenAI có thể ảnh hưởng đến việc con người đưa ra quyết định không đạo đức, ngay cả khi họ biết rằng nguồn gốc của lời khuyên là một hệ thống AI.

Các hệ thống AI đang trở nên phổ biến hơn bao giờ hết, và ảnh hưởng của chúng ngày càng rộng. Các hệ thống AI ảnh hưởng đến quyết định của con người, từ việc đề xuất phim đến việc đề xuất bạn đời. Vì vậy, điều quan trọng là phải xem xét cách AI có thể ảnh hưởng đến việc con người đưa ra quyết định không đạo đức và vi phạm các nguyên tắc đạo đức. Điều này đặc biệt quan trọng khi các mô hình AI ngày càng trở nên tinh vi.

Các nhà khoa học xã hội và nhà khoa học dữ liệu ngày càng lo ngại rằng các mô hình AI có thể được sử dụng để lan truyền thông tin sai lệch và thông tin giả mạo. Một bài báo gần đây được công bố bởi các nhà nghiên cứu từ Trung tâm Nghiên cứu Quốc tế về Khủng bố, Hỗn loạn và Chống khủng bố (CTEC) của Viện Nghiên cứu Quốc tế Middlebury cho thấy rằng mô hình GPT-3 của OpenAI có thể được sử dụng để tạo ra văn bản có ảnh hưởng, có khả năng cực đoan hóa người dân, đẩy họ đến “các ý thức hệ và hành vi cực đoan, bạo lực”.

Một nghiên cứu được thực hiện bởi một nhóm các nhà nghiên cứu từ Viện Max Planck, Đại học Amsterdam, Đại học Cologne và Trường Quản lý Otto Beisheim đã nhằm mục đích xác định mức độ ảnh hưởng của AI đối với quyết định của con người khi đưa ra lựa chọn không đạo đức. Để khám phá cách một AI có thể “làm hỏng” một người, các nhà nghiên cứu đã sử dụng một hệ thống dựa trên mô hình GPT-2 của OpenAI. Theo VentureBeat, các tác giả của bài báo đã đào tạo một mô hình dựa trên GPT2 để tạo ra cả “lời khuyên thúc đẩy gian dối” và “lời khuyên thúc đẩy trung thực”. Dữ liệu được đào tạo trên các đóng góp từ 400 người tham gia khác nhau, và sau đó, nhóm nghiên cứu đã tuyển dụng hơn 1500 người để tương tác với các mô hình AI cung cấp lời khuyên.

Các tham gia nghiên cứu được yêu cầu nhận lời khuyên từ mô hình và sau đó thực hiện một nhiệm vụ được thiết kế để bắt giữ hành vi không trung thực hoặc trung thực. Các tham gia nghiên cứu được chia thành các cặp, và trong các cặp này, họ chơi một trò chơi xúc xắc. Người tham gia đầu tiên xúc xắc và báo cáo kết quả của xúc xắc. Người tham gia thứ hai được đưa ra kết quả của xúc xắc của người tham gia đầu tiên, và sau đó họ xúc xắc lại. Người tham gia thứ hai xúc xắc một mình và chỉ chịu trách nhiệm báo cáo kết quả của mình, cho họ cơ hội để nói dối về kết quả của xúc xắc. Nếu các xúc xắc của cả hai người tham gia trùng khớp, cả hai người tham gia sẽ được trả tiền. Các tham gia cũng được trả tiền nhiều hơn nếu các kết quả trùng khớp của họ cao hơn. Nếu các giá trị báo cáo không khớp, các chủ đề sẽ không được trả tiền.

Các tham gia nghiên cứu được chia ngẫu nhiên vào một trong hai nhóm khác nhau. Một nhóm có cơ hội đọc lời khuyên thúc đẩy trung thực, trong khi nhóm kia đọc lời khuyên thúc đẩy gian dối. Các đoạn lời khuyên được viết bởi cả con người và AI. Các tham gia cũng được chia theo mức độ kiến thức về nguồn gốc của lời khuyên. Có 50% cơ hội mà một người tham gia nhất định sẽ được thông báo về nguồn gốc của lời khuyên, vì vậy một nửa số tham gia trong mỗi nhóm biết rằng nguồn gốc của lời khuyên là một hệ thống AI hoặc con người, trong khi nửa còn lại không được thông báo. Nhóm thứ hai của người tham gia có khả năng kiếm tiền thưởng cho việc đoán đúng nguồn gốc của lời khuyên.

Nghiên cứu cho thấy rằng khi lời khuyên được tạo ra bởi AI phù hợp với sở thích của một người, họ sẽ tuân theo lời khuyên, ngay cả khi họ biết rằng lời khuyên được tạo ra bởi một hệ thống AI. Theo các nhà nghiên cứu, thường có sự không phù hợp giữa sở thích được tuyên bố và hành vi thực tế, làm cho nó quan trọng để xem xét cách các thuật toán có thể ảnh hưởng đến hành vi của con người.

Đội ngũ nghiên cứu giải thích rằng nghiên cứu của họ chứng minh sự cần thiết phải kiểm tra cách một AI có thể ảnh hưởng đến hành động của một người khi xem xét cách triển khai mô hình AI một cách đạo đức. Hơn nữa, họ cảnh báo rằng các nhà đạo đức AI và nhà nghiên cứu nên chuẩn bị cho khả năng AI có thể được sử dụng bởi những người có hành vi xấu để làm hỏng người khác. Như nhóm nghiên cứu đã viết:

“AI có thể là một lực lượng tốt nếu nó thuyết phục người dân hành động một cách đạo đức hơn. Tuy nhiên, kết quả của chúng tôi cho thấy rằng lời khuyên của AI không làm tăng sự trung thực. Các cố vấn AI có thể đóng vai trò là những người bị đổ lỗi, mà một người có thể chuyển hướng (một số) trách nhiệm đạo đức của sự không trung thực. Hơn nữa … trong bối cảnh việc đưa ra lời khuyên, sự minh bạch về sự hiện diện của thuật toán không đủ để giảm bớt tác hại tiềm ẩn của nó.”

Blogger và lập trình viên với chuyên môn về Machine Learning Deep Learning topics. Daniel hy vọng giúp đỡ người khác sử dụng sức mạnh của AI cho lợi ích xã hội.