Ηθική

Ερευνητές Βρίσκουν Ότι Τα Μοντέλα AI Μπορούν Να Επηρεάσουν τους Ανθρώπους Να Λαμβάνουν Ανηθικές Αποφάσεις

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Μια ομάδα ερευνητών έχει最近 ερευνήσει την πιθανότητα της διόρθωσης του AI και την επίδρασή του στους ανθρώπους να λαμβάνουν ανηθικές αποφάσεις. Οι ερευνητές ερεύνησαν πώς οι αλληλεπιδράσεις με συστήματα που βασίζονται στο μοντέλο GPT-2 της OpenAI θα μπορούσαν να επηρεάσουν τους ανθρώπους να λαμβάνουν ανηθικές αποφάσεις, ακόμη και όταν είναι ενήμεροι ότι η πηγή της συμβουλής ήταν ένα σύστημα AI.

Τα συστήματα AI γίνονται ολοένα και πιο πανταχού παρούσα, και η επίδρασή τους αυξάνεται συνεχώς. Τα συστήματα AI επηρεάζουν τις αποφάσεις των ανθρώπων, χρησιμοποιούνται για όλα, από τη σύσταση ταινιών μέχρι τη σύσταση ρομαντικών συντρόφων. Λαμβάνοντας υπόψη πόσο μεγάλη είναι η επίδραση του AI στις ζωές των ανθρώπων, είναι σημαντικό να εξεταστεί πώς το AI μπορεί να επηρεάσει τους ανθρώπους να λαμβάνουν ανηθικές αποφάσεις και να παραβιάζουν ηθικές οδηγίες. Αυτό είναι ιδιαίτερα σημαντικό, δεδομένου ότι τα μοντέλα AI γίνονται ολοένα και πιο εξελιγμένα.

Κοινωνικοί επιστήμονες και επιστήμονες δεδομένων έχουν γίνει ολοένα και πιο ανήσυχοι ότι τα μοντέλα AI θα μπορούσαν να χρησιμοποιηθούν για τη διάδοση βλαβερών ψευδών πληροφοριών και παραπληροφοριών. Một πρόσφατο έγγραφο που δημοσιεύθηκε από ερευνητές του Ινστιτούτου Διεθνών Σπουδών του Middlebury, του Κέντρου για την Τρομοκρατία, τον Εκτροχισμό και την Αντι-τρομοκρατία (CTEC), βρήκε ότι το μοντέλο GPT-3 της OpenAI θα μπορούσε να χρησιμοποιηθεί για τη δημιουργία επηρεστικών κειμένων που θα μπορούσαν να ραδικαλίσουν τους ανθρώπους, ωθώντας τους προς “βίαιες ακροδεξιές εξτρεμιστικές ιδεολογίες και συμπεριφορές”.

Μια μελέτη που πραγματοποιήθηκε από μια ομάδα ερευνητών από το Ινστιτούτο Max Planck, το Πανεπιστήμιο του Άμστερνταμ, το Πανεπιστήμιο του Κολωνίας και τη Σχολή Διοίκησης Otto Beisheim, αποσκοπούσε να καθορίσει πόσο μεγάλη είναι η επίδραση του AI στις αποφάσεις των ανθρώπων όταν πρόκειται για ανηθικές επιλογές. Για να εξεταστεί πώς ένα AI θα μπορούσε να “διορθώσει” έναν άνθρωπο, οι ερευνητές χρησιμοποίησαν ένα σύστημα που βασίζεται στο μοντέλο GPT-2 της OpenAI. Σύμφωνα με το VentureBeat, οι συγγραφείς του εγγράφου εκπαίδευσαν ένα μοντέλο GPT2 για να δημιουργήσει και “απαράδεκτη” και “αξιοσέβαστη” συμβουλή. Τα δεδομένα εκπαιδεύτηκαν με συνεισφορές από 400 διαφορετικά άτομα, και στη συνέχεια, η ερευνητική ομάδα προσέλαβε πάνω από 1500 άτομα για να αλληλεπιδράσουν με τα μοντέλα AI που παρείχαν συμβουλή.

Οι συμμετέχοντες στη μελέτη ζητήθηκαν να λαμβάνουν συμβουλή από το μοντέλο και στη συνέχεια να εκτελέσουν μια εργασία που σχεδιάστηκε για να καταγράψει είτε αδιάφανο είτε ειλικρινή συμπεριφορά. Οι συμμετέχοντες στη μελέτη χωρίστηκαν σε ζευγάρια, και σε αυτά τα ζευγάρια, έπαιξαν ένα παιχνίδι με ζάρι. Ο πρώτος συμμετέχων έριξε το ζάρι και ανέφερε το αποτέλεσμα. Ο δεύτερος συμμετέχων έλαβε το αποτέλεσμα του πρώτου συμμετέχοντα και στη συνέχεια έριξε το ζάρι ο ίδιος. Ο δεύτερος συμμετέχων έριξε το ζάρι σε ιδιωτικό χώρο και ήταν αποκλειστικά υπεύθυνος για την αναφορά του δικού του αποτελέσματος, δίνοντάς του την ευκαιρία να ψέψει για το αποτέλεσμα του ζαριού. Αν τα ζάρια που έριξαν και οι δύο συμμετέχοντες ταίριαζαν, οι δύο συμμετέχοντες πληρώθηκαν. Οι συμμετέχοντες πληρώθηκαν επίσης περισσότερο αν τα ταίριασμα των ζαριών ήταν υψηλότερο. Αν οι αναφερόμενες τιμές δεν ταίριαζαν, οι συμμετέχοντες δεν πληρώθηκαν.

Οι συμμετέχοντες στη μελέτη χωρίστηκαν τυχαία σε δύο διαφορετικές ομάδες. Η μια ομάδα είχε την ευκαιρία να διαβάσει συμβουλή που προάγει την ειλικρίνεια, ενώ η άλλη ομάδα διάβασε συμβουλή που προάγει την αδιαφάνεια. Τα αποσπάσματα της συμβουλής γραφτήκαν από ανθρώπους και AI. Οι συμμετέχοντες χωρίστηκαν επίσης ανάλογα με το επίπεδο γνώσης τους για την πηγή της συμβουλής. Υπήρχε μια πιθανότητα 50-50 που ένας δεδομένος συμμετέχων θα ενημερωθεί για την πηγή της συμβουλής, οπότε το ήμισυ των συμμετεχόντων σε κάθε ομάδα γνώριζε ότι η πηγή της συμβουλής ήταν είτε ένα AI είτε ένας άνθρωπος, ενώ το άλλο μισό δεν ενημερώθηκε. Η δεύτερη ομάδα ανθρώπων είχε τη δυνατότητα να κερδίσει επιπλέον αμοιβή για τη σωστή εκτίμηση της πηγή της συμβουλής.

Η έρευνα αποκάλυψε ότι όταν η συμβουλή που παράγεται από το AI συμφωνεί με τις προτιμήσεις ενός ατόμου, θα ακολουθήσει τη συμβουλή, ακόμη και όταν γνωρίζει ότι η συμβουλή παράγεται από ένα σύστημα AI. Σύμφωνα με τους ερευνητές, υπήρχαν συχνά διακυμάνσεις μεταξύ των δηλωμένων προτιμήσεων και της πραγματικής συμπεριφοράς, καθιστώντας σημαντικό να εξεταστεί πώς οι αλγόριθμοι μπορούν να επηρεάσουν τις ανθρώπινες συμπεριφορές.

Η ερευνητική ομάδα εξήγησε ότι η μελέτη τους δείχνει την ανάγκη να δοκιμαστεί πώς ένα AI μπορεί να επηρεάσει τις ενέργειες ενός ατόμου όταν εξετάζεται πώς να αναπτύξει ηθικά ένα μοντέλο AI. Επιπλέον, προειδοποιούν ότι οι ηθικοί του AI και οι ερευνητές πρέπει να προετοιμαστούν για την πιθανότητα ότι το AI θα μπορούσε να χρησιμοποιηθεί από κακόβουλους για να διορθώσει άλλους. Όπως έγραψαν οι ερευνητές:

“Το AI θα μπορούσε να είναι eine δύναμη για το καλό αν καταφέρει να πείσει τους ανθρώπους να ενεργούν πιο ηθικά. Ωστόσο, τα αποτελέσματά μας αποκαλύπτουν ότι η συμβουλή του AI αποτυγχάνει να αυξήσει την ειλικρίνεια. Οι σύμβουλοι AI μπορούν να χρησιμεύσουν ως στόχοι στους οποίους μπορεί να απομακρύνει (μερικά από) την ηθική ευθύνη της αδιαφάνειας. Επιπλέον … στο контέκστ της λήψης συμβουλής, η διαφάνεια σχετικά με την παρουσία αλγορίθμων δεν επαρκεί για να ανακουφίσει την πιθανή ζημία.”

Blogger και προγραμματιστής με ειδικότητες στα Machine Learning και Deep Learning θέματα. Ο Daniel ελπίζει να βοηθήσει τους άλλους να χρησιμοποιήσουν τη δύναμη του AI για κοινωνικό καλό.