Μοντέλα και πλατφόρμες AI

Δεν Εστιάζουμε Πια τους Αλγορίθμους. Εστιάζουμε τις Πολιτισμικές Παρέμβασεις

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Για πολλά χρόνια, η κύρια ερώτηση στην τεχνητή νοημοσύνη (AI) ήταν πώς να ευθυγραμμισθούν οι αλγόριθμοι AI με τις ανθρώπινες αξίες. Οι ερευνητές προσπάθησαν να ορίσουν κανόνες ασφάλειας, ηθικές αρχές και μηχανισμούς ελέγχου που καθοδηγούν τις αποφάσεις της AI. Αυτό το έργο πέτυχε σημαντική πρόοδο. Nhưng τώρα, καθώς αυτά τα συστήματα AI γίνονται πιο ικανά και διαδεδομένα, ο στόχος της ευθυγράμμισης αρχίζει να αλλάζει. Αυτό που ξεκίνησε ως η πρόκληση της ευθυγράμμισης ενός μοντέλου με ένα σύνολο οδηγιών έχει γίνει η πολύ μεγαλύτερη πρόκληση της ευθυγράμμισης ολόκληρων πολιτισμών που χρησιμοποιούν αυτά τα συστήματα σε παγκόσμια κλίμακα. Η AI δεν είναι πλέον μόνο ένα εργαλείο. Εξελίσσεται σε ένα περιβάλλον όπου οι κοινωνίες εργάζονται, επικοινωνούν, διαπραγματεύονται και ανταγωνίζονται. Ως αποτέλεσμα, η ευθυγράμμισης δεν παραμένει πλέον ένα τεχνικό πρόβλημα. Έχει γίνει ένα πολιτιστικό πρόβλημα. Σε αυτό το άρθρο, εξηγώ γιατί η ευθυγράμμισης δεν είναι πλέον μόνο για τα μοντέλα και γιατί πρέπει να αρχίσουμε να σκεφτόμαστε σε όρους πολιτισμών αντί για μηχανές. Συζητώ επίσης πώς αυτή η αλλαγή επηρεάζει τις ευθύνες μας και τι σημαίνει για τη διεθνή συνεργασία.

Ποιοί Αξίες Αντιπροσωπεύει πραγματικά η AI;

Αν ρωτήσετε μια AI για μια ευαίσθητη ιστορική घटनία, η απάντησή της εξαρτάται από τα δεδομένα που μελέτησε. Αν αυτά τα δεδομένα προέρχονται κυρίως από το Δυτικό διαδίκτυο, η απάντηση θα έχει μια δυτική προκατάληψη. Θα προτεραιοποιήσει τον ατομικισμό, την ανοιχτή ομιλία και τα δημοκρατικά ιδανικά. Αυτές είναι καλές αξίες για πολλούς ανθρώπους. Nhưng δεν είναι οι μόνοι αξίες στον κόσμο.

Ένας χρήστης στη Σιγκαπούρη, ένας χρήστης στη Ριάντ και ένας χρήστης στο Σαν Φρανσίσκο έχουν διαφορετικές ορισμούς για το τι είναι “χρήσιμο” και τι είναι “βλαβερό”. Σε ορισμένες κουλτούρες, η κοινωνική αρμονία είναι πιο σημαντική από την απόλυτη ελευθερία της ομιλίας. Σε άλλες, ο σεβασμός στην ιεραρχία είναι πιο σημαντικός από τη διατάραξη.

Όταν μια εταιρεία του Σίλικον Βάλεϊ χρησιμοποιεί “Reinforcement Learning from Human Feedback” (RLHF),雇ώνει ανθρώπους για να αξιολογήσουν τις απαντήσεις της AI. Nhưng ποιος είναι αυτός ο άνθρωπος; Ποια είναι οι πιστεύω του; Αν ευθυγραμμίσουν το μοντέλο με τα αμερικανικά πρότυπα, τότε κατασκευάζουν κατά λάθος einen αμερικανικό πολιτιστικό εξαγωγέα. Κατασκευάζουν einen ψηφιακό διπλωμάτη που επιβάλλει τους κανόνες ενός συγκεκριμένου πολιτισμού στον υπόλοιπο κόσμο.

Η Άνοδος των Κυκλικών Συνδέσμων

Η πρόκληση δεν είναι μόνο ότι η AI αντανακλά τις πιστεύω μιας κουλτούρας. Είναι πώς αυτές οι πιστεύω μπορούν να μας αλλάξουν. Τα σύγχρονα συστήματα AI έχουν το δυναμικό να διαμορφώσουν τη συμπεριφορά των ατόμων, των οργανισμών και ακόμη και των εθνών. Μπορούν να επηρεάσουν τον τρόπο με τον οποίο σκεφτόμαστε, εργαζόμαστε, εμπιστευόμαστε και ανταγωνιζόμαστε. Αυτό δημιουργεί κυκλικούς συνδέσμους μεταξύ των συστημάτων AI και των ανθρώπινων κοινωνιών· εκπαιδεύουμε την AI και η AI διαμορφώνει τον τρόπο με τον οποίο σκεφτόμαστε και ενεργούμε. Αυτοί οι κύκλοι γίνονται ισχυρότεροι καθώς η AI γίνεται πιο διαδεδομένη. Για να δούμε πώς λειτουργεί αυτός ο κύκλος, υπάρχουν δύο παραδείγματα:

  • Η μεγάλης κλίμακας ανάπτυξη της AI αλλάζει τη κοινωνική συμπεριφορά, και η κοινωνική συμπεριφορά αλλάζει τα δεδομένα που εκπαιδεύουν τα νέα συστήματα. Για παράδειγμα, ένας αλγόριθμος συστάσεων μπορεί να διαμορφώσει τι βλέπουν, διαβάζουν και πιστεύουν οι άνθρωποι. Τα εργαλεία παραγωγικότητας αναμορφώνουν τον τρόπο με τον οποίο οι ομάδες συνεργάζονται και οι μαθητές μαθαίνουν. Αυτές οι αλλαγές στη συμπεριφορά αλλάζουν τα μοτίβα δεδομένων με τη μορφή διαφορετικών συνηθειών προβολής, μοτίβων επικοινωνίας στην εργασία ή στυλ γραφής. Όταν αυτά τα δεδομένα ρέουν στα μελλοντικά σύνολα δεδομένων, τα μοντέλα προσαρμόζουν τις υποθέσεις και τις εξόδους τους αντίστοιχα. Η ανθρώπινη συμπεριφορά διαμορφώνει τα μοντέλα, και τα μοντέλα, με τη σειρά τους, διαμορφώνουν την ανθρώπινη συμπεριφορά.
  • Τα αυτοματοποιημένα εργαλεία λήψης αποφάσεων επηρεάζουν την κοινή πολιτική, και η κοινή πολιτική επηρεάζει την εκπαίδευση των μελλοντικών μοντέλων. Για παράδειγμα, πολλές κυβερνήσεις χρησιμοποιούν τώρα την AI για να προτείνουν πού να κατανείμουν πόρους, όπως την αναγνώριση των γειτονιών που χρειάζονται περισσότερη υποστήριξη υγείας ή των περιοχών που μπορεί να δουν υψηλότερο κίνδυνο εγκλήματος. Όταν οι πολιτικοί λάβουν αποφάσεις με βάση αυτές τις συστάσεις, τα αποτελέσματα αυτών των αποφάσεων γίνονται αργότερα μέρος νέων συνόλων δεδομένων. Με τον καιρό, οι αποφάσεις πολιτικής που διαμορφώθηκαν από την AI τελικά διαμορφώνουν την επόμενη γενιά μοντέλων AI.

Μόλις αναγνωρίσετε αυτόν τον κύκλο, γίνεται σαφές ότι η AI σταδιακά διαμορφώνει και ευθυγραμμίζει τους πολιτισμούς. Ως αποτέλεσμα, οι εθνικές αρχές αρχίζουν να ρωτούν: Πώς μπορούν να προστατεύσουν τις αξίες τους ενώ ενσωματώνουν την AI στις κοινωνίες και τις θεσμούς τους;

Η Emergence της Κυρίαρχης AI

Αυτή η πρόκληση ευθυγράμμισης έχει προκαλέσει σημαντική αντίδραση από τις κυβερνήσεις παγκοσμίως. Οι εθνικές αρχές έχουν συνειδητοποιήσει ότι η εξάρτηση από εισαγόμενα συστήματα AI είναι ένα ρίσκο για την κυριαρχία τους. Δεν μπορούν να αντέξουν να έχουν τους πολίτες τους εκπαιδευμένους, ενημερωμένους και συμβουλευμένους από ένα μαύρο κουτί που σκέφτεται σαν ξένος.

Αυτή η συνειδητοποίηση οδήγησε στην άνοδο της “Κυρίαρχης AI.” Η Γαλλία επενδύει πολύ για να κατασκευάσει μοντέλα που μιλούν γαλλικά και καταλαβαίνουν τον γαλλικό νόμο και πολιτισμό. Η Ινδία κατασκευάζει αυτόχθονες αλγόριθμους AI για να διασφαλίσει τις πολιτιστικές αξίες της. Τα Ηνωμένα Αραβικά Εμιράτα και η Κίνα κατασκευάζουν μοντέλα AI που ευθυγραμμίζονται με τις δικές τους εθνικές οράσεις.

Αυτή είναι η νέα αγωνία. Είναι μια αγωνία για τον έλεγχο της αφηγήματος. Ένας πολιτισμός που δεν έχει το δικό του σύστημα AI θα χάσει τελικά τη μνήμη του. Αν τα παιδιά σας ρωτήσουν μια ερώτηση σε μια μηχανή και η μηχανή απαντήσει με τη λογική ενός διαφορετικού πολιτισμού, ο πολιτισμός σας αρχίζει να διαβρώνεται. Αυτή η συνειδητοποίηση, ωστόσο, μπορεί να οδηγήσει στη διαμόρφωση διακριτών ψηφιακών μπλοκ. Θα τελειώσουμε με ένα Δυτικό AI, ένα Κινεζικό AI, ένα Ινδικό AI και così καθεξής. Αυτά τα συστήματα θα λειτουργούν με διαφορετικά γεγονότα και διαφορετικά ηθικά πλαισιά. Αυτές οι εξελίξεις κάνουν σαφές ότι αν θέλουμε να δημιουργήσουμε ένα ενιαίο, πραγματικά ευθυγραμμισμένο μοντέλο AI, πρέπει πρώτα να βρούμε έναν τρόπο να ευθυγραμμίσουμε τους πολιτισμούς.

Ανάγκη για Διπλωματική AI

Η παραδοσιακή ευθυγράμμισης υποθέτει ότι ένα μοντέλο μπορεί να ευθυγραμμιστεί με προσεκτική εκπαίδευση, προτροπή και φραγμούς. Αυτή η σκέψη προέρχεται από την τεχνική σκέψη της πρώιμης έρευνας ασφαλείας AI. Nhưng ακόμη και η τέλεια ευθυγράμμισης του μοντέλου δεν μπορεί να λύσει τις προκλήσεις της ευθυγράμμισης των πολιτισμών. Η ευθυγράμμισης δεν μπορεί να παραμείνει σταθερή όταν οι κοινωνίες τραβούν σε αντίθετες κατευθύνσεις. Αν οι χώρες, οι εταιρείες και οι κοινότητες έχουν αντικρουόμενα στόχους, θα πιέσουν τα συστήματα AI να αντανακλούν αυτές τις αντικρουόμενες στόχους. Αυτά τα όρια δείχνουν ότι η ευθυγράμμισης δεν είναι μόνο ένα τεχνικό πρόβλημα. Είναι ένα πρόβλημα διακυβέρνησης, πολιτισμού και συντονισμού. Και αυτά τα προβλήματα απαιτούν όχι μόνο εμπειρογνώμονες ή développers. Απαιτούν ολόκληρους πολιτισμούς.

Για αυτό, πώς προχωράμε; Αν αποδεχθούμε ότι η καθολική ευθυγράμμισης είναι αδύνατη, πρέπει να αλλάξουμε την στρατηγική μας. Δεν πρέπει να ψάχνουμε για μια τεχνική λύση σε ένα φιλοσοφικό πρόβλημα. Πρέπει να αρχίσουμε να σκεφτόμαστε σαν διπλωμάτες. Θα χρειαστεί να κατασκευάσουμε πρωτόκολλα για “Ευθυγράμμισης Πολιτισμών”. Πρέπει να βρούμε έναν τρόπο να σεβαστούμε τις πιστεύω μιας κοινωνίας και τις αξίες της χωρίς να επιβάλλουμε τις πιστεύω άλλων πολιτισμών. Με άλλα λόγια, χρειαζόμαστε einen ψηφιακό Οργανισμό Ηνωμένων Εθνών για τους αλγόριθμους μας.

Αυτό απαιτεί διαφάνεια. Τώρα, δεν ξέρουμε πραγματικά ποιες αξίες κρύβονται μέσα στα βαθιά στρώματα ενός νευρωνικού δικτύου. Βλέπουμε μόνο την έξοδο. Για να ευθυγραμμίσουμε τους πολιτισμούς, πρέπει να είμαστε σαφείς για το “Σύνταγμα” κάθε μοντέλου. Ένα μοντέλο πρέπει να μπορεί να δηλώσει την προκατάληψή του. Πρέπει να μπορεί να πει: “Εκπαιδεύτηκα σε αυτά τα δεδομένα, με αυτούς τους κανόνες ασφαλείας, προτεραιοποιώντας αυτές τις αξίες.” Μόνο όταν η προκατάληψη είναι ορατή μπορούμε να εμπιστευτούμε το σύστημα. Ένας χρήστης πρέπει να μπορεί να αλλάξει μεταξύ προοπτικών. Θα πρέπει να μπορείτε να κάνετε μια ερώτηση και να δείτε πώς ένα “Δυτικό” μοντέλο απαντάει σε σύγκριση με ένα “Ανατολικό” μοντέλο. Αυτό θα μετατρέψει την AI σε ένα εργαλείο για την κατανόηση, αντί για ένα εργαλείο για την εμβάπτιση.

Το Κύριο

Έχουμε ξοδέψει πολύ χρόνο με την αγωνία για τον Terminator. Το πραγματικό ρίσκο δεν είναι ότι ένας ρομπότ θα μας καταστρέψει. Το πραγματικό ρίσκο είναι ότι ένας ρομπότ θα μας κάνει να ξεχάσουμε ποιος είμαστε. Η ευθυγράμμισης δεν είναι ένα κώδικα που μπορούμε να γράψουμε μια φορά και να ξεχάσουμε. Είναι μια συνεχής διαπραγμάτευση με τα μοντέλα AI για να τα κρατήσουμε ευθυγραμμισμένα με τις πιστεύω και τις αξίες μας. Είναι μια πολιτική πράξη. Όσο προχωράμε σε αυτή τη νέα φάση της εποχής της νοημοσύνης, πρέπει να κοιτάξουμε πέρα από την οθόνη. Πρέπει να σκεφτόμαστε πώς η AI ερμηνεύει την ιστορία μας, τα σύνορά μας και τις πιστεύω μας. Κατασκευάζουμε τους νούς που θα μας βοηθήσουν να διοικήσουμε τον κόσμο. Πρέπει να βεβαιωθούμε ότι αυτοί οι νους θα σεβαστούν τις διαφορές μεταξύ των πολιτισμών.

Ο Δρ Tehseen Zia είναι Καθηγητής στο COMSATS University Islamabad, κατέχοντας διδακτορικό τίτλο στη τεχνητή νοημοσύνη από το Τεχνικό Πανεπιστήμιο της Βιέννης, Αυστρία. Ειδικεύεται στην Τεχνητή Νοημοσύνη, τον Αυτόματο Μάθηση, την Επιστήμη Δεδομένων και την Υπολογιστική Όραση, έχει κάνει σημαντικές συνεισφορές με δημοσιεύσεις σε αξιόπιστες επιστημονικές περιοδικά. Ο Δρ Tehseen έχει επίσης ηγηθεί διαφόρων βιομηχανικών έργων ως ο Principal Investigator και έχει υπηρετήσει ως Σύμβουλος Τεχνητής Νοημοσύνης.