Ηγέτες σκέψης

Το AI-First σημαίνει Safety-First

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Αγοράστε ένα καινούριο ποδήλατο σε ένα παιδί, και το ποδήλατο θα λάβει όλη την προσοχή – όχι το λαμπερό κράνος που το συνοδεύει. Αλλά οι γονείς εκτιμούν το κράνος.

Φοβάμαι ότι πολλοί από εμάς σήμερα είμαστε σαν παιδιά όταν πρόκειται για το AI. Είμαστε επικεντρωμένοι στο πόσο cool είναι και πόσο γρήγορα podemos να το χρησιμοποιήσουμε. Όχι τόσο σε αυτό που μπορούμε να κάνουμε για να μείνουμε ασφαλείς ενώ το χρησιμοποιούμε. Είναι λυπηρό, γιατί δεν μπορείτε να έχετε το όφελος του ενός χωρίς το άλλο.

Απλά, η εφαρμογή του AI χωρίς προσεκτική σχεδίαση για την ασφάλεια πρώτα δεν είναι μόνο επικίνδυνη. Είναι ένας ευθύς δρόμος προς τον γκρεμό.

Τι σημαίνει η Ασφάλεια του AI;

Η ασφάλεια του AI περιλαμβάνει μια σειρά από βήματα. Αλλά ίσως το πιο σημαντικό στοιχείο είναι πότε να τα λάβουμε. Για να είναι αποτελεσματική, η ασφάλεια του AI πρέπει να είναι σχεδιασμένη.

Αυτό σημαίνει ότι σκεφτόμαστε πώς να αποτρέψουμε τον κίνδυνο πριν το οδηγήσουμε για δοκιμή. Βρίσκουμε τρόπο να διασφαλίσουμε ότι το AI λειτουργεί και παράγει αποτελέσματα σύμφωνα με τις αξίες και τις κοινωνικές προσδοκίες μας πρώτα – όχι μετά από κάποια αποτυχημένα αποτελέσματα.

Η σχεδίαση για την ασφάλεια του AI περιλαμβάνει επίσης τη σκέψη για το πώς να το κάνουμε robust, ή να το κάνουμε να λειτουργεί προβλέψιμα ακόμη και σε δυσμενείς καταστάσεις. Σημαίνει να το κάνουμε διαφανές, ώστε οι αποφάσεις του AI να είναι κατανοητές, ελέγξιμες και αμερόληπτες.

Αλλά περιλαμβάνει επίσης τη ματιά στο κόσμο στον οποίο το AI θα λειτουργήσει. Ποια θεσμικά και νομικά μέτρα ασφαλείας χρειαζόμαστε, ιδίως για να συμμορφωθούμε με τις ισχύουσες κυβερνητικές κανονιστικές; Και δεν μπορώ να τονίσω αρκετά το ανθρώπινο στοιχείο: Ποια θα είναι η επίδραση της χρήσης του AI στους ανθρώπους που θα αλληλεπιδράσουν με αυτό;

Η ασφάλεια με σχεδίαση σημαίνει την ενσωμάτωση της ασφάλειας του AI σε όλες τις διαδικασίες, τις ροές εργασίας και τις λειτουργίες μας πριν από την εισαγωγή του πρώτου προγράμματος.

Οι Κίνδυνοι Υπερβαίνουν τις Ανησυχίες

Δεν όλοι συμφωνούν. Όταν ακούν “ασφάλεια πρώτα”, κάποιοι ακούν “βήμα τόσο προσεκτικά και αργά που θα μείνετε πίσω”. Βέβαια, αυτό δεν είναι αυτό που σημαίνει η ασφάλεια πρώτα. Δεν πρέπει να σβήνει την καινοτομία ή να επιβραδύνει τον χρόνο αγοράς. Και δεν σημαίνει μια ατελείωτη σειρά πιλότων που δεν κλιμακώνουν ποτέ. Το αντίθετο.

Σημαίνει να κατανοήσουμε τους κινδύνους της μη σχεδίασης της ασφάλειας στο AI. Σκεφτείτε μόνο quelques.

  • Το Κέντρο Οικονομικών Υπηρεσιών της Deloitte προβλέπει ότι το GenAI θα μπορεί να ευθύνεται για απώλειες απάτης που θα φτάσουν τα 40 δισεκατομμύρια δολάρια στις Ηνωμένες Πολιτείες μόνο μέχρι το 2027, από 12,3 δισεκατομμύρια δολάρια το 2023, με ετήσιο ρυθμό αύξησης 32%.
  • Μεροληπτικές αποφάσεις. Περιπτώσεις τεκμηριώνουν μεροληπτική ιατρική φροντίδα λόγω AI που είχε εκπαιδευτεί με μεροληπτικά δεδομένα.
  • Κακές αποφάσεις που εμπνέουν περισσότερες κακές αποφάσεις. Χειρότερο από μια αρχική κακή απόφαση που προκλήθηκε από ελαττωματικό AI, μελέτες δείχνουν ότι αυτές οι ελαττωματικές αποφάσεις μπορούν να γίνουν μέρος του πώς σκεφτόμαστε και λαμβάνουμε μελλοντικές αποφάσεις.
  • Πραγματικές συνέπειες. Το AI που παρέχει κακές ιατρικές συμβουλές έχει ευθύνεται για θανατηφόρα αποτελέσματα για τους ασθενείς. Νομικά ζητήματα έχουν προκύψει από την αναφορά μιας ψευδαίσθησης του AI ως νομικής προηγούμενης. Και λάθη software που οφείλονται σε μια ψευδαίσθηση του AI έχουν μολύνει τα προϊόντα μιας εταιρείας και τη φήμη της και οδήγησαν σε ευρεία δυσαρέσκεια των χρηστών.

Και τα πράγματα είναι πρόθυμα να γίνουν ακόμη πιο ενδιαφέροντα.

Η έλευση και η ταχεία υιοθέτηση του agentic AI, του AI που μπορεί να λειτουργήσει αυτόνομα για να λάβει αποφάσεις που έχει λάβει, θα μεγαλώσει την σημασία της σχεδίασης για την ασφάλεια του AI.

Ένα AI agent που μπορεί να ενεργήσει για λογαριασμό σας μπορεί να είναι εξαιρετικά χρήσιμο. Αντί να σας λέει για τις καλύτερες πτήσεις για ένα ταξίδι, μπορεί να τις βρει και να τις κλείσει για σας. Αν θέλετε να επιστρέψετε ένα προϊόν, το AI agent μιας εταιρείας μπορεί να μην σας λέει μόνο την πολιτική επιστροφής και πώς να υποβάλετε αίτηση για επιστροφή, αλλά και να χειριστεί ολόκληρη τη διαδικασία για σας.

Καλά – όσο δεν ψευδαισθάνεται μια πτήση ή δεν χειρίζεται σωστά τις οικονομικές σας πληροφορίες. Ή να λάμβανε λάθος την πολιτική επιστροφής της εταιρείας και να αρνείται έγκυρες επιστροφές.

Δεν είναι δύσκολο να δούμε πώς οι παρόντες κίνδυνοι ασφαλείας του AI θα μπορούσαν να κασκαντίζουν εύκολα με μια σειρά από AI agents που λειτουργούν και λαμβάνουν αποφάσεις και ενεργούν, ιδίως既然 δεν θα λειτουργούν πιθανότατα μόνοι τους. Πολύ από την πραγματική αξία του agentic AI θα έρθει από ομάδες agent, όπου κάθε agent θα χειρίζεται μέρη των εργασιών και θα συνεργάζεται – agent προς agent – για να ολοκληρώσει την εργασία.

Πώς να ενστερνιστείτε την ασφάλεια του AI με σχεδίαση χωρίς να εμποδίζετε την καινοτομία και να σκοτώνετε την потенτική αξία της;

Ασφάλεια με Σχεδίαση σε Δράση

Οι ad hoc ελέγχοι ασφαλείας δεν είναι η απάντηση. Αλλά η ενσωμάτωση των πρακτικών ασφαλείας σε κάθε φάση της εφαρμογής του AI είναι.

Ξεκινήστε με τα δεδομένα. Βεβαιωθείτε ότι τα δεδομένα είναι ετικεταρισμένα, ανανεωμένα όπου χρειάζεται, απαλλαγμένα από προκαταλήψεις και υψηλής ποιότητας. Αυτό είναι ιδιαίτερα αληθινό για τα δεδομένα εκπαίδευσης.

Εκπαιδεύστε τα μοντέλα σας με ανθρώπινη ανάδραση, καθώς η ανθρώπινη κρίση είναι απαραίτητη για να διαμορφώσει τη συμπεριφορά του μοντέλου. Η ενίσχυση της μάθησης με ανθρώπινη ανάδραση (RLHF) και άλλες παρόμοιες τεχνικές επιτρέπουν στους annotators να βαθμολογούν και να οδηγούν τις απαντήσεις, βοηθώντας τα LLMs να παράγουν εξόδους που είναι ασφαλείς και ευθυγραμμισμένες με τις ανθρώπινες αξίες.

Στη συνέχεια, πριν κυκλοφορήσετε ένα μοντέλο, δοκιμάστε το. Οι ομάδες που προσπαθούν να προκαλέσουν ασφαλή συμπεριφορά με τη χρήση αντιπαλών προτύπων, περιπτώσεων και προσπαθειών να το “σπάσουν” μπορούν να αποκαλύψουν ευπάθειες. Το να τις διορθώσετε πριν να τις κυκλοφορήσετε στο κοινό τις giữει ασφαλείς πριν από οποιοδήποτε πρόβλημα.

Ενώ αυτό το τεστ διασφαλίζει ότι τα μοντέλα AI σας είναι robust, συνεχίστε να τα παρακολουθείτε με το μάτι σας στις νέες απειλές και τις αναπροσαρμογές που μπορεί να χρειαστούν στα μοντέλα.

Σε παρόμοιο πνεύμα, παρακολουθείτε τακτικά τις πηγές περιεχομένου και τις ψηφιακές αλληλεπιδράσεις για σημάδια απάτης. Κριτικά, χρησιμοποιήστε μια υβριδική προσέγγιση AI-ανθρώπου, αφήνοντας την αυτοματοποίηση του AI να φροντίσει τον τεράστιο όγκο των δεδομένων που πρέπει να παρακολουθούνται, και τους εξειδικευμένους ανθρώπους να χειρίζονται τις αναθεωρήσεις για την επιβολή και τη διασφάλιση της ακρίβειας.

Η εφαρμογή του agentic AI απαιτεί ακόμη περισσότερη προσοχή. Ένας βασικός απαιτούμενος: εκπαιδεύστε τον agent να γνωρίζει τα όριά του. Όταν συναντήσει αβεβαιότητα, ηθικές дилемμές, νέες καταστάσεις ή ιδιαίτερα υψηλές αποφάσεις, διασφαλίστε ότι γνωρίζει πώς να ζητήσει βοήθεια.

Σχεδιάστε επίσης την ιχνηλασιμότητα στα agents σας. Αυτό είναι ιδιαίτερα σημαντικό, ώστε οι αλληλεπιδράσεις τους να συμβαίνουν μόνο με επικυρωμένους χρήστες, για να αποφευχθεί η επίδραση των απάτων actor σε μια ενέργεια του agent.

Αν φαίνεται να λειτουργούν αποτελεσματικά, μπορεί να είναι诱惑 να τα αφήσετε ελεύθερα και να τα αφήσετε να κάνουν το δικό τους. Η εμπειρία μας λέει να συνεχίσουμε να τα παρακολουθούμε και τις εργασίες που τις εκπληρώνουν, για να παρακολουθούμε λάθη ή απρόσμενη συμπεριφορά. Χρησιμοποιήστε τόσο αυτοματοποιημένους ελέγχους όσο και ανθρώπινη αναθεώρηση.

Στην πραγματικότητα, ένα απαραίτητο στοιχείο της ασφάλειας του AI είναι η τακτική ανθρώπινη εμπλοκή. Οι άνθρωποι πρέπει να εμπλέκονται σκόπιμα εκεί όπου κρίσιμη κρίση, συμπόνια ή νюανς και αμφισημία εμπλέκονται σε μια απόφαση ή ενέργεια.

Πάλι, για να είμαι σαφής, αυτές είναι όλες πρακτικές που τις χτίζετε στην εφαρμογή του AI εκ των προτέρων, με σχεδίαση. Δεν είναι το αποτέλεσμα κάτι που πήγε στραβά και τότε να βγάζετε σε ταχύτητα για να δείτε πώς να ελαττώσετε την ζημία.

Λειτουργεί;

Έχουμε εφαρμόσει μια φιλοσοφία “Ασφάλεια του AI πρώτα” και ένα πλαίσιο “με σχεδίαση” με τους πελάτες μας καθ’ όλη τη διάρκεια της εμφάνισης του GenAI και τώρα στην ταχεία πορεία προς το agentic AI. Βρίσκουμε ότι, αντίθετα με τις ανησυχίες ότι θα επιβραδύνει τα πράγματα, στην πραγματικότητα βοηθά να τα επιταχύνει.

Το agentic AI έχει το потенシャル να μειώσει το κόστος της υποστήριξης των πελατών κατά 25-50%, για παράδειγμα, ενώ αυξάνει την ικανοποίηση των πελατών. Αλλά όλα αυτά εξαρτώνται από την εμπιστοσύνη.

Οι άνθρωποι που χρησιμοποιούν το AI πρέπει να το εμπιστεύονται, και οι πελάτες που αλληλεπιδρούν με το AI-ενεργοποιημένο ανθρώπινο agent ή με πραγματικά agents του AI δεν μπορούν να βιώσουν μια seule αλληλεπίδραση που θα υπονομεύσει την εμπιστοσύνη τους. Μια κακή εμπειρία μπορεί να εξαφανίσει την εμπιστοσύνη σε ένα brand.

Δεν εμπιστεύομαι τι δεν είναι ασφαλές. Όταν χτίζουμε την ασφάλεια σε κάθε στρώμα του AI που πρόκειται να κυκλοφορήσουμε, μπορούμε να το κάνουμε με εμπιστοσύνη. Και όταν είμαστε έτοιμοι να το κλιμακώσουμε, μπορούμε να το κάνουμε γρήγορα – με εμπιστοσύνη.

Ενώ η εφαρμογή της ασφάλειας του AI πρώτα μπορεί να φαίνεται υπερβολική, δεν είστε μόνοι. Υπάρχουν πολλοί εμπειρογνώμονες να σας βοηθήσουν και συνεργάτες που μπορούν να μοιραστούν ό,τι έχουν μάθει και μαθαίνουν, ώστε να μπορείτε να αξιοποιήσετε την αξία του AI ασφαλώς χωρίς να σας επιβραδύνουν.

Το AI έχει sido μια exciting διαδρομή μέχρι τώρα, και καθώς η διαδρομή επιταχύνεται, το βρίσκω εξηλαρυστικό. Αλλά είμαι επίσης χαρούμενος που φόραω το κράνος μου.

Ο Joe Anderson είναι ο Senior Director of Consulting and Digital Transformation στην TaskUs, όπου ηγείται της στρατηγικής go-to-market και της καινοτομίας. Εστιάζει στο σημείο τομής του AI, της εμπειρίας του πελάτη και των ψηφιακών λειτουργιών, και ηγείται της νέας πρακτικής συμβουλευτικής AI της TaskUs.