Μοντέλα και πλατφόρμες AI
GPT-2, Η Γεννήτρια Κειμένου Τεχνητής Νοημοσύνης Κυκλοφορεί Ολόκληρη
Όπως αναφέρει το TheNextWeb (TNW), το OpenAI, ο μη κερδοσκοπικός οργανισμός πίσω από πολλά proyectos τεχνητής νοημοσύνης, δημοσίευσε το τελικό μοντέλο στην προγραμματισμένη σταδιακή κυκλοφορία για το GPT-2, μια γεννήτρια κειμένου που έχει προκαλέσει μεγάλη συζήτηση από την ανακοίνωσή του τον Φεβρουάριο.
Βάσει της έρευνας του OpenAI με τίτλο Τα Μοντέλα Γλώσσας είναι Αυτοδίδακτες Πολυεργασίες, “το GPT-2 χρησιμοποιεί τη μηχανική μάθηση για να δημιουργήσει νέο κείμενο με βάση περιορισμένες εισαγωγές.” Αυτό σημαίνει ότι ο χρήστης μπορεί να εισαγάγει μια πρόταση ή δύο για οποιοδήποτε θέμα και η γεννήτρια AI θα δημιουργήσει ένα κείμενο που έχει κάποια σχέση με την αρχική εισαγωγή. Ουσιαστικά, όπως σημειώνει το TNW, αντίθετα με τις περισσότερες γεννήτριες κειμένου, δεν εξοδεύει προγραμμένα χορδές. Το GPT-2 δημιουργεί κείμενο που δεν υπήρχε προηγουμένως.”
Σε ένα tweet του, ο Scott B. Weingart, διευθυντής προγράμματος της Βιβλιοθήκης του Πανεπιστημίου Carnegie Mellon, δίνει ένα συγκεκριμένο παράδειγμα:
What is a Panther but a young lion?
An entire corridor filled entirely with people screaming.
How’s this for a happy ending? pic.twitter.com/qvPTrs790N
— Scott B. Weingart (@scott_bot) 20 Αυγούστου 2019
If death, in some obscure and distant hour,
Strikes me still as I slept, if I yet dream:
Is that my peace with an eternity spent?
[…]
But I fear it will be no peace or rest
Until the stars give me the full glow of their light
To see all my cares and woes in an instant.Shit. pic.twitter.com/QRoi1C3rjj
— Scott B. Weingart (@scott_bot) 20 Αυγούστου 2019
Το OpenAI ήταν αρχικά ανήσυχος για τις πιθανές κακόβουλες χρήσεις του συστήματος, οπότε τον Φεβρουάριο του 2019 αποφάσισε να κυκλοφορήσει το GPT-2 σε τέσσερα μέρη επί八 μήνες. Όπως εξήγησαν στο blog τους, “Λόγω των ανησυχιών μας σχετικά με τις κακόβουλες εφαρμογές της τεχνολογίας, δεν κυκλοφορούμε το εκπαιδευμένο μοντέλο. Ως πείραμα σε υπεύθυνη αποκάλυψη, κυκλοφορούμε ένα πολύ μικρότερο μοντέλο για τους ερευνητές να πειραματιστούν, καθώς και một τεχνική εργασία.”
Όπως εξήγησαν, το πλήρες μοντέλο περιέχει 1,5 δισεκατομμύρια παραμέτρους. “Οι περισσότερες παραμέτρους που έχει ένα μοντέλο, το ‘έξυπνο’ που φαίνεται να είναι – όπως οι άνθρωποι, η πρακτική κάνει την τέλεια.”
Το TNW σημειώνει ότι αρχικά το OpenAI κυκλοφόρησε ένα μοντέλο με 124 εκατομμύρια παραμέτρους, ακολουθούμενο από κυκλοφορίες με 355 και 774 εκατομμύρια. Σύμφωνα με αυτούς, μετά τον έλεγχο των κυκλοφορούμενων μοντέλων, “κάθε επανάληψη έδειξε σημαντική βελτίωση στις ικανότητες σε σχέση με τις προηγούμενες επαναλήψεις.”
Για να αποτρέψουν τις κακόβουλες χρήσεις, το OpenAI κυκλοφόρησε μοντέλα ανίχνευσης GPT-2 που προορίζονται “να προλαμβάνουν τις κακόβουλες χρήσεις.” Σε μια δήλωσή τους σε ένα blog post, αυτά τα μοντέλα ανίχνευσης vẫn χρειάζονται επιπλέον εργασία για να φθάσουν στο επίπεδο ποιότητας που έχει επιτευχθεί μέχρι τώρα στο GPT-2.
Όσοι ενδιαφέρονται μπορούν να κατεβάσουν το μοντέλο GPT-2 εδώ στο Github, να δουν την κάρτα μοντέλου εδώ, και να διαβάσουν το blog post του OpenAI εδώ.












