Μοντέλα και πλατφόρμες AI

Η ανοιχτόκωδικη AI ανταποδίδει με το Llama 4 της Meta

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Τις τελευταίες années, ο κόσμος της AI έχει μετατοπιστεί από μια κουλτούρα ανοιχτής συνεργασίας σε μια που κυριαρχεί από στενά φυλαγμένα ιδιωτικά συστήματα. Η OpenAI – μια εταιρεία που ιδρύθηκε με το “ανοιχτό” στο όνομά της – στράφηκε στην κράτηση των πιο ισχυρών μοντέλων της μυστικών μετά το 2019. Ανταγωνιστές όπως η Anthropic και η Google (GOOGL ) κατασκεύασαν επίσης AI πίσω από τοίχους API, προσιτά μόνο με τους δικούς τους όρους. Αυτή η κλειστή προσέγγιση δικαιολογούνταν εν μέρει από ενδιαφέροντα ασφαλείας και επιχειρήσεων, αλλά άφησε πολλούς στην κοινότητα να θρηνούν την απώλεια του πνεύματος της ανοιχτής πηγής.

Τώρα, αυτό το πνεύμα κάνει μια επανέλαση. Τα νέα μοντέλα Llama 4 της Meta σηματοδοτούν μια τολμηρή προσπάθεια να αναβιώσουν την ανοιχτόκωδικη AI στα υψηλότερα επίπεδα – και ακόμη παραδοσιακά φρουρούμενοι παίκτες λαμβάνουν σημειώσεις. Ο CEO της OpenAI, Sam Altman, αναγνώρισε πρόσφατα ότι η εταιρεία ήταν “στην λάθος πλευρά της ιστορίας” σχετικά με τα ανοιχτά μοντέλα και ανακοίνωσε σχέδια για ένα “ισχυρό νέο ανοιχτό-βαρό” μοντέλο GPT-4. Σε σύντομο, η ανοιχτόκωδικη AI ανταποδίδει, και η σημασία και η αξία του “ανοιχτού” εξελίσσονται.

(Πηγή: Meta)

Llama 4: Η ανοιχτόκωδικη πρόκληση της Meta στο GPT-4o, Claude και Gemini

Η Meta παρουσίασε το Llama 4 ως μια άλλη άμεση πρόκληση στα νέα μοντέλα από τους βαρύτομους της AI, τοποθετώντας το ως μια ανοιχτό-βαρό εναλλακτική. Το Llama 4 έρχεται σε δύο γεύσεις που είναι διαθέσιμες σήμερα – Llama 4 Scout και Llama 4 Maverick – με εντυπωσιακά τεχνικά χαρακτηριστικά. Και τα δύο είναι μοντέλα μείξης-ειδικών (MoE) που ενεργοποιούν μόνο ένα τμήμα των παραμέτρων τους ανά ερώτηση, επιτρέποντας μια τεράστια συνολική μέγεθος χωρίς να καταστρέφουν το κόστος εκτέλεσης. Ο Scout και ο Maverick κατέχουν από 17 δισεκατομμύρια “ενεργές” παραμέτρους (το μέρος που δουλεύει σε οποιαδήποτε δεδομένη είσοδο), αλλά χάρη στη MoE, ο Scout τις διανέμει σε 16 εμπειρογνώμονες (109B παραμέτρους συνολικά) και ο Maverick σε 128 εμπειρογνώμονες (400B συνολικά). Το αποτέλεσμα: τα μοντέλα Llama 4 προσφέρουν φοβερές επιδόσεις – και το κάνουν με μοναδικά πλεονεκτήματα που ακόμη και κάποια κλειστά μοντέλα δεν έχουν.

Για παράδειγμα, το Llama 4 Scout διαθέτει ένα βιομηχανικό ηγέτη 10 εκατομμυρίων token παραθύρου контекστο, τάξεις μεγέθους πέρα από τους περισσότερους ανταγωνιστές. Αυτό σημαίνει ότι μπορεί να καταναλώσει και να συλλογιστεί πάνω από πραγματικά τεράστιες εγγραφές ή κώδικες σε μια seule. Παρά το μέγεθός του, ο Scout είναι αρκετά αποτελεσματικός για να τρέξει σε ένα μόνο H100 GPU όταν είναι υψηλά ποσοστοποιημένος, υποδεικνύοντας ότι οι dévelopπεurs δεν θα χρειαστεί να έχουν einen siêuυπολογιστή για να πειραματιστούν με αυτό.

Εν τω μεταξύ, το Llama 4 Maverick είναι调节 για μέγιστη δύναμη. Τα πρώτα tests δείχνουν ότι ο Maverick ταιριάζει ή ξεπερνά τα κορυφαία κλειστά μοντέλα σε εργασίες λογικής, κωδικοποίησης και όρασης. Στην πραγματικότητα, η Meta ήδη προβάλλει ένα ακόμη μεγαλύτερο αδελφό, το Llama 4 Behemoth, που είναι ακόμη σε εκπαίδευση, το οποίο εσωτερικά “ξεπερνά το GPT-4.5, το Claude 3.7 Sonnet και το Gemini 2.0 Pro σε plusieurs STEM benchmarks.” Το μήνυμα είναι σαφές: τα ανοιχτά μοντέλα δεν είναι πλέον δεύτερης κατηγορίας· το Llama 4 στοχεύει στην κατάκτηση του state-of-the-art καθεστώτος.

Ιδιαίτερα σημαντικό, η Meta έχει κάνει το Llama 4 αμέσως διαθέσιμο για λήψη και χρήση. Οι dévelopπεurs μπορούν να λάβουν τον Scout και τον Maverick από τον επίσημο ιστότοπο ή Hugging Face υπό την άδεια Llama 4 Community. Αυτό σημαίνει ότι ο καθένας – από έναν garage hacker έως μια εταιρεία Fortune 500 – μπορεί να πάρει το μοντέλο από κάτω, να το προσαρμόσει στις ανάγκες του και να το αναπτύξει στο δικό του υλικό ή cloud. Αυτό είναι μια σαφής αντίθεση με τις ιδιωτικές προσφορές όπως το GPT-4o της OpenAI ή το Claude 3.7 της Anthropic, τα οποία παρέχονται μέσω πληρωμένων API χωρίς πρόσβαση στα υποκείμενα βάρη.

Η Meta τονίζει ότι η ανοιχτότητα του Llama 4 είναι για την ενδυνάμωση των χρηστών: “Μοιραζόμαστε τα πρώτα μοντέλα στη στάνη Llama 4, τα οποία θα επιτρέψουν στους ανθρώπους να δημιουργήσουν πιο προσωποποιημένες πολυμεσικές εμπειρίες.” Με άλλα λόγια, το Llama 4 είναι ένα εργαλείο που προορίζεται να βρίσκεται στα χέρια των développeurs και ερευνητών παγκοσμίως. Ανακτώντας μοντέλα που μπορούν να αντιταχθούν στα likes του GPT και του Claude σε ικανότητα, η Meta αναβίωσε την ιδέα ότι η κορυφαία AI δεν πρέπει να ζει πίσω από ένα paywall.

(Πηγή: Meta)

Αυθεντικός ιδεαλισμός ή στρατηγικό παιχνίδι;

Η Meta παρουσιάζει το Llama 4 με μεγαλοπρεπείς, σχεδόν αλτρουιστικούς όρους. “Το ανοιχτόκωδικο μοντέλο AI μας, Llama, έχει κατεβαστεί περισσότερες από ένα δισεκατομμύριο φορές,” ανακοίνωσε πρόσφατα ο CEO Mark Zuckerberg, προσθέτοντας ότι η ανοιχτόκωδικη AI είναι απαραίτητη για να διασφαλιστεί ότι οι άνθρωποι παντού έχουν πρόσβαση στα οφέλη της AI. Αυτή η παρουσίαση ζωγραφίζει τη Meta ως τον φανό της δημοκρατικής AI – μια εταιρεία που είναι πρόθυμη να μοιράζεται τα κορυφαία μοντέλα της για το μεγαλύτερο καλό. Και στην πραγματικότητα, η δημοτικότητα της οικογένειας Llama υποστηρίζει αυτό: τα μοντέλα έχουν κατεβαστεί σε εκπληκτική κλίμακα (πηδώντας από 650 εκατομμύρια σε 1 δισεκατομμύριο συνολικά λήψεις σε λίγους μήνες), και χρησιμοποιούνται ήδη σε παραγωγή από εταιρείες όπως η Spotify, η AT&T και η DoorDash.

Η Meta αναφέρει με υπερηφάνεια ότι οι développeurs εκτιμούν την “διαφάνεια, προσαρμογή και ασφάλεια” των ανοιχτών μοντέλων που μπορούν να τρέξουν οι ίδιοι, τα οποία “βοηθούν να φτάσουν σε νέεςระดούς δημιουργικότητας και καινοτομίας,” σε σύγκριση με τα μαύρα κουτί API. Σε αρχή, αυτό ακούγεται σαν το παλιό πνεύμα του ανοιχτού λογισμικού (σκέψου Linux ή Apache) που εφαρμόζεται στην AI – μια αδιαμφισβήτητη νίκη για την κοινότητα.

Ωστόσο, δεν μπορείς να αγνοήσεις τον στρατηγικό υπολογισμό πίσω από αυτήν την ανοιχτότητα. Η Meta δεν είναι μια φιλανθρωπική οργάνωση, και “ανοιχτόκωδικο” σε αυτό το контέκστ δεν έρχεται χωρίς προϋποθέσεις. Ιδιαίτερα, το Llama 4 κυκλοφορεί με μια ειδική άδεια κοινότητας, όχι μια τυπική άδεια permissive – έτσι ενώ τα μοντέλα είναι δωρεάν για χρήση, υπάρχουν περιορισμοί (για παράδειγμα, ορισμένες υψηλές πηγές χρήσης μπορεί να απαιτούν άδεια, και η άδεια είναι “ιδιωτική” στο ότι είναι σχεδιασμένη από τη Meta). Αυτό δεν είναι η Ανοιχτό Λογισμικό Πρωτοβουλία (OSI) εγκεκριμένη ορισμός του ανοιχτού λογισμικού, το οποίο έχει οδηγήσει ορισμένους κριτικούς να υποστηρίξουν ότι οι εταιρείες χρησιμοποιούν λανθασμένα τον όρο.

Στην πράξη, η προσέγγιση της Meta περιγράφεται συχνά ως “ανοιχτό-βαρό” ή “πηγή-διαθέσιμο” AI: ο κώδικας και τα βάρη είναι ανοιχτά, αλλά η Meta διατηρεί κάποιο έλεγχο και δεν αποκαλύπτει όλα (π.χ. δεδομένα εκπαίδευσης). Αυτό δεν μειώνει την उपयσιμότητα για τους χρήστες, αλλά δείχνει ότι η Meta είναι στρατηγικά ανοιχτή – κρατώντας αρκετούς έλεγχο για να προστατεύσει τον εαυτό της (και vielleicht την ανταγωνιστική της πλευρά). Πολλές εταιρείες τοποθετούν ετικέτες “ανοιχτόκωδικο” σε μοντέλα AI ενώ κρατούν κρυφά βασικά στοιχεία, υπονόμευοντας το αληθινό πνεύμα της ανοιχτότητας.

Γιατί θα ανοίξει η Meta; Το ανταγωνιστικό τοπίο προσφέρει ενδείξεις. Η κυκλοφορία ισχυρών μοντέλων δωρεάν μπορεί να χτίσει γρήγορα μια ευρεία βάση développeurs και εταιρειών – η Mistral AI, μια γαλλική εταιρεία, έκανε ακριβώς αυτό με τα πρώτα ανοιχτά μοντέλα της για να κερδίσει credibilitas ως κορυφαίο εργαστήριο.

Βάζοντας την αγορά με το Llama, η Meta εξασφαλίζει ότι η τεχνολογία της γίνεται θεμελιώδης στην AI οικοσύστημα, το οποίο μπορεί να αποφέρει κέρδη μακροπρόθεσμα. Είναι μια κλασική στρατηγική αγκαλιά-και-εκτείνου: αν όλοι χρησιμοποιούν το “ανοιχτό” μοντέλο σας, έμμεσα ορίζετε πρότυπα και vielleicht οδηγείτε τους ανθρώπους προς τις πλατφόρμες σας (για παράδειγμα, τα προϊόντα AI βοηθού της Meta χρησιμοποιούν το Llama). Υπάρχει επίσης ένα στοιχείο PR και τοποθέτησης. Η Meta παίζει το ρόλο του ευεργέτη καινοτόμου, ιδιαίτερα σε σύγκριση με την OpenAI – η οποία έχει αντιμετωπίσει κριτική για την κλειστή της προσέγγιση. Στην πραγματικότητα, η αλλαγή της OpenAI στην ανοιχτότητα των μοντέλων υπογραμμίζει kısmως πόσο αποτελεσματική ήταν η κίνηση της Meta.

Μετά την επαναστατική κινεζική ανοιχτόκωδικη μοντέλο DeepSeek-R1 που εμφανίστηκε τον Ιανουάριο και ξεπέρασε τα προηγούμενα μοντέλα, ο Altman ανέφερε ότι η OpenAI δεν ήθελε να μείνει στην “λανθασμένη πλευρά της ιστορίας”. Τώρα η OpenAI υποσχέθηκε ένα ανοιχτό μοντέλο με ισχυρές ικανότητες συλλογισμού στο μέλλον, σηματοδοτώντας μια αλλαγή στάσης. Είναι δύσκολο να μην δεις την επιρροή της Meta σε αυτήν την αλλαγή. Η ανοιχτόκωδικη στάση της Meta είναι και αυθεντική και στρατηγική: ευρύτερα την πρόσβαση στην AI, αλλά είναι επίσης ένα έξυπνο παιχνίδι για να ξεπεράσει τους ανταγωνιστές και να διαμορφώσει το μέλλον της αγοράς με τους δικούς της όρους.

Επιβεβαιώσεις για τους développeurs, τις εταιρείες και το μέλλον της AI

Για τους développeurs, η αναβίωση των ανοιχτών μοντέλων όπως το Llama 4 είναι ένα αναπνευστικό άνεμα. Αντί να είναι κλειδωμένοι σε ένα σύστημα και χρεώσεις ενός μόνο παρόχου, τώρα έχουν την επιλογή να τρέξουν ισχυρή AI στο δικό τους υπολογιστικό σύστημα ή να την προσαρμόσουν ελεύθερα.

Αυτό είναι ένα τεράστιο όφελος για τις εταιρείες σε ευαίσθητες βιομηχανίες – σκέψου finance, υγεία ή κυβέρνηση – που είναι διστακτικές να ταΐσουν εμπιστευτικά δεδομένα σε ένα μαύρο κουτί. Με το Llama 4, μια τράπεζα ή ένα νοσοκομείο θα μπορούσε να αναπτύξει ένα state-of-the-art γλωσσικό μοντέλο πίσω από το δικό του τείχος, το οποίο θα μπορούσε να προσαρμοστεί σε ιδιωτικά δεδομένα, χωρίς να μοιράζεται ένα token με ένα εξωτερικό όργανο. Υπάρχει επίσης ένα πλεονέκτημα κόστους. Ενώ οι χρεώσεις API για τα κορυφαία μοντέλα μπορούν να εκτοξευτούν, ένα ανοιχτό μοντέλο δεν έχει χρέωση χρήσης – πληρώνετε μόνο για την υπολογιστική δύναμη για να το τρέξετε. Οι εταιρείες που αυξάνουν τις βαρύτομες εργασίες AI έχουν τη δυνατότητα να σώσουν σημαντικά με την επιλογή μιας ανοιχτής λύσης που μπορούν να κλιμακωθούν εσωτερικά.

Δεν είναι έκπληξη, λοιπόν, που βλέπουμε περισσότερο ενδιαφέρον για ανοιχτά μοντέλα από τις εταιρείες· πολλές έχουν αρχίσει να συνειδητοποιούν ότι ο έλεγχος και η ασφάλεια της ανοιχτόκωδικης AI συμφωνούν καλύτερα με τις ανάγκες τους από τις υπηρεσίες κλειστές.

Οι développeurs, επίσης, λαμβάνουν οφέλη στην καινοτομία. Με πρόσβαση στα εσωτερικά του μοντέλου, μπορούν να το προσαρμόσουν και να το βελτιώσουν για νіш domaine (νόμος, βιοτεχνολογία, περιφερειακές γλώσσες – ονομάστε το) με τρόπους που ένα κλειστό API μπορεί να μην προσφέρει ποτέ. Η έκρηξη των κοινοτικών προγραμμάτων γύρω από τα προηγούμενα μοντέλα Llama – από chatbots που έχουν προσαρμοστεί σε ιατρικές γνώσεις μέχρι ερασιτεχνικά smartphone εφαρμογές που τρέχουν mini εκδόσεις – απέδειξε πώς τα ανοιχτά μοντέλα μπορούν να δημοκρατικοποιήσουν την πειραματική.

Ωστόσο, η αναβίωση των ανοιχτών μοντέλων也 ανακύπτει δύσκολα ερωτήματα. Γίνεται “δημοκρατικοποίηση” πραγματικά αν μόνο εκείνοι με σημαντικά υπολογιστικά πόρους μπορούν να τρέξουν ένα μοντέλο 400B παραμέτρων; Ενώ το Llama 4 Scout και Maverick μειώνουν την υλική μπάρα σε σύγκριση με τα μονόλιθα μοντέλα, είναι ακόμη βαρέα – ένα σημείο που δεν χάνεται σε ορισμένους développeurs των οποίων οι υπολογιστές δεν μπορούν να το χειριστούν χωρίς βοήθεια cloud.

Η ελπίδα είναι ότι τεχνικές όπως η συμπίεση μοντέλων, η απόσταξη ή οι μικρότερες εκδόσεις εμπειρογνωμόνων θα μεταφέρουν την δύναμη του Llama 4 σε πιο προσιτές μεγέθη. Ένα άλλο πρόβλημα είναι η κακοποίηση. Η OpenAI και άλλοι έχουν υποστηρίξει ότι η κυκλοφορία ισχυρών μοντέλων ανοιχτά μπορεί να επιτρέψει σε κακόβουλους actors (για τη δημιουργία ψευδών πληροφοριών, κώδικα malware κ.λπ.).

Αυτά τα προβλήματα παραμένουν: ένα ανοιχτόκωδικο Claude ή GPT θα μπορούσε να χρησιμοποιηθεί κακόβουλα χωρίς τα φίλτρα ασφαλείας που οι εταιρείες επιβάλλουν στις API τους. Από την άλλη πλευρά, οι υποστηρικτές υποστηρίζουν ότι η ανοιχτότητα επιτρέπει στην κοινότητα να αναγνωρίσει και να διορθώσει προβλήματα, καθιστώντας τα μοντέλα πιο robusta και διαφανή με τον καιρό από οποιοδήποτε μυστικό σύστημα. Υπάρχει απόδειξη ότι οι κοινότητες ανοιχτών μοντέλων λαμβάνουν την ασφάλεια σοβαρά, αναπτύσσοντας τα δικά τους φράγματα και μοιράζοντας τις mejores πρακτικές – αλλά είναι μια συνεχής τάση.

Τι γίνεται όλο και πιο σαφές είναι ότι προχωράμε προς ένα υβριδικό τοπίο AI όπου τα ανοιχτά και κλειστά μοντέλα συνυπάρχουν, το καθένα επηρεάζοντας το άλλο. Τα κλειστά παρόχοι όπως η OpenAI, η Anthropic και η Google vẫn διατηρούν ένα πλεονέκτημα απόλυτης απόδοσης – για τώρα. Στην πραγματικότητα, μέχρι το τέλος του 2024, η έρευνα δείχνει ότι τα ανοιχτά μοντέλα ήταν περίπου ένα χρόνο πίσω από τα καλύτερα κλειστά μοντέλα σε ικανότητα. Αλλά αυτό το χάσμα κλείνει γρήγορα.

Στη σημερινή αγορά, “ανοιχτόκωδικο AI” δεν σημαίνει πλέον μόνο ερασιτεχνικά προγράμματα ή παλαιότερα μοντέλα – είναι τώρα στο κέντρο της στρατηγικής AI για γίγαντες της τεχνολογίας και startups. Η κυκλοφορία του Llama 4 της Meta είναι μια ισχυρή υπενθύμιση της εξελισσόμενης αξίας της ανοιχτότητας. Είναι ταυτόχρονα μια φιλοσοφική στάση για την δημοκρατικοποίηση της τεχνολογίας και μια τακτική κίνηση σε μια υψηλής αποδοσης αγωνία. Για τους développeurs και τις εταιρείες, ανοίγει νέες πόρτες στην καινοτομία και την αυτονομία, ακόμη και καθώς περιπλέκει τις αποφάσεις με νέες ανταλλαγές. Και για το ευρύτερο οικοσύστημα, ανεβάζει την ελπίδα ότι τα οφέλη της AI δεν θα κλειδωθούν στα χέρια μερικών εταιρειών – αν η ανοιχτόκωδικη ηθική μπορεί να διατηρήσει την εδαφική της.

Ο Alex McFarland είναι δημοσιογράφος και συγγραφέας του AI που εξερευνά τις τελευταίες εξελίξεις στην τεχνητή νοημοσύνη. Έχει συνεργαστεί με πολλές startups και εκδόσεις του AI σε όλο τον κόσμο.