Μοντέλα και πλατφόρμες AI
Η Anthropic Εισάγει τα Opus και Sonnet στη Λειτουργία Φωνής του Claude

Η Anthropic άνοιξε τη λειτουργία φωνής του Claude για τα πιο ικανά μοντέλα της, επιτρέποντας τις προφορικές συνομιλίες να εκτελούνται στα επίπεδα Opus και Sonnet αντί του ελαφριού μοντέλου Haiku που είχε ενεργοποιήσει τη λειτουργία από το 2025. Η εταιρεία επιβεβαίωσε την αλλαγή την Πέμπτη, 23 Ιουλίου 2026, την παρουσιάζοντας ως一种 τρόπο για να κάνει τη συνομιλία με τον Claude χρήσιμη για πραγματική εργασία και όχι μόνο για γρήγορες αναζητήσεις.
Σύμφωνα με την τεκμηρίωση της λειτουργίας φωνής της Anthropic, η λειτουργία ξεκινά με το μοντέλο που επέλεξε ο χρήστης τελευταία στο κείμενο και εκτελεί την ταχύτερη εκδοχή του από προεπιλογή, οπότε μια συνεδρία κληρονομεί την ευφυΐα του μοντέλου πίσω του. Οι χρήστες μπορούν επίσης να переключθούν μεταξύ Haiku, Sonnet και Opus στη μέση μιας συνομιλίας μέσω ενός επιλογέα μοντέλου. Στην πράξη, αυτό ανοίγει εργασίες που το σύστημα Haiku χειριζόταν άσχημα: μεγαλύτερη συλλογιστική, ανατροφοδότηση για το πώς φράζετε μια πρόταση, ή εργαλειακά αιτήματα όπως η σύνταξη eines email και η ενημέρωση ενός θυρίδας ημερολογίου με φωνή.
Η λειτουργία φωνής μπορεί επίσης να φτάσει σε συνδεδεμένες εφαρμογές, συμπεριλαμβανομένων Gmail, Google Calendar, Google Docs και Slack, οπότε ένα προφορικό αίτημα μπορεί να αναζητήσει контекст από τους λογαριασμούς του χρήστη ή να εκτελέσει μια ενέργεια όπως η ανασχεδίαση μιας συνάντησης. Αυτή η ενοποίηση εφαρμογών είναι το πιο σαφές σημείο διαχωρισμού από το OpenAI, του οποίου η πρόσφατα ενημερωμένη λειτουργία φωνής άλλαξε τον τρόπο με τον οποίο το ChatGPT μιλάει αλλά δεν μπορεί ακόμη να χρησιμοποιήσει εξωτερικά εργαλεία για να εκτελέσει εργασίες.
Μια απόφαση προϊόντος, όχι ένα νέο μοντέλο φωνής
Για όσους παρακολουθούν τι πραγματικά κυκλοφορούν τα εργαστήρια, το αξιοσημείωτο μέρος αυτής της κυκλοφορίας είναι τι δεν κατασκεύασε η Anthropic. Δεν υπάρχει νέο μοντέλο φωνής εδώ. Η Anthropic ανέφερε στο Engadget ότι η ενημέρωση “εστιάζει στην ευφυΐα και την πρόσβαση σε εργαλεία” και ότι “συνεχίζει να επενδύει στη φωνή” με “περισσότερα να μοιραστούν αργότερα αυτό το έτος”. Το υποκείμενο pipeline παραμένει βασισμένο σε στροφές: ο Claude ακούει, παύει να σκέφτεται και μετά μιλάει, και φέρεται να βασίζεται σε έναν εξωτερικό πάροχο κειμένου-σε-ομιλία όπως η ElevenLabs για την προφορική έξοδο.
Η οδηγία ενός μοντέλου συλλογιστικής στη φωνή είναι λιγότερο μια αναβάθμιση ήχου από μια αναβάθμιση ικανοτήτων. Ένα προφορικό αίτημα μπορεί τώρα να χειριστεί από ένα μοντέλο που σχεδιάζει και εργάζεται σε ένα πρόβλημα, όπου το Haiku ήταν ρυθμισμένο να επιστρέψει μια γρήγορη απάντηση αντί μιας μελετημένης. Η αλλαγή στο τι μπορεί να κάνει η φωνή έρχεται εξ ολοκλήρου από το μοντέλο πίσω της.
Αυτή είναι μια διαφορετική στοίχηση από αυτή που κάνει το OpenAI. Το OpenAI έχει ρίξει πόρους σε ένα διευθυνσιοδοτούμενο, φωνητικό σύστημα, το GPT-Live, που επεξεργάζεται τι λέτε και παράγει μια απάντηση την ίδια στιγμή, πιο κοντά στο ρυθμό μιας τηλεφωνικής κλήσης. Η Anthropic αντίθετα οδηγεί τα ισχυρότερα μοντέλα συλλογιστικής της σε μια συμβατική στοίβα φωνής και αποδέχεται τους περιορισμούς συνομιλίας που έρχονται μαζί της. Επειδή το μοντέλο φωνής είναι αμετάβλητο, οι χρήστες είναι απίθανο να παρατηρήσουν ομαλότερη διαχείριση διακοπών ή μια πιο ρευστή αντιπαράθεση. Τι αλλάζει είναι το πώς καλά ο Claude μπορεί να συλλογιστεί για το τι του ζητείται, όχι το πώς φυσικά ακούγεται ενώ το κάνει.
Η ανταλλαγή αντιστοιχεί σε ένα ερώτημα που οι χρήστες του Claude αντιμετωπίζουν ήδη στο κείμενο: το πιο ικανό μοντέλο δεν είναι πάντα το σωστό για την εργασία. Η επιλογή ενός βαρύτερου μοντέλου αγοράζει βάθος με το κόστος της ταχύτητας, και οι προφορικές συνομιλίες είναι ιδιαίτερα ευαίσθητες στη καθυστέρηση. Βάζοντας την επιλογή στα χέρια του χρήστη, αντί να προεπιλέγει όλοι στην ταχύτερη επιλογή, είναι η πρακτική ουσιαστική της ενημέρωσης.
Τι είναι διαθέσιμο και τι λείπει
Η αναβαθμισμένη λειτουργία φωνής κυκλοφορεί σε βета σε όλους τους χρήστες σε όλα τα мобाइल, επιτραπέζια και ιστοσελίδες εφαρμογές της Anthropic. Επειδή είναι ένα ζήτημα οδηγώντας υπάρχοντα μοντέλα και όχι νέας υποδομής, η κυκλοφορία δεν περιμένει την Anthropic να αποστείλει φρέσκα συστήματα ήχου. Οι δωρεάν λογαριασμοί περιορίζονται στο μοντέλο Haiku και μια συνδεδεμένη εφαρμογή, με τα επίπεδα Sonnet και Opus να διατηρούνται για τους πληρωτές συνδρομητές. Η πολυγλωσσική είσοδος, που προστέθηκε νωρίτερα αυτό το έτος, περιλαμβάνεται, αν και ο Claude δεν μπορεί ακόμη να ανιχνεύσει μια αλλαγή γλώσσας από μόνος του· οι χρήστες πρέπει να ονομάσουν τη γλώσσα που πρόκειται να μιλήσουν, είτε με φωνή είτε στις ρυθμίσεις φωνής.
Ο επιλογέας αποκαλύπτει τα Opus, Sonnet και Haiku, αλλά όχι το Claude Fable 5, το πιο ικανό ευρέως διαθέσιμο μοντέλο της Anthropic, το οποίο παραμένει έξω από τη φωνή για τώρα. Αυτή η παραλείψη ταιριάζει στη λογική της κυκλοφορίας. Αυτό είναι για να ταιριάξει τη φωνή με τα μοντέλα συλλογιστικής που χρησιμοποιούν οι περισσότεροι άνθρωποι καθημερινά, και όχι για να προωθήσει τα όρια του τι μπορεί να κάνει ένας προφορικός βοηθός.
Το αποτέλεσμα διαβάζεται λιγότερο σαν μια突破 στη φωνή παρά σαν μια δήλωση στρατηγικής. Η Anthropic στοιχηματίζει ότι η αξία ενός προφορικού βοηθού έρχεται από το μοντέλο που κάνει τη σκέψη και τα εργαλεία που μπορεί να φτάσει, και όχι από μια purpose-κτισμένη αρχιτεκτονική ήχου. Τα υποσχόμενα follow-ups αργότερα αυτό το έτος θα δείξουν πόσο καιρό αυτή η θέση διατηρείται καθώς το OpenAI και η Google συνεχίζουν να προωθούν φωνητικά συστήματα δικά τους.












