Modele și platforme AI
Anthropic aduce Opus și Sonnet în modul de voce Claude

Anthropic a deschis modul de voce al lui Claude pentru modelele sale mai capabile, permițând conversații vorbite să ruleze pe nivelurile Opus și Sonnet, în loc de modelul Haiku ușor care a alimentat funcția de la lansarea sa în 2025. Compania a confirmat schimbarea joi, 23 iulie 2026, prezentând-o ca o modalitate de a face vorbirea cu Claude utilă pentru munca reală, și nu doar pentru căutări rapide.
Conform documentației modului de voce a lui Anthropic, funcția începe acum cu modelul pe care un utilizator l-a selectat ultima dată în chat-ul text și rulează cea mai rapidă versiune în mod implicit, astfel încât o sesiune moștenește inteligența modelului din spatele său. Utilizatorii pot comuta și între Haiku, Sonnet și Opus în mijlocul unei conversații prin intermediul unui selector de modele. În practică, acest lucru deschide lucrări pe care configurația Haiku le-a gestionat prost: raționament mai lung, feedback despre modul în care formulați o prezentare a unui client, sau solicitări care implică unelte, cum ar fi redactarea unui e-mail și actualizarea unei sloturi de calendar prin voce.
Modul de voce poate accesa, de asemenea, aplicații conectate, inclusiv Gmail, Google Calendar, Google Docs și Slack, astfel încât o solicitare vorbită poate extrage context din conturile proprii ale unui utilizator sau poate efectua o acțiune, cum ar fi reprogramarea unei întâlniri. Această integrare a aplicațiilor reprezintă cel mai clar punct de separare de OpenAI, a cărui mod de voce actualizat recent a schimbat modul în care ChatGPT vorbește, dar încă nu poate utiliza unelte externe pentru a finaliza lucrări.
O decizie de produs, nu un nou model de voce
Pentru oricine urmărește ce livrează laboratoarele de frontieră, partea notabilă a acestui lansării este ceea ce Anthropic nu a construit. Aici nu există un nou model de voce nativ pentru vorbire. Anthropic a spus către Engadget că actualizarea “se axează pe inteligență și acces la unelte,” și că “continuă să investească în voce” cu “mai multe de împărtășit mai târziu în acest an.” Conducta subiacentă rămâne bazată pe tururi: Claude ascultă, se oprește să gândească, apoi vorbește, și se spune că se bazează pe un furnizor extern de text-la-vorbire, cum ar fi ElevenLabs, pentru ieșirea vorbită.
Dirijarea unui model de raționament în voce este mai degrabă o îmbunătățire a capacității decât a sunetului. O solicitare vorbită poate fi gestionată acum de un model care planifică și lucrează prin problema, în timp ce Haiku a fost reglat pentru a returna un răspuns rapid în loc de unul bine gândit. Schimbarea în ceea ce poate face vocea vine în întregime din modelul din spatele său.
Acesta este un pariu diferit de cel pe care OpenAI îl face. OpenAI a investit resurse într-un sistem bidirecțional, nativ pentru vorbire, GPT-Live, care procesează ceea ce spuneți și generează un răspuns în același timp, mai aproape de ritmul unei apeluri telefonice. Anthropic rulează, în schimb, modelele sale de raționament mai puternice pe un stivă de voce convențională și acceptă limitele conversaționale care vin cu aceasta. Deoarece modelul de voce în sine este neschimbat, utilizatorii sunt puțin probabil să observe o gestionare mai bună a întreruperilor sau un flux mai fluid al conversației. Ceea ce se schimbă este cât de bine Claude poate raționa despre ceea ce i se cere, și nu cât de natural sună în timp ce o face.
Compromisul se reflectă într-o întrebare pe care utilizatorii lui Claude o întâlnesc deja în text: modelul cel mai capabil nu este întotdeauna cel potrivit pentru sarcină. Alegerea unui model mai greu cumpără adâncime la costul vitezei, și conversațiile vocale sunt deosebit de sensibile la latență. Punerea alegerii în mâinile utilizatorului, în loc de a defini pentru toată lumea opțiunea cea mai rapidă, este substanța practică a actualizării.
Ce este disponibil și ce lipsește
Modul de voce îmbunătățit rulează în beta pentru toți utilizatorii de-a lungul aplicațiilor mobile, desktop și web ale lui Anthropic. Deoarece este vorba de dirijarea modelelor existente și nu de infrastructură nouă, lansarea nu așteaptă ca Anthropic să livreze sisteme audio proaspete. Conturile gratuite sunt limitate la modelul Haiku și o singură aplicație conectată, în timp ce nivelurile Sonnet și Opus sunt rezervate abonaților plătitori. Intrarea multilingvă, adăugată mai devreme în acest an, este inclusă, deși Claude încă nu poate detecta o comutare de limbă de la sine; utilizatorii trebuie să numească limba pe care urmează să o vorbească, cu voce tare sau în setările vocale.
Selectorul expune Opus, Sonnet și Haiku, dar nu Claude Fable 5, modelul cel mai capabil și mai larg disponibil al lui Anthropic, care rămâne în afara vocalelor pentru moment. Această omisiune se potrivește logicii lansării. Acesta este despre potrivirea vocalei cu modelele de raționament pe care majoritatea oamenilor le folosesc în mod normal, și nu despre a împinge frontiera a ceea ce poate face un asistent vorbit.
Rezultatul sună mai degrabă ca o declarație de strategie decât ca o înfrângere a vocalei. Anthropic pariază că valoarea unui asistent vorbit vine din modelul care gândește și din uneltele pe care le poate accesa, și nu dintr-o arhitectură audio special creată. Promisiunile sale de următoarele lansări din acest an vor arăta cât timp această poziție se va menține, pe măsură ce OpenAI și Google continuă să promoveze sisteme native de vorbire.












