Modele i platformy AI
Anthropic wprowadza Opus i Sonnet do trybu głosowego Claude

Anthropic otworzył tryb głosowy Claude na swoje bardziej zaawansowane modele, pozwalając na prowadzenie rozmów głosowych za pomocą modeli Opus i Sonnet zamiast lekkiego modelu Haiku, który napędzał tę funkcję od jej uruchomienia w 2025 roku. Firma potwierdziła tę zmianę w czwartek, 23 lipca 2026 roku, przedstawiając ją jako sposób na uczynienie rozmów z Claude użytecznymi do prawdziwej pracy, a nie tylko do szybkich wyszukiwań.
Zgodnie z dokumentacją trybu głosowego Anthropic, funkcja ta rozpoczyna się od modelu, który użytkownik ostatnio wybrał w czacie tekstowym, i uruchamia się w najbardziej zoptymalizowanej wersji domyślnie, dzięki czemu sesja dziedziczy inteligencję modelu, który ją wspiera. Użytkownicy mogą również przełączać się między Haiku, Sonnet i Opus w trakcie rozmowy za pomocą wybierania modelu. W praktyce otwiera to możliwość pracy, która była trudna do wykonania z ustawieniem tylko Haiku: dłuższe rozumowanie, opinie na temat tego, jak użytkownik sformułował pitch dla klienta, lub żądania wymagające użycia narzędzi, takie jak tworzenie e-maila i aktualizacja miejsca w kalendarzu za pomocą głosu.
Tryb głosowy może również uzyskać dostęp do połączonych aplikacji, w tym Gmail, Google Calendar, Google Docs i Slack, dzięki czemu żądanie głosowe może pobrać kontekst z kont użytkownika lub wykonać akcję, taką jak przesunięcie spotkania. Ta integracja z aplikacjami jest najbardziej wyraźnym punktem oddzielenia od OpenAI, której ostatnio zaktualizowany tryb głosowy zmienił sposób, w jaki ChatGPT prowadzi rozmowę, ale nadal nie może korzystać z zewnętrznych narzędzi, aby wykonać pracę.
Decyzja produktowa, a nie nowy model głosowy
Dla wszystkich, którzy śledzą, co tak naprawdę dostarczają laboratoria na froncie, najbardziej godne uwagi w tym wydaniu jest to, czego Anthropic nie zbudowało. Nie ma tu nowego, rodzimego modelu głosowego. Anthropic powiedział Engadget, że aktualizacja “koncentruje się na inteligencji i dostępie do narzędzi” i że “kontynuuje inwestowanie w głos” z “więcej do udostępnienia później w tym roku”. Podstawowy potok pozostaje oparty na turach: Claude słucha, pauzuje, aby pomyśleć, a następnie mówi, i podobno opiera się na zewnętrznym dostawcy usług text-to-speech, takim jak ElevenLabs, do wyjścia głosowego.
Kierowanie modelu rozumowania do głosu jest mniej ulepszeniem audio niż zdolnością. Żądanie głosowe może teraz być obsługiwane przez model, który planuje i rozwiązuje problem, podczas gdy Haiku został dostrojony do szybkiej odpowiedzi zamiast starannej. Zmiana w tym, co głos może zrobić, pochodzi całkowicie z modelu, który go wspiera.
To jest inna stawka niż ta, na którą stawia OpenAI. OpenAI zainwestowało wiele środków w system bidirectionalny, speech-native, GPT-Live, który przetwarza to, co mówisz, i generuje odpowiedź w tym samym czasie, bliżej rytmu rozmowy telefonicznej. Anthropic kieruje swoje najsilniejsze modele rozumowania na konwencjonalny stos głosowy i akceptuje ograniczenia konwersacyjne, które się z tym wiążą. Ponieważ sam model głosowy pozostaje niezmieniony, użytkownicy są mało prawdopodobni, aby zauważyć gładkie obsługiwanie przerwań lub bardziej płynne przejścia. To, co się zmienia, to to, jak dobrze Claude może rozumieć to, o co został poproszony, a nie to, jak naturalnie brzmi podczas wykonywania tej czynności.
Wymiana ta mapuje się na pytanie, z którym użytkownicy Claude już się zmagają w tekście: najbardziej zdolny model nie zawsze jest odpowiednim dla zadania. Wybranie cięższego modelu kupuje głębię za cenę szybkości, a rozmowy głosowe są szczególnie wrażliwe na opóźnienia. Umieszczenie wyboru w rękach użytkownika, zamiast ustawienia wszystkich na najszybszą opcję, jest praktyczną treścią aktualizacji.
Co jest dostępne, a co brakuje
Zmodernizowany tryb głosowy jest wydawany w wersji beta dla wszystkich użytkowników na mobilnych, komputerowych i sieciowych aplikacjach Anthropic. Ponieważ jest to kwestia kierowania istniejących modeli, a nie nowej infrastruktury, wypuszczanie nie czeka, aż Anthropic wyśle świeże systemy audio. Darmowe konta są ograniczone do modelu Haiku i jednej połączonej aplikacji, podczas gdy Sonnet i Opus są zarezerwowane dla płacących subskrybentów. Wprowadzony wcześniej w tym roku wielojęzyczny wprowadzany jest, chociaż Claude nadal nie może samodzielnie wykryć przełączenia języka; użytkownicy muszą nazwać język, który będą mówić, na głos lub w ustawieniach głosu.
Wybieranie modelu ujawnia Opus, Sonnet i Haiku, ale nie Claude Fable 5, najbardziej zaawansowany ogólnie dostępny model Anthropic, który pozostaje poza głosem na razie. To pominięcie pasuje do logiki wydania. Chodzi o dopasowanie głosu do modeli rozumowania, których większość ludzi używa na co dzień, a nie o przesunięcie granic tego, co może zrobić asystent głosowy.
Wynik brzmi mniej jak przełom w głosie niż oświadczenie strategiczne. Anthropic obstawia, że wartość asystenta głosowego pochodzi z modelu, który myśli, i narzędzi, do których ma dostęp, a nie z architektury audio zaprojektowanej specjalnie do tego celu. Ich obiecane kontynuacje później w tym roku pokażą, jak długo ta pozycja utrzyma się, podczas gdy OpenAI i Google będą nadal promować systemy speech-native.












