AI-modeller och plattformar
Anthropic för med Opus och Sonnet till Claude Voice Mode

Anthropic har öppnat Claudes röstläge för sina mer kapabla modeller, vilket gör att talade konversationer kan köras på Opus- och Sonnet-nivåerna istället för den lätta Haiku-modellen som har drivit funktionen sedan den lanserades 2025. Företaget bekräftade förändringen på torsdag den 23 juli 2026 och framställde den som ett sätt att göra det möjligt att ha meningsfulla samtal med Claude, snarare än bara snabba sökningar.
Enligt Anthropics dokumentation för röstläge startar funktionen nu med den modell som en användare senast valde i textchatt och kör dess snabbaste version som standard, så att en session ärver intelligensen från den modell som ligger bakom. Användare kan också växla mellan Haiku, Sonnet och Opus mitt i en konversation med hjälp av en modellväljare. I praktiken öppnar det upp möjligheter för arbete som Haiku-uppsättningen hanterade dåligt: längre resonemang, feedback på hur man formulerar en kundpresentation eller verktygsintensiva förfrågningar som att utarbeta ett e-postmeddelande och uppdatera en kalenderplats med röst.
Röstläget kan också nå ut till anslutna appar, inklusive Gmail, Google Kalender, Google Dokument och Slack, så att en talad förfrågan kan hämta sammanhang från en användares egna konton eller utföra en åtgärd som att omplanera ett möte. Den app-integrationen är den tydligaste punkten av separation från OpenAI, vars nyligen uppdaterade röstläge ändrade hur ChatGPT talar men fortfarande inte kan använda externa verktyg för att utföra arbete.
En produktbeslut, inte en ny röstmodell
För alla som följer vad frontier-laboratorier faktiskt levererar är den anmärkningsvärda delen av den här utgåvan vad Anthropic inte byggde. Det finns ingen ny tal-nativ röstmodell här. Anthropic berättade för Engadget att uppdateringen “fokuserar på intelligens och verktygsåtkomst” och att de “fortsätter att investera i röst” med “mer att dela senare i år”. Den underliggande pipelinen förblir tur-baserad: Claude lyssnar, pausar för att tänka och talar sedan, och den ska enligt uppgift förlita sig på en extern text-till-tal-leverantör som ElevenLabs för den talade utmatningen.
Att dirigera en resonemangsmodell till röst är mindre en ljuduppgradering än en kapacitetsuppgradering. En talad förfrågan kan nu hanteras av en modell som planerar och arbetar genom ett problem, där Haiku var inställd på att returnera ett snabbt svar snarare än ett genomtänkt svar. Förändringen i vad röst kan göra kommer helt från modellen bakom.
Det är en annan satsning än den som OpenAI gör. OpenAI har investerat stora resurser i ett bidirektionellt, tal-nativt system, GPT-Live, som bearbetar vad du säger och genererar ett svar samtidigt, närmare rytmerna i ett telefonsamtal. Anthropic dirigerar istället sina starkaste resonemangsmodeller till en konventionell röststack och accepterar de konversationsbegränsningar som följer med det. Eftersom röstmodellen i sig är oförändrad är användare osannolika att märka av en jämnare hantering av avbrott eller en mer flytande växling.
Detta val motsvarar en fråga som Claude-användare redan står inför i text: den mest kapabla modellen är inte alltid rätt för uppgiften. Att välja en tyngre modell köper djuphet till priset av hastighet, och talade konversationer är särskilt känsliga för latency. Att lägga valet i användarens händer, snarare än att standardisera alla till det snabbaste alternativet, är den praktiska substansen i uppdateringen.
Vad som är tillgängligt och vad som saknas
Det uppdaterade röstläget rullas ut i beta till alla användare över hela Anthropics mobil-, skrivbords- och webbappar. Eftersom det är en fråga om att dirigera befintliga modeller snarare än ny infrastruktur, väntar utrullningen inte på att Anthropic levererar färska ljudsystem. Gratis konton är begränsade till Haiku-modellen och en enda ansluten app, medan Sonnet– och Opus-nivåerna är reserverade för betalande abonnenter. Multispråkig inmatning, som lades till tidigare i år, ingår, även om Claude fortfarande inte kan upptäcka ett språkbyte på egen hand; användare måste ange det språk de ska tala, antingen högt eller i röstinställningarna.
Väljaren visar Opus, Sonnet och Haiku, men inte Claude Fable 5, Anthropics mest kapabla allmänt tillgängliga modell, som förblir utanför röst för tillfället. Den utelämnandet passar utgåvans logik. Det handlar om att matcha röst till de resonemangsmodeller som de flesta människor använder dagligen, snarare än att driva gränsen för vad en talad assistent kan göra.
Resultatet ser ut som en uttalande om strategi snarare än en röstgenombrott. Anthropic satsar på att värdet av en talad assistent kommer från modellen som tänker och de verktyg den kan nå, snarare än från en specialbyggd ljudarkitektur. De utlovade uppföljningarna senare i år kommer att visa hur länge den positionen håller, medan OpenAI och Google fortsätter att driva tal-nativa system av sina egna.












