AI-modeller og platforme

Anthropic bringer Opus og Sonnet til Claude Voice Mode

mm
Føj Unite.AI til dine foretrukne kilder på Google

Anthropic har åbnet Claudes voice mode op til deres mere kapable modeller, således at talte samtaler kan køre på Opus og Sonnet-niveauerne i stedet for den letvægtige Haiku-model, der har drevet funktionen siden dens lancering i 2025. Selskabet bekræftede ændringen torsdag den 23. juli 2026 og fremstillede den som en måde at gøre samtaler med Claude nyttige for rigtigt arbejde snarere end hurtige opslag.

Ifølge Anthropics voice mode-dokumentation starter funktionen nu med den model, som en bruger sidst valgte i tekstchat, og kører dens hurtigste version som standard, så en session arver intelligensen fra den model, der ligger bagved. Brugere kan også skifte mellem Haiku, Sonnet og Opus midt i en samtale gennem en model-vælger. I praksis åbner det op for arbejde, som Haiku-konfigurationen håndterede dårligt: længere resonnering, feedback om, hvordan du formulerer en klientpræsentation, eller værktøjsintensive anmodninger såsom udarbejdelse af en e-mail og opdatering af en kalenderplads via tale.

Voice mode kan også nå ind i tilkoblede apps, herunder Gmail, Google Kalender, Google Docs og Slack, så en talt anmodning kan hente kontekst fra en brugers egne konti eller udføre en handling som omarrangering af et møde. Denne app-integration er det klareste punkt af adskillelse fra OpenAI, hvis nyligt opdaterede voice mode ændrede, hvordan ChatGPT taler, men stadig ikke kan bruge eksterne værktøjer til at få arbejde gjort.

En produktbeslutning, ikke en ny talemodel

For enhver, der følger med i, hvad frontier-laboratorier faktisk sender ud, er det bemærkelsesværdige aspekt af denne udgivelse, hvad Anthropic ikke byggede. Der er ingen ny tale-nativ talemodel her. Anthropic fortalte Engadget, at opdateringen “fokuserer på intelligens og adgang til værktøjer” og at de “fortsætter med at investere i tale” med “mere at dele senere i år”. Den underliggende pipeline forbliver baseret på ture: Claude lytter, pauserer for at tænke og taler herefter, og den skal angiveligt afhænge af en ekstern tekst-til-tale-udbyder som ElevenLabs til den talte output.

At dirigere en resonansmodel ind i tale er mindre en lydopgradering end en kapacitetsforbedring. En talt anmodning kan nu håndteres af en model, der planlægger og arbejder igennem et problem, hvor Haiku var indstillet til at returnere et hurtigt svar i stedet for et overvejet svar. Ændringen af, hvad tale kan gøre, kommer helt fra den model, der ligger bagved.

Det er en anden indsats end den, OpenAI laver. OpenAI har investeret massivt i et bidirectional, tale-nativt system, GPT-Live, der behandler, hvad du siger, og genererer et svar på samme tid, tættere på rytmen af et telefonopkald. Anthropic dirigerer i stedet deres stærkeste resonansmodeller ind på en konventionel talestack og accepterer de konversationsbegrænsninger, der følger med. Fordi talemodellen i sig selv er uændret, er brugere ikke sandsynligt at bemærke en mere flydende afbrydelseshåndtering eller en mere naturlig samtale.

Det er en anden indsats end den, OpenAI laver. OpenAI har investeret massivt i et bidirectional, tale-nativt system, GPT-Live, der behandler, hvad du siger, og genererer et svar på samme tid, tættere på rytmen af et telefonopkald. Anthropic dirigerer i stedet deres stærkeste resonansmodeller ind på en konventionel talestack og accepterer de konversationsbegrænsninger, der følger med. Fordi talemodellen i sig selv er uændret, er brugere ikke sandsynligt at bemærke en mere flydende afbrydelseshåndtering eller en mere naturlig samtale.

Hvad der er tilgængeligt, og hvad der mangler

Den opgraderede voice mode ruller ud i beta til alle brugere på Anthropics mobile-, desktop- og webapps. Fordi det er et spørgsmål om at dirigere eksisterende modeller i stedet for ny infrastruktur, afventer rulningen ikke, at Anthropic sender friske audiosystemer ud. Gratis konti er begrænset til Haiku-modellen og en enkelt tilkoblet app, mens Sonnet- og Opus-niveauerne er reserveret til betalende abonnenter. Multisproget input, tilføjet tidligere i år, er inkluderet, selv om Claude stadig ikke kan registrere et sprogskift på egen hånd; brugere må navngive det sprog, de er ved at tale, enten højt eller i taleindstillingerne.

Vælgeren afslører Opus, Sonnet og Haiku, men ikke Claude Fable 5, Anthropics mest kapable bredt tilgængelige model, der forbliver udenfor tale for nu. Den udeladelse passer med logikken bag udgivelsen. Dette handler om at matche tale med de resonansmodeller, de fleste mennesker allerede bruger dagligt, og ikke om at skubbe grænserne for, hvad en talt assistent kan gøre.

Resultatet ligner mindre en tale-gennembrud end en strategisk erklæring. Anthropic satser på, at værdien af en talt assistent kommer fra den model, der tænker, og de værktøjer, den kan nå, og ikke fra en specialbygget lydarkitektur. Deres lovede opfølgere senere i år vil vise, hvor længe den position holder, mens OpenAI og Google fortsætter med at skubbe tale-native systemer af deres egen.

Jonas Reeve er en AI-genereret analytiker hos Unite.AI, der fokuserer på kognitiv AI, kunstig generel intelligens (AGI) og de teoretiske grundlag for maskinintelligens. Hans arbejde udforsker, hvordan læring, resonnering, hukommelse og abstraktion opstår i både biologiske og kunstige systemer, og hvordan der kan trækkes forbindelser mellem moderne AI-arkitekturer og langvarige spørgsmål i kognitiv videnskab og filosofi om sindet.
Med en konceptuel og reflekterende tilgang undersøger Jonas rammer som resonneringsmodeller, agente systemer, emergent kognition og alignment-teori, med det formål at klargøre, hvad fremgang mod AGI faktisk betyder - og hvad det ikke gør. I stedet for at jagte tidsfrister eller hype lægger han vægt på første principper, konceptuel rigor og grænserne for nuværende modeller.
Artikler skrevet af Jonas Reeve er AI-genererede og gennemgået af Unite.AIs redaktionelle team for at sikre nøjagtighed, klarhed og ansvarlig diskussion af avancerede AI-koncepter.