Yapay zeka modelleri ve platformları

Antropik, Opus ve Sonnet’i Claude Ses Moduna Getiriyor

mm
Unite.AI sitesini Google'daki tercih ettiğiniz kaynaklara ekleyin

Antropik, Claude’un ses modunu daha güçlü modellere açtı ve böylece konuşulan sohbetler artık Haiku modelinin yerine Opus ve Sonnet katmanlarında çalışabiliyor. Şirket, bu değişikliği 23 Temmuz 2026 Perşembe günü onayladı ve bunu, Claude ile konuşmanın gerçek iş için değil, sadece hızlı aramalar için değil, faydalı olmasını sağlamak için bir yol olarak sundu.

Antropik’in ses modu belgelerine göre, bu özellik şimdi bir kullanıcı son olarak metin sohbetinde seçtiği modelle başlar ve varsayılan olarak en hızlı sürümünü çalıştırır, böylece bir oturum, arkasındaki modelin zekasını devralır. Kullanıcılar ayrıca bir konuşma sırasında Haiku, Sonnet ve Opus arasında bir model seçici aracılığıyla geçiş yapabilir. Uygulamada, bu, Haiku yalnızca kurulumun kötü şekilde ele aldığı çalışmaları açar: daha uzun akıl yürütme, bir müşteri teklifinin nasıl ifade edildiğine ilişkin geri bildirim veya araç yoğun talepler gibi bir e-posta taslağı oluşturma ve bir takvim bölmesini sesli olarak güncelleme.

Ses modu ayrıca Gmail, Google Takvim, Google Belgeler ve Slack gibi bağlı uygulamalara ulaşabilir, böylece bir sesli istek, bir kullanıcının kendi hesaplarından bağlam getirebilir veya bir eylem gerçekleştirebilir, örneğin bir toplantı yeniden planlayabilir. Bu uygulama entegrasyonu, OpenAI’nin recently güncellenen ses modundan en açık şekilde ayrılan noktadır ve hala outside araçları kullanarak işleri halletmek için kullanılamaz.

Ürünün kararı, yeni bir ses modeli değil

Bu sürümün dikkat çekici kısmı, Antropik’in ne inşa etmediğidir. Burada yeni bir konuşma yerli ses modeli yok. Antropik, Engadget‘e güncellemenin “zeka ve araç erişimine odaklandığını” ve “ses üzerinde daha fazla yatırım yaptıklarını” ve “bu yıl daha fazla şey paylaştıklarını” söyledi. Altındaki boru hattı hala döndürme tabanlıdır: Claude dinler, düşünmek için durur, sonra konuşur ve outside bir metin-ses sağlayıcısı gibi ElevenLabs’a güvenerek sesli çıktıyı ürettiği bildiriliyor.

Bir akıl yürütme modelini sesli hale getirmek, sesli bir yükseltme değil, bir yetenek yükseltmesidir. Bir sesli istek artık, bir problemi planlayabilen ve çalışabilen bir model tarafından ele alınabilir, oysa Haiku hızlı bir cevap vermek için ayarlanmıştı. Sesin ne yapabileceği değişikliği, arkasındaki modelden gelir.

Bu, OpenAI’nin yaptığı bahislerden farklıdır. OpenAI, bir bidirectional, konuşma yerli sistemine, GPT-Live’a, kaynak ayırmıştır ve bu sistem, söylediğiniz şeyi işler ve aynı anda bir cevap üretir, bir telefon görüşmesinin ritmine daha yakın bir şekilde. Antropik ise, en güçlü akıl yürütme modellerini geleneksel bir ses yığınına yönlendiriyor ve bunun getirdiği konuşma sınırlarını kabul ediyor. Ses modeli kendisinin değişmediği için, kullanıcılar, daha pürüzsüz kesinti işleme veya daha akıcı bir ileri geri işlemeye dikkat çekmezler. Değişen, Claude’un sorduğu şeyi nasıl düşündüğüdür, nasıl seslendirildiği değil.

Bu ticaret, Claude kullanıcılarının zaten yüzleştiği bir soruya karşılık gelir: en yetenekli model her zaman görev için doğru olan değildir. Daha ağır bir model seçmek, hız pahasına derinlik satın alır ve sesli sohbetler, özellikle gecikme açısından çok hassastır. Kullanıcının eline seçim koymak, herkesi en hızlı seçeneğe varsayılan olarak ayarlamaktan daha pratiktir, güncellemenin somut içeriğidir.

Ne mevcuttur ve ne eksik?

Yükseltilmiş ses modu, tüm kullanıcılar için mobil, masaüstü ve web uygulamalarında beta olarak yayımlanıyor. Bu, yeni altyapıya değil, mevcut modellerin yönlendirilmesine bağlı olduğu için, dağıtım, Antropik’in yeni ses sistemleri göndermesini beklemiyor. Ücretsiz hesaplar, Haiku modeline ve tek bir bağlı uygulamaya bağlı kalıyor, Sonnet ve Opus katmanları ise yalnızca ücretli abonelere ayrılmıştır. Bu yıl daha önce eklenen çok dilli girdi dahil olmak üzere, Claude hala kendi başına dil değişikliğini algılayamaz; kullanıcılar, konuşacakları dili, ya yüksek sesle ya da ses ayarlarında söylemelidir.

Seçici, Opus, Sonnet ve Haiku’yu ortaya koyar, ancak Claude Fable 5, Antropik’in en yetenekli geniş çapta mevcut modeli, sesli konuşmadan şu anda hariç tutulur. Bu eksiklik, sürümün mantığına uymaktadır. Bu, sesi, insanların günlük olarak kullandığı akıl yürütme modellerine eşleştirmekle ilgili, değil, bir sesli asistanın ne yapabileceğinin sınırlarını zorlamakla ilgili.

Sonuç, bir sesli atılımdan daha çok bir strateji beyanı gibi okunur. Antropik, bir sesli asistanın değerinin, modelin düşünmesinden ve ulaşabileceği araçlardan geldiğine, özel bir ses mimarisinden değil, bahse girmektedir. Bu yılın ilerleyen döneminde vaat edilen takip eden güncellemeler, bu konumun, OpenAI ve Google’nin kendi konuşma yerli sistemlerini ilerletmeye devam ettikçe ne kadar süreceğini gösterecektir.

Jonas Reeve bilişsel AI, yapay genel zeka (AGI) ve makine zekasının teorik temelleri üzerine odaklanan Unite.AI'de AI tarafından oluşturulan bir analisttir. Çalışmaları, öğrenme, akıl yürütme, bellek ve soyutlama gibi kavramların hem biyolojik hem de yapay sistemlerde nasıl ortaya çıktığını keşfederek, modern AI mimarileri ile bilişsel bilim ve zihin felsefesindeki uzun süredir devam eden sorular arasında bağlantılar kurar.
Kavramsal ve düşünceli bir yaklaşım benimseyen Jonas, akıl yürütme modelleri, ajan sistemleri, ortaya çıkan biliş ve hizalama teorisi gibi çerçeveleri inceleyerek, AGI'ye doğru ilerlemenin ne anlama geldiğini - ve ne anlamadığını - açıklamayı amaçlar. Zaman çizelgesi veya hırs peşinde koşmak yerine, ilk ilkeleri, kavramsal titizliği ve mevcut modellerin sınırlarını vurgular.
Jonas Reeve tarafından yazılan makaleler AI tarafından oluşturulur ve Unite.AI'nin editör ekibi tarafından advanced AI kavramlarının doğruluğu, açıklığı ve sorumlu tartışması için gözden geçirilir.