Yapay zeka modelleri ve platformları
ElevenLabs, Düşük Gecikmeli Turbo Varyantı ile Eleven V4’ü Tanıttı

ElevenLabs, 28 Eylül 2026 tarihinde Eleven v4 adlı, şirketin en duygusal modeli olduğunu belirttiği bir metin‑konuşma modelini ve ses ajanları ile gerçek‑zamanlı kullanım için tasarlanmış düşük gecikmeli bir varyant olan Eleven v4 Turbo’yu piyasaya sürdü. Her iki model de ElevenAgents, ElevenCreative ve ElevenAPI üzerinden hemen kullanılabilir; ücretsiz hesap katmanında da erişim dahildir.
Yayın gönderisi Mati Staniszewski ve Piotr Dabkowski tarafından yazıldı ve şirketin Araştırma kategorisine kaydedildi.
İfade Gücüne Odaklanan Yeni Bir Mimari
ElevenLabs, Eleven v4’ün tonu, temposu, duyguyu, karakteri ve bağlamı metinden yorumlayarak dramatik, nazik, acil, komik ya da sohbet tarzında ses üretebilen tamamen yeni bir mimari üzerine kurulduğunu ve konuşmacının kimliğini koruduğunu belirtiyor. Şirket, temel ses kalitesinin önceki modellerine kıyasla genel olarak daha yüksek olduğunu ifade ediyor.
Konuşmacı kimliklerini yakalamak için yeni bir yöntem, sesin ajan sohbetleri, sesli kitaplar ve reklamlar arasında tutarlı kalmasını sağlıyor; ayrıca sahne‑seviyesi bağlam, konuşmacıların bir konuşmada yeni söylenenlere yanıt vermesine imkan tanıyor ve şirketin daha doğal diyaloglar ürettiğini belirttiği bir deneyim sunuyor.
Satır İçi Ses Etiketleri SSML Kontrollerinin Yerini Alıyor
Kullanıcılar doğal dilde yönlendirme yapabilir ve satır içi ses etiketleri ekleyebilir; şirket örnekleri arasında kahkaha, Fransız aksanıyla öfkeli bir şekilde söylenmiş cümle, hafif yağmur ve telefon titreşimi bulunuyor. ElevenLabs, modelin bu ses etiketlerini ve yönlendirme komutlarını önceki modellerine göre daha doğru takip ettiğini söylüyor. Uluslararası Fonetik Alfabesi (IPA) fonemleri desteği önemli ölçüde iyileştirildi, böylece özelleştirilmiş telaffuzlar daha güvenilir çalışıyor ve ElevenLabs geliştirici belgeleri API kullanımı için tam etiket sözdizimini kapsıyor. Ürün sayfası SSS’ye göre, SSML etiketleri gibi <break> Eleven v4’te devre dışı bırakılmıştır; bunun yerine doğal‑dil etiketleri kontrol mekanizması olarak kullanılmaktadır.
Turbo Varyantı ve Gecikme Ölçümleri
Gerçek‑zamanlı kullanım için ElevenLabs, araştırma ve mühendislik ekiplerinin Eleven v4 Turbo’yu ElevenAgents sohbet platformu ile tek bir sistem olarak optimize ettiğini belirtiyor. Turbo, çift yönlü akışı destekler; böylece bir cümle tamamlanmadan ses geri gelmeye başlar.
Duyurunun dipnotlu metodolojisi, Eleven v4 Turbo’nun Eylül 2026 testlerinde WebSocket akışı üzerinden aynı senaryolar ve varsayılan ayarlarla çalıştırılan testlerde ortalama ilk konuşma süresinin yaklaşık 150 milisaniye olduğunu, bu sürenin Cartesia Sonic 3.6, xAI TTS, Google Gemini Flash‑Lite TTS ve OpenAI GPT‑4o mini TTS karşısında ölçüldüğünü ve ağ gecikmesinin tüm sistemler için ölçülüp çıkarıldığını belirtiyor. Şirketin ürün sayfasındaki karşılaştırma grafiği, referans değer olarak 150 ms’yi gösterirken, Cartesia Sonic 3.6 için 262 ms ve OpenAI GPT‑4o mini TTS için 814 ms bildiriyor. Duyuru ayrıca Turbo için ortalama çıkarım gecikmesinin yaklaşık 100 ms olduğunu ve bunun iki kişi arasındaki ortalama konuşma arası boşluktan daha hızlı olduğunu iddia ediyor.
Diller, Ses Klonlama ve Uzun Formlu Ses
Her iki model de 90’dan fazla dili destekliyor. Şirket, bir dilde kaydedilen bir sesin artık diğer dilleri akıcı bir şekilde konuşabildiğini, yerel bir konuşmacının aksanını benimseyebildiğini ve bu aksan uyumunun nesil sürecinde kaynağa geri dönmediğini belirtiyor.
Anlık Ses Klonları artık 10 saniyelik bir ses kaynağından yüksek doğrulukla bir sesi yakalayabiliyor; şirket ayrıca bu klonların Multilingual v2 modelinin Profesyonel Ses Klonlarından daha iyi performans gösterdiğini söylüyor. Eleven v3’te bulunmayan Profesyonel Ses Klonları yeniden destekleniyor ve modelin tam duygusal aralığıyla çalışıyor. Her klon, anlık ya da profesyonel, ses sahibinin doğrulanmış onayını gerektiriyor ve üretilen ses, ElevenLabs’ın AI Speech Classifier teknolojisi tarafından AI‑türevi olarak tespit edilebiliyor.
İstek birleştirme, daha uzun içerikler için nesillerin zincirlenmesi, Eleven v4’te önemli ölçüde daha güvenilir; bu, ElevenLabs Studio ve ElevenLabs Reader Uygulaması’nda çalışma deneyimini iyileştiriyor. Tek bir nesil 10 000 karaktere kadar destekliyor; bağlam birleştirme, daha uzun senaryolarda tempo ve teslimatı tutarlı tutuyor.
Şirket Tarafından Raporlanan Kıyaslama Sonuçları
ElevenLabs, Eleven v4’ün Eylül 2026’da Artificial Analysis Provider Voice Arena Liderlik Tablosu’nda birinci sırada yer aldığını ve kör karşılaştırmalı testlerde dinleyicilerin yaklaşık %75’inin tercih ettiğini rapor ediyor. Dipnotlu metodoloji, bu Eylül 2026 testlerinin modeli Cartesia Sonic 3.6, Inworld TTS‑2, Google Gemini 3.8 Flash‑Lite TTS ve Google Gemini 3.8 Flash TTS ile karşılaştırdığını, değerlendiricilerin aynı satırı Eleven v4 ve bir rakipten kör bir şekilde duyduğunu, hangisinin daha ifadeli ve daha doğal olduğunu yargılayarak ve eşitlikleri yarı puan olarak saydığını belirtiyor. Duyurudaki bir grafik, Eleven v4’ün bu eşleşmelerde %65‑%81 oranında kazandığını gösteriyor.
API Erişimi, Fiyatlandırma ve Uyumluluk
Her iki model de TypeScript ve Python SDK’larıyla REST ve akış uç noktaları üzerinden erişilebilir ve geliştiriciler tek bir model_id ile modeller arasında geçiş yapabilir. Çıktı formatları, diğer tüm ElevenLabs modelleriyle aynı: stüdyo ve post‑prodüksiyon çalışmaları için MP3, sıkıştırılmamış WAV/PCM ve telefon ve çağrı merkezi entegrasyonları için µ-law, örnekleme hızı ve bit hızı API aracılığıyla ayarlanır.
Fiyatlandırma, şirketin diğer metin‑konuşma modellerindeki aynı kredi yapısını izler: ayda 10.000 kredi içeren ücretsiz katman, bu da şirketin yaklaşık 10 dakikalık sesle eşdeğer olduğunu belirttiği; ayda 6 $’dan başlayan ve profesyonel ses klonlamasını içeren ücretli planlar; ve özel kurumsal fiyatlandırma. Şirketin 17.500’den fazla ses içeren kütüphanesindeki her ses, Eleven v4 ile çalışır, ancak lansmandan önce oluşturulan anlık ve profesyonel klonların yeni modelde etkili çalışabilmesi için yeniden eğitilmesi gerekir.
ElevenLabs, Eleven v4’ün SOC 2 Type II, ISO 27001 ve PCI DSS Level 1 sertifikalı altyapı üzerinde çalıştığını, sağlık hizmetleri için HIPAA uygun iş akışlarıyla GDPR uyumlu olduğunu, izinsiz senaryolar veya ses etiketleri üzerinde eğitim yapmadığını ve uygun kurumsal hizmetler için Sıfır Saklama Modu sunduğunu belirtmektedir.
Eleven v4 ürün sayfası, Ryan Peterson (Salesforce’ta Agentforce Voice ürününün SVP’si) gibi isimlendirilmiş müşterilerden açıklamalar içeriyor; Peterson şöyle diyor: “Tam da Eleven v4 Turbo’nun çıtayı yükselttiğini, daha hızlı ve daha doğal yanıtlarla müşterilerimizin beklediği standardı karşıladığını görüyoruz.” BeyondWords kurucu ortağı Patrick O’Flaherty, Spring Financial kredi oluşturma ürünleri başkanı Oscar Daniels ve Accenture Accelerate müzik ve ses lideri Kyle Gudmundson da yeni modeller hakkında açıklamalarda bulundu.
ElevenLabs, geliştiricileri tam audio-tag sözdizimi ve API entegrasyon detayları için belgelerine yönlendiriyor.












