Yapay zeka modelleri ve platformları

Claude 3.7 Sonnet, Anthropic’in AI Dirilişi

mm
Unite.AI sitesini Google'daki tercih ettiğiniz kaynaklara ekleyin

Anthropic, Claude 3.7 Sonnet‘i yayınladı, büyük dil modeli (LLM) ailesine uzun süredir beklenen bir güncelleme. Şirketin “bugüne kadarki en akıllı modeli” ve ilk hibrit akıl yürütme AI olarak tanıtılan Claude 3.7 Sonnet, önceki sürümüne (Claude 3.5 Sonnet) göre hız, akıl yürütme ve gerçek dünya görevi performansı açısından önemli iyileştirmeler sunuyor.

Bu güncelleme, OpenAI ve xAI’nin recent Grok 3‘ün ardından geliyor ve birçok AI meraklısını (ben dahil) bu lansmanı Anthropic’in recent yeniliklere verdiği cevap olarak görmeğe yöneltiyor. Yeni model, hızlı sohbet cevapları ile derin analitik düşünceyi bir sistemde birleştirmeyi amaçlıyor – bu, gelecekte AI ile etkileşimin nasıl olacağını gösterebilecek birleşik bir yaklaşım.

Uzun Süre Beklenen Sevgili AI Asistanı Güncellemesi

Çok sayıda düzenli AI kullanıcısı için Claude 3.5 Sonnet, zaten en iyilerinden biri olarak görülüyordu. Ancak son aylarda Anthropic, artan bir baskı ile karşı karşıya kaldı. AI endüstrisi, yeni özellikler ve modeller ile deli gibi gidiyordu – OpenAI’nin ChatGPT’si ses, çok adımlı akıl yürütme yetenekleri ve derin araştırma kazandı. Grok 3, gerçek zamanlı X verisi ile debut yaptı ve diğer platformlar gibi Perplexity ve Gemini güncellemeleri devam etti. Çok sayıda gözlemci, Anthropic’in geride kaldığını belirtmeye başladı. Topluluk, Anthropic’in cevabını sabırsızlıkla bekliyordu ve bir yeni Claude modelinin çıkması bekleniyordu.

Claude 3.7 Sonnet, bu beklentileri karşılamak için sonunda geldi.

Bu, Claude 3.5’ten önemli bir sıçrama, küçük bir düzenleme değil.

Anthropic, bunu kapsamlı bir güncelleme olarak tanıtıyor: daha hızlı, daha akıllı ve daha çok yönlü.

Hibrit Akıl Yürütme: Hızlı Cevaplar ve Derin Düşünce Bir Arada

Claude 3.7 Sonnet’in başlıca özelliği, hibrit akıl yürütme yeteneğidir. Basitçe söylemek gerekirse, bu model iki modda çalışabilir: standart mod için gần anında cevaplar ve yeni bir “Uzatılmış Düşünme” modu, burada AI, sorunları adım adım çalışarak, kullanıcıya akıl yürütme zincirini gösterir.

Anthropic, ayrı bir Claude akıl yürütme sürümü çıkarmak yerine, hem hızlı hem de derin düşünceyi bir AI’de birleştirdi. “İnsanlar, hızlı cevaplar ve derin düşünce için tek bir beyin kullanır, biz de akıl yürütmeyi entegre bir yetenek olarak görüyoruz… ayrı bir model olarak değil,” diye açıkladı şirket, duyuruda, kullanıcı deneyimi için birleşik bir yaklaşımı vurguladı.

Pratikte, bu, kullanıcıların hızlı bir cevap istediğinde ve Claude’un uzun uzun düşünmesi gerektiğinde karar vermeleri anlamına gelir. Basit bir geçiş, uzatılmış moda geçiş için izin verir, eğer bir soru ayrıntılı analiz veya çok adımlı mantık gerektiriyorsa. Standart modda, Claude 3.7 Sonnet, 3.5’in geliştirilmiş bir versiyonu gibi çalışır – daha hızlı ve daha rafine, ancak tanıdık hızlı sohbet tarzı ile. Uzatılmış modda, AI “kendini yansıtır” önce cevaplar, akıl yürütme sürecini içten yazarak (ve görünür kılarak) daha doğru veya karmaşık çözümlere ulaşır.

Akıl yürütme zinciri, adım adım ekran üzerinde görünür, bu özellik diğer gelişmiş AI sistemlerinde popüler hale geldi ve şimdi nihayet Claude’a geldi.

Alex McFarland/Unite AI

Anthropic’in burada ki felsefesi, bazı rakiplerle bilinçli olarak çelişiyor. OpenAI, örneğin, ayrı modeller veya modlar sunuyor, bu da bazı kullanıcılar için karıştırıcı olabilir. Claude 3.7’nin tümleşik yaklaşımı, kullanıcılar için şeyleri basitleştirmeyi amaçlıyor. Modlar arasında geçiş yapmak basittir ve.prompt stili aynı kalır. Güç kullanıcıları, AI’nin ne kadar düşündüğünü bile ayarlayabilir: API aracılığıyla, geliştiriciler, akıl yürütme için bir token bütçesi ayarlayabilir, Claude’a ne kadar düşünmesi gerektiğini söyler (sadece birkaç adımdan 128k-token’lik bir düşünme sürecine kadar). Bu granül kontrol, hız ile derinlik arasında ticaret yapma izni verir.

Claude 3.7 Sonnet’te Ana İyileştirmeler:

Claude 3.7 Sonnet’te gördüğümüz bazı ana iyileştirmeler şunlar:

  • Hibrit Akıl Yürütme Modları – Hem anında cevaplar hem de uzatılmış düşünme modu sunar, burada AI, sorunları adım adım çalışarak, akıl yürütme zincirini gösterir.
  • Birleşik Model Felsefesi – Hızlı ve yansıtıcı düşünceyi tek bir AI “beyni”nde entegre eder, bu da kullanıcılar için kullanım kolaylığı sağlar.
  • Hız ve Yanıtlama – Claude 3.5’ten daha hızlı cevaplar verir.
  • Genişletilmiş Düşünme Kontrolü – API aracılığıyla, kullanıcılar AI’nin akıl yürütme süresini sınırlayabilir veya uzatabilir (128.000 token’e kadar), bu da hız ile kalite arasında denge kurulmasını sağlar.
  • Gerçek Dünya Görevi Odaklı – Şirketin açıklamasına göre, Claude 3.7’nin eğitimi, zor matematik olimpiyat yarışmaları yerine pratik iş ve yaratıcı görevlere yöneltildi.
  • Kodlama ve Araç Kullanımı – Programlama görevlerinde, özellikle ön uç web geliştirme konusunda daha güçlü performans gösterir.

Kısıtlamalar ve AI Kullanıcıları için Sonraki Adımlar

Tüm bu heyecana rağmen, Claude 3.7 Sonnet sınırlamaları olmadan değil. Anthropic, bu modeli eğittiğinde, belirli alanları vurgulamayıconscious olarak azalttı. “Matematik ve bilgisayar bilimi yarışma problemleri için biraz daha az optimize edildi” diye açıkladı, bunun yerine daha çok günlük iş görevlerine odaklandı. Bu, Claude 3.7’nin matematik ve kodlama sorularını çözebileceği, ancak her akademik benchmark veya yarışmada lider olmayabileceği anlamına gelir. Kullanıcıların ihtiyaçları, karmaşık matematik kanıtları veya özel kodlama yarışmalarına yönelik ise, Claude’un cevaplarının tekrar kontrol edilmesi gerekebilir veya bir rakip modelin bu niş için daha iyi performans gösterebileceği alanlar olabilir. Anthropic, bu ticaretin farkında görünüyor ve modeli, teorik yetenek yerine pratik fayda için tasarlıyor.

Ek olarak, Uzatılmış Düşünme modu, bazı karmaşıklık getiriyor. Standart moddan daha yavaştır; AI, derin düşünme modundayken, kullanıcılar, AI’nin sorunları çalıştırırken kısa bir duraklama görebilir. Bu, hız ile derinlik arasında ticaret yapmanın bir parçası, ancak kullanıcıların, bu ek güçü gerçekten ihtiyaç duyup duymadıklarını değerlendirmeleri gerekiyor. Çoğu günlük sohbet sorgusunda, standart mod yeterli ve daha verimli olacaktır. Ayrıca, uzatılmış akıl yürütme bazen fazla bilgi sağlayabilir ve konudan sapabilir. Anthropic, AI’nin fikirlerini sunarken relevant ve konuya bağlı kalmasını sağlamak zorunda kalacak. Kullanıcılar, daha precisa.promptlar yazmayı veya token limitleri ayarlamayı öğrenebilirler.

Sonuç

Claude 3.7 Sonnet’in çıkışı, Anthropic’in OpenAI, Google (GOOGL ) /DeepMind ve yeni oyuncular gibi xAI ile birlikte oyunun içinde olduğunun bir beyanı. AI meraklıları ve geliştiriciler için, bu, deneyebileceği bir başka üst düzey model ekliyor, bu model, hibrit akıl yürütme ile benzersiz bir yaklaşım sunuyor.

Rekabetçi AI endüstrisinde, Anthropic’in bu hamlesi, şirketlerin modellerini nasıl konumlandırdıklarını da etkileyebilir. Büyük bir model boyutu atlayışını veya çok modlu bir demo yapmaktansa, kullanıcı deneyimi (modların birleştirilmesi, hız, pratik kullanım durumları) üzerine odaklanmayı seçerek, Anthropic, kullanışlılık ve güvenilirlik odaklı bir niş oluşturuyor.

Genel olarak, Claude 3.7 Sonnet, Anthropic için bir dönüm noktası. Bu, Claude serisinin bir evrimi, şirketin topluluğun ihtiyaçlarından öğrenerek, güçlü yönlerine odaklanarak ve zayıflıkları ele alarak. Hala izlenmesi gereken alanlar var (ve gelecekteki Claude iterasyonlarını anticip etmek için), ancak bu çıkış,明确 olarak Anthropic’in kullanıcı tabanını canlandırdı.

Alex McFarland yapay zeka muhabiri ve yazarıdır ve yapay zekadaki son gelişmeleri araştırıyor. Birçok yapay zeka başlangıç şirketi ve dünya çapındaki yayınlarda işbirliği yaptı.