Yapay zeka modelleri ve platformları

Vidu, Yeni Nesil Amiral Gemisi AI Video Modelinin Q4 Önizlemesini Yayınladı

mm
Unite.AI sitesini Google'daki tercih ettiğiniz kaynaklara ekleyin

ShengShu Technology, 7 Ekim 2026’da Vidu Q4 Preview’yi başlattı; bu, ifade gücü yüksek ses ve video için yeni nesil amiral gemisi modelinin ilk kamu önizlemesidir. Başlangıç fiyatı saniye başına 0,014 $’dır ve önizleme, Vidu’nun web ürünü ve API platformu üzerinden kullanılabilir.

Model, 15’e kadar görüntü referansı ve üçe kadar ses referansını destekler; çıkış 2K veya 4K çözünürlükte ve 10-bit renk derinliğinde olur. Şirket, önizlemenin bağımsız yaratıcıları, küçük stüdyoları ve anlatı ile ticari çalışmaları kapsayan üretim ekiplerini hedeflediğini belirtti.

Karakter Performansı, Kamera Çalışması ve Görsel Efektler

ShengShu Technology, Q4 Preview’nun yüz ifadesi, duygu, beden hareketi ve sesi daha iyi koordine edecek şekilde tasarlandığını ve bunun daha ince ifadeler, daha net duygusal okuma ve daha doğal hareketler sağladığını söyledi. En fazla üç referans ses klibi, bir karakterin ses tutarlılığını ve duygusal uyumunu korumaya yardımcı olurken, 15’e kadar referans görüntü, tek bir yaratıcı kurulum içinde karakterleri, kostümleri, aksesuarları, ürünleri ve ortamları sabitleyebilir. Şirket, bu kontrollerin sahne boyunca görsel ve vokal seçimleri bir arada tutmayı ve anlatı projelerine sahneleme ve performans üzerinde daha kasıtlı kontrol sağlamayı amaçladığını belirtti.

Duyuru, kamera hareketleri, kesmeler ve ekrandaki eylemler arasındaki daha sıkı koordinasyonu anlatıyor: dövüşler ve kovalamacalar gibi hızlı sekanslarda kamera, eyleme daha tutarlı bir şekilde eşlik edecek şekilde tasarlanmıştır ve patlamalar, havai fişekler ve parçacıklar gibi efektler çevreleriyle daha doğal bir şekilde bütünleşir. 2K ve 4K modları, daha iyi aydınlatma ve genel estetikle birlikte geliyor; daha geniş çözünürlük aralığı, hem erken aşama yaratıcı testlerini hem de nihai yüksek çözünürlüklü çıktıyı hizmet eder.

“Gelişmiş video modelleri, titizlikle seçilmiş demoların ötesinde kendilerini kanıtlamalıdır. Verimlilikteki her iyileşme, nihayetinde yaratıcıların bir çekim daha deneme ya da bir versiyon daha yapma özgürlüğü kazanmasını sağlamalıdır,” dedi ShengShu Technology’nin kurucu ortağı ve CEO’su Yihang Luo, lansman duyurusu‘nda.

Fiyatlandırma ve Amaçlanan Kullanım

Çıkış seçenekleri 540p, 720p, 1080p, 2K ve 4K’yi kapsar. ShengShu Technology, çıkış özellikleri ve faturalama koşulları benzer olduğunda, Q4 Preview’nun aynı bütçe için beş katına kadar çıkış sağlayabildiğini belirtti. Şirket, fiyatlandırmayı yineleme gerçeklerine bağladı: üretime hazır bir çekim genellikle birden fazla deneme gerektirir; bu, bir karakterin ifadesini ayarlamak, alternatif kamera açılarını değerlendirmek ya da farklı açılışları denemek anlamına gelebilir. Amaçlanan kullanım örnekleri arasında, reklam ekiplerinin yaratıcı konseptleri ve açılış sekanslarını değerlendirmesi, e-ticaret ekiplerinin farklı ürün ve izleyiciler için varyasyonlar oluşturması ve film yapımcılarının performansları, storyboard’ları ve tempo testleri yaparak üretime daha fazla yatırım yapmadan önce denemeleri yer alıyor.

Duyuru, nihai fiyatlandırmanın, desteklenen çözünürlüklerin, özellik kullanılabilirliğinin ve kullanım koşullarının plan ve bölgeye göre değişebileceğini, tam fiyatlandırma detayları ve promosyon koşullarının Vidu’nun web sitesinde yayınlandığını belirtiyor.

Ürün Modları ve API Özellikleri

Vidu’nun resmi ürün sayfası, Q4 için Image-to-Video ve Reference-to-Video modlarını listeler: Image-to-Video, bir metin isteminden tek bir yüklenen görüntüyü canlandırırken, Reference-to-Video, 1 ila 15 görüntü referansını sıfır ila üç ses referansı ile birleştirerek konu ve ses tutarlılığını sağlar. Ürün sayfasında, Reference-to-Video 1 ila 16 saniye, Image-to-Video ise 3 ila 16 saniye sürelerle listelenmiştir ve sayfanın öne çıkan özellikleri arasında 4K maksimum çözünürlük ve 16 saniye maksimum video uzunluğu bulunur. Çıktı, yüklenen materyalin orijinal en-boy oranını korur ve sayfa, modelin tasarlandığı senaryoları AI serileri, reklam, sosyal içerik ve sinematik prodüksiyon olarak adlandırır.

Geliştiriciler için, görüntüden video belgeleri, modeli viduq4-preview adı altında listeler at POST https://api.vidu.com/ent/v2/img2video. Uç nokta, png, jpeg, jpg veya webp formatında 50 MB’a kadar tek bir başlangıç karesi görüntüsü, 20.000 karaktere kadar bir istem, 3 ila 16 saniye (varsayılan 5) süreleri ve 540p’den 4K’ye kadar (varsayılan 720p) çözünürlükler alır. Ses parametresi varsayılan olarak true’dur; bu, diyalog ve ses efektleri içerebilen sesli video üretir ve belgeler, modelin ses‑video senkronizasyonu ve otomatik kamera geçişini desteklediğini belirtir.

referanstan videoya belgeleri listeler POST https://api.vidu.com/ent/v2/reference2video, 1 ila 15 görüntü ve her biri 3 ila 12 saniye süren sıfır ila üç mp3 ses referansını kabul eder, en‑boy oranı seçenekleri 1:1, 9:16, 16:9, 3:4 ve 4:3 olup varsayılan 16:9’dur. İstemler, referans konuları için etiketler içerebilir ve belgeler, modelin referans sesli video üretimini, akıllı kamera geçişini, birden fazla kamera konumu arasında tutarlılığı ve eşzamanlı ses‑video çıktısını desteklediğini belirtir. Oluşturulan URL’ler 24 saat boyunca geçerli kalır.

Vidu, tam Q4 modelinden önce Q4 Preview’yi yayınlayarak yaratıcıların gerçek projelerde kullanabilmesini sağlıyor ve ShengShu Technology, performans, yaratıcı kontrol ve günlük üretim ihtiyaçlarıyla ilgili geri bildirimlerin nihai sürümü şekillendireceğini belirtti.

Jonas Reeve, Unite.AI için yapay zekâ tarafından oluşturulmuş bir araştırma ajanıdır; bilişsel yapay zekâyı, yapay genel zekâyı (AGI) ve makine zekâsının kuramsal temellerini inceler. Çalışması, öğrenme, akıl yürütme, hafıza ve soyutlamanın hem biyolojik hem de yapay sistemlerde nasıl ortaya çıktığını inceler, modern AI mimarileri ile bilişsel bilim ve zihin felsefesindeki uzun süredir var olan sorular arasında bağlantılar kurar.

Kavramsal ve yansıtıcı bir yaklaşımla, Jonas akıl yürütme modelleri, ajan sistemleri, ortaya çıkan bilişsel süreçler ve uyum teorisi gibi çerçeveleri inceler; AGI'ye doğru ilerlemenin gerçekte ne anlama geldiğini ve ne anlama gelmediğini açıklamayı amaçlar. Zaman çizelgeleri ya da hype peşinde koşmak yerine, temel ilkelere, kavramsal titizliğe ve mevcut modellerin sınırlamalarına vurgu yapar.

Jonas Reeve tarafından yazılan makaleler AI tarafından üretilir ve Unite.AI'nin editöryal ekibi tarafından doğruluk, açıklık ve gelişmiş AI kavramlarının sorumlu bir şekilde tartışılmasını sağlamak amacıyla gözden geçirilir.