Düşünce Liderleri

Çocukların AI’si ChatGPT’den Önce Geldi – Şimdi Google’ı Çocukların Konuşma Tanıma Konusunda Geride Bıraktı

mm
Unite.AI sitesini Google'daki tercih ettiğiniz kaynaklara ekleyin

Dil öğrenme uygulamaları pazarı çocuklar için giderek kalabalıklaşıyor ve artan bir şekilde inceleniyor. Geçen hafta, kâr amacı gütmeyen Common Sense Media yayınladı Gençlik AI Güvenlik Enstitüsü, AI ürünlerini çocuklar için stres testi yapan ilk bağımsız laboratuvarı destekleyen 20 milyon ABD Doları yıllık bir yatırım ile – AI zaten dijital dil öğrenme ürünlerinde gelirin %33.5’ini oluştururken gerçekleşen bir baskı.

Aynı zamanda, bu segmentin çocuklar bölümü alone 2026’da 2.38 milyar ABD Doları’ndan 2035’te 5.17 milyar ABD Doları’na zıplama bekleniyor. Açıkça, para AI entegrasyonuna paralel olarak hareket ediyor – ancak denetim de öyle.

Araştırma Colorado Üniversitesi’nin AI Enstitüsü tarafından belgelenmiştir: konuşma tanıma doğruluğu çocuklar için yetişkinlerden podstat olarak daha düşük çünkü çoğu ticari sistem yetişkin konuşmacıların temiz seslerinden oluşur – genellikle senaryolardan okuyarak.

2024 makale nedenini güçlendirmektedir: çocukların sesleri yetişkinlere göre hızlı, öngörülemez değişiklikler içerir ve yetişkin eğitimi gören modelleri yanıltır.

Ve, uygulamada, bu bir altı yaşındaki çocuğun İngilizce öğrenirken sistem tarafından yanlış anlaşıldığı, cevap vermediği veya yanlış cevap verdiği anlamına gelir. Çocuk öğrenme ilgisi kaybeder; ebeveyn para kaybeder.

Bu, Ivan Crewkov’un 2018’de, büyük dil modellerinin ana akım bir konuşma konusu haline gelmesinden dört yıl önce çalışmaya başladığı sorunudur.

Tanışıklık Noktası

Crewkov’un edtech alanına girişi kişisel idi. Ailesi 2014’te Sibirya’dan Kaliforniya’ya taşındığında, kızı Sofia dört yaşındaydı ve anaokulunda İngilizce öğrenmekte zorlanıyordu. Her kullanılabilir aracı denedi ve hepsinde aynı boşlukları buldu.

“Genellikle okumayı içeriyordu, ki bunu henüz yapamıyordu, çok fazla iş gibi hissediyordu ve konuşma uygulaması sunmuyordu – çocukların yeni bir dil öğrenmesi için kritik olan,” Unite AI’ye söyledi.

Sonra canlı online öğretmenlere yöneldi, oturumları kaydetti ve beklemediği bir şey fark etti. “Öğretmenler gerçekten ekranlarından okuyordu” dedi ve birçokları sertifikalı eğitimciler değildi; her oturum 15 ila 20 dolar maliyeti vardı.

AI geçmişinden gelen Crewkov’un durumu okumaya göre basitti: “Bunun %80’inin sanal, konuşan bir AI karakteri ve konuşma tanıma kullanarak yapılabilir olduğu açıktı. Bu aynı zamanda pazarı dramatik bir şekilde demokratikleştirecekti çünkü çok pahalıydı,”

“Fikir, bir ders ücretinin maliyetinde bir ay öğrenme sağlamak” diye ekledi. Bu fikir Buddy.ai oldu.

Yaklaşık 10.8 milyon genç çocuk – tüm ABD’deki dokuz yaşından küçük çocukların %32’si – iki dilli öğrenenler (DLL’ler) – en az bir ebeveyni evde İngilizce’den başka bir dil konuşuyor – Göç Politikası Enstitüsü’ne göre. Aslında, 2000’den bu yana, bu nüfus %24 arttı ve DLL’ler şimdi 24 eyalet ve Washington DC’de genç çocuk nüfusunun %20’sinden fazlasını oluşturuyor.

Bunlar muhtemelen Buddy.ai gibi platformların sunduğu şeyi arayan ailelerdir – ve aynı zamanda tutarlı, yüksek kaliteli erken çocukluk programlarına erişim konusunda en az şanslı olanlardır, low-income hanehalklarının %43’ü ile karşılaştırıldığında non-DLL çocuklarının %33’ü.

Ticari mantık açık. Daha zor soru, teknolojinin gerçekten teslim edip etmediği.

Özel Olarak Tasarlanmış, Değil Geri Dönüştürülmüş

Crewkov, çocuklar için inşa etme ile çocuklar için uyarlama arasındaki farkı mimari olarak, kozmetik olarak değil, açıklar. “Çocuklar için AI inşa etmek, her şeyi çocukların sesleri, davranışları, düzenleme ve dikkat süreleri etrafında inşa etmek anlamına gelir – yetişkin bir sohbet botunu ‘çocuk moduna’ sokmaya çalışmak yerine.”

Temel problem akustik. “Yetişkin LLM yığınları yetişkin metni ve konuşmayı varsayar: uzun gramerli cümleler, stabil telaffuz ve sessiz ortamlar. Altı yaşındaki bir çocuk size bunun tersini verir: parçalı ifadeler, telaffuz hataları, bağırma, güçlü aksanlar ve arka plan gürültüsü.”

Buddy’nin konuşma tanıma sistemi, gerçek çocuk sesleri, aksanları ve gürültülü ev ortamları üzerinden eğitildi ve sürekli olarak yeniden eğitildi. Startup, şimdi çocukların seslerinde genel amaçlı konuşma tanıma konusunda Google’ı geçtiğini iddia ediyor – bu, ilk bakışta görüldüğü kadar inandırıcı değil: hedef nüfusa özgü eğitim, yetişkin verilerine dayalı eğitime göre tutarlı olarak daha iyi performans gösteriyor.

Konuşma katmanı da benzer şekilde özel olarak tasarlandı. Her oturum, Crewkov’un “yönetim katmanı” olarak adlandırdığı bir yapı içinde çalışır – bir ders planı, tanımlı konular ve hedef izleme ile donatılmış bir sistem. Dil modeli, bu yapı içinde bir bileşen olarak çalışır, ürün kendisi değil.

Çocuk yolundan saparsa, sistem yönlendirir; genel amaçlı bir LLM’nin üretebileceği herhangi bir açık uçlu konuşmaya girmez. “Bir ders planı, izin verilen konular, hedef izleme ve konuşmayı yönlendiren, yeniden yönlendiren veya gerektiğinde sonlandıran bir kod vardır – böylece altı yaşındaki bir çocuk asla açık uçlu internet sohbetine düşmez.”

Gizlilik de, bir mimari kısıtlama olarak ele alındı, ancak aynı zamanda sessiz bir şekilde rekabetçi bir unsur haline geldi. Çünkü Çocukların Çevrimiçi Gizlilik Koruma Kuralları (COPPA), ebeveyn onayı olmadan çocukların ses verilerini toplamasını yasakladığından, çocukların seslerinin en büyük halka açık veri seti sadece birkaç hundred saatlik veri içermektedir.

Buddy.ai, yaş, aksan ve gürültülü ev koşullarına göre gerçek çocuk seslerinden on binlerce saatlik veri biriktirdi. Çoğu, yetişkin LLM’lerini çocuklar için uyarlamak yerine sıfırdan inşa etmekten daha kolay bir yolu seçti, ancak bu kısayol şimdi bir yük haline geldi.

Crewkov’a göre, tüm arka plan işlemleri platformun kendi altyapısında çalışır, çocukların sesleri gerçek zamanlı olarak işlenir ve ebeveynler düşünmeden önce atılır ve hiçbir konuşma ticari AI API’leri üzerinden yönlendirilmez.

“Ebeveynlerle ne topladığımız, neden ve nasıl silebilecekleri konusunda çok açıkız – şeffaflık, teknoloji kadar önemlidir” dedi Crewkov.

ABD pazarında en son büyük güncellemesi ChitChat’i piyasaya sürdüktür – daha gelişmiş, serbest konuşma sunuyor – şirket, aynı zaman diliminde Amerikalı öğrencilerin önceki yıla göre 7.7 kat daha fazla egzersiz tamamladığını bildirdi.

Küresel olarak, ayda tamamlanan egzersizlerin ortalama sayısı yıl yıl %3.5 arttı.

Crewkov, bu sayıların ne kanıtladığının sınırları konusunda açık. “Öğrenci öğrenmesini nicel olarak ölçebilecek araştırma çalışmaları tasarlamak, umarım yakın gelecekte yapabileceğimiz bir şey,” dedi. Ancak şimdi, kanıtlar, kullanıcı geri bildirimi, ürün katılım verisi ve endüstri ödül tanıma dayanmaktadır.

Planlanmayan Kullanım Durumu

Belki de Buddy.ai’nin hikayesindeki en önemli an, davetsiz gelen andır: hedeflenmiş pazarlama olmadan, otizm ve konuşma gecikmeleri olan çocukların ebeveynleri anket verilerine göre platformun en çok dahil olan kullanıcıları arasında yer aldılar.

“İlk başta oldukça şaşırdık. Bu, Buddy’nin dünyanın dört bir yanındaki öğrencilere başka yollarla hizmet edebileceğini gösterdi,” Crewkov hatırladı.

Kurucu için, bu sadece ilginç bir anormallik değildi – bir ürünün tasarlanmadığı ancak apparent olarak doldurabileceği bir boşluğu işaret ediyordu. Şirket, bir Uygulamalı Davranış Analizi (ABA) kursu oluşturdu.

Boşluk geniş ve iyi belgelenmiştir. 2025 pazar raporu buldu otizm ABD’de 1’de 31 çocukta görülmektedir – 2000’de 1’de 150’den daha yüksek – sertifikalı terapist eksikliklerinin sürekli arka planında. Yeterli sigorta kapsamına sahip olmayan aileler için yıllık ABA terapisi maliyetleri ulaşabilir 250.000 ABD Doları.

Ulusal Sağlık Enstitüleri (NIH) araştırması neden ailelerin ABA almadığını buldu: en yaygın nedenler arasında uzun bekleme süreleri (%34), ABA sağlayıcılarının bulunmaması (%10) ve sigorta kapsamının terapıyı kapsamı olmaması (%10) yer aldı. Anket verileri ayrıca ABD’nin tüm ilçelerinin %50’sinde sertifikalı davranış analistlerinin bulunmadığını gösterdi.

AI karakterinin klinik düzeyde anlamlı bir müdahale oluşturup oluşturmadığı açık bir soru olmaya devam ediyor – ancak uzun bekleme listesindeki çocuklar için tutarlı, düşük maliyetli, talebe bağlı bir uygulama aracı olarak değeri daha kolay savunulabilir.

“Bunun üzerinde gerçekten gurur duyuyoruz, ancak bu hala bir çalışma,” dedi Crewkov.

Daha Büyük Soru

Geniş edtech pazarı şimdi AI’nin amaçlarına uygun, güçlü mimariye sahip şirketlerle dolu; gerçek öğrenme endüstrisi ürünleri. Aslında, küresel AI eğitim pazarı tahmin 2030’a kadar 32.27 milyar ABD Doları’na ulaşacak ve her büyük oyuncu bir çocuk stratejisi sahip.

Buddy.ai’nin pozisyonunu ayıran şey, iddialar değil, zaman çizelgesidir. Crewkov, çocukların konuşma tanıma çalışmasına, mevcut yatırım dalgasının modaya getirdiği ve LLM’lerin bir öğleden sonra inandırıcı bir dil öğretmeni inşa etmesini kolaylaştırdığından çok önce başladı.

Teknik altyapı – çocukların seslerine göre eğitilmiş akustik modeller, müfredat bilinci mimarisi, özel avatar sistemi – yaklaşık bir on yıl süren özel bir sorun üzerindeki çalışmanın sonucudur, değil de sıcak bir pazarın hızlı bir dönüşü.

“İki yıl içinde, Buddy, İngilizce öğrenenlerin ilk İngilizce kelimelerinden akıcılığa ilerlemeleri için gereken uygulamayı sağlayabilecek. Acele etmiyoruz, çünkü güvenlik ve gizliliği önceliklendiriyoruz,” açıkladı Crewkov.

Ve her şeyin altında yatan bir tasarım felsefesi var – çoğu AI ürün düşünce yapısına karşıt. “Altı yaşındaki çocuklar AI için geri gelmez. Bir karakter ve parçası oldukları bir dünya için geri gelirler.”

Bu, bir sohbet botuna dostane bir isim vermekten daha zor bir şey. Ve şimdi, Buddy.ai’nin en savunulabilir kenarı.

Salomé Medellín'de doğmuş bir gazeteci ve Espacio Media Incubator'da Senior Reporter'dır. Tarih ve Siyaset alanında geçmişe sahip olan Salomé'nün çalışmaları, ortaya çıkan teknolojilerin sosyal açıdan önemini vurgulamaktadır. Al Jazeera, Latin America Reports ve The Sociable gibi birçok yerde yer almıştır.