Yapay zeka modelleri ve platformları
Bilgisayarlı Görü Technique İnsan Davranışlarını Videolardan Tahmin Edebilir
Columbia Engineering araştırmacıları tarafından geliştirilen yeni bir bilgisayar görü teknikleri, videolardan insan davranışlarını tahmin edebilir. Yeni teknik, makinelerin insanların, hayvanların ve nesnelerin arasındaki daha yüksek düzeydeki ilişkiler kullanarak ne olacağını tahmin etmelerini sağlar.
Carl Vondrick, Columbia Üniversitesi’nde bilgisayar bilimi yardımcı profesörüdür. Vondrick, 24 Haziran’da Bilgisayarlı Görü ve Desen Tanıma Uluslararası Konferansı’nda sunulan çalışmanın yöneticisiydi.
“Algoritmamız, makinelerin insan davranışları hakkında daha iyi tahminler yapmalarına ve eylemlerini bizimle daha iyi koordine etmelerine bir adımdır” dedi Vondrick. “Sonuçlarımız, insan-robot işbirliği, otonom araçlar ve yardımcı teknoloji için bir dizi olasılık açıyor.”
Yeni yöntem, gelecekteki video eylem olaylarının tahmini için şimdiye kadar geliştirilen en doğru yöntemdir. Sistem, önce filmler, spor oyunları ve şovlar gibi binlerce saatlik videoları analiz etti ve ardından el sıkışmak ve yumruklaşmak gibi yüzlerce aktiviteyi tahmin etti.
Eğer sistem belirli bir eylemi tahmin edemezse, bu eylemleri bağlayan daha yüksek düzeydeki bir kavramı bulur, örneğin “selamlama” kelimesi.
Geçmiş Denemeler
Geçmişte yapılan öngörülü makine öğrenimi denemeleri genellikle bir eylemi tahmin etmeye odaklanmıştı ve algoritmalar bu eylemi, örneğin kucaklaşma, el sıkışmak, yüksek beş veya hiçbiri olarak sınıflandırma kararı veriyordu. Ancak, yüksek belirsizlik nedeniyle çoğu makine öğrenimi modeli olası seçeneklerin arasında ortaklıklar bulamıyordu.
Ekibe Columbia Engineering’den Didac Suris ve Ruoshi Liu gibi doktoralar dahil edildi ve bu ikili, daha uzun vadeli tahmin sorununa biraz farklı bir şekilde baktı.
Suris, makalenin ortak lider yazarıdır.
“Gelecekte her şey öngörülebilir değildir” dedi Suris. “Bir kişi tam olarak ne olacağını öngöremediğinde, daha yüksek bir soyutlama düzeyinde tahminde bulunur. Algoritmamız, gelecekteki olaylar hakkında soyut olarak düşünme yeteneğini öğrenen ilk algoritmadır.”
https://www.youtube.com/watch?v=b1riFCPiqN4
Yeni Sistemin Geliştirilmesi
Suris ve Liu, insan davranışını gelecekte tahmin edebilen AI modellerini geliştirmek için alışılmadık geometrilerden yararlandı.
Aude Oliva, çalışmaya dahil olmayan Massachusetts Teknoloji Enstitüsü’nde kıdemli araştırma bilimcisi ve MIT-IBM Watson AI Lab’ın ortak yöneticiydi.
“Öngörü, insan zekasının temeli” dedi Oliva. “Makineler, soyut olarak düşünme yeteneğinden yoksun oldukları için insanların asla yapmayacağı hatalar yapar. Bu çalışma, bu teknolojik açığı kapatma yönünde önemli bir adımdır.”
Araştırmacılar, makinelerin olayları gelecekte ne kadar öngörülebilir olduklarına göre düzenleyebilecekleri bir matematiksel çerçeve geliştirdiler. Örneğin, yeni sistem, yüzme ve koşma gibi aktiviteleri kendi başlarına, sadece egzersiz olarak değil, kategorilere ayırma yeteneğini öğrenir. Sistem ayrıca belirsizliği hesaba katabilir, bu da daha spesifik eylemlere yol açar.
Makaledeki ortak lider yazar Liu’ya göre, yeni geliştirilen teknik, bilgisayarların önceden programlanmış eylemler yerine nüanslı kararlar almasına yardımcı olabilir ve insan-bilgisayar güveninin kurulması için çok önemlidir.
“Güven, robotun gerçekten insanları anladığı hissinden gelir” diye açıklıyor. “Makineler insan davranışlarını anlar ve tahmin edebilirse, bilgisayarlar insanların günlük faaliyetlerinde sorunsuz bir şekilde yardım edebileceklerdir.”
Ekibin şimdi teknik gerçekten çalışıp çalışmadığını gerçek dünyada doğrulamaya bakması gerekiyor ve bu, güvenlik, sağlık ve güvenlik için dağıtılabilecek.
“İnsan davranışı genellikle şaşırtıcı” diyor Vondrick. “Algoritmalarımız makinelerin insanların ne yapacaklarını daha iyi tahmin etmelerini sağlar.”












