Anderson’un Açısı
CSET: Çin, Bilgisayarlı Görüntü İzleme Araştırması Dünyasında Lider

Guvenlik ve Yeni Teknoloji Merkezi’nden (CSET) yapılan bir araştırmaya göre, Çin’in araştırma sektörü, üç temel AI ile ilgili gözetim teknolojisi alanında ‘orantısız bir pay’ üretmekte ve Çin Komünist Partisi’nin genel olarak bilgisayar görüntüleme teknolojilerine katkısı da benzer bir hızda büyümekte ve batı yayın hızlarını geçmektedir.

Çin’in bilgisayar görüntüleme araştırması alt sektörlerinde, özellikle gözetim ile ilgili araştırma girişimlerinde açık bir liderliği. Kaynak: https://cset.georgetown.edu/wp-content/uploads/Surveillance-in-the-CV-Literature.pdf
Çin’in lider olduğu üç ana alan, kişi yeniden tanımlama (REID), kalabalık sayma ve sahtecilik tespiti (yani, kimlik teknolojilerini bozmaya yönelik girişimleri ortaya çıkarmaya yönelik teknolojiler) dir.
Ek olarak, yukarıdaki grafikte gösterildiği gibi, Çin’in araştırma topluluğu, insan odaklı bilgisayar görüntüleme görevleri üzerine daha yüksek bir yüzdeye sahip makaleler yayınlamaktadır. Bu görevler, yüz tanıma, duygudurum tanıma ve eylem tanıma gibi daha geniş gözetim çözümleri için temel teknolojileri temsil etmektedir.
Araştırmacılar yorumluyor:
‘Bu algoritmalar thường olarak sosyal medya fotoğraflarında kişileri etiketlemek gibi masum, ticari amaçlar için kullanılır. Ancak bilgisayar görüntüleme alanındaki ilerleme, bazı hükümetlerin gözetim teknolojisini baskıcı amaçlar için kullanmalarına da olanak tanıyabilir.’
Daha az tehditkar bir notta, araştırmacılar, görsel gözetim ile ilgili makalelerin, çalışma dönemindeki tüm bilgisayar görüntüleme araştırmalarının %10’unu oluşturmadığını ve daha geniş araştırmaların ülkeler arasında oldukça eşit bir şekilde dağıldığını bulmuşlardır.
Ancak, Çin’in hakimiyeti açıkça görülüyor, araştırmacılar iddia ediyor*:
‘Çin kurumlarından araştırmacılar, hem bilgisayar görüntüleme hem de görsel gözetim araştırmalarında yayınların üçte birinden fazlasına katkıda bulunmuştur.
‘Bu, Çin’i her iki alanda da en üretken ülke haline getiriyor. Çinli araştırmacıların küresel görsel gözetim araştırmalarına katkısı, bilgisayar görüntüleme araştırmalarına katkısı ile benzer bir hızda büyümektedir.’
Yeni rapor, Gözetim için AI Araştırması Trendleri adlı bir çalışma, 2015-2019 yıllarını kapsayan yayınlanmış makalelerin bir veritabanına Doğal Dil İşleme (NLP) yaklaşımlarının uygulanmasını temsil etmekte ve Ashwin Acharya, Max Langenkamp ve James Dunham tarafından yazılmıştır.
İngilizce Dili Önyargısı
Araştırmacılar, çalışmanın sadece İngilizce bilimsel makaleleri kapsadığını ve çalışmanın İngilizce olmayan yayınları da içerecek şekilde genişletilmesinin, bu sektörlerde Çin’den daha derin bir akademik çaba ortaya çıkarabileceğini gözlemlemektedir. Ayrıca, araştırmacılar, verilere patent verileri, kamera dağıtımı ve ilgili hükümet politikaları gibi ek bilgi eklenmesinin bu istatistiksel liderliği artırabileceğine inanmaktadır.
Mimari ve Veri
Araştırmacılar, temel verileri, Papers With Code’dan alınan verilerle eğitilmiş bir SciREX belge düzeyinde bilgi çıkarma modeli kullanarak elde etmişlerdir. Çerçeve, görevlere ilişkin referansları tanımlayarak makalelerin alaka düzeyini belirlemiştir, özellikle de bilgisayar görüntüleme ve gözetim odaklı projeler ve girişimlerle ilgili görevler.
Model, daha sonra altı akademik veritabanını içeren 100 milyondan fazla bireysel yayını içeren bir CSET akademik literatür kümesine uygulanmıştır. Yayın platformları, Dimensions, Web of Science, Microsoft Academic Graph, China National Knowledge Infrastructure, arXiv ve Papers With Code’du.
Arxiv ön baskı üzerine eğitilmiş bir SciBERT sınıflandırıcı, daha sonra tüm korpus boyunca bilgisayar görüntüleme makalelerini tanımlamakla görevlendirilmiştir.
SciREX ve SciBERT’in İngilizce belgeler üzerinde eğitilmesi, araştırmacıların çalışmanın kapsamını İngilizce’nin ötesine genişletmesini engelledi. Bununla ilgili olarak araştırmacılar şunları söylüyorlar: ‘Bu, ulusal karşılaştırmalarda İngilizce olmayan araştırma çıktısını düşük tahmin ettiğini ve özellikle de Çin’in dünya çapındaki araştırma payını temsil ettiğini anlamına gelir.’
Bulgular
Görsel gözetim sektöründe, çalışma, yüz tanıma görevinin 2019 yılı için binin üzerinde makalede ortaya çıktığını bulmuştur. Ancak araştırmacılar, kalabalık sayma ve yüz sahteciliği tanıma alanlarının ‘hızla büyüyen’ alanlar olduğunu belirtiyorlar.

Çalışmadan, incelenen yıllar için saptanan en sık tekrar eden görevler. Kaynak, ‘CSET birleştirilmiş korpus. Sonuçlar 22 Temmuz 2021’de oluşturuldu’
Araştırmacılar, görünüşte daha ‘nötr’ ve menos siyasi gözetim ile ilgili bilgisayar görüntüleme alanlarının da baskıcı kontrol sistemlerine katkıda bulunabileceğini düşünüyorlar. ‘Eylem tanıma’ için, kalabalık halk alanlarında ‘anormal davranış’ tanımlamak için kullanılabileceğini gözlemliyorlar; yüz sahteciliği tanıma için, ‘Bazen biyometrik giriş sistemlerinde veya sahteciliği önlemek için kullanılır, ancak gazetecileri ve aktivistleri kimliklerini gizlemekten de alıkoyabilir’ diyorlar; ve duygudurum tanıma ile ilgili olarak, makale ‘Güvenlik tehditlerini tanımlamak için kalabalık halk alanlarında duygudurum tanımayı uygulayan bazı araştırmacılar, şirketler ve hükümet ajansları olduğunu’ belirtiyor.
Genel olarak, bulgular, Çin’in bilgisayar görüntüleme araştırmalarına küresel ortalamaya göre daha fazla ilgi gösterdiğini ortaya koyuyor.

Araştırmacılar sonuç olarak şunları söylüyor:
‘Hem bilgisayar görüntüleme hem de görsel gözetim araştırmalarının payı zaman içinde arttı. Amerika Birleşik Devletleri ve müttefikleri, bu alanlarda Çin’in tek başına yayınladığı kadar araştırma yayınladı. Ancak diğer bölgelerin küresel gözetim araştırmalarına katkısı sabit kaldı veya azaldı, Çin’in payı ise büyüdü.’
*Araştırmacıların vurgusu.
İlk olarak 6 Ocak 2022’de yayınlandı.












