Andersonův úhel
CSET: Čína vede svět ve výzkumu počítačového vidění pro dohled

Nová zpráva od Centra pro bezpečnost a vznikající technologie (CSET) zjistila, že výzkumný sektor Číny produkuje ‘nepoměrně velkou část’ výzkumu tří základních technologií souvisejících s umělou inteligencí a dohledem, a že obecnější příspěvek Číny k technologiím počítačového vidění roste stejnou rychlostí a překonává západní tempo publikací.

Čína má jasnou převahu ve výzkumných iniciativách do více kontroverzních sub-sektorů výzkumu počítačového vidění, zejména souvisejících s dohledem. Zdroj: https://cset.georgetown.edu/wp-content/uploads/Surveillance-in-the-CV-Literature.pdf
Tři klíčové oblasti, ve kterých Čína má obrovskou převahu, jsou identifikace osob (REID), počítání davů a detekce podvodu (tj. technologie, které mají za cíl odhalit pokusy o obcházení identifikačních technologií).
Kromě toho, jak je znázorněno na grafu výše, výzkumná komunita Číny publikuje podstatně vyšší procento prací na úkolech souvisejících s počítačovým viděním, které, podle autorů, představují podpůrné technologie pro širší řešení dohledu, která využívají strojové učení. Tyto úkoly zahrnují rozpoznání emocí, rozpoznání obličeje a rozpoznání akce.
Autoři komentují:
‘Tyto algoritmy jsou často používány pro benigní, komerční účely, jako je například označování osob na sociálních médiích. Ale pokrok v počítačovém vidění by mohl také umožnit některým vládám používat technologie dohledu pro represivní účely.’
V méně závažném smyslu autoři zjistili, že práce související s vizuálním dohledem představují méně než 10 % veškerého výzkumu počítačového vidění provedeného v rámci studie, a že širší část výzkumu je poměrně rovnoměrně rozložena mezi zeměmi.
Nicméně, dominance Číny je zřejmá, tvrdí výzkumníci*:
‘Výzkumníci s čínskými institucionálními afiliacemi byli odpovědní za více než jednu třetinu publikací v obou oblastech počítačového vidění a vizuálního dohledu.
‘To činí Čínu daleko nejproduktivnější zemí v obou oblastech. Podíl čínských výzkumníků na globálním vizuálním dohledu roste podobnou rychlostí jako jejich podíl na výzkumu počítačového vidění.’
Nová zpráva, nazvaná Trendy ve výzkumu AI pro vizuální dohled nad populacemi, představuje aplikaci přístupů zpracování přirozeného jazyka (NLP) na dataset publikovaných prací pokrývajících roky 2015-2019, a je napsána Ashwinem Acharyou, Maxem Langenkampem a Jamesem Dunhamem.
Anglický jazykový bias
Autoři studie poznamenávají, že jejich studie se dotýká pouze anglicky psaných vědeckých prací, a že rozšíření na neanglicky psané publikace by mohlo odhalit hlubší ledovec akademických snah z Číny v těchto sektorech. Kromě toho, výzkumníci věří, že doplnění dat o pomocná informace, jako jsou patentová data, nasazení kamer a příslušné vládní politiky, by mohlo zvýšit tuto statistickou převahu.
Samozřejmě, studie připouští, že analýza veřejně dostupných a otevřených prací nemůže zohlednit soukromý firemní nebo státní výzkum, a klasifikovaný výzkum, ale je to použitelný index aktivity v sektoru v nepřítomnosti těchto skrytých datových bodů.
Architektura a data
Autoři získali základní data pomocí školení modelu SciREX na datech z Papers With Code, s rámcem, který odvozuje relevanci prací identifikací odkazů na úkoly související s počítačovým viděním, a zejména na projekty a iniciativy související s dohledem.
Model byl poté aplikován na agregovanou CSET sbírku vědecké literatury obsahující více než 100 milionů jednotlivých publikací napříč šesti akademickými datovými sadami. Publikační platformy zapojené do toho byly Dimensions, Web of Science, Microsoft Academic Graph, China National Knowledge Infrastructure, arXiv a Papers With Code.
Školený na Arxiv preprintech, SciBERT klasifikátor byl poté pověřen identifikací prací souvisejících s počítačovým viděním napříč korpusem.
Skutečnost, že SciREX a SciBERT jsou školeny na anglicky psaných dokumentech, zabránila výzkumníkům v rozšíření dosahu studie beyond angličtiny. K tomu výzkumníci komentují: ‘To znamená, že v národních srovnáních to podceňuje neanglický výstup výzkumu, a zejména to pravděpodobně podceňuje Čínu.share světového výzkumu.’
Zjištění
V rámci sektoru vizuálního dohledu studie zjistila, že rozpoznání obličeje bylo nejčastěji se opakujícím úkolem, který se objevil v více než tisících pracích pro rok 2019. Nicméně, autoři poznamenávají, že počítání davů a rozpoznání podvodu jsou ‘rychle rostoucí’ oblasti výzkumu.

Z práce, nejčastěji se opakující úkoly identifikované pro roky studie. Citovaný zdroj je ‘CSET merged corpus. Results generated 22. července 2021’
Autoři studie se domnívají, že i zdánlivě ‘neutrální’ a méně politicky výbušné počítačové vidění související s dohledem mohou také přispět k represivním kontrolním systémům. Pro ‘rozpoznání akce’ poznamenávají, že to může být použito k identifikaci ‘abnormálního chování’ v přeplněných veřejných prostorech; pro rozpoznání podvodu komentují ‘Zatímco někdy použité v biometrických systémech přihlášení nebo k prevenci podvodu, může to také zabránit novinářům a aktivistům skrýt svou identitu’; a pokud jde o rozpoznání emocí, studie komentuje, že ‘Kromě jeho nebezpečných a komerčních účelů, někteří výzkumníci, firmy a vládní agentury navrhnou aplikaci rozpoznání emocí k identifikaci bezpečnostních hrozeb v přeplněných veřejných prostorech’.
Obecně, zjištění se zdají ukazovat, že Čína je nadprůměrně intéressována o výzkum počítačového vidění, ve srovnání se světovým průměrem.

Autoři uzavírají:
‘[Čína.share obou počítačového vidění a vizuálního dohledu z Číny se zvýšila over čas. Spojené státy, spolu se svými spojenci a partnery, publikovaly podobné množství výzkumu v těchto oblastech, jako Čína publikovala sama. Nicméně, podíl těchto ostatních regionů na globálním výzkumu dohledu byl stabilní nebo klesal, zatímco Čína rostla.’
*Autoři studie zdůrazňují.
Poprvé publikováno 6. ledna 2022.












