Ángulo de Anderson
CSET: China lidera el mundo en investigación de vigilancia de visión por computadora

Un nuevo informe del Centro de Seguridad y Tecnología Emergente (CSET) ha encontrado que el sector de investigación de China produce una “parte desproporcionada” de investigación en tres tecnologías de vigilancia relacionadas con la inteligencia artificial, y que la contribución más general del PCCh a las tecnologías de visión por computadora está creciendo a la misma tasa, y notablemente superando las tasas de publicación occidentales.

La clara ventaja de China en iniciativas de investigación en subsectores más controvertidos de la investigación de visión por computadora, principalmente relacionados con la vigilancia. Fuente: https://cset.georgetown.edu/wp-content/uploads/Surveillance-in-the-CV-Literature.pdf
Las tres áreas clave en las que China tiene una gran ventaja son la reidentificación de personas (REID), el recuento de multitudes y la detección de suplantación (es decir, tecnologías que apuntan a exponer intentos de subvertir las tecnologías de identificación).
Además, como se indica en el gráfico anterior, la comunidad de investigación de China publica un porcentaje notablemente más alto de documentos sobre tareas de visión por computadora orientadas a humanos, que, según el documento, representan tecnologías de apoyo para soluciones de vigilancia más amplias que utilizan aprendizaje automático. Estas tareas incluyen el reconocimiento de emociones, el reconocimiento facial y el reconocimiento de acciones.
Los autores comentan:
‘Estos algoritmos a menudo se aplican para usos benignos, comerciales, como etiquetar a las personas en fotos de las redes sociales. Pero el progreso en la visión por computadora también podría empoderar a algunos gobiernos para utilizar la tecnología de vigilancia para fines represivos.’
En una nota menos siniestra, los autores han encontrado que los documentos relacionados con la vigilancia visual representan menos del 10% de toda la investigación de visión por computadora realizada en el período de estudio, y que la investigación más amplia está bastante distribuida de manera uniforme en los países.
Sin embargo, la dominancia de China es clara, afirman los investigadores*:
‘Los investigadores con afiliaciones institucionales chinas fueron responsables de más de un tercio de las publicaciones en investigación de visión por computadora y vigilancia visual.
‘Esto hace que China sea de lejos el país más prolífico en ambas áreas. La participación de los investigadores chinos en la investigación de vigilancia visual a nivel mundial está creciendo a una tasa similar a su participación en la investigación de visión por computadora.’
El nuevo informe, titulado Tendencias en la investigación de IA para la vigilancia visual de las poblaciones, representa la aplicación de enfoques de Procesamiento de Lenguaje Natural (NLP) a un conjunto de datos de documentos publicados que cubren los años 2015-2019, y está escrito por Ashwin Acharya, Max Langenkamp y James Dunham.
Sesgo del idioma inglés
Los autores del documento observan que su estudio solo aborda los documentos científicos en inglés, y que extenderlo a publicaciones no angloparlantes podría revelar un iceberg más profundo de esfuerzo académico de China en estos sectores. Además, los investigadores creen que aumentar los datos con información auxiliar, como datos de patentes, despliegue de cámaras y políticas gubernamentales pertinentes, podría aumentar esta ventaja estadística.
Naturalmente, el documento admite que analizar documentos públicos y publicados abiertamente no puede dar cuenta de la investigación privada corporativa o estatal, y la investigación clasificada, pero es un índice viable de la actividad del sector en ausencia de estos puntos de datos ocultos.
Arquitectura y datos
Los autores derivaron los datos básicos al entrenar un modelo de extracción de información de nivel de documento SciREX en datos de Papers With Code, con el marco que deriva la relevancia de los documentos al identificar referencias a tareas relacionadas con la visión por computadora, y particularmente a proyectos e iniciativas centrados en la vigilancia.
El modelo se aplicó luego a un cuerpo agregado de literatura académica de CSET que contiene más de 100 millones de publicaciones individuales en seis conjuntos de datos académicos. Las plataformas de publicación involucradas fueron Dimensions, Web of Science, Microsoft Academic Graph, China National Knowledge Infrastructure, arXiv y Papers With Code.
Entrenado en preimpresos de Arxiv, un clasificador SciBERT se encargó de identificar documentos de visión por computadora en todo el corpus.
El hecho de que SciREX y SciBERT estén entrenados en documentos en inglés impidió que los investigadores extendieran el alcance del estudio más allá del inglés. De esto, los investigadores comentan: ‘Esto significa que en comparaciones nacionales subestima la producción de investigación no inglesa, y en particular probablemente subrepresenta la participación de China en la investigación mundial.’
Hallazgos
Dentro del sector de vigilancia visual, el estudio encuentra que el reconocimiento facial fue la tarea más recurrente, apareciendo en más de mil documentos para el año 2019. Sin embargo, los autores observan que el recuento de multitudes y el reconocimiento de suplantación son “campos de investigación en rápido crecimiento”.

Del documento, las tareas más frecuentemente recurrentes identificadas para los años estudiados. Fuente citada es ‘CSET merged corpus. Results generated 22 de julio de 2021’
Los autores del documento consideran que incluso las aparentemente más “neutras” y menos políticamente incendiarias persecuciones de visión por computadora relacionadas con la vigilancia también pueden contribuir a sistemas de control represivo. Para el ‘reconocimiento de acciones’, observan que esto se puede utilizar para identificar ‘comportamiento anormal’ en espacios públicos concurridos; para la suplantación facial, comentan ‘Aunque a veces se utiliza en sistemas de inicio de sesión biométrico o para prevenir el fraude, también puede evitar que los periodistas y activistas oculten su identidad’; y con respecto al reconocimiento de emociones, el documento comenta que ‘Además de sus propósitos no orientados a la seguridad y comerciales, algunos investigadores, empresas y agencias gubernamentales proponen aplicar el reconocimiento de emociones para identificar amenazas de seguridad en áreas públicas concurridas’.
En general, los hallazgos parecen mostrar que China está por encima de la media en investigación de visión por computadora en comparación con el promedio global.

Los autores concluyen:
‘[La] participación de China en la investigación de visión por computadora y vigilancia visual aumentó con el tiempo. Estados Unidos, junto con sus aliados y socios, publicó una cantidad similar de investigación en estas áreas que China publicó sola. Sin embargo, la participación de estas otras regiones en la investigación de vigilancia global fue estable o disminuyó, mientras que la de China creció.’
*El énfasis en negrita de los autores del documento.
Publicado por primera vez el 6 de enero de 2022.












