Ética

Investigadores Desarrollan Algoritmos Dirigidos a Prevenir un Mal Comportamiento en la IA

mm
AÃąade Unite.AI a tus fuentes preferidas en Google

Junto con todos los avances y ventajas que la inteligencia artificial ha exhibido hasta ahora, tambiÃĐn hubo informes de efectos secundarios indeseables como la discriminaciÃģn racial y de gÃĐnero en la IA. Así que, como sciencealert.com plantea la pregunta “ÂŋcÃģmo pueden los científicos asegurarse de que los sistemas de pensamiento avanzados puedan ser justos, o incluso seguros?”

La respuesta puede estar en el informe de los investigadores de Stanford y la Universidad de Massachusetts Amherst, titulado Previniendo el comportamiento indeseable de las mÃĄquinas inteligentes. Como eurekaalert.org seÃąala en su historia sobre este informe, la IA ahora estÃĄ empezando a manejar tareas sensibles, por lo que “los formuladores de políticas insisten en que los científicos informÃĄticos ofrezcan garantías de que los sistemas automatizados han sido diseÃąados para minimizar, si no evitar completamente, resultados no deseados como el exceso de riesgo o la discriminaciÃģn racial y de gÃĐnero.”

El informe que presentÃģ este equipo de investigadores “describe una nueva tÃĐcnica que traduce un objetivo difuso, como evitar la discriminaciÃģn de gÃĐnero, en criterios matemÃĄticos precisos que permitirían a un algoritmo de aprendizaje automÃĄtico entrenar una aplicaciÃģn de IA para evitar ese comportamiento.”

El propÃģsito era, como Emma Brunskill, profesora asistente de ciencias de la computaciÃģn en Stanford y autora principal del artículo, seÃąala “queremos avanzar en la IA que respeta los valores de sus usuarios humanos y justifica la confianza que depositamos en los sistemas autÃģnomos.”

La idea era definir resultados o comportamientos “inseguros” o “injustos” en tÃĐrminos matemÃĄticos. Esto, segÚn los investigadores, permitiría “crear algoritmos que puedan aprender de los datos sobre cÃģmo evitar estos resultados no deseados con alta confianza.”

El segundo objetivo era “desarrollar un conjunto de tÃĐcnicas que hiciera fÃĄcil para los usuarios especificar quÃĐ tipo de comportamiento no deseado quieren restringir y permitir a los diseÃąadores de aprendizaje automÃĄtico predecir con confianza que un sistema entrenado con datos pasados puede ser confiable cuando se aplica en circunstancias del mundo real.”

ScienceAlert dice que el equipo llamÃģ a este nuevo sistema algoritmos ‘Seldonianos’, en honor al personaje central de la famosa serie de novelas de ciencia ficciÃģn FundaciÃģn de Isaac Asimov. Philip Thomas, profesor asistente de ciencias de la computaciÃģn en la Universidad de Massachusetts Amherst y autor principal del artículo, seÃąala, “Si uso un algoritmo Seldoniano para el tratamiento de la diabetes, puedo especificar que el comportamiento indeseable significa niveles de azÚcar en la sangre peligrosamente bajos o hipoglucemia.”

“Puedo decirle a la mÃĄquina, ‘Mientras intentas mejorar el controlador de la bomba de insulina, no hagas cambios que aumenten la frecuencia de la hipoglucemia.’ La mayoría de los algoritmos no te dan una forma de imponer este tipo de restricciÃģn en el comportamiento; no se incluyÃģ en los diseÃąos iniciales.”

Thomas agrega que “este marco Seldoniano harÃĄ que sea mÃĄs fÃĄcil para los diseÃąadores de aprendizaje automÃĄtico incorporar instrucciones de evitaciÃģn de comportamiento en todo tipo de algoritmos, de una manera que les permita evaluar la probabilidad de que los sistemas entrenados funcionen correctamente en el mundo real.”

Por su parte, Emma Brunskill tambiÃĐn seÃąala que “pensar en cÃģmo podemos crear algoritmos que respeten mejor los valores como la seguridad y la justicia es esencial a medida que la sociedad depende cada vez mÃĄs de la IA.”

Ex diplomÃĄtico y traductor para la ONU, actualmente periodista/escritor/investigador freelance, centrado en la tecnología moderna, la inteligencia artificial y la cultura moderna.