Modelos y plataformas de IA

GPT-2, Generador de Texto de Inteligencia Artificial se Lanza en su Totalidad

mm
Añade Unite.AI a tus fuentes preferidas en Google

Como informa TheNextWeb (TNW), OpenAI, la organización sin fines de lucro detrás de varios proyectos de inteligencia artificial, acaba de publicar el modelo final en la versión planificada para GPT-2, un generador de texto que ha causado mucho debate desde su anuncio en febrero.

Basado en el artículo de investigación de OpenAI titulado Los Modelos de Lenguaje son Aprendices Multitarea No Supervisados, “GPT-2 utiliza el aprendizaje automático para generar texto basado en una entrada limitada.” Lo que significa que un usuario puede escribir una oración o dos sobre cualquier tema y el generador de texto de IA creará un texto relacionado con la entrada original. En esencia, como TNW señala, a diferencia de la mayoría de los generadores de texto, no produce cadenas preescritas. GPT-2 crea texto que no existía previamente.”

En su tuit, Scott B. Weingart, director del programa de la Biblioteca de la Universidad Carnegie Mellon, da un ejemplo concreto:

 

OpenAI inicialmente estaba preocupada por posibles usos maliciosos de su sistema, así que en febrero de 2019 decidió lanzar GPT-2 en cuatro partes durante ocho meses. Como explicaron en su blog, “Debido a nuestras preocupaciones sobre aplicaciones maliciosas de la tecnología, no estamos lanzando el modelo entrenado. Como un experimento en divulgación responsable, estamos lanzando un modelo mucho más pequeño para que los investigadores lo experimenten, así como un artículo técnico.”

Como se explicó, el modelo completo contiene 1.500 millones de parámetros. “Cuanto más parámetros tenga un modelo, más ‘inteligente’ parece – al igual que los humanos, la práctica hace la perfección.”

TNW señala que inicialmente OpenAI lanzó un modelo con 124 millones de parámetros, seguido de lanzamientos con 355 y 774 millones. Según ellos, después de probar los modelos lanzados, “cada iteración mostró una mejora significativa en capacidad sobre las iteraciones anteriores.”

Para prevenir el mal uso, OpenAI lanzó modelos de detección de GPT-2 que están diseñados “para combatir el mal uso de antemano.” Según su propia admisión en un artículo del blog, estos modelos de detección aún necesitan trabajo adicional para alcanzar el nivel de calidad logrado hasta ahora en GPT-2 en sí.

Aquellos interesados pueden descargar el modelo GPT-2 aquí en Github, ver la tarjeta del modelo aquí, y leer el artículo del blog de OpenAI aquí.

Ex diplomático y traductor para la ONU, actualmente periodista/escritor/investigador freelance, centrado en la tecnología moderna, la inteligencia artificial y la cultura moderna.