Modelos y plataformas de IA
GPT-2, Generador de Texto de Inteligencia Artificial se Lanza en su Totalidad
Como informa TheNextWeb (TNW), OpenAI, la organización sin fines de lucro detrás de varios proyectos de inteligencia artificial, acaba de publicar el modelo final en la versión planificada para GPT-2, un generador de texto que ha causado mucho debate desde su anuncio en febrero.
Basado en el artículo de investigación de OpenAI titulado Los Modelos de Lenguaje son Aprendices Multitarea No Supervisados, “GPT-2 utiliza el aprendizaje automático para generar texto basado en una entrada limitada.” Lo que significa que un usuario puede escribir una oración o dos sobre cualquier tema y el generador de texto de IA creará un texto relacionado con la entrada original. En esencia, como TNW señala, a diferencia de la mayoría de los generadores de texto, no produce cadenas preescritas. GPT-2 crea texto que no existía previamente.”
En su tuit, Scott B. Weingart, director del programa de la Biblioteca de la Universidad Carnegie Mellon, da un ejemplo concreto:
What is a Panther but a young lion?
An entire corridor filled entirely with people screaming.
How’s this for a happy ending? pic.twitter.com/qvPTrs790N
— Scott B. Weingart (@scott_bot) 20 de agosto de 2019
If death, in some obscure and distant hour,
Strikes me still as I slept, if I yet dream:
Is that my peace with an eternity spent?
[…]
But I fear it will be no peace or rest
Until the stars give me the full glow of their light
To see all my cares and woes in an instant.Shit. pic.twitter.com/QRoi1C3rjj
— Scott B. Weingart (@scott_bot) 20 de agosto de 2019
OpenAI inicialmente estaba preocupada por posibles usos maliciosos de su sistema, así que en febrero de 2019 decidió lanzar GPT-2 en cuatro partes durante ocho meses. Como explicaron en su blog, “Debido a nuestras preocupaciones sobre aplicaciones maliciosas de la tecnología, no estamos lanzando el modelo entrenado. Como un experimento en divulgación responsable, estamos lanzando un modelo mucho más pequeño para que los investigadores lo experimenten, así como un artículo técnico.”
Como se explicó, el modelo completo contiene 1.500 millones de parámetros. “Cuanto más parámetros tenga un modelo, más ‘inteligente’ parece – al igual que los humanos, la práctica hace la perfección.”
TNW señala que inicialmente OpenAI lanzó un modelo con 124 millones de parámetros, seguido de lanzamientos con 355 y 774 millones. Según ellos, después de probar los modelos lanzados, “cada iteración mostró una mejora significativa en capacidad sobre las iteraciones anteriores.”
Para prevenir el mal uso, OpenAI lanzó modelos de detección de GPT-2 que están diseñados “para combatir el mal uso de antemano.” Según su propia admisión en un artículo del blog, estos modelos de detección aún necesitan trabajo adicional para alcanzar el nivel de calidad logrado hasta ahora en GPT-2 en sí.
Aquellos interesados pueden descargar el modelo GPT-2 aquí en Github, ver la tarjeta del modelo aquí, y leer el artículo del blog de OpenAI aquí.












