Regulación
USA TODAY demanda a OpenAI por contenido de noticias protegido por derechos de autor en el entrenamiento de IA

USA TODAY Co., Inc. y sus entidades periodísticas afiliadas demandaron a OpenAI en un tribunal federal de Nueva York el 8 de octubre de 2026, alegando que la compañía entrenó sus modelos GPT con cientos de miles de sus artículos protegidos por derechos de autor sin autorización y reempaquetó su periodismo en respuestas de chatbot que sustituyen a los originales. La demanda busca una indemnización superior a $250 millones.
La presentación y la compensación solicitada
El caso, USA Today Co., Inc. v. OpenAI Foundation, se presentó en el Distrito de EE. UU. para el Distrito Sur de Nueva York por el abogado Steven Lieberman de Rothwell, Figg, Ernst & Manbeck. La demanda se ingresó el 8 de octubre de 2026, acompañada de una exhibición de registros de derechos de autor y una segunda exhibición de ejemplos de salida de GPT-5.6, según el expediente judicial. Las entradas del expediente del mismo día incluyen una hoja de portada civil, un formulario de aviso de derechos de autor, una notificación de comparecencia y una solicitud de emisión de citación.
Una declaración de relación presentada el mismo día solicita que la acción se trate como relacionada con la litigio de infracción de derechos de autor contra OpenAI ya pendiente en el mismo tribunal. La demanda indica que los demandantes se unen a una larga lista de titulares de derechos de autor que han demandado a OpenAI y a otras compañías de IA, muchos de esos casos consolidados en ese tribunal.
Según el marco legal que cita la demanda, los demandantes pueden recuperar hasta $150,000 por cada infracción deliberada de derechos de autor, más hasta $25,000 por violación por la eliminación de la información de gestión de derechos de autor, los datos de propiedad y derechos adjuntos a las obras publicadas. Los demandantes alegan que los modelos de OpenAI copiaron cientos de miles de artículos y otros materiales de sus publicaciones.
Alegaciones sobre los datos de entrenamiento y la copia
Según la demanda, los grandes modelos de lenguaje de OpenAI fueron entrenados con material protegido por derechos de autor extraído de internet sin autorización, sin importar los muros de pago u otras restricciones de acceso, y OpenAI utilizó programas diseñados para eliminar la información de gestión de derechos de autor que indicaba que las obras estaban protegidas. La demanda también cita evidencia escrita que OpenAI presentó a una investigación de la Cámara de los Lores del Reino Unido en diciembre de 2023, en la que la compañía declaró que, dado que los derechos de autor cubren prácticamente todo tipo de expresión humana, limitar los datos de entrenamiento a obras de dominio público no produciría sistemas de IA que satisfagan las necesidades actuales.
La demanda indica que el contenido de las publicaciones de los demandantes comprende más de 160,000 entradas en WebText, el corpus interno que OpenAI construyó para entrenar GPT‑2, incluyendo 83,266 entradas de usatoday.com y 12,994 entradas de freep.com. Señala que los dominios de las publicaciones representan más de 122 millones de tokens en C4, un subconjunto filtrado en inglés de una captura de 2019 del archivo web Common Crawl, y reproduce la mezcla de entrenamiento de GPT‑3 publicada por OpenAI, que asignó un 60 % a Common Crawl y un 22 % a WebText2, una versión ampliada del corpus WebText.
Para argumentar que OpenAI comprendía lo que contenían sus modelos, la demanda cita comunicaciones internas. Señala que el cofundador Greg Brockman dijo a sus colegas que los modelos eran particularmente buenos para predecir el texto de los artículos de noticias, y que una presentación de 2020 del entonces líder de investigación Dario Amodei incluyó la generación de noticias entre las habilidades de GPT‑3. Cita al vicepresidente de Investigación de OpenAI declarando: “Entrenamos nuestras redes para memorizar los datos de entrenamiento — ese es su objetivo”, y menciona mensajes internos de junio de 2022 en los que los empleados reconocieron que GPT‑4 habría memorizado una gran cantidad de datos y sería altamente eficaz para reproducirlos.
La demanda también alega que, durante un período de tres años, Microsoft proporcionó a OpenAI una copia del Índice Bing, una compilación de miles de millones de páginas web extraídas para el motor de búsqueda de Microsoft que incluía el contenido de los demandantes, bajo una iniciativa denominada Project Taxi, y que Microsoft desarrolló y operó por separado un rastreador llamado Project Mango en nombre de OpenAI, por el cual OpenAI pagó a Microsoft. Además, alega que los filtros de salida de OpenAI no suprimieron contenido de ninguna entidad que no hubiera demandado a la compañía, un enfoque que, según dice, un ejecutivo de Microsoft describió internamente como una cobertura accidental.
Ejemplos de salida de GPT‑5.6
La presentación reproduce ejemplos en los que GPT-5.6, al ser solicitado para encontrar y resumir un artículo específico por título, generó lo que la demanda describe como extensos resúmenes de varias secciones que parafrasean los originales y siguen su organización estructural. Los ejemplos reproducidos involucran artículos del Indianapolis Star, del Detroit Free Press, del The Knoxville News‑Sentinel, del The Palm Beach Post, del The Tennessean, del The Enquirer, del The Des Moines Register, del The Courier‑Journal, del Naples Daily News, del Asbury Park Press, del Milwaukee Journal Sentinel, del The Columbus Dispatch, del The Oklahoman y del Star News, con versiones completas adjuntas como evidencia.
La demanda alega que OpenAI entrenó de forma afirmativa sus modelos después del entrenamiento para resumir artículos con derechos de autor en lugar de devolver los propios artículos, produciendo sustitutos que cumplen la misma función informativa que los originales. Cita al jefe de ChatGPT de OpenAI reconociendo que una vez que ChatGPT brinda una respuesta no hay “buen motivo para hacer clic” en un enlace a la fuente subyacente, y menciona la declaración de un ingeniero de OpenAI de que, por más prominentes que se muestren los enlaces, los usuarios no harán clic. Cuando los resultados de OpenAI reproducen o reempaquetan su contenido, los demandantes alegan que los usuarios no tienen razón para visitar las fuentes originales ni pagar una suscripción.
Las Partes
Los demandantes, todos pertenecientes a USA TODAY Co., Inc., poseen derechos de autor sobre contenido publicado por 19 publicaciones, entre ellas USA TODAY, The Tennessean, el Indy Star, The Bergen Record, The Enquirer, el Asbury Park Press, el Democrat & Chronicle, The Knoxville News‑Sentinel, el Naples Daily News, The Oklahoman, el Milwaukee Journal Sentinel, The Columbus Dispatch, The Arizona Republic, The Courier‑Journal, The Des Moines Register, el Detroit Free Press, The Detroit News, The Palm Beach Post y el Star News. La demanda describe a USA TODAY Co., anteriormente Gannett Co., Inc., como una empresa de medios diversificada que remonta su historia a 1906, publica USA TODAY y cientos de publicaciones diarias, y afirma que sus publicaciones han ganado decenas de premios Pulitzer y emplean a cientos de periodistas en trece estados.
Los demandados son OpenAI Foundation; OpenAI GP, LLC; OAI International, Inc.; OpenAI OpCo, LLC; OpenAI Global, LLC; OAI Corporation; y OpenAI Group PBC, cada uno descrito en la demanda como una entidad con sede en San Francisco que estuvo directamente involucrada en la supuesta infracción o se benefició de ella. La demanda relata la recapitalización de OpenAI del 28 de octubre de 2025, bajo la cual la organización sin fines de lucro se convirtió en OpenAI Foundation, manteniendo participación accionaria en la empresa con fines de lucro que OpenAI describió como valorada en aproximadamente 130 mil millones de dólares, y la empresa con fines de lucro se convirtió en OpenAI Group PBC, una corporación de beneficio público. Citando las propias divulgaciones de OpenAI, la demanda indica que ChatGPT contaba con más de 900 millones de usuarios activos semanales y más de 50 millones de suscriptores de pago a partir de marzo de 2026.
Los modelos en cuestión abarcan desde GPT‑1 hasta GPT‑6.1 y GPT‑OSS, incluidos todos los variantes Instant, Thinking, mini, nano y Pro, según la demanda. Los demandantes solicitan un juicio con jurado.












