Regulación
Microsoft le dice al tribunal que Copilot rara vez reproduce libros en el MDL de derechos de autor de IA

Microsoft solicitó un juicio sumario el 4 de septiembre de 2026 en el litigio consolidado de derechos de autor presentado por autores de libros y editores de noticias sobre el entrenamiento de grandes modelos de lenguaje, diciendo a un tribunal federal en Manhattan que la revisión de un experto de 8,2 millones de conversaciones de Copilot encontró solo 24 respuestas que contenían al menos 30 palabras coincidentes con las obras que los autores alegan.
La cifra proviene de un análisis descrito en el memorando legal de Microsoft que respalda su moción de juicio sumario en los casos consolidados de los demandantes de libros, parte del litigio multidistrital pendiente ante el juez Sidney H. Stein en el Distrito Sur de Nueva York de la Corte Federal de EE. UU. La Authors Guild y los autores de ficción y no ficción nombrados presentaron la demanda aproximadamente diez meses después de que OpenAI lanzara ChatGPT al público en noviembre de 2022, añadiendo posteriormente a Microsoft como demandado.
Qué encontró el análisis de registros de Copilot
Según el memorando, el experto de los autores de libros, el Dr. Shawn Shan, utilizó un protocolo de extracción adversarial de aproximadamente 5,3 millones de intentos que alimentó a los modelos GPT con pasajes de libros literalmente, de cientos de palabras de longitud, y menos del 1 por ciento de esos intentos produjo alguna coincidencia de 30 palabras. Microsoft caracterizó el ejercicio como uno en el que el experto seleccionó un pasaje objetivo y solicitó repetidamente al modelo hasta que emitió el texto deseado.
Fuera de ese entorno de laboratorio, el escrito indica que Shan revisó 8,2 millones de conversaciones del producto Copilot de Microsoft e identificó 24 respuestas que contenían 30 palabras coincidentes, una tasa que la presentación describe como 0,00029 por ciento. Para 202 de los 212 libros alegados, el memorando dice que el experto no encontró ninguna regurgitación en los registros. “Eso apenas socava el propósito transformador del entrenamiento de LLM”, concluye el escrito.
Microsoft también citó la propia evidencia de ventas de los autores, afirmando que los demandantes están vendiendo la misma cantidad de libros que habrían tenido si ChatGPT y Copilot nunca se hubieran lanzado y que encontraron prácticamente ningún ejemplo de resultados del mundo real que coincidieran con sus obras. El escrito cita al dramaturgo David Henry Hwang, quien declara que no cree que los LLM de los demandados estén perjudicando el mercado de sus obras, y señala que los análisis de ventas no muestran una disminución atribuible a la llegada de los modelos.
El argumento de uso justo
La alegación legal central en la presentación de Microsoft es que entrenar un LLM con libros protegidos por derechos de autor constituye un uso justo según la ley. El escrito argumenta que el uso es “profundamente transformador”, señalando fallos en dos casos adicionales de entrenamiento de IA — uno contra Meta y otro contra Anthropic — que describieron el entrenamiento de LLM como altamente transformador. Los libros se crean para ser leídos, indica el escrito, mientras que el uso por parte de OpenAI de textos como The Street Lawyer de John Grisham y Cleopatra de Stacy Schiff sirvió a un propósito tecnológico: construir un modelo que genera respuestas en lenguaje natural a indicaciones.
Ante el enfoque de los autores sobre la descarga de libros por parte de OpenAI desde Library Genesis, un repositorio en línea conocido por contener copias no autorizadas, Microsoft declaró que el registro indiscutible demuestra que no descargó ni participó en la adquisición de esos conjuntos de datos, y argumentó que la procedencia de los datos de entrenamiento no altera el análisis de uso justo porque cada paso del proceso sirvió al mismo propósito de entrenamiento.
El escrito también aborda la provisión por parte de Microsoft, a solicitud de OpenAI, de partes del índice del motor de búsqueda Bing. El memorando indica que la evidencia es inconclusa respecto a si esas partes contenían alguna de las obras de los demandantes, señalando que el experto de los demandantes identificó entre 8 y 24 obras alegadas en las porciones transferidas del índice, y argumenta que la transferencia formó parte del entrenamiento del LLM de todos modos.
Sobre el daño al mercado, Microsoft instó al tribunal a rechazar dos teorías que atribuye a los demandantes: la pérdida de tarifas de licencia por datos de entrenamiento y la “dilución del mercado” por libros asistidos por IA que compiten con los propios de los autores. La investigación citada en el escrito encontró que la gran mayoría de los consumidores no compraría un libro generado por IA incluso a un precio drásticamente más bajo, según la declaración experta de la compañía. El escrito añade que cualquier requisito de licencia para los datos de entrenamiento sería una barrera enorme para la innovación, dado que los desarrolladores tendrían que obtener obras de millones de autores.
Microsoft simultáneamente solicitó un juicio sobre los alegatos en la cuenta de infracción contributiva de los demandantes, según el mismo memorando, que afirma que considerar el entrenamiento de LLM como uso justo excluiría independientemente esa reclamación. La compañía también presentó una moción separada de juicio sumario en los casos consolidados de los demandantes de noticias el mismo día; su escrito sobre los libros describe la presentación de noticias como una explicación de por qué la herramienta específica basada en LLM que los editores impugnan es legal.
Qué sigue en el MDL
Los escritos se presentaron en In re: OpenAI, Inc. Copyright Infringement Litigation, el procedimiento multidistrital que combina los casos de los autores y los editores. Los registros del expediente muestran que The New York Times Company presentó sus propias mociones de juicio sumario el 4 de septiembre de 2026, con respuestas debidas antes del 5 de octubre de 2026, y OpenAI presentó una moción de juicio sumario sobre las reclamaciones de los demandantes de noticias el mismo día.
Una orden de sellado estipulada firmada por el juez Stein el 3 de septiembre de 2026 establece el calendario de publicación de los escritos: las partes y terceros deben presentar cualquier solicitud para mantener las redacciones en los escritos de juicio sumario antes del 14 de septiembre de 2026, y las partes deben volver a presentar públicamente sus escritos y declaraciones de la Regla 56.1 con todas las porciones no impugnadas sin redactar antes del 17 de septiembre de 2026. Los escritos de oposición siguen una vía paralela, con la re-presentación pública requerida antes del 15 de octubre de 2026.












