Derechos de autor e inteligencia artificial: la batalla legal se desplaza a las respuestas
El 4 de septiembre de 2026 venció el plazo para presentar las mociones de summary judgment — la solicitud con la que una parte pide al juez que resuelva sin juicio porque los hechos relevantes no están en disputa — en el procedimiento acumulado «In Re: OpenAI, Inc. Copyright Infringement Litigation», ante el juez federal Sidney H. Stein, en la U.S. District Court para el Southern District of New York. El registro público de CourtListener recoge las mociones presentadas por The New York Times Company y los informes periciales en apoyo de la defensa firmados por Chris Callison-Burch. Microsoft ha pedido el summary judgment sosteniendo que el entrenamiento con textos periodísticos y libros constituye un uso transformativo amparado por el fair use, y afirmando que Copilot "does not replace their protected expression". En el otro frente, OpenAI insiste en su escrito en que "Nobody owns facts, just as nobody owns language". Los editores demandantes piden en cambio que se excluya el fair use tanto por el modo en que se obtuvieron los artículos protegidos por muro de pago como por el entrenamiento realizado sobre las copias, mientras el abogado de los editores, Steven Lieberman, describe así las pruebas presentadas bajo sello: "The stuff we were forced to file under seal is scorchingly hot. Not just a smoking gun; they're a smoking bazooka." El contenido del material sellado no es verificable públicamente: la de Lieberman sigue siendo la valoración de una parte sobre documentos que nadie ajeno al procedimiento ha podido leer.
La tesis de la defensa busca desplazar el centro de gravedad del análisis desde el material absorbido en la fase de entrenamiento hacia la frecuencia real con la que los modelos generan contenidos protegidos. Según el escrito de Microsoft, un perito designado por los editores analizó unos 8,2 millones de registros de conversación de Copilot seleccionados mediante palabras clave ligadas a los sitios de los medios implicados — es decir, por construcción, el subconjunto con más probabilidades de contener sus obras: los porcentajes que siguen no describen el tráfico completo de Copilot. En la muestra, 59.545 registros (cerca del 0,7 %) presentaban al menos 16 palabras en común con los artículos, mientras que en el frente de los libros se cuentan 24 respuestas con al menos 30 palabras coincidentes (el 0,00029 % de las conversaciones analizadas), referidas a 10 de los 212 libros en litigio, y 202 volúmenes quedan sin coincidencia alguna. También según el escrito de Microsoft, un perito del Center for Investigative Reporting habría hallado 51 casos de solapamiento sustancial con obras del CIR en el mismo conjunto de datos. Al fondo quedan las estimaciones de Sensor Tower recogidas por el New York Daily News, que apuntan a más de mil millones de usuarios de ChatGPT en junio y a un coste de 6.800 dólares para generar un millón de artículos de 500 palabras en estilo periodístico.
No hemos leído el PDF íntegro del escrito de Microsoft: en el momento de la verificación, el registro público de CourtListener no mostraba la entrada específica de esa moción entre los resultados consultables, y parte del material está presentado bajo sello. Las cifras aquí recogidas proceden del texto presentado, según lo refieren New York Daily News, The Next Web y The Verge, medios que tuvieron acceso a él. Además, los umbrales de medición (16 palabras para las noticias, 30 para los libros) son los aplicados en el análisis de la defensa, y aún no es pública una impugnación técnica de los demandantes sobre método y parámetros. El juez no ha adoptado ninguna decisión, el plazo para las oposiciones vence el 9 de octubre de 2026 y no se ha fijado fecha de vista.
Si la medida correcta es lo que se reproduce en la respuesta o lo que se usó para entrenar es precisamente aquello sobre lo que deberá pronunciarse el juez Stein: los dos escritos piden aplicar el fair use a dos preguntas distintas.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Consulté por API el registro público de CourtListener de la MDL 1:25-md-03143 y confirmé el número de causa, el foro (S.D.N.Y.), el juez (Sidney H. Stein), las entradas de summary judgment del 4 de septiembre de 2026 y el calendario (presentación el 4 de septiembre, oposiciones el 9 de octubre de 2026). Después leí dos relatos independientes entre sí sobre la misma presentación — New York Daily News y The Next Web — más el de The Verge a través de un espejo: coinciden en fecha, juez y cifras (8,2 millones de conversaciones, 59.545 registros con al menos 16 palabras, 24 respuestas con al menos 30 palabras, 10 libros de 212). Las citas textuales proceden del relato del Daily News, que leyó los escritos. Descarté la noticia sobre las conversaciones entre EE. UU. y China: se basaba en fuentes anónimas y fue desmentida por un portavoz del Tesoro ("no meeting is planned").
- Incertezze
- No he leído el PDF íntegro del escrito de Microsoft: las cifras provienen del texto presentado, según lo recogen tres medios que tuvieron acceso, y en el momento de la verificación el registro público de CourtListener no mostraba la entrada específica de esa moción. Parte del material está bajo sello. Los umbrales de medición (16 palabras para las noticias, 30 para los libros) son los elegidos en el análisis de la defensa: no consta todavía como pública una impugnación técnica de los demandantes sobre método y umbrales. El juez no ha decidido nada: las oposiciones se esperan para el 9 de octubre de 2026 y no se conoce fecha de vista. El contenido del material sellado al que alude el abogado de los demandantes no es verificable desde fuera.
- Perché pubblicarla
- Es el primer caso en que la defensa de un gran proveedor de IA lleva a juicio cifras medidas sobre conversaciones reales de usuarios, y no sobre pruebas de laboratorio, para sostener que la reproducción de contenidos protegidos es estadísticamente marginal. La decisión del juez Stein sobre estas mociones puede fijar en Estados Unidos el criterio de medida del daño derivado del entrenamiento — cuánto pesa la respuesta reproducida frente a la copia de entrada — con efectos directos en el modo en que los editores europeos, donde el criterio jurídico atiende más bien a la presencia de la obra en los parámetros del modelo, plantearán sus reclamaciones.
Fonti / Sources
- CourtListener — docket In Re: OpenAI, Inc. Copyright Infringement Litigation, 1:25-md-03143 (S.D.N.Y.)
- New York Daily News — «Daily News, NY Times want 'fair use' argument rejected in copyright case against OpenAI, Microsoft»
- The Next Web — «Microsoft tells court Copilot rarely copies books»
- The Verge (via mirror UA.News) — «Microsoft says Copilot rarely reproduces NYT texts»