NUEVA YORK.- Los documentos judiciales que se están haciendo públicos en el juicio entre autores, OpenAI y Microsoft están aportando algo más que nuevos argumentos sobre el copyright.
También permiten ver qué discutían internamente las empresas mientras construían sus modelos y hasta qué punto conocían las posibles consecuencias para quienes producen los contenidos utilizados para entrenarlos.
El caso tiene como protagonistas a la Authors Guild y un grupo de autores, entre ellos John Grisham, Jodi Picoult, George R. R. Martin, Jonathan Franzen y David Baldacci. La demanda, presentada originalmente en 2023 y luego incorporada a un litigio multidistrital junto con otros casos, sostiene que OpenAI y Microsoft utilizaron libros protegidos por copyright para entrenar sus sistemas sin autorización.
Lo que acaba de hacerse público agrega una dimensión diferente. Un documento interno de OpenAI de agosto de 2019 lo decía sin rodeos: “¡Entrenamos GPT-3 con material pirateado! ¡No lo compartan!”. Otros documentos muestran que Microsoft sabía desde abril de 2019 que OpenAI usaba LibGen, una biblioteca digital de libros pirateados, y que en 2022 OpenAI eliminó esos archivos de sus sistemas.
El motivo, según un correo de uno de sus vicepresidentes de investigación, era la exposición pública: “Dado lo mucho que OpenAI está en las noticias, ahora es el momento de eliminar LibGen de nuestros sistemas”.
Pero quizás lo más relevante para la industria editorial sea lo que aparece en los documentos sobre la posible sustitución de los autores. Tarun Gogineni, contratado en 2022 para trabajar sobre la calidad de escritura de los modelos, definía como misión de investigación la creación de sistemas capaces de reemplazar a los autores humanos.
Según los documentos presentados por los demandantes, también conocía las críticas por el uso de obras sin autorización, pero no le despertaban “demasiada simpatía” y describía el desplazamiento de escritores como una forma de “disrupción económica aceptable”.
Llegó a anticipar “la muerte del lector”, con “máquinas creando basura para más máquinas”, y a publicar que, si George R. R. Martin moría antes de tiempo, “GPT puede escribir el próximo libro de Canción de hielo y fuego”.
Hay una frase de otro documento que resulta particularmente reveladora: en 2020, Jack Clark, entonces responsable de políticas de OpenAI, advertía que cuanto mejores fueran los modelos, más se preocuparían los autores de ficción de género por la posibilidad de que estos sistemas los sustituyeran en Amazon.
Y agregaba que llegaría un momento en que los artistas expresarían su preocupación y que la empresa “probablemente” ignoraría sus quejas y lanzaría igual.
No se trata de una predicción externa sobre el futuro de la IA. Es una discusión interna de la propia compañía sobre qué ocurriría cuando la capacidad de generación alcanzara determinado nivel.
Todavía no hay una decisión judicial sobre estas cuestiones. Pero los documentos que se hicieron públicos cambian el material disponible para discutirlas: ya no se trata solamente de imaginar qué podría ocurrir si la IA llega a sustituir parte del trabajo creativo. También podemos ver qué pensaban sobre esa posibilidad quienes estaban construyendo los sistemas
AM.MX/lm
The post “¡Entrenamos GPT-3 con material pirateado! ¡No lo compartan!” appeared first on Almomento | Noticias, información nacional e internacional.
septiembre 27, 2026
75 Vistas
“¡Entrenamos GPT-3 con material pirateado! ¡No lo compartan!”
Por Vocero
NUEVA YORK.- Los documentos judiciales que se están haciendo públicos en el juicio entre autores, OpenAI y Microsoft están aportando algo más que nuevos argumentos sobre el copyright. También permiten ver qué discutían internamente las empresas mientras construían sus modelos y hasta qué punto conocían las posibles consecuencias para quienes producen los contenidos utilizados para... Más [+]...






