OpenAI y Microsoft revelados como piratas de libros en la demanda de Authors Guild
Los últimos documentos de la demanda contra OpenAI y Microsoft muestran que los ejecutivos sabían que usarían libros sin licencia y que sus modelos podrían desplazar a autores humanos.

Los expedientes de la demanda de Authors Guild contra OpenAI y Microsoft, que alegan que entrenaron sus modelos con libros protegidos sin autorización, se han actualizado con revelaciones impactantes.
En la nueva memoria, se detalla que, desde 2019, Microsoft estaba al tanto del uso de LibGen –un sitio ruso que distribuye material protegido– por parte de OpenAI. El director de tecnología de Microsoft, Kevin Scott, habría sido informado por Sam Altman y Dario Amodei cuando se presentó una versión temprana de GPT‑3 a Bill Gates.
El documento también documenta declaraciones de Jack Clark, director de política de OpenAI, que en 2020 admitió que sus sistemas “podrían hacer que las personas quedaran sin trabajo”. En 2022, el ex director de investigación Tarun Gogineni expresaba la intención de que GPT‑5 “autocompletara” la serie de A Song of Ice and Fire, mostrando una actitud de que los autores podrían ser sustituidos.
El caso, que forma parte de una litigación multidistrital en Manhattan, incluye a autores de talla mundial: J.K. Rowling, George R.R. Martin, David Baldacci, entre otros. El portavoz de la Authors Guild, Mary Rasenberger, calificó los hechos como una “desdén por los escritores” y afirmó que los modelos de OpenAI “destruirán las carreras de autores”.
Para cubrir la evidencia, OpenAI lanzó el “Project Clear” y eliminó los archivos de LibGen en verano de 2022. El proceso fue documentado en un canal de Slack donde se discutió la necesidad de “eliminar LibGen de nuestros sistemas y almacenamiento”.
La demanda se centra ahora en demostrar la culpa y la intención de los ejecutivos, y se espera que haya más briefing en los próximos meses y una audiencia a principios de 2027. Si los tribunales aceptan la evidencia, podría forzar a OpenAI y Microsoft a reestructurar sus pipelines de entrenamiento y a revisar la legalidad de sus modelos.
El caso subraya la necesidad de políticas de datos claras en el desarrollo de IA. Los equipos de ingeniería deben asegurar que sus conjuntos de entrenamiento cumplan con las normas de copyright, o enfrentarse a litigios que cuestan millones y dañan la reputación.
Para más información sobre la demanda, visita el item de Hacker News.

