Anthropic pagará $1.5B por usar libros pirata para entrenar a Claude
Juez aprueba el mayor acuerdo de derechos de autor de la historia: 91% de las obras reclamadas
21 de julio de 2026 · 4 min de lectura
¿Qué ha ocurrido?
El lunes, la jueza federal Araceli Martínez-Olguín aprobó el acuerdo de $1.5 mil millones de dólares entre Anthropic y un grupo de autores y editores que demandaron a la startup de inteligencia artificial por usar libros protegidos por derechos de autor para entrenar a su chatbot Claude. El acuerdo, descrito por el abogado de los demandantes Justin Nelson como "la mayor recuperación por derechos de autor en la historia", establece que aproximadamente el 91% de los más de 482.000 libros cubiertos han sido reclamados, y los titulares recibirán alrededor de $3.000 por obra. Este monto, aunque sustancial, representa solo una fracción de los $7 mil millones que Anthropic ha recaudado en financiación, lo que sugiere que el costo es manejable para la empresa, pero envía una señal clara a la industria sobre las consecuencias de usar datos no autorizados.
Contexto del caso
La demanda, presentada inicialmente en 2023, alegaba que Anthropic había utilizado libros obtenidos de bibliotecas fantasma (shadow libraries) como Library Genesis y Sci-Hub para entrenar a Claude. Estas bibliotecas albergan copias no autorizadas de millones de obras protegidas. El tribunal determinó que, si bien entrenar modelos de IA con datos con derechos de autor no constituye infracción per se (bajo el fair use), el uso de copias piratas sí viola la ley. Este matiz es crucial para la industria: abre la puerta a que otras empresas de IA utilicen obras protegidas siempre que las obtengan legalmente, pero cierra el paso a la explotación de bibliotecas fantasma. Este fallo se suma a una serie de decisiones judiciales que están definiendo los límites del fair use en la era de la IA. Por ejemplo, en 2023, un juez desestimó demandas similares contra OpenAI por falta de pruebas, pero este caso establece un precedente más claro sobre la legalidad de las fuentes de datos.
Importancia del fallo
Este acuerdo sienta un precedente significativo para la intersección entre la inteligencia artificial y los derechos de autor. Por un lado, reconoce que el entrenamiento de modelos de IA puede ser considerado uso legítimo, lo que da un respiro a empresas como OpenAI, Google y Meta. Por otro lado, establece que la fuente de los datos debe ser legal, lo que obliga a las compañías a auditar sus conjuntos de entrenamiento. El pago de $1.5 mil millones, aunque elevado, es manejable para Anthropic, que ha recaudado más de $7 mil millones en financiación. Sin embargo, sienta un precedente para futuras demandas contra otras empresas de IA. Comparado con el acuerdo de $9 millones que Google pagó en 2023 por usar datos de libros sin permiso, este monto es 166 veces mayor, lo que refleja la escala de la infracción y la creciente presión legal sobre las empresas de IA.
Consecuencias para la industria
La decisión tendrá varias repercusiones:
- Mayor escrutinio de las fuentes de datos: Las empresas de IA deberán demostrar que sus datos de entrenamiento se obtuvieron legalmente, lo que podría aumentar los costos de adquisición de datos. Según estimaciones de la industria, la limpieza y verificación de conjuntos de datos puede incrementar los costos de entrenamiento hasta en un 30%.
- Fomento de acuerdos de licencia: Se espera que más compañías firmen acuerdos con editores y autores, como ya han hecho OpenAI con algunos medios (por ejemplo, acuerdos con Axel Springer y Associated Press). Esto podría crear un mercado de licencias para datos de entrenamiento, similar al que existe para música o imágenes.
- Impacto en startups: Las startups con menos recursos podrían verse perjudicadas si no pueden acceder a datos de entrenamiento de alta calidad sin pagar licencias. Esto podría consolidar el mercado en manos de grandes empresas con capacidad de pago, reduciendo la competencia.
- Debate sobre el fair use: El fallo refuerza la doctrina del fair use para el entrenamiento de IA, pero solo si los datos se obtienen legalmente. Esto podría llevar a una mayor litigación sobre qué constituye una fuente legal, especialmente en el caso de datos extraídos de internet donde la legalidad es ambigua.
Reacciones y próximos pasos
El abogado de los demandantes celebró el acuerdo como "un hito para los autores". Por su parte, Anthropic no ha emitido un comunicado oficial, pero se espera que implemente medidas para garantizar que futuros conjuntos de datos sean legales. La jueza Martínez-Olguín señaló que el acuerdo proporciona "alivio significativo" a los afectados. El caso continuará siendo monitoreado por la industria, ya que podría influir en otras demandas similares contra empresas de IA. Por ejemplo, hay demandas pendientes contra OpenAI por parte de autores como George R.R. Martin y John Grisham, y contra Meta por el uso de libros en el entrenamiento de LLaMA. Este acuerdo podría servir como modelo para resolver esos casos, aunque el monto podría variar según la escala de la infracción.
¿Qué deben saber los lectores?
Este caso demuestra que la inteligencia artificial no opera en un vacío legal. Las empresas deben respetar los derechos de autor, incluso cuando innovan. Para los creadores, es una victoria que reconoce el valor de su trabajo. Para los usuarios de IA, es una garantía de que los modelos que utilizan se construyen sobre bases legales, aunque el debate sobre el fair use continúa. Además, este fallo subraya la importancia de la transparencia en las fuentes de datos: las empresas de IA que no auditen sus conjuntos de entrenamiento se exponen a riesgos legales significativos. En última instancia, este caso podría acelerar la creación de estándares industriales para la adquisición de datos, beneficiando tanto a creadores como a desarrolladores de IA.
Puntos clave
- Anthropic pagará $1.5B a autores por usar libros pirata para entrenar a Claude.
- El juez dictaminó que entrenar IA con obras protegidas puede ser fair use, pero usar copias piratas no.
- Es el mayor acuerdo de derechos de autor de la historia, con ~$3,000 por libro reclamado.
- El 91% de los 482,000 libros cubiertos fueron reclamados.
- El caso sienta precedente para la industria: las empresas deben auditar sus fuentes de datos.
Preguntas frecuentes
¿Por qué Anthropic pagó $1.5 mil millones?
Por usar libros protegidos por derechos de autor obtenidos de bibliotecas fantasma (como Library Genesis) para entrenar a su chatbot Claude, lo que violó la ley de copyright.
¿El entrenamiento de IA con datos con derechos de autor es ilegal?
Según el fallo, no necesariamente. El juez determinó que entrenar con obras protegidas puede considerarse uso legítimo (fair use), pero obtener los datos de fuentes piratas sí es ilegal.
¿Cuánto recibirán los autores por libro?
Alrededor de $3,000 por libro, de un total de $1.5 mil millones para más de 482,000 libros, de los cuales el 91% fueron reclamados.
¿Qué impacto tendrá este fallo en otras empresas de IA?
Obligará a empresas como OpenAI, Google y Meta a asegurarse de que sus datos de entrenamiento provengan de fuentes legales, y podría fomentar acuerdos de licencia con editores.
Fuentes utilizadas
Sigue leyendo
Comentarios
Sé el primero en comentar.