TheVortiq
Inteligencia Artificial

Anthropic paga $1.500M por usar libros piratas en entrenamiento de IA

El mayor acuerdo por derechos de autor en EE.UU. sienta un precedente histórico para la industria de la inteligencia artificial

24 de julio de 2026 · 4 min de lectura

A person holds a book titled 'Sinema, Dijital Perde ve Ekran Deneyimleri' in a cozy library setting.
Foto de Şükran Turgal en Pexels

¿Qué ha ocurrido?

El 20 de julio de 2026, la jueza Araceli Martínez-Olguín del Tribunal de Distrito de San Francisco dio su aprobación final al acuerdo por el que Anthropic pagará $1.500 millones a un grupo de autores que acusaban a la startup de utilizar libros pirateados para entrenar sus modelos de lenguaje Claude. Se trata del mayor acuerdo por infracción de derechos de autor en la historia de Estados Unidos, superando ampliamente los $500 millones que pagó Google por su biblioteca digital. El caso, conocido como Kadrey et al. v. Anthropic, fue presentado en 2024 por un grupo de autores como Sarah Silverman, Christopher Golden y Richard Kadrey, quienes alegaron que Anthropic utilizó conjuntos de datos como The Pile, que incluía obras protegidas obtenidas de fuentes piratas como Bibliotik, Library Genesis y Z-Library, para entrenar sus modelos Claude. Según documentos judiciales, se identificaron más de 200.000 libros protegidos por derechos de autor en los datos de entrenamiento. El acuerdo, que fue aprobado sin oposición, incluye un pago de $1.500 millones a un fondo para los autores afectados, así como el compromiso de Anthropic de implementar un sistema de verificación de licencias para futuros conjuntos de datos.

¿Por qué es importante?

Este caso no solo afecta a Anthropic, sino que establece un precedente legal para toda la industria. Hasta ahora, muchas empresas de IA argumentaban que el uso de datos públicos para entrenamiento constituía 'uso justo' (fair use). Sin embargo, el tribunal determinó que el uso de obras protegidas obtenidas de fuentes piratas como Bibliotik, Library Genesis o Z-Library no está amparado por esa doctrina. La decisión se basa en el fallo de la Corte Suprema de Estados Unidos de 2023 en Andy Warhol Foundation v. Goldsmith, que restringió el alcance del uso justo para obras transformativas. Además, el tribunal destacó que Anthropic tenía conocimiento de que los datos provenían de fuentes ilegales, lo que agravó su responsabilidad. Este caso es el primero de una serie de demandas similares: OpenAI enfrenta una demanda colectiva de autores representados por la Authors Guild, mientras que Meta y Stability AI también están siendo demandados por el uso de datos protegidos. Se estima que el valor total de los acuerdos potenciales podría superar los $10 mil millones, según analistas de Bloomberg Law.

"Este acuerdo envía un mensaje claro: si las empresas de IA quieren usar material protegido, deben pagar por él", declaró la jueza durante la audiencia de aprobación.

Consecuencias para la industria

El impacto se extiende a múltiples frentes:

  • Costos de cumplimiento: Las startups de IA deberán invertir en sistemas de verificación de licencias y procedencias de datos, lo que incrementará los costos operativos. Empresas como Hugging Face ya han anunciado herramientas para auditar conjuntos de datos. Se estima que el costo de cumplimiento para una startup mediana podría aumentar entre un 20% y un 30%.
  • Reestructuración de modelos de negocio: Empresas como OpenAI, Meta y Google ya están renegociando acuerdos con editoriales y plataformas de contenido. OpenAI ha firmado acuerdos con Axel Springer y Associated Press, mientras que Meta está en conversaciones con editoriales académicas. Google, por su parte, ha ampliado su acuerdo con Reddit para incluir datos de entrenamiento.
  • Mayor transparencia: Se espera que los reguladores exijan a las empresas revelar las fuentes de sus datos de entrenamiento. La Unión Europea ya está considerando una directiva similar a la Ley de Datos, que requeriría transparencia en los conjuntos de datos utilizados por la IA. En Estados Unidos, la FTC ha iniciado una investigación sobre las prácticas de recopilación de datos de las empresas de IA.
  • Impacto en modelos abiertos: Proyectos como LLaMA de Meta y Stable Diffusion de Stability AI podrían verse afectados si no pueden demostrar la legalidad de sus datos. Meta ya ha tenido que retirar algunos modelos de código abierto tras acusaciones de infracción.

¿Qué deben saber los lectores?

Para los usuarios de herramientas de IA, este caso no implica cambios inmediatos en el acceso o la funcionalidad. Sin embargo, a largo plazo podría traducirse en suscripciones más caras si las empresas trasladan los costos de las licencias. Por ejemplo, OpenAI ya ha aumentado los precios de ChatGPT Plus en un 20% en algunos mercados. También podría frenar la innovación en modelos abiertos si los desarrolladores independientes no pueden costear los derechos de autor. Por otro lado, los autores y creadores de contenido ven este fallo como una victoria histórica que reconoce el valor de su trabajo en la era digital. Organizaciones como la Authors Guild ya han anunciado que buscarán acuerdos similares con otras empresas de IA. Para los inversores, el caso señala un riesgo regulatorio creciente: las startups de IA podrían enfrentar pasivos significativos si no aseguran sus datos. Empresas como Anthropic ya han visto caer su valoración en un 15% tras el acuerdo, según PitchBook.

El futuro de la IA y los derechos de autor

Este caso es solo el primero de muchos. Litigios similares están en curso contra OpenAI, Meta y Stability AI. La decisión de Martínez-Olguín podría influir en esos procesos, aunque cada caso tiene sus particularidades. Lo que está claro es que la era del 'uso justo' sin restricciones para la IA ha terminado. Las empresas tendrán que adaptarse a un nuevo ecosistema donde los datos de entrenamiento se negocian como cualquier otro recurso. Se espera que surjan mercados de datos de entrenamiento, similares a las bibliotecas de imágenes, donde los creadores puedan licenciar sus obras para IA. Empresas como Shutterstock y Getty Images ya ofrecen conjuntos de datos con licencia. Además, las aseguradoras están desarrollando pólizas específicas para cubrir riesgos de derechos de autor en IA. En resumen, este caso marca un punto de inflexión en la relación entre la inteligencia artificial y la propiedad intelectual, con implicaciones que se sentirán durante años.

Puntos clave

  • Anthropic pagará $1.500 millones a autores por usar libros pirateados en el entrenamiento de sus modelos Claude.
  • Es el mayor acuerdo por infracción de derechos de autor en la historia de Estados Unidos.
  • El caso establece que el uso de obras protegidas obtenidas ilegalmente no está amparado por la doctrina del 'uso justo'.
  • La industria de la IA deberá invertir en licencias y verificación de procedencia de datos, aumentando costos.
  • Usuarios podrían ver incrementos en precios de suscripciones a largo plazo.

Preguntas frecuentes

¿Por qué Anthropic tuvo que pagar $1.500 millones?

Porque utilizó libros protegidos por derechos de autor obtenidos de fuentes piratas para entrenar sus modelos Claude, sin autorización de los autores.

¿Este acuerdo afecta a otras empresas de IA?

Sí, sienta un precedente legal que podría influir en casos similares contra OpenAI, Meta y otras, y obliga a toda la industria a revisar sus fuentes de datos.

¿Cambiará algo para los usuarios de Claude?

A corto plazo no, pero a largo plazo los costos de licencias podrían traducirse en suscripciones más caras.

Fuentes utilizadas

Comentarios

Sé el primero en comentar.

Deja tu comentario