TheVortiq
Inteligencia Artificial

NYT vs OpenAI: la batalla que definirá el copyright en la era de la IA

El periódico neoyorquino ha gastado más de 20 millones de dólares en una demanda que podría cambiar las reglas del juego para los modelos de lenguaje.

28 de julio de 2026 · 4 min de lectura

A focused individual types on a laptop running AI software indoors.
Foto de Matheus Bertelli en Pexels

¿Qué ha ocurrido?

En diciembre de 2023, The New York Times (NYT) presentó una demanda contra OpenAI y Microsoft por infracción de derechos de autor, alegando que los demandados utilizaron millones de artículos del periódico sin autorización para entrenar sus modelos de lenguaje, como GPT-4 y Copilot. Según la demanda, los chatbots reproducen fragmentos textuales de los artículos, compitiendo directamente con el contenido original y perjudicando el modelo de negocio del Times. Este caso no surgió de la noche a la mañana: el NYT había intentado negociar una licencia con OpenAI durante meses, pero las conversaciones fracasaron, lo que llevó a la acción legal. La demanda busca daños legales por infracción masiva, así como la destrucción de cualquier modelo que haya utilizado los datos del Times. OpenAI ha respondido que el uso de datos públicos para entrenar IA está protegido por la doctrina del 'fair use' (uso justo), argumentando que los modelos no almacenan copias literales, sino que aprenden patrones estadísticos. Sin embargo, el NYT presentó ejemplos concretos de reproducción casi exacta de párrafos, lo que refuerza su caso.

¿Por qué es importante?

Este es el primer litigio de gran escala entre un editor tradicional y una empresa líder de IA generativa, y podría sentar un precedente histórico. Hasta ahora, las empresas de IA han operado en una zona gris legal, recopilando datos de Internet sin compensar a los creadores. El caso del NYT es especialmente significativo porque el periódico tiene un archivo de más de 170 años y ha invertido fuertemente en periodismo de calidad. Si el Times gana, podría obligar a OpenAI a pagar licencias retroactivas y establecer un sistema de compensación continua para los editores, similar a lo que ocurrió con la música digital (como los acuerdos de Spotify con sellos discográficos). Si pierde, se abriría la puerta a que las empresas de IA sigan usando contenido protegido sin pagar, lo que amenazaría la viabilidad del periodismo profesional. El propio Sulzberger ha declarado que está dispuesto a llegar hasta la Corte Suprema para defender los derechos de autor. Además, este caso se suma a otras demandas similares, como la de Getty Images contra Stability AI por usar sus fotos sin licencia, y la de varios autores (incluyendo George R.R. Martin y John Grisham) contra OpenAI por infracción de derechos de autor en libros.

Consecuencias potenciales

  • Impacto económico: OpenAI podría enfrentar daños por miles de millones de dólares. Solo el NYT ha gastado más de $20 millones en honorarios legales hasta ahora, y la batalla legal podría durar años. Además, si se establece que se requieren licencias, el costo de entrenar modelos de lenguaje podría aumentar drásticamente, afectando a startups y a la innovación en IA. Por otro lado, los editores podrían obtener una nueva fuente de ingresos mediante acuerdos de licencia, como ya ha hecho OpenAI con Associated Press, Axel Springer y Le Monde, pagando sumas no reveladas pero que se estiman en millones de dólares anuales.
  • Precedente legal: La sentencia podría definir los límites del 'fair use' en la era de la IA. Hasta ahora, los tribunales han sido favorables al 'fair use' en casos como Google Books (donde se permitió escanear libros para búsquedas), pero la reproducción de contenido creativo por parte de modelos generativos es un territorio nuevo. El caso del NYT podría establecer que entrenar modelos con datos protegidos sin permiso no es 'fair use', especialmente si el modelo puede generar contenido que compite directamente con el original.
  • Modelo de negocio: Si el Times gana, es probable que veamos una ola de demandas similares por parte de otros editores, como The Wall Street Journal, The Guardian o Reuters. Esto podría llevar a la creación de un mercado de licencias de datos para IA, donde los editores cobren por el uso de su contenido. Sin embargo, también podría incentivar a las empresas de IA a buscar datos sintéticos o de dominio público, lo que reduciría la calidad del entrenamiento.

¿Qué deben saber los lectores?

El caso se encuentra actualmente en fase de descubrimiento de pruebas, donde ambas partes están intercambiando documentos y testimonios. Se espera que el juicio comience a finales de 2024 o principios de 2025, pero podría prolongarse por años si hay apelaciones. El NYT ha solicitado que se destruyan todos los modelos de OpenAI que hayan sido entrenados con sus datos, lo que sería una medida sin precedentes. OpenAI, por su parte, ha argumentado que el Times está exagerando y que sus modelos no almacenan copias literales. Además, han señalado que el periódico utilizó 'prompts' diseñados específicamente para inducir a los modelos a reproducir texto, lo que no refleja el uso normal. Otros actores clave, como Microsoft, han respaldado a OpenAI, mientras que grupos de derechos de autor como la Authors Guild han apoyado al Times. Este caso es parte de un debate más amplio sobre la ética y legalidad del scraping de datos web para entrenar IA. A diferencia de la música o el video, donde las licencias están bien establecidas, el contenido textual aún carece de un marco claro. La resolución de este caso podría cambiar radicalmente la forma en que las empresas de IA acceden a datos de entrenamiento, afectando no solo a los editores, sino también a investigadores, desarrolladores y usuarios finales. Por ahora, los lectores deben estar atentos a las decisiones judiciales, que podrían llegar antes de lo esperado si hay un fallo sumario.

Puntos clave

  • The New York Times demandó a OpenAI y Microsoft en diciembre de 2023 por infracción de derechos de autor.
  • El periódico ha gastado más de $20 millones en el litigio.
  • El caso podría definir los límites del 'fair use' en el entrenamiento de modelos de IA.
  • Si el Times gana, se abriría la puerta a licencias obligatorias para contenido usado en IA.
  • La resolución afectará a todo el ecosistema de IA generativa y a los editores de contenido.

Preguntas frecuentes

¿Por qué demandó el NYT a OpenAI?

Porque OpenAI utilizó millones de artículos del Times sin autorización para entrenar sus modelos de lenguaje, reproduciendo fragmentos textuales y compitiendo con el contenido original.

¿Cuánto dinero ha gastado el NYT en esta demanda?

Más de 20 millones de dólares, según declaraciones de su editor A.G. Sulzberger.

¿Qué consecuencias podría tener esta demanda?

Podría establecer un precedente legal sobre el 'fair use' en IA, obligar a OpenAI a pagar licencias retroactivas y cambiar el modelo de negocio de los editores frente a las empresas de IA.

Fuentes utilizadas

Comentarios

Sé el primero en comentar.

Deja tu comentario