Anthropic paga 1.500 millones de dólares para resolver demanda de derechos de autor por datos de entrenamiento de IA

Una batalla legal que duró varios años está llegando a su fin con dinero contante y sonante.

La demanda colectiva por derechos de autor entre Anthropic y casi 500.000 autores (Bartz et al. v. Anthropic) se ha resuelto con un acuerdo de 1.500 millones de dólares. La audiencia final de aprobación está programada para el 14 de mayo; si el juez la aprueba, el dinero se liberará oficialmente.

Este es el acuerdo de derechos de autor más grande en la historia de la industria de la IA. Sin embargo, la importancia del caso va más allá de "cuánto pagó Anthropic". Lo que realmente importa son las líneas rojas legales que el tribunal trazó durante este proceso, líneas que influirán en cómo toda la industria manejará los datos de entrenamiento en el futuro.

Entrenar con libros protegidos está permitido, pero las fuentes piratas no

La lógica central de la sentencia de este caso merece una lectura detallada.

El tribunal determinó que el uso de obras protegidas por derechos de autor para entrenar grandes modelos de lenguaje constituye uso justo (fair use). El texto original afirma que "el propósito de los datos de entrenamiento es transformador, incluso extremadamente transformador". En otras palabras, usar libros protegidos para entrenar a Claude, desde el punto de vista legal, no es un problema en sí mismo.

Sin embargo, el problema de Anthropic estaba en otro lugar: el corpus de entrenamiento que utilizaba contenía obras piratas. Descargar millones de libros piratas, incluso si el propósito final es entrenar una IA, es una infracción independiente que no está protegida por el uso justo.

Por lo tanto, estos 1.500 millones de dólares resuelven el problema de la "fuente pirata", no el "acto de entrenar IA en sí mismo".

Se puede entrenar, pero con fuentes de datos legales. Esta es la línea roja legal de IA más clara de 2026.

Como parte del acuerdo, también se exigió a Anthropic que destruyera ese conjunto de datos piratas. Pagó el dinero y además tuvo que eliminar los datos.

Cada autor recibirá aproximadamente 3.000 dólares antes de deducir los honorarios de los abogados. 500.000 personas repartiéndose 1.500 millones de dólares, ese es el promedio. No es mucho, pero la naturaleza de una demanda colectiva no es enriquecer a individuos; su significado es establecer reglas.

La industria musical también está liquidando cuentas, de forma más flexible

No solo el sector editorial. Dos grandes casos en la industria musical también se cerraron en este período:

  • Universal Music contra Udio: Ambas partes alcanzaron un acuerdo y simultáneamente firmaron un acuerdo de licencia formal. Se pagó el dinero y en el futuro se utilizarán datos con licencia
  • Warner Music contra Suno: En los términos del acuerdo, Suno se comprometió a desarrollar un producto completamente nuevo utilizando un "modelo de licencia más avanzado", lo que significa no solo pagar una indemnización, sino también reemplazar el modelo existente por una versión entrenada con datos legales

El enfoque de la industria musical es más inteligente que el del sector editorial: no se trata solo de obtener una compensación, sino de convertir el acuerdo en el punto de partida para establecer una relación de licencia a largo plazo. Los titulares de derechos reciben dinero y también ingresos futuros por licencias de datos.

Los resultados de la IA no pueden obtener derechos de autor

Simultáneamente, la Corte Suprema decidió el 2 de marzo rechazar la revisión del caso Thaler contra Perlmutter.

Este caso intentaba obtener protección de derechos de autor para contenido generado por IA. El rechazo de la Corte Suprema equivale a mantener la decisión del tribunal inferior: Las obras generadas por IA, sin contribución creativa humana, no pueden obtener derechos de autor.

Esto tiene un impacto directo en la lógica comercial de las herramientas de IA:

  • Artículos escritos por usuarios con Claude: el usuario tiene los derechos de autor
  • Contenido que Claude "crea" sin ninguna instrucción humana: sin derechos de autor, cualquier persona puede usarlo

Esta regla está básicamente establecida y no cambiará.

Thomson Reuters ganó, los datos legales son otra línea

Hay una excepción en los casos de derechos de autor de IA, que siguió una lógica diferente: Thomson Reuters demandó a la herramienta de investigación legal de IA Ross Intelligence, acusándola de copiar los resúmenes (headnotes) de Westlaw para entrenamiento.

El tribunal dictaminó: Esto no constituye uso justo.

¿Por qué es diferente del caso Bartz? Dos diferencias clave:

  1. Los resúmenes legales son producto de la edición de Thomson Reuters, no material original
  2. Ross y Westlaw tienen una relación de competencia directa; el tribunal consideró que este uso no es transformador

Esta sentencia está actualmente en apelación. Muestra que los límites del "uso justo" no son absolutos; las relaciones de competencia y la naturaleza de los datos influyen en la decisión.

Varios casos importantes aún están en curso

Algunas demandas clave aún no tienen resultado:

  • In Re Demanda Colectiva por Infracción de Derechos de Autor de OpenAI: 12 casos se consolidaron en un MDL; la cuestión central es si los resultados de ChatGPT infringen derechos de autor
  • Disney y otros contra Midjourney: El caso pendiente más importante en el área de generación de imágenes, que afecta directamente el futuro de las herramientas de texto a imagen
  • Kadrey et al. contra Meta: Si la distribución y el uso de modelos de código abierto constituyen una infracción de derechos de autor, aún sin conclusión

Para las áreas de generación de imágenes e infracción de resultados de IA, los precedentes aún no se han establecido; estas son las mayores incertidumbres legales en la actualidad.

Las reglas están prácticamente definidas

Para las empresas de IA, de esta serie de sentencias y acuerdos se pueden extraer varias señales claras:

  1. El entrenamiento en sí mismo es básicamente uso justo, pero las fuentes piratas son un riesgo independiente; no ahorre en este costo
  2. El modelo de "licencia + acuerdo" de la industria musical podría convertirse en la nueva normalidad; los titulares de derechos se inclinan cada vez más por obtener licencias en lugar de solo compensaciones
  3. La generación de imágenes y la infracción de resultados siguen siendo campos minados; es mejor no apostar a "esperar a que salgan los precedentes"
  4. Los resultados de la IA no tienen derechos de autor; esta regla está establecida; los modelos de negocio deben evitar reclamaciones de derechos de autor sobre "contenido original de IA"

Los 1.500 millones de dólares de Anthropic son una cifra grande, pero considerando su escala de ingresos actual, es el precio para comprar certeza. El costo del cumplimiento normativo de datos es, al final, más barato que la incertidumbre de los litigios.

Fuentes de referencia: AI in litigation series: An update on AI copyright cases in 2026 (Norton Rose Fulbright); CocoLoop, Bartz v. Anthropic Settlement: What Authors Need to Know (The Authors Guild); AI Copyright Lawsuit Developments in 2025: A Year in Review (Copyright Alliance); Generative AI Lawsuits Timeline (Sustainable Tech Partner)