Anthropic paga US$ 1,5 bilhão para encerrar processo de direitos autorais sobre dados de treinamento de IA

Uma batalha judicial que durou vários anos está sendo encerrada com dinheiro vivo.

A ação coletiva de direitos autorais entre a Anthropic e quase 500 mil autores (Bartz et al. v. Anthropic) foi resolvida com um acordo de US$ 1,5 bilhão. A audiência final de aprovação está marcada para 14 de maio; se o juiz aprovar, o dinheiro será oficialmente liberado.

Este é o maior acordo de direitos autorais da indústria de IA até hoje. No entanto, o significado do caso vai além de "quanto a Anthropic pagou". O mais relevante são as linhas vermelhas legais que o tribunal traçou durante esse processo – linhas que influenciarão como toda a indústria lidará com dados de treinamento no futuro.

Treinar com livros protegidos é permitido, mas fontes piratas não

A lógica central da decisão deste caso merece uma leitura cuidadosa.

O tribunal determinou que o uso de obras protegidas por direitos autorais para treinar grandes modelos de linguagem se enquadra no uso justo (fair use). O texto original afirma que "o propósito dos dados de treinamento é transformador – até mesmo extremamente transformador". Em outras palavras, usar livros protegidos para treinar o Claude, do ponto de vista legal, não é um problema em si.

No entanto, o problema da Anthropic estava em outro lugar: o corpus de treinamento utilizado continha obras piratas. Baixar milhões de livros piratas – mesmo que o objetivo final seja treinar IA – é uma violação independente, não protegida pelo uso justo.

Portanto, os US$ 1,5 bilhão resolvem o problema da "fonte pirata", não o "ato de treinar IA em si".

Treinar pode, mas com fontes de dados legais. Esta é a linha vermelha legal de IA mais clara de 2026.

Como parte do acordo, a Anthropic também foi obrigada a destruir o conjunto de dados piratas. Pagou o dinheiro e ainda teve que excluir os dados.

Cada autor receberá cerca de US$ 3.000 antes da dedução dos honorários advocatícios. 500 mil pessoas dividindo US$ 1,5 bilhão, essa é a média. Não é muito, mas a natureza de uma ação coletiva não é enriquecer indivíduos – seu significado é estabelecer regras.

Indústria musical também está acertando contas, de forma mais flexível

Não apenas o setor editorial. Dois grandes casos na indústria musical também foram encerrados neste período:

  • Universal Music vs. Udio: As partes chegaram a um acordo e simultaneamente assinaram um contrato formal de licenciamento. O dinheiro foi pago, e no futuro serão usados dados licenciados
  • Warner Music vs. Suno: Nos termos do acordo, a Suno se comprometeu a desenvolver um produto totalmente novo usando um "modelo de licenciamento mais avançado" – ou seja, não apenas pagar indenização, mas também substituir o modelo existente por uma versão treinada com dados legais

A abordagem da indústria musical é mais inteligente que a do setor editorial: não se trata apenas de obter indenização, mas de transformar o acordo no ponto de partida para um relacionamento de licenciamento de longo prazo. Os detentores de direitos autorais recebem dinheiro e também receitas futuras de licenciamento de dados.

Conteúdos gerados por IA não podem ser protegidos por direitos autorais

Simultaneamente, a Suprema Corte decidiu em 2 de março recusar a revisão do caso Thaler v. Perlmutter.

Este caso tentava obter proteção de direitos autorais para conteúdos gerados por IA. A recusa da Suprema Corte equivale a manter a decisão do tribunal inferior: Obras geradas por IA, sem contribuição criativa humana, não podem obter direitos autorais.

Isso tem impacto direto na lógica comercial das ferramentas de IA:

  • Artigos escritos por usuários com Claude: o usuário detém os direitos autorais
  • Conteúdo que Claude "cria" sem qualquer instrução humana: sem direitos autorais, qualquer pessoa pode usar

Esta regra está basicamente definida e não mudará.

Thomson Reuters venceu, dados jurídicos são outra linha

Há uma exceção nos casos de direitos autorais de IA, que seguiu uma lógica diferente: a Thomson Reuters processou a ferramenta de pesquisa jurídica de IA Ross Intelligence, acusando-a de copiar os headnotes do Westlaw para treinamento.

O tribunal decidiu: Isso não constitui uso justo.

Por que é diferente do caso Bartz? Duas diferenças principais:

  1. Os headnotes jurídicos são produto da edição da Thomson Reuters, não material bruto
  2. Ross e Westlaw têm relação de concorrência direta; o tribunal considerou que esse uso não é transformador

Esta decisão está atualmente em recurso. Ela mostra que os limites do "uso justo" não são absolutos; relações de concorrência e a natureza dos dados influenciam o julgamento.

Vários grandes casos ainda em andamento

Algumas ações judiciais importantes ainda não têm resultado:

  • In Re Ação Coletiva de Violação de Direitos Autorais da OpenAI: 12 casos foram consolidados em um MDL; a questão central é se as saídas do ChatGPT violam direitos autorais
  • Disney e outros vs. Midjourney: O caso pendente mais importante na área de geração de imagens, afetando diretamente o futuro das ferramentas de texto para imagem
  • Kadrey et al. vs. Meta: Se a distribuição e uso de modelos de código aberto constituem violação de direitos autorais, ainda sem conclusão

Para as áreas de geração de imagens e violação de saída de IA, os precedentes ainda não foram estabelecidos – estas são as maiores incertezas legais atualmente.

As regras estão praticamente definidas

Para as empresas de IA, desta série de decisões e acordos é possível extrair vários sinais claros:

  1. O treinamento em si é basicamente uso justo, mas fontes piratas são um risco independente – não economize nesse custo
  2. O modelo "licenciamento + acordo" da indústria musical pode se tornar o novo normal; detentores de direitos autorais tendem cada vez mais a buscar licenciamento em vez de apenas indenização
  3. Geração de imagens e violação de saída ainda são campos minados – é melhor não apostar em "esperar os precedentes saírem primeiro"
  4. Saídas de IA não têm direitos autorais – esta regra está definida; modelos de negócios devem evitar reivindicações de direitos autorais sobre "conteúdo original de IA"

Os US$ 1,5 bilhão da Anthropic são um número grande, mas considerando sua escala de receita atual, é o preço para comprar certeza. O custo da conformidade de dados é, no final, mais barato que a incerteza de litígios.

Fontes de referência: AI in litigation series: An update on AI copyright cases in 2026 (Norton Rose Fulbright); CocoLoop, Bartz v. Anthropic Settlement: What Authors Need to Know (The Authors Guild); AI Copyright Lawsuit Developments in 2025: A Year in Review (Copyright Alliance); Generative AI Lawsuits Timeline (Sustainable Tech Partner)