A Anthropic chega a um acordo de 1,5 mil milhões de dólares em violação de direitos de autor: mas os autores e a editora não acham que ganharam

Um juiz federal dos EUA aprovou o acordo final de uma ação coletiva de direitos de autor movida contra a Anthropic, no valor de 1,5 mil milhões de dólares, estabelecendo o maior registo de acordo na história da legislação de direitos de autor dos EUA.
(Antecedentes: Depois de a Anthropic digitalizar 2 milhões de livros para treinar o Claude, o material foi directamente enviado para um triturador de papel e destruído)
(Informação de contexto: Sony leva Suno a tribunal este mês: o uso de músicas protegidas por direitos de autor para treinar AI conta como “uso justo”, e agora a questão é levada pela primeira vez a tribunal)

Índice do artigo

Toggle

  • Um julgamento sobre “como se arranjam os livros”
  • Os autores não acham que ganharam
  • O campo de batalha não acabou, apenas mudou de adversário

Depois de mais de um ano de litígio, o caso finalmente chega ao ponto em que a Anthropic paga para o encerrar. No dia 20, um juiz federal dos EUA aprovou formalmente este acordo final da ação colectiva de direitos de autor: cerca de 500.000 obras foram consideradas envolvidas, com uma indemnização média de 3.000 dólares por obra. O valor seria dividido entre autores e editoras detentores dos direitos, somando 1,5 mil milhões de dólares.

Esta aprovação final foi assinada pela juíza do Tribunal Distrital dos EUA para o Distrito Norte da Califórnia Araceli Martinez-Olguin, substituindo uma decisão preliminar proferida no ano passado pelo juiz William Alsup. O caso parece ter terminado na superfície, mas as controvérsias deixadas nessa decisão de Alsup, na verdade, só agora começaram a propagar-se por toda a indústria de IA.

Um julgamento sobre “como se arranjam os livros”

A história remonta a 2024. Um grupo de autores processou a Anthropic, acusando-a de, sem autorização, usar livros pirateados para treinar o chatbot de conversação Claude.

Durante a tramitação, Alsup proferiu uma rara decisão “de duas faces”: considerou que treinar modelos de IA com textos protegidos por direitos de autor constitui uso justo. Em termos simples, trata-se de pegar nos livros e usá-los para alimentar o modelo com o aprendizado de padrões de linguagem; por si só, isso não constitui violação. Juridicamente, é visto como um uso transformativo semelhante a citar, comentar ou usar para fins educativos.

Na altura, esta constatação foi amplamente encarada como uma viragem para a indústria de IA, ao abrir uma “porta” para a legitimidade dos dados de treino e dar uma faísca de esperança a outras empresas de IA que ainda estavam em processo.

No entanto, Alsup também traçou outra linha. O facto de o ato de treinar ser lícito não significa que a forma de obter os livros também o seja. A Anthropic obtinha os livros por dois canais: um era comprar e depois digitalizar, processo que não suscitou contestação; o outro era descarregar directamente a partir de sites pirateados, como a Library Genesis e a Pirate Library Mirror. Alsup considerou esta parte ilegal e afirmou que o problema podia ir directamente a julgamento com júri.

Uma vez em julgamento, os valores de indemnização ficariam ao critério do júri, com um tecto que poderia ultrapassar em muito o montante do acordo. A Anthropic, após ponderar, optou por um valor previsível, trocando uma disputa com resultados difíceis de antecipar e que se prolongaria por mais tempo.

Esta decisão parece pragmática, mas também garante que, para o exterior, nunca será possível ver numa decisão formal como é que o júri, afinal, precificaria uma obra pirateada.

Os autores não acham que ganharam

Apesar de 1,5 mil milhões de dólares soar como um valor astronómico, muitos autores não encaram este acordo como uma vitória. A razão é que este dinheiro compensa a via secundária de “obter piratamente”, e não a questão principal de “se o treino de IA constitui violação”.

O problema jurídico central — se usar obras protegidas por direitos de autor para treinar um modelo constitui ou não uso justo — acabou por resultar, na prática, num desfecho favorável às empresas de IA. O que os autores receberam foi uma espécie de multa pela preguiça da Anthropic e pela tentativa de atalhar na compra de livros, e não uma vitória “de princípio” do tipo “as empresas de IA não podem usar os meus livros para treinar modelos”. Por outras palavras, os autores ganharam a batalha menos importante dentro da guerra, mas perderam o lance mais decisivo.

Mais importante ainda, esta decisão nem sequer chega a ser um precedente vinculativo. Em linguagem simples: quando outros juízes se depararem com casos semelhantes no futuro, não precisam de copiar a lógica de Alsup; podem chegar a conclusões totalmente diferentes conforme o caso. A explicação é simples: trata-se apenas de uma decisão de “um único tribunal distrital”. Como a Anthropic escolheu o acordo, o caso nunca será enviado ao tribunal de recurso, pelo que não haverá oportunidade de que tribunais de nível superior confirmem e alarguem para toda a indústria regras que todos teriam de seguir.

Entre uma decisão de um tribunal distrital e um precedente vinculativo que abrangeria toda a indústria, existe um percurso completo de recursos. O acordo acabou por bloquear por completo esse caminho, devolvendo a questão “afinal o treino de IA conta como uso justo ou não” à zona cinzenta do direito.

Para outras empresas de IA que ainda estão a litigar, a decisão de Alsup pode, no máximo, servir como caso de referência, mas não impõe a nenhum juiz a obrigação de seguir o mesmo raciocínio.

O campo de batalha não acabou, apenas mudou de adversário

O encerramento do caso da Anthropic não significa que as controvérsias sobre direitos de autor dos dados usados para treinar IA tenham chegado ao fim. A Google, a Meta, a Midjourney e a OpenAI ainda carregam uma série de ações judiciais de direitos de autor. Os detalhes dos casos são diferentes, as evidências que os juízes têm e a forma como cada parte obteve os dados também não são iguais. No futuro, é totalmente possível que se chegue a conclusões totalmente diferentes das de Alsup.

Na semana passada, inclusive, editoras como Hachette, Cengage e Elsevier, juntamente com o escritor Scott Turow e a S.C.R.I.B.E., acabaram de apresentar uma ação colectiva contra a Google, acusando-a de usar uma plataforma de IA Gemini treinada com obras protegidas por direitos de autor. Com o mesmo guião, trocando apenas o réu, a história provavelmente vai repetir-se. Além disso, o próximo juiz não precisará de considerar nenhuma palavra da decisão do caso Anthropic.

Para toda a indústria editorial, o caso da Anthropic parece mais um modelo: demonstra que o caminho pode ser este — ceder primeiro em “uso justo” e depois negociar o montante do acordo relacionado com a obtenção pirateada. Isso sugere também que, em litígios futuros contra a Google ou a Meta, a batalha pode concentrar-se novamente nos meios de obtenção dos dados, e não propriamente em saber se o treino em si é legal ou ilegal. A diferença reside em que cada empresa tem registos distintos sobre as fontes dos dados de treino: algumas seguem colaborações autorizadas, outras não conseguem explicar claramente. Esses detalhes determinarão se o próximo processo seguirá um desfecho de acordo semelhante ao deste caso, ou se será levado a tribunal e lutado até ao fim.

Ver original
Esta página pode conter conteúdos de terceiros, que são fornecidos apenas para fins informativos (sem representações/garantias) e não devem ser considerados como uma aprovação dos seus pontos de vista pela Gate, nem como aconselhamento financeiro ou profissional. Consulte a Declaração de exoneração de responsabilidade para obter mais informações.
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
Comentar
Adicionar um comentário
Adicionar um comentário
Nenhum comentário
  • Fixado