Existe uma batalha silenciosa a decorrer nos tribunais e nas salas de reuniões das maiores empresas tecnológicas do mundo. O campo de batalha são os livros, os artigos e as obras literárias que alimentaram o desenvolvimento dos modelos de inteligência artificial mais poderosos da atualidade. A questão central é simples de formular, mas extraordinariamente difícil de responder: é legal usar obras protegidas por direitos de autor para treinar sistemas de IA?
Como funciona o treino de uma IA, afinal?
Para perceber o problema, é útil compreender o processo. Treinar um modelo de linguagem é semelhante a ensinar uma criança a escrever mostrando-lhe milhares de livros. A criança não memoriza cada frase palavra por palavra, mas absorve padrões, estilos, estruturas e lógicas narrativas. O modelo de IA faz o mesmo: processa enormes volumes de texto para aprender a gerar linguagem coerente e útil. O problema surge quando parte desses “livros de estudo” pertencem a autores que nunca deram autorização para esse uso.
O argumento das empresas de tecnologia
As grandes empresas, como a OpenAI, a Google ou a Meta, tendem a invocar o conceito de “uso justo” (fair use), uma doutrina jurídica norte-americana que permite, em certas circunstâncias, usar material protegido sem pagar direitos. O argumento é que o modelo não reproduz os livros, apenas aprende com eles, da mesma forma que um estudante lê um romance para depois escrever a sua própria história. Nesta lógica, o produto final é transformador e suficientemente distinto da obra original para ser considerado legítimo.
O argumento dos autores e criadores
Do outro lado estão escritores, jornalistas e editoras que discordam profundamente. O raciocínio deles parte de uma premissa diferente: se a IA aprende com o estilo de um autor e depois gera textos semelhantes a custo zero, está a competir diretamente com esse autor no mercado. É como se uma academia de música gravasse todos os álbuns de um artista para ensinar os seus alunos sem pagar royalties, e depois esses alunos vendessem músicas no mesmo estilo. O prejuízo económico para o criador original é real e mensurável.
O estado atual da lei: uma zona cinzenta enorme
A verdade incómoda é que a legislação existente não foi concebida para este cenário. Os direitos de autor foram desenhados numa era em que copiar significava reproduzir. O treino de IA levanta questões completamente novas: copiar temporariamente para aprender é o mesmo que copiar para distribuir? O modelo resultante é uma obra derivada? Existe um dano mensurável ao mercado do autor?
Nos Estados Unidos, vários processos judiciais estão em curso, incluindo ações movidas pela autora Sarah Silverman e pelo The New York Times contra a OpenAI. Na Europa, o Regulamento de IA da União Europeia começa a impor obrigações de transparência sobre os dados usados no treino, mas sem proibições explícitas. Em Portugal e no resto da União Europeia, a Diretiva sobre Direitos de Autor no Mercado Único Digital de 2019 prevê uma exceção para a mineração de texto e dados para fins de investigação científica, mas o seu alcance comercial permanece ambíguo.
Porque é que isto nos interessa a todos nós?
Esta discussão não é apenas académica. Se os tribunais decidirem que o treino de IA com obras protegidas é ilegal sem compensação, o custo de desenvolver modelos de linguagem vai aumentar substancialmente. Isso pode abrandar a inovação, concentrá-la ainda mais nas empresas com maiores recursos financeiros e alterar os produtos que chegam ao consumidor final. Por outro lado, se não existir qualquer proteção, os criadores de conteúdo perdem o incentivo económico para produzir as obras que, ironicamente, são a matéria-prima de toda esta tecnologia.
Para onde caminha o futuro?
A solução mais provável passará por um modelo de licenciamento coletivo, semelhante ao que existe na indústria musical com as sociedades de gestão de direitos. As empresas de IA pagariam uma taxa para aceder a vastos repositórios de obras, e os criadores receberiam uma compensação proporcional. Já existem acordos pioneiros neste sentido, como o celebrado entre a Associated Press e a OpenAI. Mas a regulamentação abrangente e universal ainda está longe de ser uma realidade.
Até lá, nós vivemos numa zona de indefinição jurídica onde os modelos de IA mais usados no quotidiano foram, muito provavelmente, treinados com obras cujos autores nunca foram consultados nem compensados. É uma questão que merece atenção, debate público e, acima de tudo, respostas legais à altura da velocidade com que a tecnologia avança.
Fonte: Notícia Original





