Quando uma empresa de inteligência artificial recolhe informação sem autorização de um site governamental de saúde, o assunto deixa de ser apenas político e passa a ser uma questão que afeta a confiança de milhões de pessoas nos sistemas digitais que usamos todos os dias. Foi exatamente isso que o primeiro ministro australiano Anthony Albanese trouxe a público ao acusar a OpenAI de ter raspado conteúdos do portal de saúde do governo australiano sem qualquer permissão prévia.
O que é a “raspagem” de dados e por que razão é problemática
Para perceber o que está em causa, é útil pensar num cenário do quotidiano. Quando alguém entra numa biblioteca pública, pode ler os livros, tomar notas e aprender. O que não pode fazer é fotocopiar toda a coleção, sair sem pedir autorização e depois vender esses conhecimentos como seus. A raspagem de dados, ou web scraping, funciona de forma semelhante: um programa informático visita automaticamente páginas da internet e copia o seu conteúdo em grande escala, muitas vezes sem o conhecimento ou consentimento de quem as publica.
No caso em apreço, o portal visado continha informação sensível relacionada com saúde pública, um domínio onde a precisão, a origem e o contexto dos dados têm implicações diretas para o bem estar das pessoas. Utilizar esse conteúdo para treinar modelos de inteligência artificial sem autorização levanta questões sérias sobre propriedade intelectual, soberania digital e, acima de tudo, sobre os limites éticos do desenvolvimento tecnológico.
A reação do governo australiano e o que ela representa
A posição de Albanese foi clara e direta: classificou a situação como “obviamente inadmissível”. Esta linguagem não é acidental. Os governos de todo o mundo estão a perceber que as grandes empresas de IA construíram os seus modelos mais poderosos com base em enormes quantidades de dados recolhidos da internet, muitos deles provenientes de fontes públicas, mas nem por isso livres de restrições legais ou éticas.
A Austrália não está sozinha nesta preocupação. Na Europa, o Regulamento Geral sobre a Proteção de Dados estabelece limites rigorosos sobre como os dados dos cidadãos podem ser utilizados. Em Portugal, a Comissão Nacional de Proteção de Dados tem competência para investigar e sancionar práticas semelhantes. O que o caso australiano torna evidente é que a tensão entre a velocidade da inovação tecnológica e os quadros regulatórios existentes está a chegar a um ponto de rutura.
O que a OpenAI diz e o que fica por esclarecer
A empresa por trás do ChatGPT não emitiu, até ao momento desta publicação, uma resposta detalhada que refute ou confirme os contornos específicos da acusação. Este silêncio é, por si só, revelador de uma tendência mais ampla: as empresas de IA têm operado durante anos numa zona cinzenta legal, assumindo que o que está disponível na internet é livremente utilizável para fins de treino de modelos.
Essa premissa está agora a ser contestada em múltiplas frentes, desde tribunais nos Estados Unidos com processos movidos por meios de comunicação e autores, até a investigações regulatórias na Europa e, agora, declarações públicas de líderes governamentais na Ásia Pacífico. A questão central permanece em aberto: quem possui os dados que alimentam a inteligência artificial e quem tem o direito de lucrar com eles?
O que nós, enquanto utilizadores, devemos reter desta situação
Este episódio serve como um lembrete importante de que a inteligência artificial não cresce no vácuo. Cada resposta gerada por um modelo de linguagem é o resultado de um processo de aprendizagem que consumiu quantidades imensas de texto humano, produzido por jornalistas, investigadores, profissionais de saúde e cidadãos comuns. Quando esse processo ocorre sem transparência ou consentimento, a confiança nos sistemas digitais fica comprometida.
Para os utilizadores de serviços de saúde em linha, a situação é particularmente sensível. A informação médica exige rigor e responsabilidade editorial. Se os modelos de IA são treinados com conteúdos de portais governamentais sem supervisão adequada, existe o risco de que contextos, nuances e atualizações críticas se percam ou sejam distorcidos no processo.
A boa notícia é que este tipo de confronto público entre governos e empresas tecnológicas está a acelerar a criação de regras mais claras. O resultado ideal não é impedir a inovação, mas garantir que ela acontece com responsabilidade, transparência e respeito pelos direitos de quem produziu o conhecimento que a torna possível.
Fonte: Notícia Original





