Processo contra OpenAI e Microsoft por uso de conteúdo jornalístico em IA
O New York Times, o Seattle Times e o Newsday entraram com ações na Justiça federal dos EUA acusando a OpenAI e a Microsoft de terem utilizados conteúdos jornalísticos sem autorização para treinar modelos de inteligência artificial, como o ChatGPT e o Microsoft Copilot. As movimentações judiciais foram feitas na sexta-feira, 4, no Tribunal Distrito Sul de Nova York, conforme informam O Estado de S. Paulo e Tilt (UOL).
Argumentos do New York Times
Os documentos entregues na sexta-feira trazem uma série de referências culturais e legais. Citam a lei de direitos autorais, mencionam obras de arte como as de Andy Warhol, o poeta Lord Byron e até o antigo time de beisebol dos New York Giants. O jornal argumenta que seus textos não foram transformados o suficiente pelos modelos de IA e que as respostas geradas atuam como substitutos diretos, enfraquecendo o valor econômico do conteúdo original.
O NYT também afirma que as empresas copiaram ilegalmente seus artigos de diferentes formas durante o desenvolvimento da tecnologia, violando os direitos dos editores. A ação foi inicialmente movida em 2023 e conta com o apoio de outros veículos de notícias. Para o jornal, se os sistemas de IA competem como fontes de informação, eles prejudicam modelos de negócios baseados em assinaturas e publicidade.
Defesa das empresas
A Microsoft afirma que a legislação atual sobre direitos autorais não permite que os detentores de direitos impeçam o desenvolvimento de tecnologias transformadoras, citando seu próprio produto, o Copilot. Para a empresa, bloquear inovações seria incompatível com o avanço tecnológico.

A OpenAI declarou que suas ferramentas colocam informações úteis ao alcance de qualquer pessoa, chamando isso de progresso social. A empresa reforçou que a lei de direitos autorais não se opõe a esse tipo de inovação e reiterou o princípio do uso justo como base para o treinamento de seus modelos. Nenhuma das empresas comentou detalhes específicos do processo.
Outras ações judiciais
O Seattle Times e o Newsday também moveram ações na mesma data, acusando a OpenAI e a Microsoft de terem feito raspagem de conteúdo de seus sites, inclusive artigos protegidos por paywall, para compor os conjuntos de dados usados no treinamento do ChatGPT, do Copilot e das funcionalidades de IA do Bing.
Os jornais alegam que os sistemas conseguem reproduzir trechos com alta fidelidade, parafrasear artigos de forma muito próxima ao original e responder perguntas dos usuários sem que estes precisem acessar os sites ou assinar as publicações. Alan Fisco, presidente e CEO do Seattle Times, disse que é preciso proteger o conteúdo produzido com recursos milionários por sua equipe. Um porta-voz da OpenAI afirmou que os modelos são treinados apenas com dados públicos, baseando-se no uso justo. Um representante da Microsoft reconheceu surpresa com a ação, mas disse que valoriza o jornalismo local e está aberto a conversar para encontrar soluções.
Diferenças na cobertura
O Estado de S. Paulo destacou as referências culturais e esportivas nos documentos judiciais, como as menções a Lord Byron, Andy Warhol e o New York Giants, como parte da discussão sobre uso justo e transformação. A Tilt trouxe foco às alegações de scraping de conteúdo protegido por paywall, aos detalhes sobre como os dados foram coletados e às declarações das empresas sobre fair use e disposição para negociar.
Questões ainda não resolvidas
- Quantidade exata de artigos supostamente utilizados nos conjuntos de treinamento da IA.
- Valor da indenização ou das medidas cautelares que os jornais estão buscando.
- Data prevista para a decisão do juiz Sidney H. Stein, embora os envolvidos esperem que ela ocorra nas próximas semanas.


