O The Seattle Times e o Newsday processaram a OpenAI e a Microsoft nesta sexta-feira, alegando em um tribunal federal que as empresas de tecnologia copiaram o jornalismo dos jornais sem permissão para treinar seus sistemas de inteligência artificial.
A ação no Tribunal Distrital dos EUA para o Distrito Sul de Nova York alega que a OpenAI e a Microsoft coletaram dados (scraped) dos sites dos jornais, incluindo conteúdos protegidos por paywall, e incorporaram os artigos em conjuntos de dados usados para treinar e operar produtos como o ChatGPT, o Microsoft Copilot e recursos de IA do Bing.
Os jornais, sediados em Seattle e Long Island (Nova York), afirmaram que os produtos de IA das empresas conseguem reproduzir trechos de suas reportagens, parafrasear artigos de forma muito próxima e fornecer respostas aos usuários que reduzem a necessidade de visitar seus sites ou assinar seus jornais.
"Sentimos fortemente que devemos defender nosso conteúdo — no qual gastamos milhões de dólares por ano para produzir — de ser usado sem nosso consentimento ou compensação", escreveu o presidente e CEO do Seattle Times, Alan Fisco, aos funcionários, de acordo com o próprio jornal.
Um porta-voz da OpenAI, sediada em São Francisco, disse que seus modelos são treinados em dados publicamente disponíveis e amparados pelo uso aceitável (fair use), sem comentar especificamente sobre o processo.
Um porta-voz da Microsoft, sediada perto de Seattle, no Estado de Washington, disse em um e-mail: "Embora estejamos surpresos com o processo, valorizamos a importância do jornalismo local e estamos sempre dispostos a nos sentar e buscar soluções para esse tipo de disputa".
O Seattle Times e o Newsday pedem uma ordem judicial que exija a destruição das cópias de suas obras, bem como dos conjuntos de dados de treinamento ou modelos de IA que os tenham incorporado.
O processo é semelhante ao movido pelo The New York Times em 2023, que acusou a OpenAI e a Microsoft de usarem milhões de artigos de jornais sem permissão para treinar o popular chatbot da OpenAI. O caso continua em andamento e é um dos dezenas apresentados por detentores de direitos autorais contra empresas de tecnologia como OpenAI, Anthropic e Meta pelo que chamam de uso indevido de seu material para treinar sistemas de IA.
Valor