Executivo da Microsoft chamou uso de conteúdo jornalístico para treinar modelos de IA de 'maior roubo de trabalho da história humana'

Executivo da Microsoft chamou uso de conteúdo jornalístico para treinar modelos de IA de 'maior roubo de trabalho da história humana' - Foto
Fonte da notícia: Epoca Negócios Epoca Negócios

Documentos internos de Microsoft e OpenAI tornados públicos em uma ação judicial liderada pelo The New York Times revelam que funcionários das duas empresas discutiram internamente os riscos de usar conteúdo jornalístico para treinar sistemas de inteligência artificial, além do potencial impacto econômico que os chatbots poderiam causar aos veículos de comunicação. De acordo com o Ars Technica, o conteúdo dos documentos foi divulgado em uma petição apresentada por grupos de mídia que acusam as empresas de violação de direitos autorais. Segundo os autores da ação, uma das principais evidências envolve declarações de Brent Hecht, diretor de ciência aplicada da Microsoft. Em documentos internos, ele teria descrito a raspagem massiva de conteúdo jornalístico para treinamento de IA como um "roubo impressionante em proporções sem precedentes" e, possivelmente, "o maior roubo de trabalho da história humana".

Em outra comunicação, o executivo também questionou a tese de que o treinamento de modelos com notícias poderia ser enquadrado como uso justo ("fair use"), argumento central da defesa das empresas no processo. Os documentos também mostram preocupações semelhantes na OpenAI. De acordo com a petição, Nick Turley, responsável pelo ChatGPT, avaliou que veículos de imprensa enfrentariam uma "ameaça existencial" caso produtos comerciais baseados em IA passassem a substituir a função desempenhada por provedores de notícias.

Um documento da Microsoft chegou a descrever um possível "círculo vicioso" ("doom loop"), no qual a redução do tráfego para os sites de notícias enfraqueceria a produção de conteúdo que alimenta os próprios modelos de IA. Competição pelo público Os autores do processo afirmam que dados internos reforçariam essa preocupação. Segundo os documentos citados, a Microsoft registrou quedas entre 83% e 93% nas taxas de clique destinadas a alguns grupos de mídia e reduções entre 51% e 94% para outros.

A avaliação dos veículos é que, ao oferecer respostas prontas diretamente ao usuário, os chatbots reduzem a necessidade de visitar os sites originais e comprometem uma das principais fontes de receita do setor. A ação judicial também destaca comunicações internas que reconheciam o caráter substitutivo dos assistentes de IA. Em depoimento, o CEO da Microsoft, Satya Nadella, admitiu que plataformas de IA podem capturar cliques que antes seriam direcionados aos veículos jornalísticos ao entregar informações diretamente em suas interfaces. Já mensagens internas da OpenAI indicariam consenso de que usuários tendem a não acessar os links originais quando recebem respostas completas dos modelos. Outro ponto explorado pelos autores envolve supostas tentativas de contornar barreiras impostas pelos veículos. A petição menciona trocas de mensagens nas quais funcionários da OpenAI discutiram maneiras de acessar conteúdo protegido por paywalls. O documento também aponta que as empresas tinham conhecimento dos riscos associados à reprodução de trechos extensos de reportagens nas respostas geradas pelos sistemas. Disputa nos tribunais Os grupos de mídia argumentam que Microsoft e OpenAI sabiam que seus produtos poderiam competir diretamente com os próprios veículos que forneceram, involuntariamente, parte do material utilizado no treinamento dos modelos. A acusação sustenta ainda que as empresas deixaram de buscar acordos de licenciamento amplos para compensar produtores de conteúdo, ao mesmo tempo em que expandiam produtos comerciais baseados em inteligência artificial. Em resposta à reportagem da Ars Technica, um porta-voz da Microsoft afirmou que os comentários de Brent Hecht representam opiniões individuais e não refletem a posição oficial da companhia. A empresa também reiterou que considera seus sistemas de IA uma aplicação transformativa da doutrina de "fair use" e negou que os produtos substituam veículos jornalísticos. A OpenAI não comentou imediatamente o caso. Para os grupos de mídia, a disputa vai além das perdas atuais de tráfego. A sustentação econômica do jornalismo profissional, afirmam os autores da ação, é também uma condição para a manutenção de fontes confiáveis de informação que alimentam os modelos de inteligência artificial.

Na avaliação dos veículos, uma eventual decisão judicial obrigando empresas de IA a licenciar conteúdo jornalístico poderia redefinir a relação entre o setor tecnológico e a indústria de notícias nos próximos anos. *Sob supervisão de Daniel Pinheiro Mais Lidas

Compartilhar: WhatsApp Facebook Telegram X

Deseja ler a íntegra original na fonte jornalística?

Acessar matéria no site Epoca Negócios