tech & talk
IA09 de out. de 2026, 10:53

USA Today processa OpenAI por uso de mais de 160 mil artigos sem autorização

A USA Today Co., controladora do jornal USA Today e de publicações locais da rede Gannett, pede mais de US$ 250 milhões da OpenAI por suposta violação de direitos autorais no treinamento de modelos de IA.

Por Elias Brandão · Analista de IA e ética

Compartilhar

Um jornal é feito de reportagem apurada, não de previsão estatística

Pense assim: um modelo de linguagem como os da OpenAI, criadora do ChatGPT, aprende a prever a próxima palavra analisando montanhas de texto. O problema, segundo a USA Today Co. — controladora do jornal USA Today e de uma rede de publicações locais da Gannett, grupo de mídia americano —, é que boa parte desse texto veio de reportagens protegidas por direitos autorais, sem pagamento ou autorização.

A empresa, junto com 19 publicações afiliadas, processou a OpenAI na Corte Distrital dos EUA para o Distrito Sul de Nova York, pedindo mais de US$ 250 milhões em danos. O processo foi protocolado nesta quinta-feira (8), segundo o The Verge.

O número que sustenta a ação

A USA Today Co. alega que mais de 160 mil artigos seus foram identificados nos conjuntos de dados usados para treinar modelos da OpenAI, incluindo cerca de 83 mil só do domínio usatoday.com. Segundo o processo, esse material apareceria em mais de 122 milhões de tokens (unidades de texto processadas pelo modelo) no banco de dados C4, usado para treinar modelos de linguagem, com 23 milhões de tokens vindos apenas do USA Today.

As alegações incluem infração deliberada ("willful") de direitos autorais, infração vicária e remoção de informações de gestão de direitos — como retirar os créditos de autoria (bylines) e os avisos de copyright antes de repassar o conteúdo a usuários do ChatGPT.

Dois lados da história

De um lado, veículos de jornalismo argumentam que empresas de IA lucram reaproveitando décadas de apuração paga por redações, sem repassar nada a quem produziu o conteúdo original. Do outro, empresas como a OpenAI defendem que treinar modelos com material disponível publicamente configura uso justo ("fair use"), tese ainda não pacificada pela Justiça americana.

O caso se soma a uma onda de processos semelhantes — incluindo o aberto pelo The New York Times — reunidos em um litígio multidistrital que já tramita em Nova York. A OpenAI não respondeu publicamente às novas alegações até a conclusão desta apuração.

O que falta responder

Resta saber se a Justiça vai tratar o treinamento de IA com notícias como uso justo ou como violação, decisão que pode redefinir como toda a indústria de IA generativa lida com conteúdo jornalístico no futuro.

openaidireitos autoraisjornalismoprocesso judicialia
Compartilhar