Home / NOTÍCIAS / GERAIS / Reddit processa Perplexity por uso indevido de dados em IA

Reddit processa Perplexity por uso indevido de dados em IA

Advertisements
Advertisements

Reddit processa Perplexity por uso indevido de dados em IA

Reddit processa Perplexity por uso indevido de dados em IA A rede social entrou na Justiça dos EUA contra a Perplexity e outras três startups acusadas de coletar conteúdo de resultados de busca sem autorização para treinar modelos de inteligência artificial.

Reddit processa Perplexity por uso indevido de dados em IA

A ação, registrada em um tribunal da Califórnia, afirma que bots da Perplexity, SerpApi, Oxylabs e AWMProxy extraíram massivamente postagens de usuários do Reddit — material protegido por direitos de uso — e venderam esses dados a empresas de IA. O processo pede indenização por perdas financeiras e uma liminar que impeça a continuidade da prática.

Advertisements
Advertisements

Segundo a petição, as empresas “mascararam suas identidades” para burlar sistemas de proteção e driblar bloqueios de IP, obtendo o conteúdo por meio de resultados do Google. O diretor jurídico do Reddit, Ben Lee, classificou o fenômeno como “economia de lavagem de dados em escala industrial”.

O caso surge poucos meses depois de o Reddit firmar acordos de licenciamento com Google e OpenAI, que passaram a ter acesso oficial e remunerado à base de dados da plataforma. Ao mesmo tempo, a rede desenvolve sua própria ferramenta de IA para organizar e exibir, de forma transparente, informações geradas pelos 426 milhões de usuários semanais.

Para o Reddit, o comportamento dos scrapers destoa desse modelo. A Perplexity teria continuado a citar trechos do fórum mesmo após receber notificação extrajudicial para cessar a coleta. Questionada, a empresa nega irregularidades, mas segue citada no processo.

Especialistas veem a disputa como marco para a chamada “corrida do ouro” pelos dados humanos que alimentam sistemas de linguagem natural. Sem novas fontes de informação, modelos conversacionais perdem precisão; por isso, o controle sobre grandes repositórios de texto torna-se estratégico.

A íntegra da petição ainda não foi tornada pública, mas o The New York Times antecipou que o Reddit investiu “dezenas de milhões de dólares” em tecnologias anti-scraping nos últimos anos, escalonando a resposta contra coleta não autorizada.

Para saber como outras empresas brasileiras lidam com desafios semelhantes, visite a nossa editoria de Brasil e continue acompanhando a cobertura completa sobre tecnologia e direito digital.

Crédito da imagem: gguy/Shutterstock

Advertisements
Advertisements