Reddit processa Perplexity por uso indevido de dados em IA
Reddit processa Perplexity por uso indevido de dados em IA A rede social entrou na Justiça dos EUA contra a Perplexity e outras três startups acusadas de coletar conteúdo de resultados de busca sem autorização para treinar modelos de inteligência artificial.
Reddit processa Perplexity por uso indevido de dados em IA
A ação, registrada em um tribunal da Califórnia, afirma que bots da Perplexity, SerpApi, Oxylabs e AWMProxy extraíram massivamente postagens de usuários do Reddit — material protegido por direitos de uso — e venderam esses dados a empresas de IA. O processo pede indenização por perdas financeiras e uma liminar que impeça a continuidade da prática.
Segundo a petição, as empresas “mascararam suas identidades” para burlar sistemas de proteção e driblar bloqueios de IP, obtendo o conteúdo por meio de resultados do Google. O diretor jurídico do Reddit, Ben Lee, classificou o fenômeno como “economia de lavagem de dados em escala industrial”.
O caso surge poucos meses depois de o Reddit firmar acordos de licenciamento com Google e OpenAI, que passaram a ter acesso oficial e remunerado à base de dados da plataforma. Ao mesmo tempo, a rede desenvolve sua própria ferramenta de IA para organizar e exibir, de forma transparente, informações geradas pelos 426 milhões de usuários semanais.
Para o Reddit, o comportamento dos scrapers destoa desse modelo. A Perplexity teria continuado a citar trechos do fórum mesmo após receber notificação extrajudicial para cessar a coleta. Questionada, a empresa nega irregularidades, mas segue citada no processo.
Especialistas veem a disputa como marco para a chamada “corrida do ouro” pelos dados humanos que alimentam sistemas de linguagem natural. Sem novas fontes de informação, modelos conversacionais perdem precisão; por isso, o controle sobre grandes repositórios de texto torna-se estratégico.
Imagem: gguy
A íntegra da petição ainda não foi tornada pública, mas o The New York Times antecipou que o Reddit investiu “dezenas de milhões de dólares” em tecnologias anti-scraping nos últimos anos, escalonando a resposta contra coleta não autorizada.
Para saber como outras empresas brasileiras lidam com desafios semelhantes, visite a nossa editoria de Brasil e continue acompanhando a cobertura completa sobre tecnologia e direito digital.
Crédito da imagem: gguy/Shutterstock















