Reddit processa Perplexity por roubo de dados para IA
Publicado em 23 de outubro de 2025 às 10:24
2 min de leituraReddit acusa Perplexity de roubo de dados • Reddit processou a Perplexity e outras três empresas por suposto roubo de dados e violação de direitos autorais e termos de serviço.
• Um post "fantasma" criado pelo Reddit apareceu na Perplexity, servindo como prova de uso indevido de conteúdo.
• A empresa pede indenização e proibição permanente do uso de seus dados pelas rés.
O Reddit abriu um processo judicial contra a conhecida startup de inteligência artificial Perplexity por suposto roubo de dados em escala industrial. Além dela, a ação também mira a SerpApi, a Oxylabs e a AWMProxy – as duas últimas são da Lituânia e da Rússia.
Segundo a acusação, detalhada pelo The New Tork Times, essas três empresas operaram coletando ilegalmente dados do Reddit não diretamente, mas ao extrair o conteúdo dos resultados de busca do Google. Esse material seria revendido para alimentar modelos de IA de empresas como a Perplexity.
A alegação é de que as empresas violaram as leis de direitos autorais e os termos de serviço da plataforma ao praticar a raspagem de dados (data scraping) sem autorização.
Reddit criou armadilha
Para provar a violação, o Reddit preparou um post de teste "fantasma", visível apenas para os robôs de indexação do Google e inacessível de qualquer outra forma. Em poucas horas, o conteúdo desse post teria aparecido nos resultados de busca da Perplexity.
Segundo a ação, essa é a prova de que a startup de IA está usando o Google como um atalho para acessar e exibir o conteúdo do Reddit sem permissão.
O processo alega ainda que o Reddit já havia enviado uma notificação formal para a Perplexity no passado, exigindo que a startup parasse a raspagem dos dados. A companhia teria concordado, mas o Reddit afirma que as citações ao seu conteúdo na ferramenta de IA "saltaram quarenta vezes" desde então.
Em comunicado enviado à Bloomberg, o diretor jurídico do Reddit, Ben Lee, afirma que as empresas de IA "estão presas a uma corrida armamentista por conteúdo humano de qualidade", e que essa pressão "alimentou uma economia de ‘lavagem de dados’ em escala industrial."
Vale lembrar que essa não é a primeira vez que a Perplexity é envolvida em polêmica sobre uso indevido de dados. Em agosto desse ano, a Cloudflare acusou a companhia de ignorar instruções do arquivo robots.txt e extrair ilegalmente o conteúdo de sites. Em 2024, a Amazon teve que intervir após acusações de que a startup estaria usando os servidores dela para plagiar matérias de veículos como Wired e Forbes.
Reddit quer indenização
Fonte: Tecnoblog
Leia também
- Google paga US$ 10 milhões por e-mails e conversas internas de companhia aérea falida para treinar IA

A Spirit Airlines parou de voar, mas uma parte pouco óbvia de seus ativos despertou o interesse do Google: anos de e-mails, conversas entre funcionários, documentos e código de software. A gigante de tecnologia venceu um leilão judicial ao oferecer US$ 10 milhões pelo conjunto de dados da companhia aérea falida. O Goo…
💬 0 - IA cria corrida por eletricistas nos EUA, e alguns já ganham até US$ 280 mil por ano

A expansão da inteligência artificial está criando uma demanda inesperada nos Estados Unidos: empresas precisam de centenas de milhares de eletricistas, encanadores, técnicos e outros profissionais especializados para construir a infraestrutura que mantém a IA funcionando. E algumas dessas vagas podem pagar salários c…
💬 0 - SSD antigo da SanDisk grava 1 petabyte de dados e ultrapassa em 25x a expectativa de vida útil declarada pelo fabricante

Nenhum componente de computador dura para sempre, mas determinar sua vida útil exata nem sempre é fácil. Isso é especialmente verdade para SSDs, cuja memória se degrada gradualmente à medida que os dados são gravados e apagados. No entanto, um experimento mostrado por um usuário no YouTube demonstra que até mesmo disp…
💬 0