O Reddit passou um ano processando scrapers. Em 28 de agosto, um deles respondeu: a entrada de processo 119 em Reddit, Inc. v. SerpApi LLC, no Distrito Sul de Nova York, consta como "Answer to Amended Complaint AND Counterclaim", e a reconvenção é de antitruste.

A teoria

SerpApi alega monopolização e tentativa de monopolização sob a Seção 2 do Sherman Act, além de quatro pedidos declaratórios. O mercado alegado é estreito e definido com precisão: acesso programático a dados conversacionais humanos autênticos em larga escala, em fóruns com tópicos organizados por threads, para indexação em mecanismos de busca e para o treinamento e a fundamentação de sistemas de IA. O núcleo factual é uma sequência — uma parceria de dados com uma empresa de busca anunciada no início de 2024, seguida, em meados de 2024, por uma mudança no robots.txt que deixou o acesso programático aberto a esse único parceiro, enquanto a medida técnica em que o Reddit se baseia em sua própria ação só foi implantada meses depois. Entre os pedidos de reparação estão indenização tripla e uma liminar contra a veiculação de instruções robots.txt específicas por solicitante que discriminem com base no status de licenciamento.

O que a formulação comum erra

Quatro correções, todas essenciais. Isto é uma petição, não uma decisão — nenhum juiz a avaliou, e uma moção para arquivar de outro réu ainda estava pendente quando ela foi apresentada. Um réu entrou com a peça: o processo mostra uma resposta separada e simples de outra parte no mesmo dia, sem reconvenção, então dizer que "os réus processaram de volta" está errado. Nenhuma autoridade reguladora está envolvida — trata-se de uma reconvenção privada, não de uma investigação antitruste. E nenhum valor em dólares foi pleiteado; o pedido é por danos efetivos, em valor triplicado.

O elo mais fraco

A definição de mercado é o ponto que será atacado. Um mercado composto por conversas humanas em threads em fóruns temáticos se aproxima de um mercado de um único produto, e definições de mercado para um só produto são o modo de falha padrão de ações sob a Seção 2 na fase de arquivamento. Os precedentes de scraping citados pela SerpApi são casos de acesso, não casos antitruste, e não sustentam que restringir o robots.txt viole o Sherman Act.

Por que, ainda assim, vale acompanhar

A própria ação do Reddit se baseia em circunvenção da Seção 1201 do DMCA e concorrência desleal, não em propriedade sobre as postagens dos usuários. A reconvenção inverte o enquadramento: se acordos exclusivos de dados com plataformas passarem a configurar exposição antitruste, a estrutura do mercado de dados para treinamento de IA muda, independentemente de quem vença este caso.