Reddit passe depuis un an son temps à poursuivre les scrapers. Le 28 août, l’un d’entre eux a riposté : l’inscription au rôle 119 dans l’affaire Reddit, Inc. v. SerpApi LLC, devant la Southern District of New York, est enregistrée comme « Answer to Amended Complaint AND Counterclaim », et la demande reconventionnelle relève du droit de la concurrence.
La théorie
SerpApi invoque une monopolisation et une tentative de monopolisation au titre de la section 2 du Sherman Act, ainsi que quatre chefs déclaratoires. Le marché allégué est étroit et précisément défini : l’accès programmatique à des données conversationnelles humaines authentiques à grande échelle, issues de forums à fils de discussion organisés par thème, pour l’indexation de recherche et pour l’entraînement et l’ancrage de systèmes d’IA. Le cœur factuel est une séquence — un partenariat de données avec une entreprise de recherche annoncé début 2024, puis, à la mi-2024, une modification de robots.txt qui a laissé l’accès programmatique ouvert à ce seul partenaire, tandis que la mesure technique sur laquelle Reddit s’appuie dans sa propre affaire n’a été déployée que des mois plus tard. Les réparations demandées comprennent des dommages-intérêts triplés et une injonction interdisant de servir des directives robots.txt spécifiques au demandeur qui discriminent selon le statut de licence.
Ce que le cadrage courant comprend mal
Quatre corrections, toutes essentielles. Il s’agit d’un acte de procédure, pas d’une décision — aucun juge ne l’a examiné, et une requête en rejet déposée par un autre défendeur était encore pendante au moment où il a été enregistré. Un seul défendeur l’a déposée : le dossier montre, le même jour, une réponse distincte et ordinaire d’une autre partie, sans demande reconventionnelle, donc dire que « les défendeurs ont contre-attaqué » est inexact. Aucune autorité de régulation n’est impliquée — il s’agit d’une demande reconventionnelle privée, pas d’une enquête antitrust. Et aucun montant n’est chiffré ; la demande porte sur des dommages réels, triplés.
Le maillon faible
C’est la définition du marché qui sera attaquée. Un marché constitué de conversations humaines filées sur des forums thématiques ressemble fortement à un marché de produit unique, et les définitions de marché portant sur un seul produit constituent le mode d’échec classique des demandes fondées sur la section 2 au stade du rejet. Les précédents en matière de scraping cités par SerpApi sont des affaires d’accès, pas des affaires antitrust, et ils n’établissent pas que restreindre robots.txt viole le Sherman Act.
Pourquoi cela mérite quand même d’être suivi
La propre action de Reddit repose sur la contournement de la section 1201 du DMCA et la concurrence déloyale, et non sur la propriété des publications des utilisateurs. La demande reconventionnelle inverse l’angle : si les accords exclusifs de données avec des plateformes deviennent un risque antitrust, la structure du marché des données d’entraînement pour l’IA change, quel que soit le vainqueur dans cette affaire.
