Reddit은 1년간 스크래퍼들을 상대로 소송을 벌여 왔습니다. 8월 28일 그들 중 하나가 맞받아쳤습니다. Reddit, Inc. v. SerpApi LLC의 뉴욕 남부지방법원 사건기록 119번은 "Answer to Amended Complaint AND Counterclaim"으로 기재돼 있으며, 이 반소는 반독점 관련입니다.
이론
SerpApi는 Sherman Act 제2조에 따른 독점화 및 독점화 시도와 함께 4개의 확인청구를 제기했습니다. 주장하는 시장은 좁고 정밀하게 설정돼 있습니다. 검색 인덱싱과 AI 시스템의 학습 및 근거화(grounding)를 위해, 주제별로 정리된 스레드형 포럼에서 대규모의 진짜 인간 대화 데이터를 프로그램적으로 접근하는 시장이라는 것입니다. 사실관계의 핵심은 하나의 검색기업과의 데이터 파트너십이 2024년 초 발표된 뒤, 2024년 중반 robots.txt 변경으로 그 한 파트너에 대해서만 프로그램적 접근이 열려 있었고, Reddit이 자체 소송에서 의존하는 기술적 조치는 몇 달 뒤에야 배치됐다는 순서입니다. 청구한 구제는 3배 손해배상과, 라이선스 상태에 따라 차별하는 요청자별 robots.txt 지시를 제공하지 못하도록 하는 금지명령을 포함합니다.
통상적 프레임이 놓치는 점
수정이 필요한 네 가지 점이 있습니다. 이는 판결이 아니라 소장입니다 — 법관이 이를 심사한 적이 없고, 다른 피고의 기각 신청도 아직 계류 중이던 시점에 제출됐습니다. 제기한 곳은 한 피고입니다. 사건기록에는 같은 날 다른 당사자의 별도이고 단순한 답변서가 반소 없이 제출된 것으로 나와 있으므로, "피고들이 반소를 제기했다"는 표현은 틀립니다. 규제기관은 관여하지 않았습니다 — 이는 반독점 조사 아닌 사적 반소입니다. 그리고 청구된 금액도 없습니다; 요청은 실제 손해의 3배 배상입니다.
가장 약한 고리
이 사안에서 공격받을 지점은 시장 정의입니다. 주제별 포럼의 인간 대화 스레드로 구성된 시장은 사실상 단일 제품 시장에 가깝고, 단일 제품 시장 정의는 기각 단계에서 Sherman Act 제2조 청구가 흔히 실패하는 전형적 원인입니다. SerpApi가 인용한 스크래핑 선례는 접근 사건이지 반독점 사건이 아니며, robots.txt 제한이 Sherman Act를 위반한다고 보지도 않습니다.
그럼에도 지켜볼 가치는 있는 이유
Reddit의 본래 소송은 DMCA 제1201조 우회와 불공정경쟁에 기반하며, 사용자 게시물의 소유권에 기반하지 않습니다. 이번 반소는 프레임을 뒤집습니다. 배타적 플랫폼 데이터 거래가 반독점 노출을 초래한다면, 이 사건의 승패와 무관하게 AI 학습 데이터 시장의 구조는 달라집니다.
