4 июня 2025 года Reddit Inc., владелец крупнейшего онлайн-форума в мире с множеством сообществ (сабреддитов), подал иск в Верховный суд Сан-Франциско против владельца известного ИИ-агента Claude (Anthropic, PBC).
Anthropic обвиняется в том, что он многократно скрапил контент с ресурсов Reddit, несмотря на публичные заявления Anthropic летом 2024 года о полной блокировке веб-краулинга с ресурсов Reddit. Чтобы добавить изюминку в opening statement своего иска, юристы Reddit (Quinn Emanuel) спросили самого Claude «Were you trained, at least in part, on Reddit data?”, на что получили прямой ответ “Yes”, и использовали это как доказательство против Claude.
В своем исковом заявлении Reddit просит суд:
Юристы Reddit приводят следующие основные группы аргументов в иске:
Заметим, что в отличие от многих дел в сфере ИИ, например дела Bartz v. Anthropic, где основное внимание уделяется нарушениям авторских прав при обучении ИИ и свободному использованию (fair use), в этом споре Reddit фокусируется на нарушении договора (User Agreement) и режима конфиденциальности сообщений, а также общего характера ведения бизнеса в этом сегменте. Reddit пытается поставить вопрос «этичности» и справедливости скраппинга как такового, упирая на то, что ИИ-модели Anthropic на самом деле отличаются от того, что им приписывают маркетинговые материалы и публичные заявления Anthropic.
На просторах СНГ в свое время все внимание было приковано к делу ВКонтакте против Дабл, где также рассматривались вопросы правомерности парсинга / скраппинга данных из социальной сети vk.com. Если с точки зрения исключительных прав на базу данных все более или менее разрешилось (если кратко – это было незаконно), пусть и в свете мирового соглашения, то по вопросу использования персональных данных пользователей, которые сделаны общедоступными самими пользователями ситуация далека от прояснения. Однако именно на фоне этого вопроса в России появилась новая статья 10.1 в ФЗ-152 «О персональных данных», которая до сих пор вызывает споры и дискуссии на предмет того, при каких условиях допустимо осуществлять парсинг данных сайтов и соцсетей.
Советуем нашим читателям и клиентам следить за развитием событий по этой теме, особенно тем, кто связан с созданием и обучением ИИ-моделей.
Авторы: Александр Стружко
Уважаемые журналисты, использование материалов с сайта REVERA в публикациях возможно только после нашего письменного разрешения.