Одна проверка на ботов, два суда, противоположные решения
С разницей в одиннадцать дней этим летом два федеральных судьи рассмотрели одну и ту же проверку Google на ботов, одного и того же ответчика и аналогичные исковые требования. Их выводы оказались прямо противоположными.
20 июля 2026 года главный судья Ивонн Гонсалес Роджерс из Северного округа Калифорнии отклонила иски Google по DMCA против SerpApi, компании, которая продает результаты поиска Google через API. 31 июля судья Пол Энгельмайер из Южного округа Нью-Йорка в основном отклонил ходатайства SerpApi и Perplexity о прекращении иска Reddit, основанного на той же системе Google.
| Дело | Суд | Решение | Иски по DMCA |
|---|---|---|---|
| Google против SerpApi | N.D. California | 20 июля 2026 | Отклонены |
| Reddit против SerpApi | S.D. New York | 31 июля 2026 | В основном сохранены |
Судебный процесс Google против SerpApi попал в заголовки, и многие издания расценили июль как одну победу и одно поражение для парсеров. Мы видим это иначе. Исход двух дел определил не сам факт обхода защиты. Решающим фактором стало то, что находилось за этой защитой, и кто владеет правами на этот контент. Для всех, кто собирает данные в сети, этот вывод куда полезнее любых громких заголовков.
Как SearchGuard выглядит со стороны клиента
SearchGuard представляет собой JavaScript challenge, который Google внедрил в свой поиск в январе 2025 года. По заявлению самого Google, запрос из нераспознанного источника получает код на исполнение. Браузер обычного пользователя выполняет его незаметно, тогда как большинство автоматизированных клиентов с этим не справляются и получают отказ.
Мы сталкиваемся с этим сами. В тестах, проведенных 17 сентября 2026 года, Google Search возвращал на некоторые автоматизированные запросы страницу размером 92 КБ с заголовком "Google Search": HTTP 200, никаких результатов и предложение включить JavaScript. Защита Reddit выглядит в сетевом трафике точно так же (200 с заголовком "Reddit - Prove your humanity"). Любой инструмент, который оценивает успешность только по статус-коду, зафиксирует обе страницы как успешно полученные.
Вот деталь, которую упустили в новостях. Судья Гонсалес Роджерс не утверждала, что SerpApi не обходила SearchGuard. Она признала, что Google надлежащим образом обосновал иск по разделу 1201 DMCA, и отвергла довод SerpApi о том, что Google, не являясь правообладателем контента, не имел права подавать иск. Но Google все равно проиграл.
Что это значит: суды больше не считают вопрос "удалось ли обойти проверку?" решающим. Они рассматривают его лишь как отправную точку.
Почему Google проиграл, а Reddit нет
Раздел 1201 DMCA запрещает обход мер, контролирующих доступ к «произведению, охраняемому в соответствии с этим разделом», то есть защищенному авторским правом. В собственном иске Google ее результаты поиска описаны как компиляции общедоступной информации с блоками Knowledge Panels, которые «могут содержать определенный защищенный авторским правом контент». Судебное решение опиралось буквально на слова Google: «В той степени, в которой результаты Google Search не содержат контента, защищенного авторским правом, нельзя утверждать, что SearchGuard эффективно контролирует доступ к произведению, охраняемому Законом об авторском праве». Эта часть иска была отклонена без права повторной подачи.
Часть, касающаяся Knowledge Panel, не прошла вторую проверку. Мера контроля должна применяться «с разрешения правообладателя», а Google не указала ни одного условия лицензий на эти изображения. Google контролирует вход, но не владеет большей частью того, что находится за ним.
Позиция Reddit иная. Посты пользователей защищены авторским правом, а пользовательское соглашение предоставляет Reddit лицензию на все эти материалы. Судья Engelmayer поддержал претензии по разделу 1201(a)(1)(A) против обоих ответчиков и по разделу 1201(a)(2) против SerpApi, отклонив при этом иск по разделу 1201(b), а также обвинения по законам штата в неосновательном обогащении и недобросовестной конкуренции. Проверка та же, но у этого истца были права на защищаемый контент. При этом суд оставил открытым вопрос о том, защищены ли вообще короткие сниппеты, отображаемые на страницах Google, а ходатайство об отклонении иска от Oxylabs, также фигурирующей в деле, все еще находится на рассмотрении.
Лицензия становится замком
Google сделала выводы. Ее исправленный иск, поданный 10 августа, перестраивает правовую позицию вокруг контрактов. В нем утверждается, что лицензиары разрешили внедрять средства контроля доступа, «а в некоторых случаях настаивали на том, чтобы Google это сделала». В иске говорится, что один неназванный партнер с 2017 года обязывает Google «прилагать коммерчески обоснованные усилия для защиты лицензионного контента от несанкционированного доступа третьих лиц», а соглашение с Reddit «предписывает Google не позволять третьим лицам извлекать и самостоятельно коммерциализировать лицензионный контент». В качестве разрешения от пользователей приводится даже собственная Privacy Policy компании Google.
Второе ходатайство SerpApi об отклонении иска указывает на то, что ни одно из этих соглашений фактически не представлено суду, и что «положение о запрете скачивания не является положением о запрете доступа». 15 сентября судья отклонил запрос SerpApi с требованием обязать Google предоставить лицензии. Согласно судебному реестру, слушание по самому ходатайству назначено на 13 октября 2026 года.
Мы считаем, что октябрьское решение суда менее важно, чем сформированный им прецедент. Пункт договора, требующий от лицензиата защищать контент от несанкционированного доступа, раньше был простой формальностью. После событий этого лета это недостающий элемент для иска о возмещении установленных законом убытков в размере от $200 до $2,500 за каждое нарушение. Поэтому стоит ожидать, что теперь каждое соглашение о передаче контента будет содержать такое условие, включая схемы платного доступа, формирующиеся вокруг pay-per-crawl.
Учетные записи никогда не были спорным вопросом
Один аспект остался абсолютно неизменным. В середине сентября федеральный судья в Калифорнии утвердил мировое соглашение между LinkedIn и ProAPIs, а также их партнером Netswift: прекратить скрейпинг, остановить продажу или передачу данных, отказаться от использования фейковых аккаунтов и удалить всю собранную информацию. В иске LinkedIn говорилось о миллионах поддельных профилей, при этом сотни или тысячи новых создавались ежедневно.
Эти обвинения касались учетных записей, а не обхода проверок. И результат оказался бескомпромиссным: никакого доступа, никакой перепродажи, никаких данных.
Что это означает для дата-команд
Мы инженеры, а не юристы, и оба июльских решения были приняты на этапе рассмотрения ходатайств об отклонении иска, а не по итогам полноценного судебного разбирательства. Воспринимайте дальнейший текст как обзор тенденций в юридической аргументации, а ключевые вопросы передавайте корпоративным юристам.
- Классифицируйте цели по типу сохраняемых данных. Цены, остатки на складе, позиции в выдаче, ссылки и каталоги являются фактами. Посты, отзывы, статьи, фотографии и тексты песен представляют собой объект авторского права. Бессрочная часть постановления от 20 июля защищает первую категорию; разбирательство с Reddit относится ко второй.
- Маршрут получения не очищает контент юридически. Оставшиеся претензии Reddit касаются постов, предположительно извлеченных со страниц поисковой выдачи Google, а не с reddit.com. Получение пользовательского контента через поискового посредника сохраняет все претензии первоначального правообладателя.
- Собственные механизмы защиты правообладателя имеют сильную юридическую позицию. Слабым местом Google было выставление барьеров перед результатами чужого труда. Издатель, владеющий статьями и подключивший защиту от ботов, лишен этой уязвимости. Согласно отчету Zyte State of Web Access 2026, 18.5% ведущих сайтов используют специализированные сервисы защиты от ботов, делая этот выбор осознанно.
- Контролируйте этапы с авторизацией. Если на каком-либо шаге вашего пайплайна выполняется вход в аккаунт, именно там сосредоточены основные юридические риски, независимо от будущих решений судов относительно систем защиты от ботов.
- Закладывайте расходы на технические ограничения, которые не отменит ни один суд. 26 августа Google подтвердил, что ссылки в выдаче теперь идут через редирект google.com/goto. Дерек Перкинс из Nozzle сообщил, что эти ссылки невозможно декодировать локально, а получение позиций для одной страницы из пяти требует от 500 до 1,000 запросов. Если добавить к этому отмену параметра num=100 в сентябре 2025 года (как это повлияло на трекинг позиций), сбор поисковых данных подорожал дважды, безо всякого участия судебных инстанций.
От кода к контрактам
Годами спор вокруг скрапинга сводился к тому, считается ли проверка на бота цифровым замком. Этим летом ответ стал более конкретным, чем просто да или нет: может считаться, если замок принадлежит владельцу содержимого или тому, кого он письменно на это уполномочил.
Это переносит борьбу из инженерных отделов в отделы лицензирования. Добавьте к этому решение Cloudflare сортировать бот-трафик по заявленной цели, и вектор развития становится понятен: доступ определяется тем, кто вы и что вы подписали, и все меньше зависит от того, как выглядят ваши запросы.
Если вы собираете публичные факты, июль внес больше ясности в вашу позицию. Если же вы собираете чужие тексты в обход чужих ограничений, защищать такую практику стало намного сложнее.