← Всички публикации

Делото Google срещу SerpApi: Проверката за ботове не е същината

Два съда, една проверка за ботове на Google, противоположни решения в рамките на 11 дни. Делото Google срещу SerpApi показва решаващия фактор днес: чие съдържание стои зад проверката.

Една bot проверка, два съда, противоположни решения

В рамките на единадесет дни това лято двама федерални съдии разгледаха една и съща Google bot проверка, един и същ ответник и същия тип иск. Те стигнаха до противоположни заключения.

На 20 юли 2026 г. главният съдия Yvonne Gonzalez Rogers от Окръжния съд за Северния окръг на Калифорния отхвърли исковете на Google по DMCA срещу SerpApi, компанията, която продава резултати от Google чрез API. На 31 юли съдия Paul Engelmayer от Окръжния съд за Южния окръг на Ню Йорк предимно отхвърли исканията на SerpApi и Perplexity за прекратяване на делото на Reddit, което стъпва на същата система на Google.

Дело Съд Решение от Искове по DMCA
Google срещу SerpApi N.D. California 20 юли 2026 Отхвърлени
Reddit срещу SerpApi S.D. New York 31 юли 2026 Повечето остават

Делото Google срещу SerpApi влезе в заглавията и голяма част от медийното отразяване определи юли като една победа и една загуба за scraper услугите. Ние го тълкуваме по различен начин. Заобикалянето на проверката не е това, което раздели двата изхода. Това, което стои зад проверката и кой притежава правата върху него, го направи. За всеки, който събира данни от мрежата, това е много по-полезно правило от всяко медийно заглавие.

Как изглежда SearchGuard от страната на получателя

SearchGuard е JavaScript предизвикателството, което Google постави пред Search през януари 2025 г. По думите на самия Google, заявка от източник, който той не разпознава, получава код за изпълнение. Браузърът на реален потребител отговаря без някой да забележи; повечето автоматизирани клиенти не могат и получават отказ.

Ние самите се сблъскваме с него. При тестове, които проведохме на 17 септември 2026 г., Google Search отговори на някои автоматизирани заявки с 92 KB страница с просто заглавие "Google Search": HTTP 200, никакви резултати и подкана за включване на JavaScript. Собствената защита на Reddit изглежда почти по същия начин на мрежово ниво (200 със заглавие "Reddit - Prove your humanity"). Всяка система, която оценява успеха само по статус код, записва и двете като успешно доставени страници.

Ето частта, която остана пренебрегната в заглавията. Съдия Gonzalez Rogers не прие, че SerpApi никога не е заобикалял SearchGuard. Тя постанови, че Google е формулирал адекватен иск по Раздел 1201 от DMCA, и отхвърли аргумента на SerpApi, че Google, като лице без собственост върху съдържанието, изобщо не може да води дело. Google загуби въпреки това.

Какво означава това: съдилищата не разглеждат въпроса "заобиколихте ли проверката?" като решаващ. Те го третират просто като отправна точка.

Защо Google загуби, а Reddit не

Раздел 1201 от DMCA забранява заобикалянето на мярка, контролираща достъпа до „произведение, защитено съгласно този раздел“, което означава произведение, защитено с авторски права. Самата искова молба на Google описва резултатите като компилации от публична информация с Knowledge Panels, които „могат да съдържат известно защитено с авторски права съдържание“. Съдебното решение прие думите на Google буквално: „Доколкото резултатите от търсенето в Google не съдържат защитено с авторски права съдържание, не може да се твърди, че SearchGuard ефективно контролира достъпа до произведение, защитено съгласно Закона за авторското право.“ Тази част от делото беше прекратена без право на повторно внасяне.

Частта с Knowledge Panel се провали на втори тест. Мярката трябва да работи „с разрешението на носителя на авторското право“, а Google не посочи нито една клауза от лицензите зад тези изображения. Google управлява портала. Компанията не притежава по-голямата част от това, което се намира зад него.

Позицията на Reddit е различна. Публикациите на потребителите са защитени с авторски права, а потребителското споразумение дава на Reddit лиценз за всички тях. Съдия Engelmayer уважи исковете по раздел 1201(a)(1)(A) срещу двамата ответници и по раздел 1201(a)(2) срещу SerpApi, като същевременно отхвърли иска по 1201(b) и точките за неоснователно обогатяване и нелоялна конкуренция по щатското право. Същата проверка, но този ищец имаше права върху съдържанието, което защитаваше. Съдът остави открит въпроса дали кратките откъси, които се появяват на страниците на Google, изобщо са защитени, а искането на Oxylabs за прекратяване на делото, също посочена като ответник, все още се разглежда.

Лицензът се превръща в катинар

Google разбра намека. Тяхната изменена искова молба, подадена на 10 август, преструктурира делото около договорите. В нея се посочва, че лицензодателите са разрешили контрол на достъпа „и в някои случаи са настояли Google да го направи“. Посочва се, че неназован партньор задължава Google от 2017 г. насам да „полага търговски разумни усилия за защита на лицензираното съдържание срещу неоторизиран достъп от трети страни“, както и че сделката с Reddit „указва на Google да не позволява на трети страни да извличат и комерсиализират самостоятелно лицензираното съдържание“. Дори се предлага собствената Декларация за поверителност на Google като пълномощно от потребителите.

Второто искане за прекратяване от SerpApi отговаря, че нито едно от тези споразумения реално не е представено пред съда и че „клауза срещу изтегляне не е клауза срещу достъп“. На 15 септември съдията отхвърли искането на SerpApi да задължи Google да предостави лицензите. Изслушването по самото искане е насрочено за 13 октомври 2026 г., според делото.

Смятаме, че октомврийското решение има по-малко значение от модела за действие, който то вече наложи. Клауза, задължаваща лицензополучателя да защитава съдържанието от неоторизиран достъп, преди беше стандартен текст. След това лято тя е липсващият елемент в иск за законови обезщетения от 200 до 2500 долара за всяко нарушение. Затова очаквайте всяка сделка за съдържание оттук нататък да включва такава клауза, включително договореностите за платен достъп, които започнаха да се оформят около pay-per-crawl.

Акаунтите никога не са били отвореният въпрос

Една част от този казус изобщо не се промени. В средата на септември федерален съдия в Калифорния финализира споразумение между LinkedIn и ProAPIs, заедно с партньора им Netswift: прекратяване на scraping дейностите, спиране на продажбата или прехвърлянето на данните, прекратяване на използването на фалшиви акаунти и изтриване на събраните данни. Искът на LinkedIn описва милиони фалшиви акаунти, като всеки ден са били създавани стотици или хиляди.

Тези обвинения бяха съсредоточени върху акаунтите, а не върху заобикалянето на защитна проверка. Резултатът беше категоричен: без достъп, без препродажба, без данни.

Какво означава това за екипите за данни

Ние сме инженери, а не юристи, и двете решения от юли бяха взети на етап motion-to-dismiss, а не в съдебен процес. Приемете написаното по-долу като ориентир за посоката на правните аргументи и отнесете съществените въпроси към юрисконсулт.

  1. Разпределете целите си според това какви данни запазвате. Цени, складови наличности, класирания, връзки и обяви са факти. Публикации, отзиви, статии, снимки и текстове на песни са авторско изразяване. Постоянната част от решението от 20 юли обхваща първия вид; казусът с Reddit попада във втория.
  2. Маршрутът не изчиства съдържанието. Оцелелите искове на Reddit се отнасят за публикации, за които се твърди, че са взети от страниците с резултати на Google, а не от reddit.com. Извличането на потребителско съдържание през междинна търсачка пренася претенцията на собственика заедно с него.
  3. Собствената проверка на притежателя на правата е силният аргумент. Слабостта на Google беше, че управляваше бариера пред чужд труд. Издател, който притежава своите статии и е внедрил bot продукт, за да ги защитава, няма тази слабост. Според доклада на Zyte State of Web Access 2026 18.5% от водещите сайтове използват специализирана услуга за засичане на bot трафик, всеки от тях по собствен избор.
  4. Пребройте входовете с профил. Ако някоя стъпка от вашия pipeline изисква login, точно там се концентрира правният риск, независимо от бъдещите съдебни решения относно защитите срещу bot трафик.
  5. Предвидете бюджет за затруднения, които никой съд няма да премахне. Google потвърди на 26 август, че връзките в резултатите вече минават през пренасочване google.com/goto. Дерек Пъркинс от Nozzle съобщи, че връзките не могат да бъдат декодирани локално и че извличането на класиране от пет страници изисква от 500 до 1000 requests. Добавете и премахването на параметъра num=100 от септември 2025 г. (как се отрази това на проследяването на позициите) и събирането на данни от търсачките поскъпна два пъти, без намесата на съдия.

От код към договори

Години наред спорът за scraping се въртеше около това дали проверката за ботове се счита за заключване. Отговорът от това лято е по-категоричен от просто „да“ или „не“: може да се счита, когато заключването принадлежи на собственика на съдържанието или на лице, упълномощено от него писмено.

Това пренася битката от инженерните екипи в правните отдели за лицензиране. Като добавим и решението на Cloudflare да сортира трафика от ботове според декларираната му цел, посоката изглежда ясна: достъпът се определя от това кой сте и какво сте подписали, а все по-малко от това как изглеждат вашите requests.

Ако събирате публични факти, юли внесе повече яснота за вашата позиция. Ако събирате чужд текст през чужд портал, защитата на тази дейност току-що стана много по-трудна.