← كل المقالات

دعوى Google ضد SerpApi: فحص البوتات ليس هو المسألة

محكمتان، وفحص بوتات واحد من Google، وحكمان متناقضان بفارق 11 يوما. توضح دعوى Google ضد SerpApi المعيار الحاسم الآن: لمن تعود ملكية المحتوى المحمي بالفحص.

فحص بوت واحد، محكمتان، وقراران متناقضان

بفارق أحد عشر يومًا هذا الصيف، نظر قاضيان فيدراليان في فحص بوت Google نفسه، والمدعى عليه نفسه، ونوع الدعوى نفسه. وجاءت النتيجتان متناقضتين تمامًا.

في 20 يوليو 2026، قضت رئيسة القضاة Yvonne Gonzalez Rogers من المحكمة الجزئية لشمال كاليفورنيا بـ رفض دعاوى DMCA المقدمة من Google ضد SerpApi، وهي الشركة التي تبيع نتائج Google عبر API. وفي 31 يوليو، رفض القاضي Paul Engelmayer من المحكمة الجزئية لجنوب نيويورك في الغالب طلبات SerpApi وPerplexity لرفض دعوى Reddit، والتي تستند إلى نظام Google ذاته.

القضية المحكمة تاريخ الحكم دعاوى DMCA
Google ضد SerpApi شمال كاليفورنيا (N.D. Cal.) 20 يوليو 2026 رُفضت
Reddit ضد SerpApi جنوب نيويورك (S.D.N.Y.) 31 يوليو 2026 مستمرة في الغالب

تصدرت دعوى Google ضد SerpApi العناوين الرئيسية، واعتبرت معظم التغطيات أن شهر يوليو انتهى بفوز وخسارة لأدوات جمع البيانات (scrapers). لكننا نقرأ المشهد بشكل مختلف. فتجاوز الفحص لم يكن هو العامل الحاسم في النتيجتين. ما كان يقع خلف الفحص، ومن يملك الحقوق فيه، هو ما أحدث الفارق. وبالنسبة لأي شخص يجمع بيانات الويب، تعد هذه القاعدة أكثر فائدة بكثير من أي عنوان صحفي.

كيف يبدو SearchGuard من جانب المستلم

SearchGuard هو تحدي JavaScript وضعته Google أمام محرك البحث في يناير 2025. ووفقًا لتوضيح Google نفسه، فإن الاستعلام الوارد من مصدر لا تتعرف عليه يتلقى كودًا لتنفيذه. يستجيب متصفح المستخدم دون أن يلاحظ أحد، بينما تعجز معظم برمجيات الأتمتة عن ذلك، فيتم رفضها.

نواجه هذا الفحص بأنفسنا. في اختبارات أجريناها في 17 سبتمبر 2026، استجاب محرك بحث Google لبعض الطلبات المؤتمتة بصفحة بحجم 92 كيلوبايت بعنوان "Google Search" فقط: رمز الحالة HTTP 200، وبلا أي نتائج، مع مطالبة بتفعيل JavaScript. وتبدو بوابة Reddit مشابهة جدًا على مستوى الشبكة (رمز 200 بعنوان "Reddit - Prove your humanity"). أي أداة تقيس النجاح بناءً على رمز الحالة ستسجل كلتا الحالتين كصفحات تم تسليمها بنجاح.

إليك الجزء الذي غاب عن العناوين الرئيسية. القاضية Gonzalez Rogers لم تقر بأن SerpApi لم تتجاوز SearchGuard مطلقًا. بل رأت أن Google قد ادعت بشكل كافٍ انتهاكًا للمادة 1201 من قانون DMCA، ورفضت حجة SerpApi بأن Google، لكونها ليست المالك، لا يحق لها رفع الدعوى أصلاً. ورغم ذلك، خسرت Google.

ما يعنيه هذا: المحاكم لا تتعامل مع سؤال "هل تجاوزت الفحص؟" باعتباره السؤال الحاسم. بل تتعامل معه كنقطة انطلاق فقط.

لماذا خسرت Google بينما لم تخسر Reddit

تحظر المادة 1201 من قانون DMCA التحايل على أي تدبير يتحكم في الوصول إلى "عمل محمي بموجب هذا الباب"، وهو ما يعني عملا محميا بحقوق الطبع والنشر. وصفت شكوى Google نفسها نتائجها بأنها تجميعات لمعلومات عامة، مع لوحات معرفة "قد تحتوي على بعض المحتوى المحمي بحقوق الطبع والنشر". استند القرار القضائي إلى إقرار Google حرفيا: "بقدر ما لا تحتوي نتائج بحث Google على أي محتوى محمي بحقوق الطبع والنشر، لا يمكن القول إن SearchGuard يتحكم بفعالية في الوصول إلى عمل محمي بموجب قانون حقوق الطبع والنشر". تم رفض هذا الجزء من الدعوى دون إذن بالتعديل.

أما الجزء المتعلق بلوحات المعرفة فقد فشل في اختبار ثانٍ. يجب أن يعمل التدبير "بتفويض من صاحب حقوق الطبع والنشر"، ولم تذكر Google أي بند من بنود التراخيص الخاصة بتلك الصور. تدير Google البوابة، لكنها لا تملك معظم ما يقع خلفها.

يقف Reddit في موقف مختلف؛ فمنشورات مستخدميه محمية بحقوق الطبع والنشر، وتمنح اتفاقية المستخدم الخاصة به ترخيصا لـ Reddit لجميع هذه المنشورات. أيد القاضي Engelmayer المطالبات بموجب المادة 1201(a)(1)(A) ضد كلا المدعى عليهما وبموجب المادة 1201(a)(2) ضد SerpApi، بينما رفض دعوى بموجب 1201(b) وبنود الإثراء بلا سبب والمنافسة غير العادلة بموجب قانون الولاية. نفس الفحص القانوني، لكن هذا المدعي كان يمتلك حقوقا في المحتوى الذي يحميه. تركت المحكمة الباب مفتوحا بشأن ما إذا كانت المقتطفات القصيرة التي تظهر على صفحات Google محمية أصلا، ولا يزال طلب الرفض المقدم من Oxylabs، المذكورة أيضا في الدعوى، معلقا.

الترخيص يتحول إلى قفل

استوعبت Google الرسالة. تعيد شكواها المعدلة، المرفوعة في 10 أغسطس، بناء القضية حول العقود. حيث تنص على أن مانحي التراخيص فوضوا ضوابط الوصول "وفي بعض الحالات أصروا على أن تفعل Google ذلك". وتذكر أن شريكا غير معلن ألزم Google منذ عام 2017 بـ "بذل جهود معقولة تجاريا لحماية المحتوى المرخص من وصول أطراف خارجية غير مصرح لها"، وأن صفقة Reddit "توجه Google إلى عدم تمكين أطراف خارجية من استخراج المحتوى المرخص وتسويقه تجاريا بشكل مستقل". حتى إنها تقدم سياسة خصوصية Google الخاصة كتفويض من المستخدمين.

يجيب طلب الرفض الثاني المقدم من SerpApi بأن أيا من تلك الاتفاقيات ليس معروضا فعليا على المحكمة، وأن "شرط منع التنزيل ليس شرطا لمنع الوصول". في 15 سبتمبر، رفض القاضي طلب SerpApi بإلزام Google بتقديم التراخيص. تم تحديد موعد جلسة الاستماع بشأن الطلب نفسه في 13 أكتوبر 2026، وفقا لـ سجل الدعوى.

نعتقد أن حكم أكتوبر أقل أهمية من خطة العمل التي وضعها بالفعل. كان البند الذي يوجه المرخص له لحماية المحتوى من الوصول غير المصرح به مجرد نص نمطي. بعد هذا الصيف، أصبح هو العنصر المفقود في المطالبة بتعويضات قانونية تتراوح بين 200 و2500 دولار لكل انتهاك. لذلك توقع أن يتضمن كل اتفاق محتوى يُوقع من الآن فصاعدا هذا البند، بما في ذلك ترتيبات الوصول المدفوع التي بدأت تتشكل حول pay-per-crawl.

لم تكن الحسابات هي المسألة غير المحسومة إطلاقا

جانب واحد من هذا الموضوع لم يتغير إطلاقا. في منتصف سبتمبر، أقر قاض فيدرالي في كاليفورنيا حكما بالتراضي بين LinkedIn وProAPIs، بالإضافة إلى شريكتها Netswift: إيقاف الـ scraping، إيقاف بيع البيانات أو نقلها، إيقاف استخدام الحسابات المزيفة، وحذف ما تم أخذه. وصفت شكوى LinkedIn حسابات وهمية بالملايين، مع إنشاء المئات أو الآلاف منها يوميا.

تركزت تلك الادعاءات على الحسابات، وليس على تجاوز عمليات التحقق. وكانت النتيجة حاسمة: لا وصول، لا إعادة بيع، ولا بيانات.

ماذا يعني هذا لفرق البيانات

نحن مهندسون ولسنا محامين، وكلا حكمي يوليو صدرا في مرحلة طلبات رد الدعوى (motion-to-dismiss) وليس في المحاكمة. اقرأ ما يلي كخريطة توضح مسار الحجج القانونية، واعرض الأسئلة الفعلية على مستشارك القانوني.

  1. صنف أهدافك حسب ما تحتفظ به. الأسعار، ومستويات المخزون، والترتيبات، والروابط، والقوائم هي حقائق. بينما المنشورات، والمراجعات، والمقالات، والصور، وكلمات الأغاني هي تعبيرات إبداعية. يغطي الجزء الدائم من أمر 20 يوليو النوع الأول، بينما تقع قضية Reddit ضمن النوع الثاني.
  2. المسار لا يطهر المحتوى. تتعلق مطالبات Reddit المستمرة بمنشورات يُزعم أنها أُخذت من صفحات نتائج Google، وليس من موقع reddit.com مباشرة. سحب محتوى المستخدم عبر وسيط بحث يجلب معه مطالبات المالك أيضا.
  3. إجراءات التحقق الخاصة بالمالك هي الموقف الأقوى. كانت نقطة ضعف Google هي فرض بوابة على أعمال الآخرين. الناشر الذي يملك مقالاته واشترى خدمة bot لحمايتها لا يشارك تلك النقطة، ووفقا لتقرير Zyte's State of Web Access 2026، فإن 18.5% من أفضل المواقع تشغل خدمة مخصصة للكشف عن الـ bots، وكل منها يقوم بذلك باختياره.
  4. احسب عمليات تسجيل الدخول. إذا كانت أي خطوة في pipeline الخاصة بك تتطلب تسجيل الدخول، فهنا يتركز تعرضك للمخاطر، بغض النظر عما ستقوله المحاكم في النهاية بشأن عمليات التحقق من الـ bots.
  5. ضع في الحسبان العقبات التي لن تزيلها أي محكمة. أكدت Google في 26 أغسطس أن روابط النتائج تمر الآن عبر إعادة توجيه google.com/goto. ذكر Derek Perkins من Nozzle أن الروابط لا يمكن فك تشفيرها محليا وأن معالجة ترتيب مكون من خمس صفحات يتطلب من 500 إلى 1000 request. أضف إلى ذلك إزالة num=100 منذ سبتمبر 2025 (تأثير ذلك على تتبع الترتيب)، لتصبح بيانات البحث أكثر تكلفة مرتين، دون تدخل أي قاض.

من الكود إلى العقود

لسنوات طويلة، كان الجدل حول الـ scraping يدور حول ما إذا كان فحص الـ bot يُعد بمثابة قفل حماية. وجاءت الإجابة هذا الصيف أكثر دقة من مجرد نعم أو لا: يمكن اعتباره كذلك، عندما يكون القفل مملوكاً لمن يملك المحتوى بداخله، أو لشخص مفوض كتابياً من قبله.

ينقل هذا الصراع من الفرق الهندسية إلى أقسام التراخيص. أضف إلى ذلك خطوة Cloudflare الرامية إلى تصنيف حركة مرور الـ bot حسب الغرض المُعلن، ويبدو أن المسار قد حُسم: يُحدد الوصول بناءً على هويتك وما وقعت عليه من عقود، ويقل اعتماده تدريجياً على شكل الـ requests التي ترسلها.

إذا كنت تجمع بيانات عامة، فقد جعل شهر يوليو موقفك أكثر وضوحاً. أما إذا كنت تجمع محتوى الآخرين عبر بوابة طرف ثالث، فقد أصبح الدفاع عن موقفك أكثر صعوبة بكثير.