Analyse sectorielle

Analyse sectorielle

← Tous les articles

Procès Google contre SerpApi : le contrôle anti-bot n'est pas la question

Deux tribunaux, un contrôle anti-bot Google, des décisions opposées à onze jours d'intervalle. Le procès Google contre SerpApi montre ce qui fait désormais la décision : la nature du contenu protégé par ce contrôle.

Search, Agent, Training : les nouvelles règles du Web pour les bots

Cloudflare classe désormais les bots par finalité et non par comportement : Search, Agent ou Training. La configuration par défaut du 15 septembre est plus restreinte que ne le laissait craindre la panique, et une option manque à l'appel.

Le web scraping se consolide. Voici ce qui change.

Oxylabs a levé 130 M$ pour une valorisation de 3,6 Md$. Bright Data a franchi les 300 M$ d'ARR. L'API de web scraping de milieu de gamme disparaît rapidement. Posez-vous ces cinq questions.

Pourquoi les navigateurs headless fuient davantage en 2026

Les détecteurs ont creusé l'écart entre les sessions headless et normales en 2026. Si vous exécutez Puppeteer ou Playwright en production, anticipez le coût de la détection.

Cloudflare Precursor : la session est la nouvelle empreinte

Cloudflare a déployé Precursor le 13 juillet. La détection comportementale à l'échelle de la session signifie que rafraîchir la page ne réinitialise plus votre score de bot. Pourquoi c'est important.

Le Pay-Per-Crawl divise le Web en deux

La place de marché pay-per-crawl de Cloudflare et le code HTTP 402 divisent le web entre données sous licence et données ouvertes. Voici ce qui change pour les équipes qui collectent des données web en 2026.

Quand l'extraction par LLM cesse d'être rentable

Firecrawl facture 5 fois plus pour extraire une page via LLM que pour la scraper. À 100 000 pages par jour, l'équation s'effondre. Quand l'extraction par LLM vaut-elle son coût, et quand ne le vaut-elle pas ?

Pourquoi la taille du pool de proxy n'a plus d'importance en 2026

Les fournisseurs affichent 400 millions d'IP résidentielles. Mais en 2026, la réputation IP s'est effondrée en tant que défense, et la taille du pool de proxy a cessé de prédire le succès réel.

L'EU AI Act met fin au libre-service des données d'entraînement

La collecte de données d'entraînement pour l'IA passe d'un problème technique à un problème de conformité. L'EU AI Act et la surveillance accrue des fournisseurs redéfinissent les règles d'ici 2027.