Dos tribunales, una verificación de bots de Google, fallos opuestos con once días de diferencia. La demanda de Google contra SerpApi muestra qué lo decide ahora: qué contenido está detrás de la verificación.
Cloudflare ahora clasifica los bots por propósito y no por comportamiento: Search, Agent o Training. El valor predeterminado del 15 de septiembre es más acotado que la alarma generada, y falta una casilla.
Oxylabs recaudó $130M con una valoración de $3.6B. Bright Data superó los $300M en ARR. La API de web scraping del mercado medio desaparece rápido. Hazte estas cinco preguntas.
Los detectores ampliaron la brecha entre las sesiones de navegadores headless y normales en 2026. Si ejecutas Puppeteer o Playwright en producción, prepárate para el costo de detección.
Cloudflare lanzó Precursor el 13 de julio. La detección de comportamiento a nivel de sesión significa que actualizar la página ya no restablece tu puntuación de bot. Por qué es importante.
El mercado de pago por rastreo de Cloudflare y HTTP 402 dividen la web en datos licenciados y abiertos. Esto es lo que cambia para los equipos que recopilan datos web en 2026.
Firecrawl cobra 5 veces más por extraer una página con LLM que por hacer scraping. Con 100k páginas al día, los números no cuadran. Cuándo la extracción con LLM justifica su coste y cuándo no.
Los proveedores anuncian 400 millones de IPs residenciales. Pero en 2026, la reputación de IP colapsó como defensa y el tamaño del pool de proxies dejó de predecir el éxito real.
Tu header User-Agent ya no importa. Los fingerprints a nivel de conexión clasifican bots con un 98.6% de precisión antes de leer los headers. Esto es lo que cambió en 2026.
La recopilación de datos de entrenamiento para IA acaba de pasar de ser un problema técnico a un problema de cumplimiento normativo. La Ley de IA de la UE y el creciente escrutinio a los proveedores reconfiguran las reglas hasta 2027.