
Google lanzó reCAPTCHA v3 a finales de 2018, cambiando fundamentalmente la detección de bots. En lugar de interrumpir a los usuarios con puzzles de imágenes, asigna a cada sesión una puntuación de riesgo de 0.0 (humano) a 1.0 (bot). Los sitios web fijan umbrales — por encima de 0.5, el acceso puede bloquearse silenciosamente.
Para los scrapers, fue un cambio de paradigma. Los clientes HTTP simples que superaban los retos de v2 ya no podían confiar solo en servicios de resolución de CAPTCHA. Las señales de comportamiento — movimiento del ratón, patrones de scroll, huella del navegador — importan tanto como resolver puzzles.
En Scrapy Ninja nos adaptamos rápido. Nuestro stack combina automatización de navegador real (Playwright), calentamiento de sesión (navegar con naturalidad antes de extraer), persistencia de cookies y coincidencia de huella TLS. Mantenemos un throughput de más de 3.000 consultas por segundo en proyectos de clientes.
reCAPTCHA v3 no es invencible, pero sube el listón considerablemente. Los scripts amateur fallan; la infraestructura de producción con emulación adecuada del navegador tiene éxito. Si tus sitios objetivo usan v3, presupuesta extracción basada en navegador en lugar de HTTP crudo.
Seguimos monitorizando las actualizaciones de Google — v3 Enterprise añade modelos personalizados por sitio — y ajustamos nuestras contramedidas en consecuencia. Contáctanos si reCAPTCHA está bloqueando tu proyecto de datos.


