La Extract API extrae cualquier página web a Markdown, HTML o texto plano mediante proxies residenciales con huellas TLS de navegadores reales. Usa por defecto un nivel TLS rápido y solo lanza un navegador headless cuando la página presenta un reto anti-bot.
El motor auto resuelve la mayoría de las páginas en el nivel TLS rápido, reintenta en una IP de salida nueva si es bloqueado y escala a un navegador headless sigiloso solo ante un reto real: máxima velocidad, mínimo coste.
Obtén campos concretos con selectores CSS, o describe lo que quieres en lenguaje natural y deja que la extracción con IA devuelva JSON estructurado. Se admiten emulación móvil, capturas y acciones de página.
Descubre las URL de un sitio con map, rastrea todo un sitio a Markdown por página o extrae muchas URL de forma asíncrona con batch, todo a través de la misma pipeline de proxies residenciales.