Web Scraping & Extract API

L'Extract API extrait n'importe quelle page web en Markdown, HTML ou texte brut via des proxies résidentiels avec empreintes TLS de vrais navigateurs. Elle utilise par défaut un niveau TLS rapide et ne lance un navigateur headless que lorsqu'une page présente un défi anti-bot.

Moteur intelligent

Le moteur auto résout la plupart des pages sur le niveau TLS rapide, réessaie sur une nouvelle IP de sortie en cas de blocage et n'escalade vers un navigateur headless furtif que face à un vrai défi — vitesse maximale, coût minimal.

Extraction structurée et par IA

Récupérez des champs précis avec des sélecteurs CSS, ou décrivez ce que vous voulez en langage naturel et laissez l'extraction par IA renvoyer du JSON structuré. L'émulation mobile, les captures et les actions de page sont prises en charge.

Crawl, map et batch

Découvrez les URL d'un site avec map, explorez tout un site en Markdown page par page ou extrayez de nombreuses URL de façon asynchrone avec batch — le tout via la même pipeline de proxies résidentiels.