De Extract API scrapt elke webpagina naar schone Markdown, HTML of platte tekst via residentiële proxies met TLS-vingerafdrukken van echte browsers. Standaard gebruikt hij een snelle TLS-laag en start alleen een headless browser wanneer een pagina een bot-uitdaging geeft.
De auto-engine lost de meeste pagina's op via de snelle TLS-laag, probeert bij blokkade opnieuw op een verse exit-IP en escaleert alleen bij een echte uitdaging naar een stealth headless browser — maximale snelheid, minimale kosten.
Haal specifieke velden op met CSS-selectors, of beschrijf in natuurlijke taal wat je wilt en laat AI-extractie gestructureerde JSON teruggeven. Mobiele emulatie, screenshots en pagina-acties worden ondersteund.
Ontdek de URL's van een site met map, crawl een hele site naar Markdown per pagina of scrape veel URL's asynchroon met batch — allemaal via dezelfde residentiële-proxy-pipeline.