Die Extract API scrapt jede Webseite zu sauberem Markdown, HTML oder reinem Text über Residential-Proxies mit TLS-Fingerabdrücken echter Browser. Standardmäßig nutzt sie eine schnelle TLS-Stufe und startet nur dann einen Headless-Browser, wenn eine Seite eine Bot-Prüfung stellt.
Die Auto-Engine löst die meisten Seiten auf der schnellen TLS-Stufe, wiederholt bei Blockade über eine frische Exit-IP und eskaliert nur bei einer echten Prüfung zu einem Stealth-Headless-Browser — maximale Geschwindigkeit, minimale Kosten.
Ziehen Sie bestimmte Felder mit CSS-Selektoren, oder beschreiben Sie in natürlicher Sprache, was Sie brauchen, und lassen Sie die KI-Extraktion strukturiertes JSON liefern. Mobile-Emulation, Screenshots und Seitenaktionen werden unterstützt.
Ermitteln Sie die URLs einer Website mit Map, crawlen Sie eine ganze Website seitenweise zu Markdown oder scrapen Sie viele URLs asynchron mit Batch — alles über dieselbe Residential-Proxy-Pipeline.