Extract API は、実在ブラウザの TLS フィンガープリントを持つレジデンシャルプロキシ経由で、任意のWebページをクリーンなMarkdown・HTML・プレーンテキストに変換します。既定では高速な TLS ティアを使い、ページがボット判定を出したときだけヘッドレスブラウザを起動します。
auto エンジンはほとんどのページを高速な TLS ティアで解決し、ブロックされたら新しい出口 IP で再試行し、実際のチャレンジのときだけステルスなヘッドレスブラウザに切り替えます。最大の速度、最小のコストです。
CSS セレクタで特定のフィールドを取得したり、必要な内容を自然言語で記述して AI 抽出に構造化 JSON を返させたりできます。モバイルエミュレーション、スクリーンショット、ページ操作にも対応します。
map でサイトの URL を発見し、サイト全体をページ単位で Markdown に crawl し、batch で多数の URL を非同期にスクレイピング — すべて同じレジデンシャルプロキシのパイプラインで。