Web スクレイピング & Extract API

Extract API は、実在ブラウザの TLS フィンガープリントを持つレジデンシャルプロキシ経由で、任意のWebページをクリーンなMarkdown・HTML・プレーンテキストに変換します。既定では高速な TLS ティアを使い、ページがボット判定を出したときだけヘッドレスブラウザを起動します。

スマートエンジン

auto エンジンはほとんどのページを高速な TLS ティアで解決し、ブロックされたら新しい出口 IP で再試行し、実際のチャレンジのときだけステルスなヘッドレスブラウザに切り替えます。最大の速度、最小のコストです。

構造化・AI 抽出

CSS セレクタで特定のフィールドを取得したり、必要な内容を自然言語で記述して AI 抽出に構造化 JSON を返させたりできます。モバイルエミュレーション、スクリーンショット、ページ操作にも対応します。

crawl・map・batch

map でサイトの URL を発見し、サイト全体をページ単位で Markdown に crawl し、batch で多数の URL を非同期にスクレイピング — すべて同じレジデンシャルプロキシのパイプラインで。