Web Scraping и Extract API

Extract API скрапит любую веб-страницу в чистый Markdown, HTML или обычный текст через резидентные прокси с TLS-отпечатками реальных браузеров. По умолчанию используется быстрый TLS-уровень, а headless-браузер запускается только при анти-бот проверке.

Умный движок

Авто-движок обрабатывает большинство страниц на быстром TLS-уровне, повторяет запрос с нового исходящего IP при блокировке и переходит к скрытному headless-браузеру только при реальной проверке — максимум скорости, минимум затрат.

Структурное и ИИ-извлечение

Извлекайте нужные поля CSS-селекторами или опишите нужное на естественном языке — ИИ-извлечение вернёт структурированный JSON. Поддерживаются мобильная эмуляция, скриншоты и действия на странице.

Crawl, map и batch

Найдите URL сайта через map, обойдите весь сайт в Markdown постранично или скрапьте множество URL асинхронно через batch — всё по одному конвейеру на резидентных прокси.