AI 에이전트 프록시 대역폭 비용: 작업당 실제 비용
브라우저 에이전트는 모든 단계에서 모든 이미지, 폰트, 트래커를 다운로드합니다. 작업당 8번의 탐색이 24 MB이며, 하루에 천 개의 작업을 수행하면 한 달에 약 700 GB입니다. 여기서 대역폭이 사용되는 곳과 절약 방법을 알아보세요.
브라우저와 함께 오는 AI 에이전트 프록시 대역폭 비용은 아무도 예산에 포함하지 않습니다. HTTP 스크래퍼는 파싱할 HTML을 가져오고 멈춥니다. 에이전트는 실제 Chromium을 구동합니다: 비전 단계가 이미지를 볼 수 있도록 이미지를 다운로드하고, 레이아웃이 안정되도록 웹 폰트를 다운로드하며, 아무도 말리지 않았기 때문에 분석 비콘을 다운로드합니다 - 그리고 모든 탐색, 모든 재시도, 모든 작업에서 다시 그렇게 합니다. 이 게시물은 계산을 소리내어 하고, 우리의 숫자를 믿는 대신 자신의 숫자를 측정하는 방법을 보여주며, 주거용 기가바이트 요금을 약 10배 줄이는 방법을 나열합니다.
계산법: 페이지 무게 x 단계 x 작업 수
이전에 게시한 측정값에서 시작하세요: 현대 페이지의 전체 브라우저 렌더링은 이미지, 미디어, 폰트 및 타사 스크립트가 로드되면 2-5 MB를 이동하며, 자산이 차단된 동일한 페이지는 종종 150 KB 미만의 HTML입니다. 새 페이지 로드의 작업 평균으로 3 MB를 사용하세요. 이제 단계가 아닌 탐색을 세어보세요 - 한 페이지 내에서 클릭하는 에이전트는 거의 다시 다운로드하지 않지만, 새로운 URL은 새 페이지입니다. 현실적인 연구 또는 가격 확인 작업은 약 8개를 터치합니다:
- 작업당: 8번의 탐색 x 3 MB = 24 MB 프록시를 통해.
- 하루당: 1,000 작업 x 24 MB = 24,000 MB = ~23 GB.
- 한 달당: 23 GB x 30 = ~700 GB.
- 청구서당: GB당 -6의 주거용 시장 요금으로, 이는 $700-4,200 한 달 - 중간 $3 per GB에서 작업당 약 $0.07입니다.
작업당 7센트는 사소해 보이지만 에이전트의 단위 경제에서 가장 큰 항목이 될 수 있습니다. 토큰과 달리, 작업의 난이도보다는 목표의 무게에 따라 확장됩니다: 이미지가 많은 마켓플레이스에서의 사소한 작업은 텍스트 사이트에서의 복잡한 작업보다 비용이 더 많이 듭니다. GB당 가격이 처음이라면, 주거용 기가바이트가 실제로 구매하는 것에 대한 우리의 분석은 동일한 방정식의 페이지당 GB 측면을 다룹니다.
자신의 AI 에이전트 프록시 대역폭 비용 측정
우리의 것은 평균입니다; 당신의 것은 전적으로 목표에 달려 있습니다. Chromium은 수행한 모든 요청의 HAR 파일을 작성할 수 있으며, 브라우저 사용은
record_har_path를 통해 이를 노출합니다.record_har_mode="full"을 사용하여 크기 필드를 채우고,record_har_content="omit"을 사용하여 파일에 모든 응답 본문을 포함하지 않고 바이트 수를 얻습니다:from browser_use import Browser browser = Browser( proxy={ "server": "http://gate.quantumproxies.io:8000", "username": "USER", "password": "PASS", }, record_har_path="./runs/task-01.har", record_har_mode="full", # 'minimal' drops the size fields you need record_har_content="omit", # sizes yes, response bodies no )그런 다음 합산하세요. 프록시는 양방향으로 청구되므로 요청 헤더도 포함되며, HAR은 크기가 알려지지 않은 경우
-1을 작성합니다 - 이를 0으로 고정하여 조용히 빼지 않도록 하세요:import json, sys har = json.load(open(sys.argv[1])) entries = har["log"]["entries"] def size(d, *keys): return sum(max(0, d.get(k, 0) or 0) for k in keys) total = 0 by_type = {} for e in entries: up = size(e["request"], "headersSize", "bodySize") down = size(e["response"], "headersSize", "bodySize") total += up + down mime = e["response"].get("content", {}).get("mimeType", "?").split(";")[0] by_type[mime] = by_type.get(mime, 0) + up + down print(f"{len(entries)} requests, {total/1_048_576:.2f} MB billed") for mime, n in sorted(by_type.items(), key=lambda kv: -kv[1])[:8]: print(f" {n/1024:8.0f} KB {mime}")세 가지 대표적인 작업에서 실행하면 실제 작업당 비용을 알 수 있습니다. MIME별 분석이 유용한 부분입니다: 대부분의 소비자 사이트에서는 이미지, 비디오, 폰트 및 분석이 상위에 있으며, 이들 중 어느 것도 에이전트의 추론에 기여하지 않습니다.

각 3 MB의 8번 탐색은 작업당 24 MB입니다. GB당 요금제를 선택하기 전에 일일 볼륨을 곱하세요. 레버 1: 에이전트가 읽지 않는 것을 다운로드하지 마세요
이것은 가장 큰 것이며 자체적으로 5-10배의 가치가 있습니다. Playwright 또는 Puppeteer에서 요청을 가로채고 리소스 유형별로 중단합니다 - 레시피는 프록시 GB 요금 절감 가이드에 있습니다. 브라우저 사용에서는 두 가지 더 무딘 그러나 효과적인 도구가 있습니다:
args를 통한 Chromium 시작 플래그와 uBlock Origin, 쿠키 처리 및 URL 정리를 포함한 기본 확장 세트로,enable_default_extensions로 활성화됩니다. 이를 켜 두세요 - 제거된 광고 및 트래커 호출은 청구되지 않는 호출입니다.browser = Browser( proxy=PROXY, enable_default_extensions=True, # uBlock Origin: fewer tracker requests args=[ "--blink-settings=imagesEnabled=false", # no image bytes at all "--disable-remote-fonts", # no web font downloads "--autoplay-policy=user-gesture-required",# no video streaming itself "--mute-audio", ], )솔직한 경고: 이미지를 제거하면 비전 기반 에이전트가 눈이 멀게 됩니다. 에이전트가 스크린샷을 통해 추론하는 경우, 배포 전에 이미지를 끈 상태로 테스트하세요 - 많은 작업이 여전히 텍스트와 구조를 포함하는 DOM 덕분에 살아남지만, 사진으로 제품을 식별하는 작업은 그렇지 않습니다. 만약 문제가 발생하면
imagesEnabled=false를 제거하고 폰트, 미디어 및 트래커 절약을 유지하세요, 이는 여전히 대부분의 이익입니다.레버 2: 에이전트를 울타리 안에 가두세요
길을 잃은 에이전트는 측정된 주거용 게이트웨이를 통해 비디오를 스트리밍하는 에이전트입니다. 브라우저 사용에는
allowed_domains와prohibited_domains가 있으며, 둘 다 설정할 때allowed_domains가 우선합니다.*.example.com과 같은 패턴은 하위 도메인을 포함합니다; TLD 위치의 와일드카드는 의도적으로 거부되며, 100개 이상의 항목이 있는 목록은 집합으로 최적화됩니다. 모든 프로덕션 에이전트에 설정하세요 - 비용 제어가 안전 제어보다 우선입니다.레버 3: 프로필을 재사용하고 재시도를 제한하세요
실행당 새 시크릿 프로필은 빈 HTTP 캐시를 의미하므로, 에이전트는 동일한 사이트에서 작업마다 동일한 로고, 스타일시트 및 프레임워크 번들을 다시 다운로드합니다.
user_data_dir을 지속적인 디렉토리에 지정하면 캐시가 실행 간에 제 역할을 할 수 있습니다. 거래는 신원입니다: 캐시된, 쿠키가 있는 프로필은 안정적인 지문이므로, 풀을 가로질러 방황하게 두기보다는 하나의 프로필을 하나의 고정 IP에 고정하세요 - 페어링은 우리의 브라우저 사용 프록시 구성 가이드에 다루어져 있습니다.재시도는 또 다른 조용한 배수입니다. 3 MB 페이지에서 세 번의 시도는 하나의 실패한 탐색을 9 MB로 바꾸며, 에이전트는 모델이 "다시 시도"하기로 계속 결정하기 때문에 스크래퍼보다 더 많이 재시도합니다. 재시도를 한 번으로 제한하고, 동일한 차단된 주소를 통해 동일한 요청을 반복하는 대신 IP를 전환하세요. 두 개의 IP를 통한 두 번의 시도가 하나를 통한 다섯 번보다 바이트의 40%를 차지합니다.

네 가지 레버를 쌓으면 브라우징 에이전트가 작업당 24 MB에서 약 2.4 MB로 줄어들며, 할 수 있는 일을 바꾸지 않습니다. 레버 4: 필요 없는 에이전트를 사용하지 마세요
이것은 솔직한 부분입니다. 경로가 알려지지 않았을 때 에이전트는 비용을 지불합니다 - 검색하고, 읽고, 결정하고, 데이터를 찾기 위해 탐색해야 할 때입니다. 이미 URL과 필드를 알고 있다면, 브라우저를 구동하여 이를 얻는 것은 가장 비싼 방법입니다. Scraper API는 자산 제거와 파싱이 가장자리에서 발생하기 때문에 3 MB의 렌더 대신 약 30-60 KB의 추출된 텍스트로 동일한 페이지를 반환하며, 원시 트래픽이 아닌 결과에 대해 요금이 부과됩니다. 일반적으로 시장에서 성공적인 요청 천 개당
-3의 요금이 부과되는 요청당 가격에서, 여덟 페이지는 센트 비용이 듭니다.생산에서 승리하는 패턴은 하이브리드입니다: 에이전트가 탐색하고 결정하게 한 다음, 반복 가능한 부분을 API 경로에 넘깁니다. 가격이 특정 URL의 특정 필드에 있다는 것을 발견하면, 그 조회는 다시는 브라우저를 통해 진행되지 않아야 합니다. 우리의 헤드리스 브라우저 대 HTTP 요청 비용에 대한 노트는 고전적인 스크래핑에 대한 동일한 거래를 정량화하며, 더 넓은 에이전트 스택은 AI 에이전트를 위한 웹 인프라에 있습니다.
최적화된 청구서의 모습
레버를 쌓고 계산을 다시 실행하세요. 자산 차단은 평균 새 페이지를 3 MB에서 약 300 KB로 줄이므로, 8번의 탐색은 24 MB가 아닌 2.4 MB가 됩니다. 하루에 천 개의 작업은 약 2.3 GB 하루와 70 GB 한 달 - 시장 요금으로 $70-420, 이전에는 $700-4,200이었습니다. 에이전트의 능력에는 아무런 변화가 없었습니다; 단지 보지 않은 사진을 다운로드하는 비용을 지불하지 않았을 뿐입니다.
자주 묻는 질문
AI 에이전트는 얼마나 많은 대역폭을 사용하나요?
자산이 있는 새 페이지 로드당 약 3 MB를 예산으로 잡으세요, 따라서 8개의 URL을 터치하는 작업은 약 24 MB입니다. 비디오가 많은 페이지는 몇 배 더 높고, 텍스트 중심 사이트는 더 낮습니다. 가정하지 말고 HAR 녹화로 측정하세요 - 목표 사이트 간의 차이가 에이전트 프레임워크 간의 차이보다 큽니다.
에이전트가 스크래퍼보다 대역폭을 더 많이 사용하는 이유는 무엇인가요?
스크래퍼는 하나의 문서를 가져와 파싱합니다. 에이전트는 전체 페이지 - 이미지, 폰트, 미디어, 분석 -를 렌더링합니다. 페이지가 페이지처럼 작동해야 하기 때문이며, 모든 탐색 및 모든 재시도에서 다시 그렇게 합니다. 또한 탐색합니다: 스크래퍼가 요청하지 않을 페이지를 방문합니다, 왜냐하면 어느 페이지가 답을 가지고 있는지 미리 알지 못하기 때문입니다.
LLM API 호출이 프록시를 통해 가나요?
그렇지 않아야 합니다. 브라우저 세션에만 프록시를 구성하세요. 환경 변수로
HTTP_PROXY또는HTTPS_PROXY를 설정하면 모든 모델 요청이 측정된 주거용 게이트웨이를 통해 이동합니다 - 모든 단계에서 프롬프트와 응답이 포함됩니다. 이는 순수한 낭비이며, 기존 에이전트에서 찾기 쉬운 큰 절약 중 하나입니다.스크래핑 API가 에이전트보다 저렴한가요?
알려진 URL과 알려진 필드의 경우, 거의 항상 그렇습니다. 수십 킬로바이트로 측정된 파싱된 markdown 또는 JSON을 받으며, 시장에서의 요청당 가격은 성공적인 호출 천 개당 약
-3입니다. 경로를 발견해야 할 때 에이전트는 비용을 지불할 가치가 있습니다 - 탐색을 위해 사용하고, 반복 가능한 조회는 API에 넘기세요.에이전트가 비용을 절약하기 위해 데이터센터 프록시를 사용해야 하나요?
대상이 이를 허용하는 경우, 예 - 데이터센터 대역폭은 기가바이트당 여러 배 저렴하고 속도가 더 좋습니다. 문제는 에이전트 트래픽이 이미 비인간적으로 보이기 때문에, 보호된 사이트에서 데이터센터 IP는 실패하는 경향이 있으며, 실패한 작업은 바이트를 두 배로 소모합니다. 보호되지 않은 대상에서는 기본적으로 데이터센터를 사용하고, 실제로 IP 평판으로 필터링하는 사이트에는 주거용을 예약하세요.
대역폭은 에이전트 경제학에서 조용한 항목이며, 지루한 엔지니어링에 반응합니다: HAR로 측정하고, 에이전트가 읽지 않는 것을 차단하고, 도메인을 울타리로 두고, 캐시를 재사용하고, 재시도를 제한하고, 이미 알고 있는 URL의 페이지를 렌더링하지 마세요. 이 여섯 가지를 모두 수행하면 700 GB 한 달이 70 GB 한 달로 변하며, 능력 손실 없이 가능합니다.