Costo della larghezza di banda del proxy per agenti AI: I numeri reali per attività

Un agente browser scarica ogni immagine, font e tracker ad ogni passo. Con 8 navigazioni per attività, sono 24 MB - circa 700 GB al mese con mille attività al giorno. Ecco dove va e come ridurlo.

Il costo della larghezza di banda del proxy per agenti AI che nessuno mette a budget è quello che arriva con il browser. Uno scraper HTTP recupera l'HTML che analizza e si ferma. Un agente guida un vero Chromium: scarica le immagini affinché il passaggio di visione possa vederle, i font web affinché il layout si stabilizzi, i beacon analitici perché nessuno gli ha detto di non farlo - e lo fa di nuovo ad ogni navigazione, ad ogni tentativo, per ogni attività. Questo post fa l'aritmetica ad alta voce, ti mostra come misurare il tuo numero invece di fidarti del nostro, e elenca le leve che riducono di circa 10 volte il costo di un gigabyte residenziale.

L'aritmetica: peso della pagina per passi per attività

Parti dalle misurazioni che abbiamo pubblicato prima: un rendering completo di una pagina moderna sposta 2-5 MB una volta che immagini, media, font e script di terze parti sono caricati, mentre la stessa pagina con asset bloccati è spesso sotto 150 KB di HTML. Prendi 3 MB come media di lavoro per un caricamento di pagina fresco. Ora conta le navigazioni piuttosto che i passi - un agente che clicca all'interno di una pagina riscarica molto poco, ma ogni nuovo URL è una pagina fresca. Un'attività di ricerca o controllo prezzi realistica ne tocca circa otto:

Sette centesimi per attività sembrano banali finché non diventano la voce più grande nell'economia unitaria del tuo agente. A differenza dei token, scala con quanto sono pesanti i tuoi obiettivi piuttosto che con quanto è difficile la tua attività: un'attività banale su un mercato ricco di immagini costa più di una complessa su un sito di testo. Se la tariffazione per GB è nuova per te, la nostra analisi di cosa compra effettivamente un gigabyte residenziale copre il lato pagine-per-GB della stessa equazione.

Misura il tuo costo della larghezza di banda del proxy per agenti AI

Il nostro è una media; il tuo dipende interamente dai tuoi obiettivi. Chromium può scrivere un file HAR di ogni richiesta che fa, e l'uso del browser lo espone tramite record_har_path. Usa record_har_mode="full" affinché i campi di dimensione siano popolati, e record_har_content="omit" per ottenere i conteggi dei byte senza incorporare ogni corpo di risposta nel file:

from browser_use import Browser

browser = Browser(
    proxy={
        "server": "http://gate.quantumproxies.io:8000",
        "username": "USER",
        "password": "PASS",
    },
    record_har_path="./runs/task-01.har",
    record_har_mode="full",     # 'minimal' drops the size fields you need
    record_har_content="omit",  # sizes yes, response bodies no
)

Poi somma. Un proxy fattura in entrambe le direzioni, quindi contano anche le intestazioni delle richieste, e HAR scrive -1 quando una dimensione è sconosciuta - bloccali a zero piuttosto che lasciarli sottrarre silenziosamente:

import json, sys

har = json.load(open(sys.argv[1]))
entries = har["log"]["entries"]

def size(d, *keys):
    return sum(max(0, d.get(k, 0) or 0) for k in keys)

total = 0
by_type = {}
for e in entries:
    up = size(e["request"], "headersSize", "bodySize")
    down = size(e["response"], "headersSize", "bodySize")
    total += up + down
    mime = e["response"].get("content", {}).get("mimeType", "?").split(";")[0]
    by_type[mime] = by_type.get(mime, 0) + up + down

print(f"{len(entries)} requests, {total/1_048_576:.2f} MB billed")
for mime, n in sorted(by_type.items(), key=lambda kv: -kv[1])[:8]:
    print(f"  {n/1024:8.0f} KB  {mime}")

Esegui su tre attività rappresentative e avrai un costo reale per attività. La suddivisione per MIME è la parte utile: su la maggior parte dei siti consumer le righe superiori sono immagini, video, font e analitiche, e nessuna di esse alimenta il ragionamento del tuo agente.

Statistiche per la larghezza di banda degli agenti AI: 3 MB per pagina fresca, 24 MB per attività, circa 700 GB al mese con mille attività al giorno, e una riduzione di 10 volte con asset bloccati
Otto navigazioni a 3 MB ciascuna sono 24 MB per attività. Moltiplica per il tuo volume giornaliero prima di scegliere un piano per GB.

Leva 1: smetti di scaricare ciò che l'agente non legge mai

Questa è la grande e vale da sola 5-10 volte. In Playwright o Puppeteer intercetti le richieste e le abortisci per tipo di risorsa - la ricetta è nella nostra guida a ridurre il costo del GB del proxy. Nell'uso del browser hai due strumenti più grezzi ma efficaci: i flag di lancio di Chromium tramite args e il set di estensioni predefinito, che include uBlock Origin oltre alla gestione dei cookie e alla pulizia degli URL ed è abilitato da enable_default_extensions. Lascialo attivo - ogni chiamata pubblicitaria e di tracker che uccide è una chiamata per cui non sei fatturato.

browser = Browser(
    proxy=PROXY,
    enable_default_extensions=True,   # uBlock Origin: fewer tracker requests
    args=[
        "--blink-settings=imagesEnabled=false",   # no image bytes at all
        "--disable-remote-fonts",                 # no web font downloads
        "--autoplay-policy=user-gesture-required",# no video streaming itself
        "--mute-audio",
    ],
)

Un onesto avvertimento: uccidere le immagini acceca un agente guidato dalla visione. Se il tuo agente ragiona sugli screenshot, testalo con le immagini spente prima di distribuirlo - molte attività sopravvivono perché il DOM porta ancora il testo e la struttura, ma un'attività che identifica i prodotti tramite foto no. Se si rompe, rimuovi imagesEnabled=false e mantieni i risparmi su font, media e tracker, che sono ancora la maggior parte del guadagno.

Leva 2: recinta l'agente

Un agente che si perde è un agente che trasmette video attraverso il tuo gateway residenziale a consumo. L'uso del browser ha allowed_domains e prohibited_domains esattamente per questo, con allowed_domains che ha la precedenza quando li imposti entrambi. Modelli come *.example.com coprono i sottodomini; i caratteri jolly nella posizione del TLD sono deliberatamente respinti, e le liste oltre cento voci vengono ottimizzate in set. Impostalo su ogni agente di produzione - è un controllo dei costi prima di essere un controllo di sicurezza.

Leva 3: riutilizza il profilo e limita i tentativi

Un profilo incognito fresco per esecuzione significa una cache HTTP vuota, quindi l'agente riscarica lo stesso logo, foglio di stile e pacchetto di framework ad ogni attività contro lo stesso sito. Puntare user_data_dir a una directory persistente consente alla cache di fare il suo lavoro tra le esecuzioni. Il compromesso è l'identità: un profilo memorizzato nella cache e con cookie è un'impronta digitale stabile, quindi fissa un profilo a un IP di uscita fisso piuttosto che lasciarlo vagare per il pool - l'abbinamento è coperto nella nostra guida alla configurazione del proxy per uso browser.

I tentativi sono l'altro moltiplicatore silenzioso. Tre tentativi su una pagina da 3 MB trasformano una navigazione fallita in 9 MB, e gli agenti ritentano più degli scraper perché il modello continua a decidere di "riprovare". Limitalo a un tentativo, e fai in modo che il tentativo cambi l'IP di uscita invece di ripetere la stessa richiesta attraverso lo stesso indirizzo bloccato. Due tentativi attraverso due IP battono cinque attraverso uno, al 40% dei byte.

Vedi quanto costa un gigabyte su proxy residenziali a consumo

Checklist che confronta le leve che riducono la larghezza di banda degli agenti AI - blocco degli asset, blocco degli annunci, recinzione dei domini, riutilizzo del profilo, limiti ai tentativi - contro le abitudini che la consumano
Quattro leve, impilate, portano un agente di navigazione da 24 MB per attività a circa 2,4 MB senza cambiare ciò che può fare.

Leva 4: non usare un agente che non ti serve

Questa è la parte sincera. Un agente guadagna il suo costo quando il percorso è sconosciuto - quando deve cercare, leggere, decidere e navigare per ottenere dati il cui URL nessuno avrebbe potuto scrivere in anticipo. Quando conosci già l'URL e i campi, guidare un browser per ottenerli è il modo più costoso per farlo. Un Scraper API che restituisce markdown pulito o JSON consegna la stessa pagina come circa 30-60 KB di testo estratto invece di 3 MB di rendering, perché lo stripping degli asset e l'analisi avvengono al margine e sei addebitato per il risultato, non per il traffico grezzo. Con la tariffazione per richiesta, che di solito è di

-3 per mille richieste riuscite sul mercato, otto pagine costano centesimi.

Il modello che vince in produzione è ibrido: lascia che l'agente esplori e decida, poi passa la parte ripetibile a un percorso API. Una volta che ha scoperto che il prezzo si trova a un URL specifico in un campo specifico, quella ricerca non dovrebbe mai più passare attraverso un browser. I nostri appunti su browser senza testa contro richieste HTTP quantificano lo stesso compromesso per lo scraping classico, e l'intero stack degli agenti è in infrastruttura web per agenti AI.

Come appare la fattura ottimizzata

Impila le leve e rifai l'aritmetica. Gli asset bloccati portano la media di una pagina fresca da 3 MB a circa 300 KB, quindi otto navigazioni diventano 2,4 MB invece di 24 MB. Mille attività al giorno sono quindi circa 2,3 GB al giorno e 70 GB al mese - $70-420 ai tassi di mercato, contro $700-4.200 prima. Nulla della capacità dell'agente è cambiato; ha semplicemente smesso di pagare per scaricare fotografie che non ha mai guardato.

Domande frequenti

Quanta larghezza di banda utilizza un agente AI?

Metti a budget circa 3 MB per caricamento di pagina fresca con asset attivi, quindi circa 24 MB per un'attività che tocca otto URL. Le pagine ricche di video corrono molto più in alto; i siti orientati al testo corrono più in basso. Misura il tuo con una registrazione HAR piuttosto che assumere - la differenza tra i siti target è maggiore della differenza tra i framework degli agenti.

Perché gli agenti costano più larghezza di banda degli scraper?

Uno scraper recupera un documento e lo analizza. Un agente rende la pagina completa - immagini, font, media, analitiche - perché ha bisogno che la pagina si comporti come una pagina, e lo fa di nuovo ad ogni navigazione e ad ogni tentativo. Esplora anche: visita pagine che uno scraper non richiederebbe mai, perché non sa in anticipo quale contiene la risposta.

Le chiamate API LLM passano attraverso il proxy?

Non dovrebbero. Configura il proxy solo sulla sessione del browser. Se imposti HTTP_PROXY o HTTPS_PROXY come variabili d'ambiente per essere scrupoloso, ogni richiesta del modello viaggia attraverso il tuo gateway residenziale a consumo - prompt e risposte, ad ogni passo. È puro spreco, ed è uno dei risparmi più facili da trovare in un agente esistente.

Un'API di scraping è più economica di un agente?

Per URL conosciuti e campi conosciuti, quasi sempre. Ricevi markdown o JSON analizzati misurati in decine di kilobyte piuttosto che un rendering multi-megabyte, e la tariffazione per richiesta sul mercato è di circa

-3 per mille chiamate riuscite. L'agente vale il suo costo quando il percorso deve essere scoperto - usalo per esplorare, poi passa le ricerche ripetibili all'API.

Gli agenti dovrebbero usare proxy di datacenter per risparmiare?

Dove il target li tollera, sì - la larghezza di banda del datacenter è molte volte più economica per gigabyte e la velocità è migliore. Il problema è che il traffico degli agenti sembra già non umano, quindi un IP di datacenter su un sito protetto tende a fallire, e un'attività fallita costa i suoi byte due volte. Imposta di default il datacenter su obiettivi non protetti e riserva il residenziale per i siti che effettivamente filtrano per reputazione IP.

La larghezza di banda è la voce silenziosa nell'economia degli agenti, e risponde all'ingegneria noiosa: misura con un HAR, blocca ciò che l'agente non legge mai, recinta i domini, riutilizza la cache, limita i tentativi e rifiuta di rendere una pagina di cui conosci già l'URL. Fai tutte e sei e un mese da 700 GB diventa un mese da 70 GB senza perdita di capacità.

Esegui i tuoi agenti su proxy residenziali a consumo