Costo de Ancho de Banda de Proxy para Agentes de IA: Los Números Reales por Tarea

Un agente de navegador descarga cada imagen, fuente y rastreador en cada paso. Con 8 navegaciones por tarea, eso es 24 MB - alrededor de 700 GB al mes con mil tareas al día. Aquí es donde se va y cómo reducirlo.

El costo de ancho de banda de proxy para agentes de IA que nadie presupone es el que llega con el navegador. Un scraper HTTP obtiene el HTML que analiza y se detiene. Un agente maneja un Chromium real: descarga las imágenes para que el paso de visión pueda verlas, las fuentes web para que el diseño se asiente, los balizas de análisis porque nadie le dijo que no lo hiciera - y lo hace de nuevo en cada navegación, en cada reintento, para cada tarea. Esta publicación hace la aritmética en voz alta, te muestra cómo medir tu propio número en lugar de confiar en el nuestro, y enumera las palancas que reducen una factura de gigabytes residenciales aproximadamente 10 veces.

La aritmética: peso de la página por pasos por tareas

Comienza con mediciones que hemos publicado antes: una renderización completa de un navegador de una página moderna mueve de 2 a 5 MB una vez que las imágenes, medios, fuentes y scripts de terceros se cargan, mientras que la misma página con activos bloqueados suele estar por debajo de 150 KB de HTML. Toma 3 MB como promedio de trabajo para una carga de página nueva. Ahora cuenta navegaciones en lugar de pasos - un agente que hace clic dentro de una página vuelve a descargar muy poco, pero cada nueva URL es una página nueva. Una tarea realista de investigación o verificación de precios toca alrededor de ocho de ellas:

Siete centavos por tarea suenan triviales hasta que es la línea más grande en la economía unitaria de tu agente. A diferencia de los tokens, escala con lo pesado que son tus objetivos en lugar de lo difícil que es tu tarea: una tarea trivial en un mercado denso en imágenes cuesta más que una compleja en un sitio de texto. Si el precio por GB es nuevo para ti, nuestro desglose de lo que realmente compra un gigabyte residencial cubre el lado de páginas por GB de la misma ecuación.

Mide tu propio costo de ancho de banda de proxy para agentes de IA

El nuestro es un promedio; el tuyo depende completamente de tus objetivos. Chromium puede escribir un archivo HAR de cada solicitud que hace, y el uso del navegador expone eso a través de record_har_path. Usa record_har_mode="full" para que los campos de tamaño estén poblados, y record_har_content="omit" para obtener los conteos de bytes sin incrustar cada cuerpo de respuesta en el archivo:

from browser_use import Browser

browser = Browser(
    proxy={
        "server": "http://gate.quantumproxies.io:8000",
        "username": "USER",
        "password": "PASS",
    },
    record_har_path="./runs/task-01.har",
    record_har_mode="full",     # 'minimal' drops the size fields you need
    record_har_content="omit",  # sizes yes, response bodies no
)

Luego súmalo. Un proxy factura en ambas direcciones, por lo que los encabezados de solicitud también cuentan, y HAR escribe -1 cuando un tamaño es desconocido - limita esos a cero en lugar de dejar que se resten silenciosamente:

import json, sys

har = json.load(open(sys.argv[1]))
entries = har["log"]["entries"]

def size(d, *keys):
    return sum(max(0, d.get(k, 0) or 0) for k in keys)

total = 0
by_type = {}
for e in entries:
    up = size(e["request"], "headersSize", "bodySize")
    down = size(e["response"], "headersSize", "bodySize")
    total += up + down
    mime = e["response"].get("content", {}).get("mimeType", "?").split(";")[0]
    by_type[mime] = by_type.get(mime, 0) + up + down

print(f"{len(entries)} requests, {total/1_048_576:.2f} MB billed")
for mime, n in sorted(by_type.items(), key=lambda kv: -kv[1])[:8]:
    print(f"  {n/1024:8.0f} KB  {mime}")

Ejecuta eso en tres tareas representativas y tendrás un costo real por tarea. El desglose por MIME es la parte útil: en la mayoría de los sitios de consumo, las filas superiores son imágenes, video, fuentes y análisis, y ninguno de ellos alimenta el razonamiento de tu agente.

Estadísticas para el ancho de banda de agentes de IA: 3 MB por página nueva, 24 MB por tarea, alrededor de 700 GB por mes con mil tareas al día, y una reducción de 10 veces con activos bloqueados
Ocho navegaciones de 3 MB cada una son 24 MB por tarea. Multiplica por tu volumen diario antes de elegir un plan por GB.

Palanca 1: deja de descargar lo que el agente nunca lee

Esta es la grande y vale por sí sola de 5 a 10 veces. En Playwright o Puppeteer interceptas solicitudes y abortas por tipo de recurso - la receta está en nuestra guía para reducir una factura de GB de proxy. En el uso del navegador tienes dos herramientas más toscas pero efectivas: las banderas de lanzamiento de Chromium a través de args, y el conjunto de extensiones predeterminado, que incluye uBlock Origin más manejo de cookies y limpieza de URL y se habilita con enable_default_extensions. Déjalo activado - cada llamada de anuncio y rastreador que mata es una llamada por la que no te facturan.

browser = Browser(
    proxy=PROXY,
    enable_default_extensions=True,   # uBlock Origin: fewer tracker requests
    args=[
        "--blink-settings=imagesEnabled=false",   # no image bytes at all
        "--disable-remote-fonts",                 # no web font downloads
        "--autoplay-policy=user-gesture-required",# no video streaming itself
        "--mute-audio",
    ],
)

Una advertencia honesta: matar imágenes ciega a un agente impulsado por visión. Si tu agente razona sobre capturas de pantalla, pruébalo con las imágenes desactivadas antes de lanzarlo - muchas tareas sobreviven porque el DOM aún lleva el texto y la estructura, pero una tarea que identifica productos por foto no lo hará. Si se rompe, elimina imagesEnabled=false y mantén los ahorros en fuentes, medios y rastreadores, que aún son la mayor parte de la ganancia.

Palanca 2: encierra al agente

Un agente que se pierde es un agente transmitiendo video a través de tu puerta de enlace residencial medida. El uso del navegador tiene allowed_domains y prohibited_domains para exactamente esto, con allowed_domains tomando precedencia cuando configuras ambos. Los patrones como *.example.com cubren subdominios; los comodines en la posición de TLD se rechazan deliberadamente, y las listas de más de cien entradas se optimizan en conjuntos. Configúralo en cada agente de producción - es un control de costos antes de ser un control de seguridad.

Palanca 3: reutiliza el perfil y limita los reintentos

Un perfil de incógnito nuevo por ejecución significa una caché HTTP vacía, por lo que el agente vuelve a descargar el mismo logotipo, hoja de estilo y paquete de framework en cada tarea contra el mismo sitio. Apuntar user_data_dir a un directorio persistente permite que la caché haga su trabajo entre ejecuciones. La compensación es la identidad: un perfil en caché con cookies es una huella digital estable, por lo que asigna un perfil a una IP de salida fija en lugar de dejar que deambule por el grupo - la combinación está cubierta en nuestra guía de configuración de proxy de uso del navegador.

Los reintentos son el otro multiplicador silencioso. Tres intentos en una página de 3 MB convierten una navegación fallida en 9 MB, y los agentes reintentan más que los scrapers porque el modelo sigue decidiendo "intentar de nuevo". Limítalo a un reintento, y haz que el reintento cambie la IP de salida en lugar de repetir la misma solicitud a través de la misma dirección bloqueada. Dos intentos a través de dos IPs superan a cinco a través de una, con el 40% de los bytes.

Ve cuánto cuesta un gigabyte en proxies residenciales de pago por GB

Lista de verificación comparando palancas que reducen el ancho de banda de agentes de IA - bloqueo de activos, bloqueo de anuncios, cercado de dominios, reutilización de perfiles, límites de reintentos - contra los hábitos que lo consumen
Cuatro palancas, apiladas, llevan a un agente de navegación de 24 MB por tarea a aproximadamente 2.4 MB sin cambiar lo que puede hacer.

Palanca 4: no uses un agente que no necesitas

Esta es la parte sincera. Un agente gana su costo cuando el camino es desconocido - cuando tiene que buscar, leer, decidir y navegar su camino hacia datos cuyo URL nadie podría haber escrito de antemano. Cuando ya conoces el URL y los campos, manejar un navegador para obtenerlos es la forma más cara de hacerlo. Una Scraper API que devuelve markdown limpio o JSON entrega la misma página como aproximadamente 30-60 KB de texto extraído en lugar de 3 MB de renderizado, porque el despojo de activos y el análisis ocurren en el borde y se te cobra por el resultado, no por el tráfico bruto. En precios por solicitud, que típicamente corren de

-3 por mil solicitudes exitosas en el mercado, ocho páginas cuestan centavos.

El patrón que gana en producción es híbrido: deja que el agente explore y decida, luego entrega la parte repetible a una ruta de API. Una vez que ha descubierto que el precio vive en un URL específico en un campo específico, esa búsqueda nunca debería pasar por un navegador de nuevo. Nuestras notas sobre navegador sin cabeza versus solicitudes HTTP cuantifican el mismo intercambio para el scraping clásico, y la pila más amplia de agentes está en infraestructura web para agentes de IA.

Cómo se ve la factura optimizada

Apila las palancas y vuelve a ejecutar la aritmética. Los activos bloqueados llevan la página nueva promedio de 3 MB a aproximadamente 300 KB, por lo que ocho navegaciones se convierten en 2.4 MB en lugar de 24 MB. Mil tareas al día son entonces alrededor de 2.3 GB al día y 70 GB al mes - $70-420 a tasas de mercado, contra $700-4,200 antes. Nada sobre la capacidad del agente cambió; simplemente dejó de pagar por descargar fotografías que nunca miró.

Preguntas frecuentes

¿Cuánto ancho de banda usa un agente de IA?

Presupuesta alrededor de 3 MB por carga de página nueva con activos activados, por lo que aproximadamente 24 MB para una tarea que toca ocho URLs. Las páginas ricas en video corren varias veces más alto; los sitios centrados en texto corren más bajo. Mide el tuyo con una grabación HAR en lugar de asumir - la diferencia entre sitios objetivo es mayor que la diferencia entre marcos de agentes.

¿Por qué los agentes consumen más ancho de banda que los scrapers?

Un scraper obtiene un documento y lo analiza. Un agente renderiza la página completa - imágenes, fuentes, medios, análisis - porque necesita que la página se comporte como una página, y lo hace de nuevo en cada navegación y cada reintento. También explora: visita páginas que un scraper nunca solicitaría, porque no sabe de antemano cuál tiene la respuesta.

¿Las llamadas a la API de LLM pasan por el proxy?

No deberían. Configura el proxy solo en la sesión del navegador. Si configuras HTTP_PROXY o HTTPS_PROXY como variables de entorno para ser exhaustivo, cada solicitud de modelo viaja a través de tu puerta de enlace residencial medida también - indicaciones y respuestas, en cada paso. Es un desperdicio puro, y es uno de los ahorros grandes más fáciles de encontrar en un agente existente.

¿Es una API de scraping más barata que un agente?

Para URLs conocidas y campos conocidos, casi siempre. Recibes markdown o JSON analizado medido en decenas de kilobytes en lugar de un renderizado de varios megabytes, y el precio por solicitud en el mercado se sitúa alrededor de

-3 por mil llamadas exitosas. El agente vale su costo cuando el camino debe ser descubierto - úsalo para explorar, luego entrega las búsquedas repetibles a la API.

¿Deberían los agentes usar proxies de centro de datos para ahorrar dinero?

Donde el objetivo los tolere, sí - el ancho de banda de centro de datos es varias veces más barato por gigabyte y la velocidad es mejor. La trampa es que el tráfico del agente ya parece no humano, por lo que una IP de centro de datos en un sitio protegido tiende a fallar, y una tarea fallida cuesta sus bytes dos veces. Predetermina a centro de datos en objetivos no protegidos y reserva residenciales para los sitios que realmente filtran por reputación de IP.

El ancho de banda es el elemento silencioso en la economía de agentes, y responde a la ingeniería aburrida: mide con un HAR, bloquea lo que el agente nunca lee, cerca los dominios, reutiliza la caché, limita los reintentos, y rehúsa renderizar una página cuyo URL ya conoces. Haz los seis y un mes de 700 GB se convierte en un mes de 70 GB sin pérdida de capacidad.

Ejecuta tus agentes en proxies residenciales de pago por GB