代发货研究的代理:自己构建数据层

付费研究工具只是带有仪表板的抓取器。以下是如何通过代理自己构建相同的数据层——竞争对手目录、供应商价格和库存,以及地理限制的广告库。

代发货产品研究工具承诺提供捷径:一个仪表板可以显示热门产品,跟踪竞争对手商店并监控广告。去掉品牌包装,它们就是抓取器——领先者索引了200M+产品,覆盖10M+ Shopify商店,每天新增100,000+产品,并根据几十个因素对其进行评分。所有这些都运行在您可以自己收集的公共数据上。本指南展示了如何通过代理构建相同的研究层:竞争对手目录、供应商价格和库存监控,以及地理限制的广告情报——这些工具实际上销售的三个信号。

解锁竞争对手目录的端点

几乎每个Shopify商店都在公共/products.json端点公开其整个目录——无需密钥,无需登录。它每页最多分页250个产品,并以结构化JSON返回标题、变体、价格、库存可用性和图像。这个单一端点是大多数“商店情报”功能的支柱。通过代理路由它,这样您就可以在不被限速的情况下抓取多个商店:

import requests

proxy = "http://USER:PASS@gate.quantumproxies.io:8000"
proxies = {"http": proxy, "https": proxy}

def shopify_catalog(store):
    page, out = 1, []
    while True:
        r = requests.get(f"https://{store}/products.json",
                         params={"limit": 250, "page": page},
                         proxies=proxies, timeout=20)
        products = r.json().get("products", [])
        if not products:
            break
        out += products
        page += 1
    return out

for p in shopify_catalog("examplestore.com"):
    v = p["variants"][0]
    print(p["title"], v["price"], v["available"])

这让您在一次抓取中获得竞争对手的完整产品线、价格和库存标志。我们对products.json端点的深入探讨详细介绍了速率限制和边缘情况。

从商店发现到通过住宅代理到products.json目录抓取和根据饱和度和价格变动的获胜者排名短名单的DIY代发货研究流程
每个阶段都是一个公共端点加上一个代理——与付费研究工具销售的信号相同,由您自己组装。

监控供应商价格和库存变化

目录快照告诉您今天商店销售的是什么。优势在于变化:哪些产品刚刚缺货,哪些价格变动,哪些列表是新的。按计划运行目录抓取,并将每次运行与上次进行比较。供应商价格下降、竞争对手提高利润率或突然补货都是早期信号——而最先发现这些信号的商店比仍在手动检查的其他人有几个小时的领先时间:

import json

prev = json.load(open("yesterday.json"))          # {product_id: price}
today = {p["id"]: p["variants"][0]["price"]
         for p in shopify_catalog("examplestore.com")}

for pid, price in today.items():
    if pid in prev and price != prev[pid]:
        print(pid, "price moved", prev[pid], "->", price)
    elif pid not in prev:
        print(pid, "NEW listing", price)

json.dump(today, open("yesterday.json", "w"))

同样的模式适用于供应商市场。从AliExpress或大型市场抓取价格、库存和运费矩阵,让您在利润窗口关闭之前发现它们——机制与大规模竞争对手价格监控相同。

广告情报是地理限制的——所以使用地理池

产品研究的另一半是广告监控:在产品饱和之前查看竞争对手正在运行的创意和优惠。公共广告库公开了这些信息,但它们是地理特定的——一个国家显示的广告取决于请求来自哪里。要查看美国观众与英国观众看到的内容,您需要在两者中都有出口。一个覆盖200+国家的住宅代理池让您可以按市场抓取广告库和本地化店面,这正是付费工具构建其区域需求和饱和视图的方式。

相同的地理池本地化了店面本身。价格、运费承诺和可用变体因国家而异,因此从美国、英国和德国出口抓取竞争对手的产品页面揭示了他们如何按市场定价——为您自己的区域策略提供原材料。结合阅读广告库和本地化店面,您不仅可以了解什么产品畅销,还可以了解在哪里以及以什么价格畅销。

获取用于广告和商店研究的住宅代理

显示研究工具索引200M+产品,覆盖10M+商店,每天新增100K产品,从返回250个产品每页的公共products.json端点中提取的头条数字
付费工具销售的规模建立在返回250个产品每页的公共端点上——这些数据您可以自己索引。

将原始数据转化为短名单

数据本身不是决策。收取研究费用的工具添加了两个您可以自己计算的派生信号。饱和度只是有多少商店销售相同的产品——统计您抓取的目录中标题或图像哈希的出现次数;低计数且需求上升是最佳位置。动量是变化率——在您的每日差异中新增列表、补货和降价。根据这两者对候选者进行排名,您就可以在不支付黑箱评分的情况下获得可防御的短名单。具体来说,动量评分是新列表加上补货减去一周滚动期间的降价,按降序排列,将仍未拥挤的产品推到顶部——这是在其他人蜂拥而至之前值得测试的窗口。对于定价方面,LLM辅助价格匹配有助于解决不同商店对同一产品的不同命名。

安排并尊重限制

研究价值来自于节奏,因此按计划运行这些抓取——价格和库存每日,完整目录每周——并存储每个快照。这就是将一次性查看转变为您可以采取行动的趋势线的原因。两个纪律保持其健康。轮换出口并调整请求速度,以便单个商店的服务器不会看到来自一个IP的突发;products.json是公共的,但不是无限的,过度抓取的商店会开始返回错误。并通过稳定键去重跨商店的产品——标准化标题或图像哈希——这样同一产品由四十个商店销售在您的饱和度计算中只算一次,而不是四十次。

何时渲染而不是抓取

大多数这个流程是简单的JSON抓取,快速且便宜。一些目标——某些店面、JavaScript背后的广告库或具有反机器人层的市场——不会将数据交给原始请求。对于这些,Scraper API可以渲染JavaScript并轮换IP,省去您维护无头浏览器的麻烦。如果您在跨市场自动化订单或账户操作,我们的市场自动化指南涵盖了账户卫生方面。

常见问题

我需要代理来进行代发货产品研究吗?

对于少量手动查询,不需要。对于持续监控——抓取多个竞争对手目录、每日检查供应商价格以及查看地理特定的广告库——需要。单个IP的流量很快会被限速,而广告和商店数据因国家而异,只有地理多样化的代理池才能揭示。

如何查看竞争对手的完整产品列表?

如果他们在Shopify上运行,请在其域名上请求/products.json。它返回整个目录——标题、价格、变体和库存标志——每页最多250个产品,作为公共JSON。通过代理路由它以抓取多个商店而不触发速率限制。

我可以自己构建研究工具而不是付费购买吗?

可以。付费工具是带有仪表板的抓取器。核心数据——通过products.json的目录、供应商价格和地理限制的广告库——是公共的,可以通过代理池和调度器收集。您放弃了一个精致的UI,但获得了对来源、新鲜度和成本的控制。

哪种代理类型最适合代发货研究?

住宅代理,因为广告库和本地化店面按地理位置提供不同的数据,而住宅出口为您提供准确的国家级视图,阻止率低。如果您想降低带宽成本,数据中心代理可以处理对宽松商店的高容量products.json抓取。

代发货研究是一个数据问题,而数据是公共的。通过products.json的竞争对手目录、按计划的供应商价格和库存差异以及通过住宅池的地理限制广告库为您提供付费工具收费的每个信号——完全控制您跟踪的内容及其保持新鲜的方式。

在QuantumProxies上构建您的研究堆栈