市場別ストリーミングカタログ調査:利用可能データセットの構築

ストリーミングサービスのカタログは国境ごとに変わります。市場ごとにどこで何が利用可能かを測定し、それをライセンスおよびコンテンツインテリジェンスに変える方法をご紹介します。

同じストリーミングサービスでも、国ごとに異なる製品です。ライセンス契約は市場ごとに結ばれるため、スペインでカタログの目玉となるタイトルがドイツでは存在せず、日本には6か月後に登場するかもしれません。コンテンツ戦略に関わる人々 - スタジオ、ディストリビューター、アナリスト、買収チーム - にとって、市場ごとの変動はノイズではなく、シグナルです。このガイドでは市場別ストリーミングカタログ調査について説明します:どこで何が利用可能かを測定し、国ごとに比較可能なデータセットを構築し、それをライセンスインテリジェンスに変える方法です。まずは枠組みの注意点:これは市場調査として外部から公開カタログを観察するものであり、自分のサブスクリプションの地域を回避するものではありません。

カタログが実際にどれほど異なるか

その差異は多くの人が想像するよりも大きいです。公共のライブラリトラッカーは、2024年初頭のスロバキアの最大の国別Netflixカタログが約8,000タイトルを持っていることを発見しましたが、他の市場ではその一部しかありません。米国のライブラリだけでも、3,600本以上の映画と1,800本以上のテレビ番組があり、他のどの国とも異なるミックスです。そして、利用可能性は普遍的ではありません:Netflixは中国、北朝鮮、クリミアではまったく運営していません。この変動をすべてのプロバイダーとすべてのタイトルにわたって掛け合わせると、単一の国の視点では捉えきれない豊かで絶えず変化するデータセットが得られます。

国別にストリーミングカタログのサイズが異なることを示す統計パネル、約8,000タイトルから減少し、Netflixがない3カ国
カタログのサイズとタイトルのミックスは市場間で大きく異なります - その広がりこそが調査が測定するものです。

データの所在

すべてをゼロからリバースエンジニアリングする必要はありません。2つの中立的なソースが多くの重労働を引き受けます。The Movie Database (TMDb) はクリーンで正確なメタデータを提供し、タイトルごとに安定したIDを持ち、市場間での記録の結合に非常に役立ちます。JustWatchスタイルの利用可能性アグリゲーターは、どのプロバイダーがどの国でどのタイトルを提供しているかを追跡し、非公式のNetflix Global Searchのようなコミュニティプロジェクトは長い間地域ライブラリをカタログ化してきました。TMDbをアイデンティティの背骨として使用し、利用可能性フィードを市場ごとのレイヤーとして上に重ねます。

市場内IPが必要な理由

ここが機械的な核心です。プロバイダーの公開カタログと発見ページは、リクエストがどこから来ているように見えるかに基づいてローカルライブラリをレンダリングします - したがって、イタリアの加入者が見るカタログを見るには、リクエストがイタリアのIPから発信される必要があります。単一の視点は単一の国の答えを提供します。クロスマーケットのデータセットを構築するには、各ターゲット国で同じクエリをループさせる必要があります。200以上の国にまたがる住宅プロキシプールがそれを実現可能にします - 各市場がブロックされたり不整合なものではなく、本物のローカルビューを返すための実際の国内IPです。これは、広告検証航空運賃調査の背後にある同じジオ視点の規律であり、答えは場所に対してのみ存在します。

ロケーションページで完全な国別カバレッジを確認してください。プロファイルできる市場は、出口を持っている市場です。

import requests

# Fetch a provider's public catalog view as a viewer in each market would
GATE = "gate.quantumproxies.io:8000"
MARKETS = ["us", "gb", "de", "it", "jp", "br"]

def catalog_view(url, country):
    # exit country selected in the proxy username -> the local library view
    proxy = f"http://USER-country-{country}:PASS@{GATE}"
    r = requests.get(url, proxies={"http": proxy, "https": proxy},
                     headers={"Accept-Language": country}, timeout=25)
    return r

by_market = {cc: catalog_view("https://example-provider.com/browse", cc)
             for cc in MARKETS}

市場間の正規化

生の国別データは、アイデンティティを調整するまで比較可能ではありません。同じ映画が市場ごとに異なるローカルタイトル、アートワーク、スラッグを持っているため、表示タイトルで一致させるとゴミが生成されます。すべてを正規のIDにキー化します - TMDb IDが理想的です - そうすれば、米国の"The Godfather: Part II"と他の場所でのローカライズされたタイトルが1つの記録に統合されます。一度タイトルが市場間で重複排除されると、比較は自動的に書かれます:どの国がタイトルを持っているか、いつ登場したか、カタログサイズのランク、ギャップがどこにあるか。

# Build an availability matrix: which markets carry each canonical title
from collections import defaultdict

availability = defaultdict(set)   # tmdb_id -> set of country codes

def record(country, titles):
    for t in titles:
        availability[t["tmdb_id"]].add(country)

# ...after populating from each market's parsed catalog:
def gaps_vs(reference="us"):
    # titles present in the reference market but missing elsewhere
    return {tid: (all_markets - markets)
            for tid, markets in availability.items()
            if reference in markets}

all_markets = {"us", "gb", "de", "it", "jp", "br"}
市場を選択し、ジオターゲティングされた出口とタイトルの正規化を経てクロスマーケットの利用可能性比較に至るパイプライン図
パイプラインは市場ごとのループであり、次に正規のIDで結合されます - アイデンティティの調整が市場を比較可能にします。

カタログをインテリジェンスに変える

データセットは分析でその価値を発揮します。利用可能なウィンドウを追跡して、米国でのリリース後にタイトルが他の市場に到達するまでの時間を確認します - ライセンスの遅延を直接読み取ります。国ごとのカタログサイズとジャンルミックスをベンチマークして、プロバイダーがどこに投資しているかを理解します。競合他社が持っているコンテンツのギャップを見つけるか、逆にあなたが持っていないものを見つけます。特定のタイトルが数週間にわたって国境を越えて展開されるのを観察して、契約構造を推測します。全体の取得をスケジュールに従って実行し、各キャプチャにタイムスタンプを付けると、デルタがライセンス移動フィードになります - 競合他社の価格監視と同じ監視ロジックがコンテンツ権に適用されます。

1つの習慣がスナップショットをモニターに変えます:取得をスケジュールし、各キャプチャを前回と比較して差分を確認します。新しい追加、静かな削除、市場でのタイトルの初登場がすべてデルタとして浮かび上がり、静的なインベントリではなく変更フィードを提供します。すべてのキャプチャをタイムスタンプ付きで保存し、正規のIDを安定させておけば、過去の任意の日付における市場のカタログを再構築できます - これは一度限りの調査とライセンスチームが実際に支払う継続的なインテリジェンス製品の違いです。

ラインの正しい側に留まる

これは地理に触れるため、範囲について意図的であるべきです。ここでの正当な使用は、市場調査として公開されているカタログと利用可能データを測定することであり、自分のアカウントの地域的な権利を回避したり、コンテンツを再配布したりすることではありません。各サービスの利用規約を尊重し、公開カタログメタデータ(タイトル、利用可能性、日付 - 個人ユーザーデータではない)のみを収集し、リクエストを礼儀正しく行ってください。これは情報提供であり、法的アドバイスではありません。特定のプログラムが疑問を引き起こす場合は、スケールする前に相談を受けてください。

200以上の国で市場内住宅IPを取得

よくある質問

なぜストリーミングカタログは国ごとに異なるのですか?

ライセンスは市場ごとに交渉され、時間的にウィンドウ化されるため、特定のタイトルの権利は国ごとに異なり、変化します。ある映画はある市場でストリーミングされ、別の市場では利用できず、第三の市場では後で登場するかもしれません。利用可能性はプロバイダーがどこで運営しているかにも依存します。いくつかの国にはサービスがありません。その市場ごとの変動がカタログ調査が測定するものです。

他の国のストリーミングカタログを見るにはどうすればよいですか?

調査のために、ターゲット国にある出口IPを通じてプロバイダーの公開カタログまたは発見ページをリクエストし、ローカルライブラリが市場内の視聴者が見るようにレンダリングされるようにします。住宅プロキシプールを使用して、プロファイルしたい各国の出口を通じてクエリをループさせ、比較のために結果を正規のタイトルIDに正規化します。

カタログ調査に役立つデータソースは何ですか?

TMDbを使用して、正規のタイトルメタデータと安定したIDを取得し、市場間で記録を結合し、利用可能性アグリゲーター(JustWatchスタイルのフィードやコミュニティの地域ライブラリトラッカー)を使用して国ごとのレイヤーを取得します。TMDbはアイデンティティを提供し、利用可能性フィードは市場の次元を提供します。2つを重ね合わせて、比較可能なクロスマーケットデータセットを構築します。

ストリーミングカタログ調査は合法ですか?

市場分析のために公開されているカタログと利用可能性メタデータを収集することは一般的な慣行ですが、各サービスの利用規約が適用され、これは法的アドバイスではありません。公開カタログデータに限定し、個人ユーザーデータを避け、自分の地域的な権利を回避したり、コンテンツを再配布したりしないでください。特定の大規模プログラムについては相談を受けてください。

ストリーミングカタログは動的で国境に依存するデータセットであり、その価値は市場間の違いに正確に存在します。市場内IPから各国をプロファイルし、タイトルを正規のIDに調整し、スケジュールに従ってキャプチャすれば、散在する地域ライブラリがライセンスインテリジェンスエンジンに変わります。

プロファイルできるすべての国を確認