Badanie katalogu streamingowego według rynku: Tworzenie zestawów danych o dostępności

Katalog usługi streamingowej zmienia się na każdym granicy. Oto jak mierzyć, co jest dostępne gdzie, rynek po rynku, i przekształcić to w inteligencję licencyjną i treściową.

Ta sama usługa streamingowa to inny produkt w każdym kraju. Umowy licencyjne są zawierane rynek po rynku, więc tytuł, który jest głównym punktem katalogu w Hiszpanii, może być nieobecny w Niemczech i pojawić się w Japonii sześć miesięcy później. Dla każdego, kto zajmuje się strategią treści - studia, dystrybutorzy, analitycy, zespoły akwizycji - ta zmienność na rynku nie jest szumem, to jest sygnał. Ten przewodnik obejmuje badanie katalogu streamingowego według rynku: jak mierzyć, co jest dostępne gdzie, budować porównywalny zestaw danych w różnych krajach i przekształcać to w inteligencję licencyjną. Najpierw uwaga wprowadzająca: chodzi o obserwowanie publicznych katalogów z zewnątrz jako badanie rynku, a nie o omijanie regionalnych ograniczeń własnej subskrypcji.

Jak bardzo katalogi faktycznie się różnią

Rozbieżność jest większa, niż większość ludzi zakłada. Publiczne trackery bibliotek odkryły, że największy krajowy katalog Netflixa - słowacki, na początku 2024 roku - zawiera około 8 000 tytułów, podczas gdy inne rynki mają tylko ułamek tej liczby. Sama biblioteka USA zawiera około 3 600+ filmów i 1 800+ programów telewizyjnych, co stanowi inny zestaw niż w jakimkolwiek innym kraju. A dostępność nie jest uniwersalna: Netflix w ogóle nie działa w Chinach, Korei Północnej ani na Krymie. Pomnóż tę zmienność przez każdego dostawcę i każdy tytuł, a otrzymasz bogaty, stale zmieniający się zestaw danych, którego żaden widok jednego kraju nie jest w stanie uchwycić.

Panel statystyczny pokazujący zmienność rozmiaru katalogu streamingowego według kraju, od ~8 000 tytułów w dół, oraz trzy kraje bez Netflixa
Rozmiar katalogu i mieszanka tytułów znacznie się różnią między rynkami - to właśnie ta rozpiętość jest tym, co badania mierzą.

Gdzie znajdują się dane

Nie musisz odtwarzać wszystkiego od podstaw. Dwa neutralne źródła wykonują większość ciężkiej pracy. The Movie Database (TMDb) dostarcza czystych, kanonicznych metadanych - stabilne id dla każdego tytułu, obsada, rok wydania - co jest nieocenione do łączenia rekordów między rynkami. Agregatory dostępności w stylu JustWatch śledzą, którzy dostawcy oferują które tytuły w których krajach, a projekty społecznościowe, takie jak nieoficjalne Netflix Global Search, od dawna katalogują regionalne biblioteki. Używaj TMDb jako kręgosłupa dla tożsamości i traktuj kanały dostępności jako warstwę per-rynkową, którą nakładasz na wierzch.

Dlaczego potrzebujesz IP z rynku

Oto mechaniczne sedno. Publiczny katalog dostawcy i strony odkrywania renderują lokalną bibliotekę na podstawie miejsca, z którego pochodzi żądanie - więc aby zobaczyć katalog, który widzi subskrybent we Włoszech, twoje żądanie musi pochodzić z włoskiego IP. Jeden punkt widzenia daje odpowiedź jednego kraju; aby zbudować zestaw danych międzyrynkowy, musisz przepuścić to samo zapytanie przez wyjście w każdym docelowym kraju. Pula proxy rezydencyjnych obejmująca 200+ krajów to coś, co czyni to praktycznym - prawdziwe IP w kraju, dzięki czemu każdy rynek zwraca swoje autentyczne lokalne widoki, a nie zablokowane lub niespójne. To ta sama dyscyplina geo-widokowa, która stoi za weryfikacją reklam i badaniem taryf lotniczych, gdzie odpowiedź istnieje tylko w odniesieniu do lokalizacji.

Przeglądaj pełne pokrycie krajowe na naszej stronie lokalizacji; rynki, które możesz profilować, to rynki, w których masz wyjścia.

import requests

# Fetch a provider's public catalog view as a viewer in each market would
GATE = "gate.quantumproxies.io:8000"
MARKETS = ["us", "gb", "de", "it", "jp", "br"]

def catalog_view(url, country):
    # exit country selected in the proxy username -> the local library view
    proxy = f"http://USER-country-{country}:PASS@{GATE}"
    r = requests.get(url, proxies={"http": proxy, "https": proxy},
                     headers={"Accept-Language": country}, timeout=25)
    return r

by_market = {cc: catalog_view("https://example-provider.com/browse", cc)
             for cc in MARKETS}

Normalizacja między rynkami

Surowe dane z każdego kraju nie są porównywalne, dopóki nie pogodzimy tożsamości. Ten sam film nosi różne lokalne tytuły, grafiki i slugi w każdym rynku, więc dopasowanie na podstawie tytułu wyświetlanego daje śmieci. Kluczuj wszystko do kanonicznego id - id TMDb jest idealne - więc "Ojciec chrzestny: Część II" w USA i jego lokalny tytuł gdzie indziej zredukują się do jednego rekordu. Gdy tytuły są zduplikowane między rynkami, porównania piszą się same: które kraje mają tytuł, kiedy się pojawił, jak katalogi się klasyfikują i gdzie są luki.

# Build an availability matrix: which markets carry each canonical title
from collections import defaultdict

availability = defaultdict(set)   # tmdb_id -> set of country codes

def record(country, titles):
    for t in titles:
        availability[t["tmdb_id"]].add(country)

# ...after populating from each market's parsed catalog:
def gaps_vs(reference="us"):
    # titles present in the reference market but missing elsewhere
    return {tid: (all_markets - markets)
            for tid, markets in availability.items()
            if reference in markets}

all_markets = {"us", "gb", "de", "it", "jp", "br"}
Schemat rurociągu od wyboru rynków przez wyjścia z geo-targetingiem i normalizację tytułów do porównania dostępności między rynkami
Rurociąg to pętla na rynku, a następnie połączenie na kanonicznym id - pogodzenie tożsamości to to, co sprawia, że rynki są porównywalne.

Przekształcanie katalogów w inteligencję

Zestaw danych zarabia na siebie w analizie. Śledź okna dostępności, aby zobaczyć, jak długo po premierze w USA tytuł dociera do innych rynków - bezpośrednie odczytanie opóźnienia licencyjnego. Porównaj rozmiar katalogu i mieszankę gatunków według kraju, aby zrozumieć, gdzie dostawca inwestuje. Zauważ luki w treści, które ma konkurent, a ty nie, lub odwrotnie. Obserwuj, jak konkretny tytuł przemieszcza się przez granice w ciągu tygodni, aby wywnioskować struktury umów. Uruchom cały proces regularnie, oznaczaj czasem każdą rejestrację, a różnice staną się kanałem ruchu licencyjnego - ta sama logika monitorowania co monitorowanie cen konkurencji, zastosowana do praw do treści.

Jeden nawyk zamienia migawkę w monitor: zaplanuj pobieranie i porównaj każdą rejestrację z poprzednią. Nowe dodatki, ciche usunięcia i pierwsze pojawienie się tytułu na rynku ujawniają się jako różnice, dając ci kanał zmian zamiast statycznego inwentarza. Przechowuj każdą rejestrację z oznaczeniem czasowym i utrzymuj stabilne kanoniczne id, a będziesz mógł odtworzyć katalog dowolnego rynku, jak wyglądał w dowolnym dniu w przeszłości - co jest różnicą między jednorazowym badaniem a ciągłym produktem inteligencji, za który zespół licencyjny faktycznie zapłaci.

Pozostań po właściwej stronie linii

Ponieważ to dotyka geografii, bądź świadomy zakresu. Uzasadnione użycie tutaj to mierzenie publicznie wyświetlanych danych katalogowych i dostępności jako badanie rynku - nie omijanie regionalnych uprawnień własnego konta ani redystrybucja treści. Szanuj warunki każdej usługi, zbieraj tylko publiczne metadane katalogowe (tytuły, dostępność, daty - nie dane osobowe użytkowników) i uprzejmie rozkładaj swoje żądania. To jest informacyjne, a nie porada prawna; jeśli konkretny program budzi pytania, skonsultuj się przed jego skalowaniem.

Uzyskaj IP rezydencyjne w 200+ krajach

Często zadawane pytania

Dlaczego katalogi streamingowe różnią się w zależności od kraju?

Licencjonowanie jest negocjowane rynek po rynku i okienkowane w czasie, więc prawa do danego tytułu różnią się - i zmieniają - w zależności od kraju. Film może być dostępny w jednym rynku, niedostępny w innym i pojawić się później w trzecim. Dostępność zależy również od tego, gdzie dostawca w ogóle działa; niektóre kraje nie mają usługi. Ta zmienność na rynku to to, co mierzą badania katalogów.

Jak mogę zobaczyć katalog streamingowy w innym kraju?

Do badań, zażądaj publicznego katalogu lub stron odkrywania dostawcy przez wyjściowe IP zlokalizowane w docelowym kraju, aby lokalna biblioteka renderowała się tak, jak widziałby ją widz na rynku. Przeprowadź zapytanie przez wyjście w każdym kraju, który chcesz profilować, używając puli proxy rezydencyjnych, a następnie znormalizuj wyniki do kanonicznego id tytułu do porównania.

Jakie źródła danych pomagają w badaniach katalogów?

Używaj TMDb do kanonicznych metadanych tytułów i stabilnych id do łączenia rekordów między rynkami oraz agregatorów dostępności (kanały w stylu JustWatch i trackery regionalnych bibliotek społecznościowych) do warstwy per-krajowej. TMDb daje ci tożsamość; kanały dostępności dają ci wymiar rynku. Nakładaj te dwa, aby zbudować porównywalny zestaw danych międzyrynkowych.

Czy badania katalogów streamingowych są legalne?

Zbieranie publicznie wyświetlanych metadanych katalogowych i dostępności do analizy rynku jest powszechną praktyką, ale obowiązują warunki każdej usługi, a to nie jest porada prawna. Trzymaj się publicznych danych katalogowych, unikaj danych osobowych użytkowników, nie używaj ich do omijania własnych uprawnień regionalnych ani redystrybucji treści i skonsultuj się w przypadku konkretnego programu na dużą skalę.

Katalog streamingowy to zmieniający się, zależny od granic zestaw danych, a jego wartość tkwi właśnie w różnicach między rynkami. Profiluj każdy kraj z IP na rynku, pogodź tytuły do jednego kanonicznego id i rejestruj według harmonogramu - a rozproszone regionalne biblioteki stają się silnikiem inteligencji licencyjnej.

Zobacz każdy kraj, który możesz profilować