Badanie katalogu streamingowego według rynku: Tworzenie zestawów danych o dostępności
Katalog usługi streamingowej zmienia się na każdym granicy. Oto jak mierzyć, co jest dostępne gdzie, rynek po rynku, i przekształcić to w inteligencję licencyjną i treściową.
Ta sama usługa streamingowa to inny produkt w każdym kraju. Umowy licencyjne są zawierane rynek po rynku, więc tytuł, który jest głównym punktem katalogu w Hiszpanii, może być nieobecny w Niemczech i pojawić się w Japonii sześć miesięcy później. Dla każdego, kto zajmuje się strategią treści - studia, dystrybutorzy, analitycy, zespoły akwizycji - ta zmienność na rynku nie jest szumem, to jest sygnał. Ten przewodnik obejmuje badanie katalogu streamingowego według rynku: jak mierzyć, co jest dostępne gdzie, budować porównywalny zestaw danych w różnych krajach i przekształcać to w inteligencję licencyjną. Najpierw uwaga wprowadzająca: chodzi o obserwowanie publicznych katalogów z zewnątrz jako badanie rynku, a nie o omijanie regionalnych ograniczeń własnej subskrypcji.
Jak bardzo katalogi faktycznie się różnią
Rozbieżność jest większa, niż większość ludzi zakłada. Publiczne trackery bibliotek odkryły, że największy krajowy katalog Netflixa - słowacki, na początku 2024 roku - zawiera około 8 000 tytułów, podczas gdy inne rynki mają tylko ułamek tej liczby. Sama biblioteka USA zawiera około 3 600+ filmów i 1 800+ programów telewizyjnych, co stanowi inny zestaw niż w jakimkolwiek innym kraju. A dostępność nie jest uniwersalna: Netflix w ogóle nie działa w Chinach, Korei Północnej ani na Krymie. Pomnóż tę zmienność przez każdego dostawcę i każdy tytuł, a otrzymasz bogaty, stale zmieniający się zestaw danych, którego żaden widok jednego kraju nie jest w stanie uchwycić.

Gdzie znajdują się dane
Nie musisz odtwarzać wszystkiego od podstaw. Dwa neutralne źródła wykonują większość ciężkiej pracy. The Movie Database (TMDb) dostarcza czystych, kanonicznych metadanych - stabilne id dla każdego tytułu, obsada, rok wydania - co jest nieocenione do łączenia rekordów między rynkami. Agregatory dostępności w stylu JustWatch śledzą, którzy dostawcy oferują które tytuły w których krajach, a projekty społecznościowe, takie jak nieoficjalne Netflix Global Search, od dawna katalogują regionalne biblioteki. Używaj TMDb jako kręgosłupa dla tożsamości i traktuj kanały dostępności jako warstwę per-rynkową, którą nakładasz na wierzch.
Dlaczego potrzebujesz IP z rynku
Oto mechaniczne sedno. Publiczny katalog dostawcy i strony odkrywania renderują lokalną bibliotekę na podstawie miejsca, z którego pochodzi żądanie - więc aby zobaczyć katalog, który widzi subskrybent we Włoszech, twoje żądanie musi pochodzić z włoskiego IP. Jeden punkt widzenia daje odpowiedź jednego kraju; aby zbudować zestaw danych międzyrynkowy, musisz przepuścić to samo zapytanie przez wyjście w każdym docelowym kraju. Pula proxy rezydencyjnych obejmująca 200+ krajów to coś, co czyni to praktycznym - prawdziwe IP w kraju, dzięki czemu każdy rynek zwraca swoje autentyczne lokalne widoki, a nie zablokowane lub niespójne. To ta sama dyscyplina geo-widokowa, która stoi za weryfikacją reklam i badaniem taryf lotniczych, gdzie odpowiedź istnieje tylko w odniesieniu do lokalizacji.
Przeglądaj pełne pokrycie krajowe na naszej stronie lokalizacji; rynki, które możesz profilować, to rynki, w których masz wyjścia.
import requests
# Fetch a provider's public catalog view as a viewer in each market would
GATE = "gate.quantumproxies.io:8000"
MARKETS = ["us", "gb", "de", "it", "jp", "br"]
def catalog_view(url, country):
# exit country selected in the proxy username -> the local library view
proxy = f"http://USER-country-{country}:PASS@{GATE}"
r = requests.get(url, proxies={"http": proxy, "https": proxy},
headers={"Accept-Language": country}, timeout=25)
return r
by_market = {cc: catalog_view("https://example-provider.com/browse", cc)
for cc in MARKETS}
Normalizacja między rynkami
Surowe dane z każdego kraju nie są porównywalne, dopóki nie pogodzimy tożsamości. Ten sam film nosi różne lokalne tytuły, grafiki i slugi w każdym rynku, więc dopasowanie na podstawie tytułu wyświetlanego daje śmieci. Kluczuj wszystko do kanonicznego id - id TMDb jest idealne - więc "Ojciec chrzestny: Część II" w USA i jego lokalny tytuł gdzie indziej zredukują się do jednego rekordu. Gdy tytuły są zduplikowane między rynkami, porównania piszą się same: które kraje mają tytuł, kiedy się pojawił, jak katalogi się klasyfikują i gdzie są luki.
# Build an availability matrix: which markets carry each canonical title
from collections import defaultdict
availability = defaultdict(set) # tmdb_id -> set of country codes
def record(country, titles):
for t in titles:
availability[t["tmdb_id"]].add(country)
# ...after populating from each market's parsed catalog:
def gaps_vs(reference="us"):
# titles present in the reference market but missing elsewhere
return {tid: (all_markets - markets)
for tid, markets in availability.items()
if reference in markets}
all_markets = {"us", "gb", "de", "it", "jp", "br"}

Przekształcanie katalogów w inteligencję
Zestaw danych zarabia na siebie w analizie. Śledź okna dostępności, aby zobaczyć, jak długo po premierze w USA tytuł dociera do innych rynków - bezpośrednie odczytanie opóźnienia licencyjnego. Porównaj rozmiar katalogu i mieszankę gatunków według kraju, aby zrozumieć, gdzie dostawca inwestuje. Zauważ luki w treści, które ma konkurent, a ty nie, lub odwrotnie. Obserwuj, jak konkretny tytuł przemieszcza się przez granice w ciągu tygodni, aby wywnioskować struktury umów. Uruchom cały proces regularnie, oznaczaj czasem każdą rejestrację, a różnice staną się kanałem ruchu licencyjnego - ta sama logika monitorowania co monitorowanie cen konkurencji, zastosowana do praw do treści.
Jeden nawyk zamienia migawkę w monitor: zaplanuj pobieranie i porównaj każdą rejestrację z poprzednią. Nowe dodatki, ciche usunięcia i pierwsze pojawienie się tytułu na rynku ujawniają się jako różnice, dając ci kanał zmian zamiast statycznego inwentarza. Przechowuj każdą rejestrację z oznaczeniem czasowym i utrzymuj stabilne kanoniczne id, a będziesz mógł odtworzyć katalog dowolnego rynku, jak wyglądał w dowolnym dniu w przeszłości - co jest różnicą między jednorazowym badaniem a ciągłym produktem inteligencji, za który zespół licencyjny faktycznie zapłaci.
Pozostań po właściwej stronie linii
Ponieważ to dotyka geografii, bądź świadomy zakresu. Uzasadnione użycie tutaj to mierzenie publicznie wyświetlanych danych katalogowych i dostępności jako badanie rynku - nie omijanie regionalnych uprawnień własnego konta ani redystrybucja treści. Szanuj warunki każdej usługi, zbieraj tylko publiczne metadane katalogowe (tytuły, dostępność, daty - nie dane osobowe użytkowników) i uprzejmie rozkładaj swoje żądania. To jest informacyjne, a nie porada prawna; jeśli konkretny program budzi pytania, skonsultuj się przed jego skalowaniem.
Uzyskaj IP rezydencyjne w 200+ krajach
Często zadawane pytania
Dlaczego katalogi streamingowe różnią się w zależności od kraju?
Licencjonowanie jest negocjowane rynek po rynku i okienkowane w czasie, więc prawa do danego tytułu różnią się - i zmieniają - w zależności od kraju. Film może być dostępny w jednym rynku, niedostępny w innym i pojawić się później w trzecim. Dostępność zależy również od tego, gdzie dostawca w ogóle działa; niektóre kraje nie mają usługi. Ta zmienność na rynku to to, co mierzą badania katalogów.
Jak mogę zobaczyć katalog streamingowy w innym kraju?
Do badań, zażądaj publicznego katalogu lub stron odkrywania dostawcy przez wyjściowe IP zlokalizowane w docelowym kraju, aby lokalna biblioteka renderowała się tak, jak widziałby ją widz na rynku. Przeprowadź zapytanie przez wyjście w każdym kraju, który chcesz profilować, używając puli proxy rezydencyjnych, a następnie znormalizuj wyniki do kanonicznego id tytułu do porównania.
Jakie źródła danych pomagają w badaniach katalogów?
Używaj TMDb do kanonicznych metadanych tytułów i stabilnych id do łączenia rekordów między rynkami oraz agregatorów dostępności (kanały w stylu JustWatch i trackery regionalnych bibliotek społecznościowych) do warstwy per-krajowej. TMDb daje ci tożsamość; kanały dostępności dają ci wymiar rynku. Nakładaj te dwa, aby zbudować porównywalny zestaw danych międzyrynkowych.
Czy badania katalogów streamingowych są legalne?
Zbieranie publicznie wyświetlanych metadanych katalogowych i dostępności do analizy rynku jest powszechną praktyką, ale obowiązują warunki każdej usługi, a to nie jest porada prawna. Trzymaj się publicznych danych katalogowych, unikaj danych osobowych użytkowników, nie używaj ich do omijania własnych uprawnień regionalnych ani redystrybucji treści i skonsultuj się w przypadku konkretnego programu na dużą skalę.
Katalog streamingowy to zmieniający się, zależny od granic zestaw danych, a jego wartość tkwi właśnie w różnicach między rynkami. Profiluj każdy kraj z IP na rynku, pogodź tytuły do jednego kanonicznego id i rejestruj według harmonogramu - a rozproszone regionalne biblioteki stają się silnikiem inteligencji licencyjnej.