Jak uzyskać dane z Twittera/X bez oficjalnego API w 2026 roku

Oficjalne API X wycenia większość projektów poza zasięgiem. Oto, jakie publiczne dane z Twittera/X są nadal dostępne, dwie drogi ich zbierania i jak naprawdę porównują się koszty.

Twitter — przemianowany na X w 2023 roku — pozostaje jednym z najbogatszych zbiorów danych tekstowych w czasie rzeczywistym w internecie, ale oficjalne API wycenia większość projektów poza zasięgiem. Płatne plany zaczynają się od $100 miesięcznie za skromny plan Basic i sięgają około $5000 miesięcznie za poziom Pro, z niższymi poziomami ograniczonymi do około 300 odczytów co 15 minut. Jeśli Twój projekt nie może tego uzasadnić, ten przewodnik obejmuje, jakie publiczne dane X są nadal dostępne, dwie metody ich zbierania i jak naprawdę porównują się koszty.

Co się zmieniło i dlaczego ludzie odeszli

Darmowe i tanie poziomy odczytu, które napędzały dekadę narzędzi badawczych i pulpitów, zniknęły. Zastąpił je model subskrypcyjny, w którym początkowy płatny poziom jest drogi w porównaniu do oferowanej objętości, a rzeczywiste obciążenia badawcze lub monitorujące trafiają do rozmów o cenach korporacyjnych. Dla projektu śledzącego kilkaset kont lub wyszukującego na żywo, ceny za odczyt na oficjalnych stawkach (rzędu pół centa do centa za odczyt) rosną szybciej niż wartość danych.

Ta luka to powód, dla którego "alternatywa dla Twitter API" stała się stałym wyszukiwaniem. Istnieją dwie uczciwe odpowiedzi: zewnętrzne API danych, które odsprzedaje ustrukturyzowane dane tweetów, lub samodzielne zbieranie publicznej sieci. Oba unikają procesu zatwierdzania konta dewelopera; różnią się tym, kto utrzymuje infrastrukturę.

Diagram statystyczny pokazujący kosztową ścianę oficjalnego API X: $100 miesięcznie Basic, $5000 miesięcznie Pro, 300 odczytów na 15 minut i koszt za odczyt
Minimalny koszt oficjalnego API jest wysoki, a limity odczytów są ścisłe — to powód, dla którego większość projektów szuka innych rozwiązań.

Jakie publiczne dane X są nadal dostępne

Wiele jest widoczne dla niezalogowanego odwiedzającego i to są dane warte zbierania, ponieważ są jednoznacznie publiczne. W praktyce obejmuje to:

Czego nie powinieneś dotykać: niczego za logowaniem, kont chronionych ani wiadomości bezpośrednich. W momencie, gdy dane wymagają uwierzytelnienia do ich wyświetlenia, przestają być publicznym zbiorem danych i stają się dostępem opartym na koncie — to zupełnie inne podejście prawne i dotyczące warunków użytkowania.

Trasa 1: zewnętrzne API danych

Kilka usług odsprzedaje ustrukturyzowane dane X na zasadzie płatności za wynik, zazwyczaj ułamek centa za tweet lub profil — często rząd wielkości poniżej oficjalnych cen za odczyt. Wysyłasz zapytanie, otrzymujesz JSON, a ktoś inny absorbuje rotację proxy i parsowanie. To najszybsza droga, jeśli chcesz danych, a nie infrastruktury, a Twoje wolumeny są umiarkowane. Kompromis to zależność: ceny, pokrycie i czas działania zależą od dostawcy.

Trasa 2: samodzielne zbieranie publicznej sieci

Jeśli chcesz kontroli, wyłączności lub bardzo dużych wolumenów, zbieraj je bezpośrednio. X jest mocno renderowany po stronie klienta i wrażliwy na geolokalizację, więc dwie rzeczy mają znaczenie: czysty, zaufany adres IP wyjściowy i zdolność do wykonania JavaScriptu strony. Platformy konsumenckie bardziej ufają adresom IP mobilnym i rezydencyjnym niż zakresom centrów danych, więc kieruj żądania przez rotującą pulę z nową sesją na każdą osobę:

import requests

# residential/mobile exit — X trusts these far more than datacenter IPs
proxy = "http://USER:PASS@rotating.quantumproxies.io:8000"
proxies = {"http": proxy, "https": proxy}

headers = {
    "User-Agent": "Mozilla/5.0 (iPhone; CPU iPhone OS 17_0 like Mac OS X) "
                  "AppleWebKit/605.1.15 (KHTML, like Gecko) Mobile/15E148",
    "Accept-Language": "en-US,en;q=0.9",
}

# public profile page — logged-out view, rendered client-side
r = requests.get("https://x.com/nasa", headers=headers,
                 proxies=proxies, timeout=20)
print(r.status_code)

Surowe żądanie zwraca powłokę JavaScript, a nie tweety — oś czasu jest ładowana z wewnętrznego punktu końcowego po załadowaniu strony. Dla wszystkiego poza statycznym profilem musisz albo renderować stronę w przeglądarce bez głowy przez proxy, albo przekazać całą pracę do Scraper API, które renderuje JavaScript, rotuje adresy IP rezydencyjne i zwraca bezpośrednio załadowany JSON:

# Scraper API: render the client-side page and return structured content,
# rotation and fingerprinting handled server-side
curl -G "https://api.quantumproxies.io/scraper" \
  --data-urlencode "url=https://x.com/search?q=%23AIagents&f=live" \
  --data-urlencode "render=true" \
  --data-urlencode "country=us" \
  -H "Authorization: Bearer YOUR_API_KEY"
Diagram przepływu zbierania publicznych danych z Twittera/X: trafienie w publiczny punkt końcowy, rotacja adresu IP wyjściowego przez proxy, parsowanie JSON i przechowywanie zbioru danych
Pętla zbierania jest taka sama jak w przypadku każdej strony renderowanej po stronie klienta: zaufany IP, renderowanie, parsowanie załadowanego JSON, deduplikacja.

Jak naprawdę porównują się koszty

Oficjalne API nalicza opłaty za odczyt i ogranicza wolumen za poziomami. Zbieranie z publicznej sieci przez proxy nalicza opłaty za gigabajt ruchu — a załadowany JSON oś czasu jest mały. Przy niskim wolumenie zewnętrzne API danych jest najtańsze pod względem wysiłku; przy dużym wolumenie samodzielne zbieranie przez płatną na GB pulę rezydencyjną jest zazwyczaj najtańsze w absolutnych kategoriach, ponieważ płacisz za bajty, a nie za licencjonowanie tweetów. Przeprowadź arytmetykę dla własnej liczby odczytów przed podjęciem decyzji o którejkolwiek z opcji.

Przykład z życia pokazuje kompromis w sposób konkretny. Pulpit nawigacyjny sprawdzający 500 kont co godzinę to 12 000 odczytów profilu dziennie. Przy oficjalnych cenach za odczyt to duży miesięczny rachunek na płatnych poziomach; te same odczyty zebrane z publicznych stron to kilka setek megabajtów ruchu proxy, ponieważ załadowany profil JSON jest mały. Zewnętrzne API danych znajduje się pomiędzy — tanie za wynik, ale płacisz za każde pojedyncze wywołanie. Najpierw modeluj swoją rzeczywistą liczbę odczytów, a następnie wybierz trasę, której jednostkowa ekonomia wygrywa przy tym wolumenie, zamiast domyślnie wybierać najłatwiejszą do połączenia.

Zbieraj publiczne dane X na płatnej na GB puli

Pozostawanie po właściwej stronie linii

To ogólne informacje, a nie porada prawna. Zbieranie publicznie dostępnych danych w szanowanych stawkach jest ogólnie obronne, ale trzy zasady utrzymują projekt w czystości: pozostawaj wylogowany, aby widzieć tylko publiczne dane, szanuj limity szybkości i wycofuj się przy błędach, oraz traktuj autorów tweetów jak ludzi — posty X często zawierają dane osobowe, co wiąże się z obowiązkami w stylu RODO, jeśli je przechowujesz. Nasz przewodnik na temat proxy dla platform społecznościowych obejmuje stronę operacyjną, a zbieranie publicznych danych TikTok stosuje ten sam wzorzec do krótkich filmów.

Często zadawane pytania

Czy istnieje darmowa alternatywa dla Twitter/X API?

Nie ma już darmowego oficjalnego poziomu odczytu, który wspierałby rzeczywiste projekty. Najbliżej "darmowego" jest samodzielne zbieranie publicznych stron, gdzie jedynym kosztem jest przepustowość proxy — płatna na GB pula rezydencyjna nalicza opłaty za ruch, a nie za tweet. Zewnętrzne API danych oferują małe darmowe kredyty do testowania, a następnie naliczają ułamek centa za wynik.

Czy mogę skrapować dane X bez konta dewelopera?

Tak — publiczne profile, tweety, wyszukiwania i trendy są widoczne bez uwierzytelnienia, więc ich zbieranie nie wymaga konta dewelopera ani zatwierdzenia OAuth. Potrzebujesz zaufanych adresów IP wyjściowych i zdolności do renderowania strony po stronie klienta, ponieważ X ładuje swoją oś czasu z wewnętrznego punktu końcowego po załadowaniu, a nie serwuje jej w początkowym HTML.

Dlaczego potrzebuję proxy do danych Twitter/X?

X jest agresywny w ograniczaniu szybkości i dostosowywaniu geograficznym, i nie ufa zakresom IP centrów danych. Rotujące proxy rezydencyjne lub mobilne prezentują się jako zwykłe połączenia konsumenckie, rozpraszają żądania, aby żadne pojedyncze IP nie wzrosło, i pozwalają przypiąć kraj wyjściowy, gdy potrzebujesz trendów lub wyników wyszukiwania specyficznych dla regionu — wszystko to utrzymuje stabilność zbierania przy dużym wolumenie.

Czy zbieranie publicznych tweetów jest legalne?

Zbieranie publicznie dostępnych danych jest ogólnie traktowane jako legalne, ale nie jest to ogólne pozwolenie. Pozostawaj wylogowany, unikaj chronionych lub prywatnych treści, szanuj limity szybkości i pamiętaj, że tweety często zawierają dane osobowe — ich przechowywanie uruchamia obowiązki związane z prawem prywatności, takie jak RODO. W razie wątpliwości co do konkretnego zastosowania, zasięgnij porady prawnej zamiast zakładać.

Cena ściany oficjalnego API jest realna, ale publiczne dane za nią są nadal dostępne. Wybierz zewnętrzne API dla szybkości przy niskim wolumenie lub zbieraj je samodzielnie przez czystą pulę rezydencyjną, gdy skala lub kontrola mają znaczenie — i utrzymuj to publiczne, zrównoważone i świadome prywatności.

Renderuj i zbieraj dane X za pomocą Scraper API