Wie man öffentliche TikTok-Daten im Jahr 2026 scrapt (Was funktioniert)

TikToks öffentliche Daten sind alle da — in einem versteckten JSON-Blob und einem cursor-paginierten Feed — aber die Anti-Bot-Schicht ist der Grund, warum jeder Standard-Scraper schließlich versagt. Hier ist, was noch funktioniert und warum mobile IPs wichtig sind.

TikTok veröffentlicht überraschend viele öffentliche Daten — Profile, Video-Metadaten, Hashtag-Feeds, Engagement-Zahlen — und nichts davon erfordert ein Login zum Lesen. Was das Scrapen von TikTok-Daten schwierig macht, ist nicht das Finden der Daten; es ist die aggressive Markierung automatisierten Zugriffs durch die Anti-Bot-Schicht der Seite, weshalb jede Standard-Bibliothek schließlich versagt und warum die Exit-IP, die Sie verwenden, entscheidet, ob Sie Ergebnisse oder ein CAPTCHA erhalten. Dieser Leitfaden behandelt, wo die öffentlichen Daten zu finden sind, wie die Paginierung wirklich funktioniert, warum inoffizielle Tools veralten und warum mobile Proxys die pragmatische Standardlösung sind. Es geht um öffentliche, nicht-personenbezogene Forschungsdaten — Trends, Ersteller, Hashtags — nicht um das Scrapen privater Konten.

Wo die öffentlichen Daten tatsächlich zu finden sind

TikTok ist eine clientseitig gerenderte App, daher liefert ein naives GET nur eine Hülle. Der nützliche Inhalt befindet sich an zwei Stellen: ein versteckter JSON-Blob, der in die Seite eingebettet ist (ein universelles Datenskript, aus dem die App hydratisiert wird) und die internen Feed-Endpunkte, die die App nach dem Laden aufruft. Zwischen ihnen können Sie fast alles lesen, was ein Betrachter sieht: für jedes Video den text der Beschriftung, createTime, diggCount (Likes), shareCount, playCount, commentCount, collectCount, plus verschachtelte author, music und stats Objekte. Autorendaten umfassen Follower- und Gesamt-Like-Zahlen, Verifizierungsstatus, Bio und Bio-Link. Diashow-Posts kennzeichnen isSlideshow und enthalten ein Bildlink-Array anstelle eines Videos.

Profile benötigen zwei IDs, nicht nur einen Benutzernamen

Der Stolperstein, der jeden ersten Versuch ausbremst: Um den Video-Feed eines Benutzers abzurufen, sind zwei Kennungen erforderlich, nicht nur der Handle. Sie benötigen die numerische id (userID) und die secUid, die beide durch die Auflösung des Profils zuerst ermittelt werden. Fehlt die secUid, liefert der Feed-Aufruf nichts. Einmal auflösen, dann durch den Feed blättern.

# Sketch of the account-free flow every TikTok scraper follows.
# 1) Resolve the profile to get BOTH ids
user = get_user("someusername")          # -> {"id": ..., "secUid": ...}
user_id, sec_uid = user["id"], user["secUid"]

# 2) Page the feed with those ids (see cursor loop below)
videos = user_feed(user_id, sec_uid)

Die Paginierung basiert auf einem Cursor (und ist auf ~30 begrenzt)

Ein Feed-Aufruf liefert ungefähr 30 Beiträge — bei weitem nicht die gesamte Timeline. TikTok paginiert mit einem Cursor: Jede Antwort enthält einen cursor (wo dieser Batch endete) und ein hasMore Boolean. Um den gesamten Feed zu erhalten, müssen Sie in einer Schleife den Cursor zurückgeben, bis hasMore falsch ist. Dies ist auch der Punkt, an dem Sie am meisten exponiert sind — jede Seite ist eine weitere Anfrage von Ihrer IP, sodass eine lange Timeline viele Anrufe von einer Adresse aus erfordert.

def crawl_feed(user_id, sec_uid):
    items, cursor, has_more = [], 0, True
    while has_more:
        page = user_feed(user_id, sec_uid, cursor=cursor)  # ~30 posts
        items.extend(page["itemList"])
        cursor = int(page["cursor"])
        has_more = page["hasMore"]
        # rotate / pace here — every loop is a fresh request from your IP
    return items
Diagramm der Cursor-Paginierung auf einem TikTok-Feed: Benutzer auf id und secUid auflösen, erste Seite mit 30 Beiträgen, mobiler Exit-IP, Schleife auf Cursor, während hasMore
Der Feed gibt Ihnen einen Cursor und ein hasMore-Flag; geben Sie den Cursor zurück, bis hasMore falsch wird.

Warum inoffizielle Bibliotheken immer wieder versagen

Wenn Sie eine beliebte Open-Source-TikTok-Bibliothek verwendet haben, kennen Sie das: Sie funktioniert eine Weile, dann beginnt sie CAPTCHAs oder leere Ergebnisse zurückzugeben, und ein geforkter Patch erscheint, um sie am Leben zu halten. Diese Fluktuation ist nicht die Schuld der Maintainer — TikTok ändert seine Signierungs- und Anti-Bot-Logik, und jeder inoffizielle Client eilt, um aufzuholen. Zwei Lehren folgen daraus. Fixieren Sie sich auf einen gepflegten Fork und erwarten Sie, ihn zu aktualisieren. Und binden Sie die Zuverlässigkeit Ihrer Datenpipeline nicht an eine brüchige Bibliothek — der dauerhafte Teil ist Ihre eigene Parsing- und Rotationsschicht um die aktuell funktionierende Abrufmethode.

Gescrapte Medien-URLs laufen ab — greifen Sie schnell zu

Eine subtile Falle für jeden, der Inhalte archiviert: TikToks Avatar-, Cover- und Video-URLs sind zeitlich signiert. Sie tragen x-expires und x-signature Abfrageparameter und funktionieren innerhalb von Stunden nicht mehr. Ein Link, den Sie heute Morgen gescrapt haben, ist bis zum Abend tot. Wenn Sie die Medien selbst benötigen, laden Sie sie im selben Durchlauf herunter, in dem Sie sie entdecken; wenn Sie nur Metadaten benötigen, speichern Sie die stabilen IDs und lösen Sie bei Bedarf frische URLs auf.

Warum speziell mobile Proxys

TikTok ist eine mobile-first Plattform mit mobilgradigen Anti-Bot-Erwartungen, und hier entscheidet die Wahl der IP alles. Datacenter-IPs werden schnell markiert. Residential-IPs sind weit besser. Aber mobile Proxys sind die beste Wahl, weil Mobilfunknetze so funktionieren: Mobilfunkanbieter leiten Tausende von echten Abonnenten durch eine Handvoll gemeinsamer IPs (CGNAT), sodass eine einzelne mobile IP wie eine ganze Menge echter Nutzer aussieht. Sie zu blockieren würde bedeuten, echte Kunden zu blockieren, was Plattformen äußerst ungern tun — der Grund, den wir in warum mobile IPs so vertrauenswürdig sind behandeln. Mobile Exits ermöglichen es Ihnen auch, geo-spezifische Feeds zu sampeln: TikTok passt Trends nach Ländern an, sodass ein UK-Exit und ein US-Exit unterschiedliche "For You"-Inhalte liefern.

Holen Sie sich mobile Proxys für TikTok-Daten

TikTok Shop und geografische Unterschiede

TikTok Shop Produktdaten folgen der gleichen Struktur — öffentliche Listings, strukturiertes JSON, Cursor-Paginierung — aber die Verfügbarkeit ist stark geografisch eingeschränkt, sodass Sie den Katalog einer Region nur von einer Exit-IP in dieser Region aus sehen können. Dies ist der gleiche Grund, warum TikTok-Wachstumsarbeit auf standortangepasste IPs setzt: Egal, ob Sie Shop-Inventar oder Trend-Feeds lesen, der Inhalt, den Sie erhalten, ist eine Funktion dessen, wo Ihre IP sagt, dass Sie sind. Sampeln Sie jeden Markt von einem passenden Exit und behandeln Sie die Ergebnisse als regionsspezifisch, nicht global.

Checkliste, was funktioniert und was beim Scrapen öffentlicher TikTok-Daten beißt, einschließlich verstecktem JSON, Cursor-Paginierung, ablaufenden Medien-URLs und Datacenter-IP-Markierung
Die öffentlichen Daten sind alle ohne Login erreichbar — die Hürde ist die Anti-Bot-Markierung, ablaufende URLs und das 30-Post-Limit.

Wann man den DIY-Stack überspringen sollte

Die Pflege eines TikTok-Scrapers bedeutet, Signierungsänderungen zu verfolgen, CAPTCHAs zu handhaben und einen Fork zu betreuen — eine laufende Belastung, kein einmaliger Aufbau. Wenn TikTok-Daten ein Input für ein Produkt sind und nicht das Produkt selbst, nimmt Ihnen eine Scraper API, die die Seite rendert, mobile-grade IPs rotiert und sauberes JSON zurückgibt, diese Wartung ab. Führen Sie Ihren eigenen Stack aus, während Sie die Struktur lernen; wechseln Sie zu einer verwalteten Abrufschicht, wenn die Wartung mehr kostet als die Erkenntnis.

Häufig gestellte Fragen

Kann man TikTok-Daten ohne Konto scrapen?

Ja — öffentliche Profile, Videos, Hashtags und deren Engagement-Metadaten sind ohne Login lesbar, weil TikTok sie in einem versteckten JSON-Blob einbettet und über interne Feed-Endpunkte bereitstellt. Sie müssen dennoch die numerische id und secUid eines Profils auflösen, bevor Sie dessen Feed durchblättern, und Sie werden ohne saubere, rotierende IPs auf Anti-Bot-Markierungen stoßen.

Warum bekommt mein TikTok-Scraper CAPTCHAs?

TikTok markiert IPs, die sich wie Automatisierung verhalten — zu viele Anfragen, Datacenter-Adressbereiche oder eine IP mit schlechtem Ruf. Cursor-Paginierung verschlimmert es, weil eine vollständige Timeline viele Anrufe von einer IP erfordert. Verteilen Sie Anfragen über einen rotierenden mobilen oder residential Pool, dosieren Sie sie und validieren Sie Antworten. Mobile IPs ziehen am wenigsten Verdacht auf sich, weil sie von echten Abonnenten geteilt werden.

Wie viele TikTok-Daten kann eine Anfrage zurückgeben?

Ein einzelner Feed-Aufruf liefert ungefähr 30 Beiträge. Um eine vollständige Timeline zu sammeln, müssen Sie in einer Schleife den Cursor, den die Antwort Ihnen gibt, zurückgeben, bis das hasMore-Flag falsch ist. Da jede Seite eine weitere Anfrage von Ihrer IP ist, bedeuten längere Timelines mehr Exposition — weshalb Rotation und Dosierung wichtig sind, wenn die Anzahl wächst.

Brauche ich mobile Proxys für TikTok?

Nicht unbedingt, aber sie sind die stärkste Option. Datacenter-IPs werden schnell markiert; Residential-IPs funktionieren besser; mobile Proxys funktionieren am besten, weil Carrier-CGNAT bedeutet, dass eine mobile IP von vielen echten Nutzern geteilt wird, sodass Plattformen ungern blockieren. Mobile Exits ermöglichen es Ihnen auch, geo-spezifische Trend- und Shop-Daten zu ziehen, indem Sie das Exit-Land wählen.

TikToks öffentliche Daten sind alle ohne Login erreichbar — der schwierige Teil ist, erreichbar zu bleiben. Lösen Sie beide Profil-IDs auf, schleifen Sie den Cursor, greifen Sie sofort auf signierte Medien zu und routen Sie durch mobile-grade IPs, damit Ihre Anfragen wie die Menge aussehen, in der sie sich verstecken. Richten Sie die IP-Schicht richtig ein und der Rest ist nur JSON.

Starten Sie mit QuantumProxies mobile Proxys