Comment obtenir des données Twitter/X sans l'API officielle en 2026

L'API officielle de X est trop coûteuse pour la plupart des projets. Voici quelles données publiques de Twitter/X sont encore accessibles, les deux voies pour les collecter, et comment les coûts se comparent réellement.

Twitter — rebaptisé X en 2023 — reste l'un des ensembles de données textuelles en temps réel les plus riches sur Internet, mais l'API officielle a exclu la plupart des projets. Les niveaux payants commencent autour de 100 $ par mois pour un plan Basique modeste et montent jusqu'à environ 5 000 $ par mois pour un volume de niveau Pro, avec des niveaux inférieurs limités à environ 300 lectures toutes les 15 minutes. Si votre projet ne peut pas justifier cela, ce guide couvre quelles données publiques de X sont encore accessibles, les deux façons de les collecter, et comment les coûts se comparent réellement.

Ce qui a changé, et pourquoi les gens sont partis

Les niveaux de lecture gratuits et bon marché qui ont alimenté une décennie d'outils de recherche et de tableaux de bord ont disparu. Ce qui les a remplacés est un modèle d'abonnement où le niveau d'entrée payant est cher par rapport au volume qu'il permet, et les charges de travail de recherche ou de surveillance authentiques aboutissent à une discussion sur les prix d'entreprise. Pour un projet suivant quelques centaines de comptes ou un terme de recherche en direct, la tarification par lecture aux tarifs officiels (de l'ordre d'un demi-cent à un cent par lecture) s'accumule plus vite que la valeur des données.

C'est cet écart qui explique pourquoi "alternative à l'API Twitter" est devenu une recherche permanente. Il y a deux réponses honnêtes : une API de données tierce qui revend des données de tweets structurées, ou collecter le web public vous-même. Les deux évitent le processus d'approbation du compte développeur ; elles diffèrent en qui maintient l'infrastructure.

Diagramme statistique montrant le mur des coûts de l'API officielle de X : 100 $ par mois Basique, 5000 $ par mois Pro, 300 lectures toutes les 15 minutes, et coût par lecture
Le seuil de l'API officielle est élevé et ses limites de lecture sont strictes — la raison pour laquelle la plupart des projets cherchent ailleurs.

Quelles données publiques de X sont encore accessibles

Beaucoup de choses sont visibles pour un visiteur déconnecté, et ce sont les données qui valent la peine d'être collectées car elles sont sans ambiguïté publiques. En pratique, cela couvre :

Ce que vous ne devriez pas toucher : tout ce qui est derrière une connexion, les comptes protégés ou les messages directs. Dès que les données nécessitent une authentification pour être vues, cela cesse d'être une collecte publique et devient un accès basé sur un compte — une posture légale et de conditions de service entièrement différente.

Voie 1 : une API de données tierce

Plusieurs services revendent des données structurées de X sur une base de paiement par résultat, généralement une fraction de cent par tweet ou profil — souvent un ordre de grandeur en dessous de la tarification officielle par lecture. Vous envoyez une requête, vous obtenez du JSON, et quelqu'un d'autre absorbe la rotation des proxies et le parsing. C'est le chemin le plus rapide si vous voulez des données, pas de l'infrastructure, et que vos volumes sont modérés. Le compromis est la dépendance : la tarification, la couverture et la disponibilité sont à la discrétion du fournisseur.

Voie 2 : collecter le web public vous-même

Si vous voulez du contrôle, de l'exclusivité ou un très grand volume, collectez-le directement. X est fortement rendu côté client et sensible à la géolocalisation, donc deux choses importent : une IP de sortie propre et de confiance et la capacité d'exécuter le JavaScript de la page. Les plateformes grand public font davantage confiance aux IPs mobiles et résidentielles qu'aux plages de centres de données, donc dirigez les requêtes à travers un pool rotatif avec une session fraîche par persona :

import requests

# residential/mobile exit — X trusts these far more than datacenter IPs
proxy = "http://USER:PASS@rotating.quantumproxies.io:8000"
proxies = {"http": proxy, "https": proxy}

headers = {
    "User-Agent": "Mozilla/5.0 (iPhone; CPU iPhone OS 17_0 like Mac OS X) "
                  "AppleWebKit/605.1.15 (KHTML, like Gecko) Mobile/15E148",
    "Accept-Language": "en-US,en;q=0.9",
}

# public profile page — logged-out view, rendered client-side
r = requests.get("https://x.com/nasa", headers=headers,
                 proxies=proxies, timeout=20)
print(r.status_code)

Une requête brute renvoie une coquille JavaScript, pas les tweets — la timeline s'hydrate à partir d'un point de terminaison interne après le chargement de la page. Pour tout ce qui dépasse un profil statique, vous devez soit rendre la page dans un navigateur sans tête via le proxy, soit confier tout le travail à une Scraper API qui rend le JavaScript, fait tourner les IPs résidentielles et renvoie directement le JSON hydraté :

# Scraper API: render the client-side page and return structured content,
# rotation and fingerprinting handled server-side
curl -G "https://api.quantumproxies.io/scraper" \
  --data-urlencode "url=https://x.com/search?q=%23AIagents&f=live" \
  --data-urlencode "render=true" \
  --data-urlencode "country=us" \
  -H "Authorization: Bearer YOUR_API_KEY"
Diagramme de flux de collecte de données publiques Twitter/X : atteindre un point de terminaison public, faire tourner l'IP de sortie via un proxy, parser le JSON, et stocker l'ensemble de données
La boucle de collecte est la même que pour n'importe quel site rendu côté client : IP de confiance, rendu, parsing du JSON hydraté, déduplication.

Comment les coûts se comparent réellement

L'API officielle facture par lecture et limite le volume derrière des niveaux. La collecte du web public via des proxies facture par gigaoctet de trafic — et une charge utile JSON de timeline hydratée est petite. À faible volume, l'API de données tierce est la moins chère en effort ; à grand volume, l'auto-collecte sur un pool résidentiel payant par Go est généralement la moins chère en termes absolus, car vous payez pour les octets, pas pour la licence par tweet. Faites le calcul pour votre propre nombre de lectures avant de vous engager dans l'une ou l'autre option.

Un exemple concret rend le compromis tangible. Un tableau de bord interrogeant 500 comptes toutes les heures représente 12 000 lectures de profil par jour. À la tarification officielle par lecture, cela représente une facture mensuelle lourde sur les niveaux payants ; les mêmes lectures collectées à partir de pages publiques représentent quelques centaines de mégaoctets de trafic proxy, car une charge utile de profil hydratée est petite. L'API de données tierce se situe entre les deux — bon marché par résultat, mais vous payez pour chaque appel individuel. Modélisez d'abord votre véritable nombre de lectures, puis choisissez la voie dont l'économie unitaire l'emporte à ce volume plutôt que de vous rabattre sur celle qui est la plus facile à mettre en place.

Collecter des données publiques de X sur un pool payant par Go

Rester du bon côté de la ligne

Ceci est une information générale, pas un conseil juridique. Collecter des données accessibles au public à des rythmes respectueux est globalement défendable, mais trois règles gardent un projet propre : restez déconnecté pour ne voir que des données publiques, respectez les limites de taux et reculez en cas d'erreurs, et traitez les auteurs de tweets comme des personnes — les publications X contiennent souvent des données personnelles, ce qui entraîne des obligations de type RGPD si vous les stockez. Notre guide sur les proxies pour les plateformes sociales couvre le côté opérationnel, et la collecte de données publiques TikTok applique le même modèle à la vidéo courte.

Questions fréquemment posées

Existe-t-il une alternative gratuite à l'API Twitter/X ?

Il n'existe plus de niveau de lecture officiel gratuit qui soutienne de vrais projets. Le plus proche du "gratuit" est de collecter vous-même les pages publiques, où votre seul coût est la bande passante des proxies — un pool résidentiel payant par Go facture le trafic, pas par tweet. Les APIs de données tierces offrent de petits crédits gratuits pour tester, puis facturent une fraction de cent par résultat.

Puis-je extraire des données X sans compte développeur ?

Oui — les profils publics, les tweets, les recherches et les tendances sont visibles sans authentification, donc les collecter ne nécessite pas de compte développeur ni d'approbation OAuth. Vous avez besoin d'IPs de sortie de confiance et de la capacité de rendre la page côté client, car X hydrate sa timeline à partir d'un point de terminaison interne après le chargement plutôt que de la servir dans le HTML initial.

Pourquoi ai-je besoin de proxies pour les données Twitter/X ?

X est agressif en matière de limitation de taux et de personnalisation géographique, et il se méfie des plages d'IPs de centres de données. Faire tourner des proxies résidentiels ou mobiles se présente comme des connexions de consommateurs ordinaires, répartit les requêtes pour qu'aucune IP unique ne monte en flèche, et vous permet de fixer un pays de sortie lorsque vous avez besoin de tendances ou de résultats de recherche spécifiques à une région — tout cela maintient la collecte stable à volume.

La collecte de tweets publics est-elle légale ?

La collecte de données accessibles au public est généralement considérée comme légitime, mais ce n'est pas une permission générale. Restez déconnecté, évitez le contenu protégé ou privé, respectez les limites de taux, et souvenez-vous que les tweets contiennent fréquemment des données personnelles — les stocker déclenche des obligations de lois sur la vie privée telles que le RGPD. En cas de doute sur une utilisation spécifique, prenez un avis juridique plutôt que de supposer.

Le mur des prix de l'API officielle est réel, mais les données publiques derrière sont encore accessibles. Choisissez l'API tierce pour la rapidité à faible volume, ou collectez-les vous-même sur un pool résidentiel propre lorsque l'échelle ou le contrôle importent — et gardez-le public, mesuré et conscient de la vie privée.

Rendre et collecter des données X avec la Scraper API