Nous sommes Geonode et nous vendons des proxys ; voici donc la mise en garde qui s'impose : X est la plateforme pour laquelle nous avons le moins de raisons de vous vendre nos services. Ses conditions d'utilisation interdisent le scraping en des termes qui ne laissent aucune marge d'interprétation, sa page robots.txt interdit tout robot d'indexation qui n'y est pas expressément mentionné, et l'API officielle est la seule voie autorisée. Nous n’allons pas rédiger de guide pour contourner ces restrictions, et si vous espériez en trouver un, cet article va vous décevoir. Il existe un ensemble bien précis et restreint de tâches pour lesquelles l’utilisation de proxys est appropriée — vérifier la diffusion de vos propres publicités par région, vérifier l’apparence du contenu visible publiquement depuis différents pays, surveiller la sécurité de la marque à un volume modeste — et celles-ci sont traitées en détail ci-dessous. Pour tout le reste, la réponse honnête est : l’API ou rien, et nous préférons le dire clairement plutôt que d’accepter de l’argent.
Les conditions d'utilisation de X et le fichier robots.txt sont d'une clarté inhabituelle
La plupart des plateformes découragent le scraping en termes généraux. X adopte une approche différente.
Les Conditions d'utilisation stipulent, dans la section relative à l'utilisation acceptable : « Vous ne devez pas accéder aux Services par d'autres moyens que les interfaces actuellement disponibles et publiées que nous mettons à votre disposition. Par exemple, cela signifie que vous ne pouvez pas pratiquer le scraping des Services sans l’autorisation écrite expresse de X ».
Et parmi les interdictions énumérées, une précision explicite entre parenthèses : « (REMARQUE : l’exploration ou le scraping des Services sous quelque forme que ce soit, à quelque fin que ce soit, sans notre consentement écrit préalable, est expressément interdit) ».
Lisez attentivement « sous quelque forme que ce soit, à quelque fin que ce soit ». Cette formulation coupe court aux arguments habituellement avancés — selon lesquels les données publiques sont librement exploitables, l’accès en lecture seule est différent, ou la recherche fait l’objet d’une exemption. X a rédigé cette exclusion de manière large et délibérée. Cette même clause couvre également les tentatives visant à « contourner, manipuler ou désactiver les systèmes et les Services ».
L’robots.txt, disponible à l’adresse x.com/robots.txt, va dans le même sens. Elle accorde des autorisations spécifiques à certains robots d’indexation nommément désignés — Googlebot et Bingbot font partie d’un même groupe, tandis que facebookexternalhit dispose de sa propre autorisation — puis, pour tout le reste :
User-agent: *
Disallow: /
Tout. Il existe également une liste «Crawl-delay: 1» et un ensemble de blocages explicites concernant les robots d’indexation basés sur l’IA et les réseaux sociaux : Google-Extended, FacebookBot, Discordbot, ainsi que ceux de Meta (meta-webindexer, meta-externalagent, meta-externalads et meta-externalfetcher) reçoivent tous Disallow: *.
Même les robots d’indexation de recherche nommément désignés se voient interdire l’accès aux parties intéressantes. /search/realtime, /search/users, /*/followers, /*/following, /*/likes, /*/retweets, /*/media et /*/analytics sont tous interdits — c’est-à-dire précisément les chemins qu’un pipeline de données sociales souhaiterait emprunter.
Deux conclusions s’imposent. Premièrement, il ne s’agit pas d’une zone grise ; X a délibérément levé toute ambiguïté. Deuxièmement, robots.txt est une demande et non un mécanisme coercitif, et le fait de l’ignorer entraîne en pratique une restriction d’accès et de compte, sans conséquence plus grave. Il s’agit là d’un risque commercial, et vous devriez en évaluer le coût en toute connaissance de cause plutôt que de faire comme s’il n’existait pas.
La procédure officielle et ses coûts
La procédure officielle consiste à passer par l’API X via le portail des développeurs.
Nous n’allons pas mentionner de tarifs ici, et la raison mérite d’être précisée : le portail des développeurs de X nécessite l’utilisation de JavaScript et une authentification ; nous ne pouvons donc pas vérifier les tarifs actuels à partir d’une page officielle. Les chiffres qui circulent dans les résultats de recherche proviennent de tiers, ils divergent les uns des autres, et ce blog ne présente pas des tarifs non vérifiés comme des faits avérés. Ce que nous pouvons vous dire d’un point de vue structurel, c’est que le modèle tarifaire a été réorganisé : il s’est éloigné des forfaits mensuels fixes dont se souviennent de nombreux développeurs pour s’orienter vers une facturation à l’utilisation, avec un accès entreprise par application. Consultez directement le portail des développeurs et obtenez les chiffres actuels auprès de X.
Ce qui est vérifiable, c’est le Contrat et la Politique des développeurs, qui contient des contraintes surprenantes pour ceux qui pensent que l’accès à l’API implique une liberté totale en matière de données :
La redistribution est plafonnée. Les développeurs peuvent fournir « jusqu’à 500 objets “Posts” et/ou objets “User” publics à chaque personne qui utilise votre service quotidiennement, si cela est effectué par des moyens non automatisés (par exemple, téléchargement de feuilles de calcul ou de PDF) », les volumes plus importants nécessitant une autorisation écrite de X.
Le partage à des fins universitaires est restreint. Les chercheurs universitaires « sont autorisés à diffuser des identifiants de publication et/ou d’utilisateur uniquement à des fins de recherche non commerciale pour le compte d’un établissement universitaire », sous réserve de l’accord écrit de X.
Les actions d’écriture sont soumises à des règles spécifiques. Les services effectuant des actions d’écriture « doivent respecter les règles d’automatisation » : consentement explicite avant toute réponse automatisée ou tout message privé, respect immédiat des demandes de désabonnement, et interdiction absolue d’effectuer « des actions massives, agressives ou de type spam, y compris le suivi massif » ou de publier « du contenu identique ou substantiellement similaire sur plusieurs comptes ».
C’est cette dernière série de règles qui importe pour une grande partie de la demande de proxys. La plateforme a expressément interdit, dans ses conditions d’utilisation destinées aux développeurs et en langage clair, les pratiques de publication via plusieurs comptes que les utilisateurs achètent des proxys pour mettre en œuvre.
La comparaison honnête n’est donc pas « API contre proxys à moindre coût ». Il s’agit plutôt d’un « accès autorisé avec des limites documentées » contre un « accès non autorisé avec les mêmes limites, mais comportant un risque de sanctions ». Le coût est un facteur. Ce n’est pas le seul.
Les missions légitimes qui restent aux proxys
Un champ d’action plus restreint que ne le laisse supposer le volume de recherche, mais bien réel.
Vérification géographique de vos propres publicités. Vous avez acheté des emplacements publicitaires dans des pays spécifiques. Pour confirmer la diffusion, il faut donner l’impression d’être présent dans ces pays, et aucune API ne vous indique ce qu’un utilisateur à São Paulo voit réellement. Il s’agit de vérifier vos propres dépenses ; cela n’implique pas de collecte automatisée à grande échelle, et c’est le cas le plus « propre » de la liste.
Contrôles de sécurité de la marque et de contiguïté. Vérifier ce qui apparaît à côté de votre contenu dans différentes régions. Même raisonnement : faible volume, dépendant de la géographie, concerne votre propre marque.
Disponibilité régionale du contenu. Vérifier si un contenu est visible, restreint ou bloqué dans certaines juridictions. X publie une partie de ces informations dans ses rapports de transparence, mais les vérifications au cas par cas nécessitent une perspective régionale.
Accès à X depuis un réseau qui le bloque. Un pare-feu d’entreprise ou de campus filtrant le site est un problème de réseau, pas un problème lié à X, et cela ne soulève aucune question relative aux conditions d’utilisation du côté de la plateforme.
Remarquez ce que ces points ont en commun : un faible volume, une dimension géographique et l’absence de collecte massive de données. Il s’agit de problèmes liés à l’utilisation de proxys. La collecte massive de données ne figure pas sur la liste, car les critères ci-dessus la placent en dehors de ce pour quoi nous pouvons apporter notre aide.
Quel type de proxy pour quelle tâche ?
| Tâche | Type | Pourquoi |
|---|---|---|
| Vérification de la diffusion des publicités | Résidentiel | Doit ressembler à un véritable internaute de ce pays |
| Contrôles de proximité pour la sécurité des marques | Résidentiel | Idem — le flux varie selon l’internaute |
| Contrôles de disponibilité régionale | Résidentiel ou mobile | Mobile si le comportement spécifique à l’application est important |
| Contourner un filtre réseau | Centre de données | Le moins cher, et aucune contrainte côté plateforme |
Les adresses résidentielles dominent cette liste car chaque tâche légitime ici dépend de la nécessité d’être perçu comme un internaute lambda dans un lieu spécifique. Une adresse de centre de données au Brésil se trouve au Brésil, mais ne correspond pas à un consommateur brésilien, et pour la composition du flux, cette différence est justement l’essentiel.
Deux réalités techniques, quel que soit le type.
X est en grande partie rendu côté client. La réponse HTML initiale n’est qu’une coquille vide. Tout ce que vous ferez nécessitera un navigateur ou une interface renvoyant des données structurées — ce qui, pour la voie autorisée, correspond à l’API.
Les affichages en mode « déconnecté » et « connecté » diffèrent énormément. Une grande partie de la plateforme est soumise à des restrictions d’accès. Une vérification géographique effectuée en mode « déconnecté » mesure quelque chose de différent de ce que voit votre audience, et concilier ces deux aspects est plus difficile qu’il n’y paraît.
Ce qu’il faut rechercher chez un fournisseur
Des critères qui perdurent bien au-delà de n’importe quel classement de marques.
Une géolocalisation que vous pouvez vérifier avant de vous engager. Testez avec un véritable essai sur plusieurs bases de données de géolocalisation et, dans le cas de la vérification publicitaire, par rapport à ce que la plateforme vous propose réellement, car c’est le seul test qui compte. Les bases de données ne sont pas toujours cohérentes ; c’est la vision de la plateforme qui fait foi, puisque c’est celle-là que vous achetez.
Ciblage au niveau de la ville si vos campagnes sont ciblées à ce niveau. La granularité au niveau du pays est la norme. Toute granularité plus fine varie considérablement d’un fournisseur à l’autre et d’un emplacement à l’autre, et une carte de couverture ne constitue pas une preuve.
Contrôle des sessions. Le fait de conserver une seule adresse de sortie tout au long d’une séquence de requêtes est essentiel pour tout processus en plusieurs étapes. La rotation par requête est adaptée à certaines tâches, mais peut s’avérer nuisible pour d’autres.
Un modèle de tarification adapté à votre charge de travail. La tarification au trafic et la tarification par adresse IP conviennent à différents types d’utilisation. La vérification publicitaire se caractérise généralement par de faibles volumes sur de nombreux emplacements, ce qui favorise la tarification au trafic. Une surveillance continue à partir de quelques emplacements fixes favorise la tarification par adresse IP. Déterminez votre profil d’utilisation avant de comparer les tarifs annoncés, car ceux-ci ne sont pas comparables.
Provenance transparente du pool résidentiel. Demandez comment le réseau est constitué et si les personnes acheminant votre trafic ont donné leur consentement. Une réponse évasive est un signe d’évasion. Il s’agit d’abord d’une question d’éthique, puis de stabilité — et, suite à la mesure coercitive annoncée en janvier 2026 par l’équipe de veille sur les menaces de Google à l’encontre d’un réseau de revendeurs interconnectés, d’une question juridique également.
Un test avec un volume suffisant pour apporter des preuves. Pas une centaine de requêtes. Suffisamment pour observer les taux de réussite sur l’ensemble de vos emplacements cibles réels sur plusieurs jours.
Nos tarifs et leurs lacunes
D'après notre page dédiée aux tarifs, consultée en septembre 2026 — à vérifier avant tout achat.
Le trafic résidentiel commence à 0,79 $/Go, puis passe à 0,50 $/Go au-delà de 100 Go et à 0,27 $/Go au-delà de 1 To. Les nouveaux comptes bénéficient de 1 To de trafic résidentiel gratuit. Le trafic de centre de données commence à 0,14 $/Go, facturé au trafic plutôt qu’à l’adresse IP. Les adresses FAI coûtent 1,25 $ par adresse IP, et il existe une formule résidentielle illimitée à 1 800 $ par mois.
En quoi cela ne vous convient pas :
La vérification publicitaire à faible volume ne justifie peut-être pas d’achat. Si vous vérifiez la diffusion publicitaire dans quatre pays une fois par semaine, cela représente un volume de trafic négligeable. Le niveau gratuit couvre ce besoin et vous ne devriez pas prévoir de dépenses du tout. Nous préférerions que vous utilisiez la période d’essai, puis que vous vous désinscriviez.
Une surveillance concentrée et à fort volume à partir de quelques emplacements est moins chère ailleurs. Notre tarification résidentielle est au gigaoctet. Si vous acheminez beaucoup de trafic via une poignée d’adresses, la tarification par IP est le modèle qui vous convient et vous devriez vous tourner vers un fournisseur qui la propose.
Une utilisation saisonnière en pics d’activité vous fait perdre de l’argent chez nous. Le trafic n’est pas reporté d’un mois sur l’autre. Une campagne intensive pendant deux semaines par trimestre vous fera payer la capacité qu’elle consomme. Recherchez un fournisseur dont le trafic n’expire pas.
Les applications basées sur un navigateur consomment rapidement de la bande passante. X nécessite un rendu, ce rendu récupère toutes les ressources, et les ressources vidéo sont volumineuses. Prévoyez un budget plusieurs fois supérieur à ce qu’indique une estimation HTTP brute, et bloquez les images et les médias au niveau du navigateur lorsque votre application n’en a pas besoin.
Remarques pratiques de configuration
Assurez-vous que les paramètres régionaux et géographiques correspondent. Une adresse de sortie japonaise avec des en-têtes de langue en-US et un fuseau horaire européen est une combinaison qu’aucun véritable utilisateur ne produit, et la composition du flux réagit aux paramètres linguistiques indépendamment de l’adresse.
Vérifiez en fonction du contenu, et non par recherche d’adresse IP. Pour les travaux géographiques, le test consiste à vérifier si le contenu propre à chaque région diffère réellement. Si une sortie brésilienne vous montre les mêmes tendances que votre bureau, la géolocalisation ne fonctionne pas, quels que soient les résultats fournis par un service de recherche.
Conservez les sessions tout au long des vérifications en plusieurs étapes. Une rotation en cours de séquence génère un historique incohérent.
Effectuez les mesures par emplacement, et non de manière agrégée. Un pool qui fonctionne dans huit pays mais échoue dans un seul apparaîtra comme opérationnel dans une métrique moyennée. Il s’agit du modèle de « défaillance silencieuse » dont nous avons parlé dans l’article « Pourquoi il est important de tester les proxys ».
Respectez l’Crawl-delay: 1. X la publie. Même pour les tâches restreintes mentionnées ci-dessus, espacer vos requêtes au moins à ce rythme est à la fois courtois et raisonnable.
Quand il ne faut absolument pas acheter de proxys X
C'est la section la plus longue ici, et ce n'est pas un hasard.
Lorsque vous souhaitez obtenir des données en masse. Les conditions d’utilisation interdisent « l’exploration ou le scraping des Services sous quelque forme que ce soit, à quelque fin que ce soit » sans autorisation écrite. L’API est la solution à privilégier. Si le coût ou les limites de l’API ne conviennent pas à votre projet, la conclusion logique est que le projet doit être repensé, et non que vous ayez besoin d’une autre adresse.
Lorsque vous souhaitez gérer de nombreux comptes. Les conditions d’utilisation pour les développeurs de X interdisent expressément « les actions massives, agressives ou de type spam, y compris le fait de suivre en masse » et la publication de « contenu identique ou substantiellement similaire sur plusieurs comptes ». Il s’agit de la principale source de demande pour ce terme de recherche, et nous ne sommes pas le fournisseur qu’il vous faut dans ce cas.
Lorsque votre volume est minime. Vérifier occasionnellement quelques éléments depuis quelques pays ne nécessite pas de forfait. Utilisez l’offre gratuite et n’allez pas plus loin.
Lorsque l’API répond à vos besoins. Un accès autorisé avec des limites documentées vaut mieux qu’un accès non autorisé avec les mêmes limites mais comportant un risque supplémentaire, et ce dans une fourchette de prix assez large.
Lorsque vous n’avez encore rien développé. Une bande passante sans pipeline pour l’exploiter revient à souscrire à rien.
Lorsque vous êtes chercheur. Les conditions d’utilisation pour les développeurs de X comportent des dispositions spécifiques pour les chercheurs universitaires qui diffusent des identifiants de publication (Post IDs) et des identifiants d’utilisateur (User IDs) à des fins de recherche institutionnelle non commerciale, sous réserve d’une autorisation écrite. Suivez cette voie. Elle existe, et créer un scraper vous ferait perdre le statut que cette voie vous confère.
Questions fréquentes
Le « scraping » de X (Twitter) est-il autorisé ?
Non. Les Conditions d'utilisation stipulent que vous « ne pouvez pas effectuer de scraping sur les Services sans l'autorisation écrite expresse de X », et précisent par ailleurs que « le crawling ou le scraping des Services sous quelque forme que ce soit, à quelque fin que ce soit, sans notre consentement écrit préalable, est expressément interdit ». La politique relative aux robots (robots.txt) interdit tout robot d'indexation non spécifiquement mentionné. Ce n'est pas ambigu.
Ai-je besoin de proxys pour l'API de X ?
Non. L'accès à l'API se fait à l'aide d'identifiants via des connexions classiques et est soumis à ses propres limites de débit, que les proxys ne modifient pas. Si vous atteignez les limites de l'API, la solution consiste à passer à un niveau d'accès supérieur, et non à changer d'adresse IP.
Qu’autorise le fichier robots.txt de X ?
Les robots d’indexation nommés, tels que Googlebot, Bingbot et facebookexternalhit, bénéficient de droits spécifiques, mais les chemins d’accès sensibles — recherche, abonnés, abonnements, mentions « J’aime », retweets, médias, analyses — leur sont interdits, même à eux. Pour tout le reste, la règle est « User-agent: * / Disallow: / ». Le fichier bloque également explicitement plusieurs robots d’indexation basés sur l’IA et les réseaux sociaux, et définit « Crawl-delay: 1 ».
Quels sont les proxys les plus adaptés à X ?
Les proxys résidentiels, pour les tâches légitimes dépendantes de la localisation géographique, car le but de ces tâches est de voir ce que voit un utilisateur lambda dans un lieu donné. Les proxys de centre de données conviennent et sont moins chers pour contourner un filtre réseau, lorsque la plateforme n’est pas l’obstacle.
Puis-je utiliser des proxys pour gérer plusieurs comptes X ?
Nous ne vous aiderons pas dans cette démarche. Les conditions d’utilisation pour les développeurs de X interdisent les actions en masse et la publication de contenu substantiellement similaire sur plusieurs comptes ; toute infraction entraîne la suspension des comptes concernés. La gestion autorisée de plusieurs comptes à des fins légitimes s’effectue via les outils fournis par X.
Combien coûte l’API X ?
X a réorganisé sa tarification, s’éloignant des paliers fixes dont se souviennent de nombreux développeurs, et son portail développeurs nécessite une authentification et l’utilisation de JavaScript ; nous ne pouvons donc pas vérifier les chiffres actuels auprès d’une source officielle. Les chiffres fournis par des tiers dans les résultats de recherche divergent les uns des autres. Consultez directement le portail développeurs.
Puis-je effectuer du scraping sur X à des fins de recherche universitaire ?
Pas sans autorisation — les conditions générales stipulent « à quelque fin que ce soit ». Le contrat de développeur de X comporte toutefois des dispositions spécifiques permettant aux chercheurs universitaires de diffuser des identifiants de publication (Post ID) et d’utilisateur (User ID) dans le cadre de recherches institutionnelles non commerciales, moyennant une autorisation écrite. C’est la voie autorisée et elle mérite d’être explorée.
Un proxy résidentiel empêchera-t-il X de me détecter ?
Non, et quiconque prétend le contraire exagère. Le type d’adresse n’est qu’un indicateur parmi tant d’autres ; l’historique du compte, les caractéristiques de l’appareil, les schémas comportementaux et le moment de la connexion sont autant de facteurs qui entrent en ligne de compte. Les adresses résidentielles suscitent moins de soupçons que celles des centres de données. C’est là une affirmation honnête, qui ne signifie pas pour autant que l’on soit indétectable.
Conclusion
Nous avions pour objectif de rédiger un guide d’achat de proxys, mais les conditions générales d’utilisation ont donné lieu à un article différent. C’est là la vérité, et la passer sous silence aurait été malhonnête.
X interdit le crawling et le scraping « sous quelque forme que ce soit et à quelque fin que ce soit » sans consentement écrit, bloque tous les crawlers non identifiés sur robots.txt et interdit expressément, dans ses conditions d’utilisation destinées aux développeurs, les pratiques de création de comptes multiples qui sont à l’origine de la majeure partie de la demande pour ce type de recherche. En revanche, l’API constitue la voie autorisée, et ses contraintes sont documentées plutôt que découvertes a posteriori.
Ce qui reste aux proxys est légitime mais limité : vérifier que votre propre publicité atteint les régions pour lesquelles vous avez payé, contrôler la proximité des marques par marché, confirmer la disponibilité régionale et contourner un réseau qui filtre le site. Dans ces cas-là, les adresses résidentielles avec géolocalisation vérifiable constituent le bon choix ; le contrôle des sessions prime sur la vitesse brute, et les volumes en jeu sont suffisamment faibles pour qu’un essai gratuit puisse suffire.
Pour tout projet de plus grande envergure, la solution réside dans l’API — et si l’API ne correspond pas au projet, il s’agit là d’une information sur le projet lui-même plutôt que d’un problème à contourner.
