私たちはGeonodeというプロキシ販売業者ですが、ここで重要な開示事項があります:**Xは、私たちがお客様にプロキシを販売する正当性を最も説明しにくいプラットフォームです。**その利用規約では、解釈の余地を残さない明確な文言でスクレイピングを禁止しており、robots.txtでは、具体的に名指しされていないすべてのクローラーの使用を禁じており、公式APIの利用が唯一認められた手段となっています。 当社は、これを回避するためのガイドを作成するつもりはありません。もしそのようなガイドを期待されていたのであれば、この記事は期待外れとなるでしょう。 プロキシの使用が適切とされる業務は、実際にはごく限られています――地域ごとの自社広告配信状況の確認、各国から公開されているコンテンツの表示状況の検証、小規模なブランドセーフティのモニタリングなど――これらは以下で適切に解説しています。 それ以外のすべてについては、正直な答えは「APIか、それ以外はない」であり、私たちは金を受け取るよりも、そうはっきり言うことを選びます。
Xの利用規約とrobots.txtは異例なほど明確
多くのプラットフォームは、一般的な表現でスクレイピングを控えるよう促しています。しかし、Xは異なるアプローチをとっています。
利用規約の「許容される利用」の項には、次のように記載されています。「当社は、現在利用可能かつ公開されているインターフェースを通じて以外の手法で本サービスにアクセスすることを禁じます。 例えば、これは、Xの明示的な書面による許可なしに、本サービスをスクレイピングしてはならないことを意味します」。
また、列挙された禁止事項の中には、次のような明確な補足説明が括弧書きで付されています:「(注:当社の事前の書面による同意なしに、いかなる形式であれ、いかなる目的であれ、本サービスをクロールまたはスクレイピングすることは明示的に禁止されています)」。
「いかなる形式であれ、いかなる目的であれ」という表現を注意深く読んでください。この表現は、人々が通常持ち出す主張――公開データは自由に利用してよい、読み取り専用アクセスは別物である、研究目的は例外である――を排除しています。X社は、この除外条項を意図的に広範に定めています。 同条項は、「システムおよび本サービスを回避、操作、または無効化しようとする試み」も対象としています。
x.com/robots.txt に掲載されている「robots.txt(クローラーポリシー)」もこれと一致しています。このポリシーでは、指定されたクローラー(GooglebotとBingbotは同一グループ、facebookexternalhitは独自のグループ)に対して特定の許可を与え、それ以外についてはすべて以下のように規定しています:
User-agent: *
Disallow: /
すべてです。 また、Crawl-delay: 1 があり、AI やソーシャルクローラーに対する一連の明示的なブロックも存在します。Google-Extended、FacebookBot、Discordbot、および Meta の meta-webindexer、meta-externalagent、meta-externalads、meta-externalfetcher はすべて Disallow: * を割り当てられています。
指定された検索クローラーでさえ、興味深い部分へのアクセスは制限されています。/search/realtime、/search/users、/*/followers、/*/following、/*/likes、/*/retweets、/*/media、/*/analytics はすべて許可されていません。つまり、これらはまさにソーシャルデータパイプラインがアクセスしたいと考えるパスそのものです。
ここから2つの明確な結論が導き出されます。第一に、これはグレーゾーンではなく、Xは意図的に曖昧さを排除しています。第二に、robots.txtは強制的な仕組みではなく単なる要請であり、これを無視した場合の実質的な結果は、劇的な事態ではなく、アカウントやアクセス権の制限にとどまります。これはビジネス上のリスクであり、存在しないふりをするのではなく、そのリスクを認識した上で適切に評価すべきです。
公式のルートとその費用
公式に認められている方法は、開発者ポータルを経由したX APIの利用です。
ここでは価格については言及しませんが、その理由を明記しておく価値があります:Xの開発者ポータルではJavaScriptと認証が必要であるため、公式ページから現在の価格を確認することができないからです。 検索結果に表示される数値は第三者によるものであり、情報にばらつきがあります。当ブログでは、未確認の価格情報を事実として繰り返すことはしません。構造的な観点からお伝えできるのは、価格モデルが再構築されたということです。多くの開発者が記憶しているような固定の月額料金体系から、アプリケーションごとのエンタープライズアクセスに基づく従量課金制へと移行しました。 開発者ポータルを直接確認し、Xから最新の数値を入手してください。
確認可能なのは開発者契約およびポリシーであり、そこには「APIへのアクセス=データの自由」と想定している人々を驚かせるような制約が含まれています:
再配布には上限があります。 開発者は、「非自動化された手段(例:スプレッドシートやPDFのダウンロード)を通じて行われる場合、サービスを利用する各ユーザーに対し、1日あたり最大500件の公開投稿オブジェクトおよび/またはユーザーオブジェクトを提供できる」が、それ以上の量についてはXからの書面による許可が必要となる。
学術目的での共有は限定されています。 学術研究者は、「学術機関を代表して非営利の研究を行う目的のみに限り、投稿IDおよび/またはユーザーIDを配布することが許可されています」が、これにはXからの書面による承認が必要です。
書き込み操作には独自のルールがあります。 書き込み操作を行うサービスは「自動化ルール」に従わなければなりません。具体的には、自動返信やダイレクトメッセージの送信前に明示的な同意を得る、オプトアウトの要求に直ちに応じる、そして「一括フォローを含む、大量・攻撃的・スパム的な行為」や「複数のアカウントに同一または実質的に類似したコンテンツを投稿する行為」を一切行わないことが求められます。
この最後の要件こそが、プロキシ需要の大部分にとって重要な点です。プラットフォームは、開発者利用規約において平易な言葉で、ユーザーがプロキシを購入して実現しようとするマルチアカウントでの投稿パターンを明確に禁止しています。
したがって、公正な比較は「API対低価格のプロキシ」ではありません。「文書化された制限のある公認のアクセス」対「同じ制限に加え、規制違反のリスクを伴う非公認のアクセス」なのです。コストは要因の一つですが、唯一の要因ではありません。
プロキシに残された正当な仕事
検索ボリュームが示唆するよりも範囲は狭いですが、確実に存在します。
自社広告の地理的検証。 特定の国での広告枠を購入した場合、配信を確認するには、その国にいるように見せかける必要があります。また、サンパウロのユーザーが実際に何を見ているかを教えてくれるAPIは存在しません。 これは自社の広告費の確認であり、大量のデータを自動収集するものではなく、このリストの中で最もクリーンなケースです。
ブランドセーフティおよび隣接コンテンツのチェック。 さまざまな地域で、自社のコンテンツの隣に何が表示されているかを確認することです。理由も同じです:処理量は少なく、地域に依存し、自社のブランドに関わる問題だからです。
地域ごとのコンテンツの閲覧可能性。 特定の法域において、コンテンツが表示されるか、制限されるか、あるいは非表示にされるかを確認します。Xは透明性レポートの一部としてこの情報を公開していますが、個々のコンテンツごとの確認には地域ごとの視点が必要です。
Xをブロックしているネットワークからのアクセス。 企業やキャンパスのファイアウォールによってサイトがフィルタリングされるのはネットワーク上の問題であり、Xの問題ではありません。また、プラットフォーム側において利用規約上の問題を引き起こすこともありません。
これらに共通する点に注目してください。処理量が少なく、地理的要因が焦点であり、一括収集が行われていないことです。これらはプロキシに関連する問題です。一括データ収集がこのリストに含まれていないのは、上記の条件により、それが私たちが支援する範囲外となるためです。
業務ごとに適したプロキシの種類
| 業務 | 種類 | 理由 |
|---|---|---|
| 広告配信検証 | 一般家庭用 | その国の実際の視聴者に見えなければならない |
| ブランドセーフティの隣接チェック | 一般家庭用 | 同上 — フィードは視聴者ごとに異なる |
| 地域別利用可能状況の確認 | 一般家庭用またはモバイル | アプリ固有の挙動が重要な場合はモバイル |
| ネットワークフィルタの回避 | データセンター | 最も安価で、プラットフォーム側の制約がない |
このリストで「一般家庭用」が主流となっているのは、ここに挙げた正当な業務のすべてが、特定の場所にいる「普通の視聴者」と見なされることに依存しているためです。ブラジルのデータセンターのIPアドレスはブラジルにあるものの、ブラジルの一般消費者ではありません。フィードの構成において、この違いこそがまさに重要なポイントです。
タイプに関わらず、2つの技術的な現実があります。
Xはクライアント側でのレンダリングが中心です。 初期のHTMLレスポンスは、ほとんどがシェルに過ぎません。何を行うにしても、構造化されたデータを返すブラウザやインターフェースが必要となります。正規の経路では、それがAPIとなります。
ログアウト時とログイン時の表示には大きな違いがあります。 プラットフォームの大部分はアクセス制限がかかっています。ログアウト状態で実行される地理的チェックは、視聴者が実際に目にする内容とは異なるものを測定しており、その整合を取ることは想像以上に困難です。
プロバイダー選びのポイント
ブランドランキングよりも長く通用する選定基準。
契約前に確認できるジオロケーション。 複数のジオロケーションデータベースに対して実際のトライアルでテストを行い、広告検証の場合は、プラットフォームが実際に配信している内容と照らし合わせてください。これが唯一重要なテストです。データベース間の情報は一致しないことがありますが、購入するのはプラットフォーム側の表示内容です。
キャンペーンが都市単位の場合は、都市単位のターゲティング機能。 国単位のターゲティングは標準です。それより細かい単位はプロバイダーや地域によって大きく異なり、カバレッジマップだけでは証拠にはなりません。
セッション制御。 一連のリクエストを通じて単一の出口アドレスを維持することは、マルチステップの処理において重要です。リクエストごとのローテーションは、ある用途では適切ですが、他の用途ではむしろ有害となる場合があります。
ワークロードに合わせた料金モデル。 トラフィック単位の課金とIP単位の課金は、利用形態によって適したものが異なります。広告検証は通常、多くのロケーションで少量ずつ行われるため、トラフィック単位の課金が適しています。少数の固定ロケーションからの継続的なモニタリングには、IP単位の課金が適しています。表示されている基本料金は比較対象にならないため、比較を行う前に自社の利用形態を明確に把握してください。
住宅用IPプールの誠実な調達。 ネットワークがどのように構築されているか、またトラフィックを転送する人々が同意しているかどうかを尋ねてください。「回避策」という答えが返ってくるかもしれません。これはまず倫理的な問題であり、次に安定性の問題です。さらに、2026年1月にGoogleの脅威インテリジェンスチームが、相互に連携した再販業者ネットワークに対して発表した執行措置を踏まえると、法的な問題でもあります。
何かを証明できるだけの十分なトラフィック量を伴う試験運用。 100件程度のリクエストでは不十分です。実際のターゲット地域全体において、数日にわたる成功率を確認できるだけの十分な量が必要です。
当社の料金体系と、その不適切な点
2026年9月時点で確認した料金ページより — 購入前にご確認ください。
一般家庭向けトラフィックは1GBあたり0.79ドルからで、100GBを超えると0.50ドル/GB、1TBを超えると0.27ドル/GBに下がります。新規アカウントには1TBの一般家庭向けトラフィックが無料で付与されます。データセンター向けトラフィックは1GBあたり0.14ドルからで、IPアドレス単位ではなくトラフィック量に応じて課金されます。 ISPアドレスは1IPあたり1.25ドルで、月額1,800ドルの無制限一般向けプランも用意されています。
以下の点にご注意ください:
トラフィック量が少ない広告検証の場合、購入する価値がない可能性があります。 週に1回、4カ国での広告配信状況を確認する程度であれば、トラフィック量はごくわずかです。 無料枠で十分カバーできるため、費用をかける計画は一切立てるべきではありません。むしろ、トライアル期間を利用して、その後解約していただくことをお勧めします。
少数のロケーションからの集中的な大容量モニタリングについては、他社の方が安価です。 当社の一般家庭向け料金体系はギガバイト単位です。 少数のアドレスを通じて大量のトラフィックを送信する場合は、IP単位の料金体系が適しており、それを提供している業者から購入すべきです。
季節的なトラフィックの急増は、当社では損失につながります。 トラフィックは月をまたいで繰り越されません。四半期に2週間だけトラフィックが集中するキャンペーン作業の場合、消費した容量分の費用を支払うことになります。 トラフィックに有効期限がないプロバイダーを探してください。
ブラウザベースの作業は帯域幅を急速に消費します。 Xではレンダリングが必要であり、レンダリングにはすべてのアセットの取得が伴い、動画アセットは容量が大きいです。単純なHTTP見積もりの数倍の予算を確保し、必要のない画像やメディアはブラウザレベルでブロックするようにしてください。
設定に関する実用的な注意事項
ロケールと地理情報を一致させてください。 en-US という言語ヘッダーを持ち、ヨーロッパのタイムゾーンが設定された日本のアクセス元アドレスという組み合わせは、実際の閲覧者ではあり得ないものです。また、フィードの構成は、アドレスとは無関係に言語設定に応じて行われます。
IP検索ではなく、コンテンツで検証する。 地理的な分析を行う場合、地域ごとに異なるコンテンツが実際に異なっているかどうかが検証基準となります。ブラジルのエグジットで、あなたのデスクと同じ傾向が見られる場合、どのような検索サービスが何を報告しようとも、ジオロケーションは正しく機能していません。
複数段階のチェックにわたりセッションを維持する。 シーケンスの途中でプロキシを切り替えると、履歴に一貫性が失われます。
集計値ではなく、ロケーションごとに計測してください。 8カ国で機能し、1カ国で失敗するプロキシプールは、平均化された指標では正常と見なされてしまいます。これは、プロキシのテストが重要な理由で述べた「サイレント・フェイル」のパターンです。
Crawl-delay: 1を遵守する。 Xがこれを公開しています。上記の限定的なタスクであっても、リクエストのペースを少なくともその速度以下に抑えることは、礼儀正しいだけでなく、賢明な対応でもあります。
Xプロキシを絶対に購入すべきでない場合
ここでは、意図的に最も長いセクションとしています。
大量のデータが必要な場合。 利用規約では、書面による同意なしに「いかなる形式であれ、いかなる目的であれ、本サービスをクローリングまたはスクレイピングすること」が禁止されています。APIの利用が正しい手段です。もしAPIのコストや制限がプロジェクトに適さない場合、正直な結論として、別のアドレスが必要なのではなく、プロジェクトそのものの見直しが必要だということです。
多数のアカウントを運用したい場合。 Xの開発者利用規約では、「一括フォローを含む、大量、攻撃的、またはスパム的な行為」や、「複数のアカウントに同一または実質的に類似したコンテンツを投稿すること」が明確に禁止されています。これはこの検索キーワードに対する需要の最大の要因ですが、当社はそれに対応するベンダーではありません。
利用量がごくわずかな場合。 数カ国からたまに数件の確認を行う程度であれば、プランは必要ありません。無料枠を利用して、それ以上は行わないでください。
APIの利用条件を満たしている場合。 制限が明文化された正規のアクセスは、同じ制限に加えリスクを伴う非正規のアクセスよりも、かなり幅広い価格帯において優れています。
まだ何も構築していない場合。 活用するパイプラインのない帯域幅は、何の役にも立たないサブスクリプションに過ぎません。
研究者である場合。 Xの開発者利用規約には、書面による承認を条件として、非営利の機関研究のためにPost IDやUser IDを配布する学術研究者向けの特別な規定があります。そのルートを利用してください。そのルートは存在しており、代わりにスクレイパーを構築すると、そのルートによって得られる地位を失うことになります。
よくある質問
X(Twitter)のスクレイピングは許可されていますか?
いいえ。利用規約には、「Xの明示的な書面による許可なしに本サービスをスクレイピングしてはならない」と記載されており、別の箇所では「当社の事前の書面による同意なしに、いかなる形式であれ、いかなる目的であれ、本サービスをクローリングまたはスクレイピングすることは明示的に禁止されている」と明記されています。robots.txtでは、具体的に名指しされていないすべてのクローラーが禁止されています。この規定に曖昧さは一切ありません。
X APIの利用にはプロキシが必要ですか?
いいえ。APIへのアクセスは、通常の接続環境下で認証情報を使用して行われ、独自のレート制限が設けられています。プロキシを使用しても、このレート制限は変わりません。APIの制限に抵触している場合は、解決策はIPアドレスを変更することではなく、アクセス階層を変更することです。
Xのrobots.txtでは何が許可されていますか?
Googlebot、Bingbot、facebookexternalhitなどの指定されたクローラーには特定のアクセス許可が与えられていますが、検索、フォロワー、フォロー中、いいね、リツイート、メディア、アナリティクスといった重要なパスは、これらのクローラーであってもアクセスが禁止されています。それ以外については、User-agent: * / Disallow: /というルールが適用されます。また、いくつかのAIクローラーやソーシャルクローラーを明示的にブロックし、Crawl-delay: 1を設定しています。
Xにはどのプロキシが最適ですか?
地理に依存する正当なタスクには、レジデンシャルプロキシが適しています。こうしたタスクの目的は、その地域の一般ユーザーが何を見ているかを確認することだからです。プラットフォーム自体が障害となっていない場合、ネットワークフィルターを回避するにはデータセンタープロキシでも問題なく、費用も安くなります。
プロキシを使用して複数のXアカウントを管理することはできますか?
これについてはサポートいたしません。Xの開発者利用規約では、一括操作や複数のアカウントにわたる実質的に類似したコンテンツの投稿が禁止されており、違反が確認された場合、アカウントが凍結されます。正当な目的での承認済みマルチアカウント管理は、X独自のツールを通じて行われます。
X APIの利用料金はいくらですか?
Xは、多くの開発者が記憶しているような固定料金体系から価格体系を改定しました。また、開発者ポータルには認証とJavaScriptが必要であるため、公式ソースから現在の料金を確認することはできません。検索結果に表示されるサードパーティの情報は互いに食い違っています。開発者ポータルを直接ご確認ください。
学術研究のためにXからデータをスクレイピングすることはできますか?
許可なしではできません。利用規約には「いかなる目的でも」と明記されています。ただし、Xの開発者契約には、学術研究者が書面による承認を得た上で、非営利の機関研究のために投稿IDやユーザーIDを配布することに関する具体的な規定があります。これが公認された方法であり、検討する価値があります。
住宅用プロキシを使えば、Xに検出されずに済みますか?
いいえ、そう主張する人は誇大広告をしています。IPアドレスの種類は多くの判断材料の一つに過ぎず、アカウントの履歴、デバイスの特性、行動パターン、アクセスタイミングなどがすべて判断材料となります。住宅用IPアドレスはデータセンター用IPアドレスに比べて、不審なフラグが立つ可能性は低くなります。これが正直なところですが、検出されないということとは異なります。
まとめ
当初はプロキシの購入ガイドを書くつもりでしたが、利用規約のせいで、まったく別の記事になってしまいました。これが正直な結果であり、これを隠すことこそが不誠実だったでしょう。
Xは、書面による同意なしに「いかなる形式、いかなる目的であれ」クローリングやスクレイピングを禁止しており、robots.txt内の名前のないクローラーをすべて拒否し、開発者規約において、この検索に対する需要の大部分を占めるマルチアカウントの利用パターンを明確に禁じています。これに対し、APIは公認のルートであり、その制約は発見されるものではなく、文書化されています。
プロキシの利用目的として残されているのは、正当ではあるものの限定的なものです。具体的には、自社の広告が支払った対象地域に確実に届いているかを確認すること、市場ごとのブランド隣接性をチェックすること、地域ごとの提供状況を確認すること、そしてサイトをフィルタリングするネットワークを迂回することです。 こうした用途においては、地理位置情報が検証可能な住宅用IPアドレスの購入が適切であり、セッション制御は単純な速度よりも重要であり、また扱うトラフィック量は十分に少ないため、無料トライアルだけで事足りる場合もあります。
それ以上の規模の場合は、APIが答えとなります。もしAPIがプロジェクトに適さない場合、それは回避すべき問題というよりは、プロジェクトに関する情報として捉えるべきでしょう。
