Geonode logo
Maricor Bunal

Maricor Bunal

Aktualisiert: 7. Oktober 2026

Veröffentlicht: 5. Mai 2023

Die Wahl des besten User-Agents für das Web-Scraping

Optimieren Sie das Web-Scraping mit dem richtigen User-Agent. Erfahren Sie mehr über User-Agents von Browsern und Bots und deren Verwendung. Probieren Sie Geonode als leistungsstarkes Scraping-Tool aus.

In der Welt des Web-Scrapings sind User-Agents eine entscheidende Komponente, um mithilfe automatisierter Tools wertvolle Daten aus beliebten Suchmaschinen zu extrahieren. Ohne User-Agents laufen Web-Scraper Gefahr, entdeckt zu werden und gegen die Nutzungsbedingungen von Websites zu verstoßen. In diesem Artikel werden wir die am häufigsten verwendeten User-Agents für das Web-Scraping untersuchen und erläutern, wie sie es Web-Scrapern ermöglichen, Daten ethisch und rechtmäßig zu extrahieren.

Was sind User-Agents?

User-Agents fungieren als Vermittler zwischen dem Web-Scraper und der Website. Wenn ein Web-Scraper eine Anfrage an eine Website sendet, wird der User-Agent im Request-Header mitgesendet. Der User-Agent informiert die Website über die Identität des Web-Scrapers, das zum Senden der Anfrage verwendete Gerät und den verwendeten Webbrowser. Die Website nutzt diese Informationen, um Inhalte bereitzustellen, die für den jeweiligen Gerätetyp und Browser optimiert sind.

Die Bedeutung von User-Agents beim Web-Scraping

  1. Hilft Web-Scrapern, menschliches Verhalten nachzuahmen und eine Erkennung zu vermeiden

  2. Ermöglicht es Web-Scrapern, Daten auf ethische und rechtmäßige Weise zu extrahieren

  3. Hilft Web-Scrapern, Verstöße gegen die Nutzungsbedingungen von Websites und rechtliche Konsequenzen zu vermeiden.

  4. Hilft Web-Scrapern, die Sperrung von IP-Adressen und Zugriffsbeschränkungen auf Websites zu vermeiden

  5. Ermöglicht es Web-Scrapern, ihren Scraping-Prozess an bestimmte Websites und Datentypen anzupassen

  6. Verbessert die Leistung und Stabilität von Web-Scraping-Tools durch die Optimierung der Interaktionen mit Websites.

Die beliebtesten User-Agents für das Web-Scraping

Für das Web-Scraping werden üblicherweise zwei Arten von User-Agents verwendet: Browser-User-Agents und Bot-User-Agents.

Browser-User-Agents

Browser-User-Agents werden verwendet, um menschliches Verhalten bei der Interaktion mit modernen Browsern nachzuahmen. Chrome, Firefox, Safari und Edge sind die wichtigsten Browser-User-Agents, die für das Web-Scraping verwendet werden.

1. Chrome-User-Agents

Chrome-User-Agents sind die am häufigsten verwendeten Browser-User-Agents für das Web-Scraping. Web-Scraper bevorzugen Chrome-User-Agents, da sie in hohem Maße anpassbar sind und eine große Auswahl an Erweiterungen und Plugins bieten, um die Web-Scraping-Fähigkeiten zu verbessern. Chrome-User-Agents zeichnen sich zudem durch hervorragende Leistung und Stabilität aus.

Um Chrome-User-Agents für das Web-Scraping zu verwenden, müssen Sie den User-Agent in den Browsereinstellungen ändern. Öffnen Sie dazu die Entwicklertools in Chrome, wählen Sie die Registerkarte „Netzwerk“ aus und klicken Sie auf das Dropdown-Menü „User-Agent“. Dort können Sie den User-Agent auswählen, den Sie für das Web-Scraping verwenden möchten.

Hier sind die User-Agent-Strings:

Windows: Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/58.0.3029.110 Safari/537.3

Mac: Mozilla/5.0 (Macintosh; Intel Mac OS X 10_15_0) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/78.0.3904.97 Safari/537.36

2. Firefox-User-Agents

Firefox-User-Agents sind eine weitere beliebte Option für das Web-Scraping. Firefox-User-Agents bieten hervorragende Datenschutz- und Sicherheitsfunktionen, was sie zu einer beliebten Wahl für Web-Scraping-Projekte macht, bei denen sensible Daten eine Rolle spielen. Firefox-User-Agents bieten zudem eine große Auswahl an Erweiterungen und Plugins, um die Web-Scraping-Fähigkeiten zu verbessern.

Um Firefox-User-Agents für das Web-Scraping zu nutzen, müssen Sie die Erweiterung „User Agent Switcher“ installieren. Nach der Installation können Sie den gewünschten User-Agent aus dem Dropdown-Menü der Erweiterung auswählen.

Hier sind die Formate der User-Agent-Header:

Windows: Mozilla/5.0 (Windows NT 10.0; Win64; x64; rv:58.0) Gecko/20100101 Firefox/58.0

Mac: Mozilla/5.0 (Macintosh; Intel Mac OS X x.y; rv:42.0) Gecko/20100101 Firefox/42.0

3. Safari-User-Agents

Safari-User-Agents sind die standardmäßigen Browser-User-Agents, die auf Apple-Geräten verwendet werden. Safari-User-Agents werden häufig für Web-Scraping-Projekte eingesetzt, bei denen Apple-Geräte zum Einsatz kommen. Safari-User-Agents bieten hervorragende Leistung und Stabilität, was sie zu einer beliebten Wahl für Web-Scraping-Projekte macht, die eine schnelle und zuverlässige Datenextraktion erfordern.

Um Safari-User-Agents für das Web-Scraping zu verwenden, müssen Sie den User-Agent in den Browsereinstellungen ändern. Öffnen Sie dazu in Safari das Menü „Entwickeln“, wählen Sie „User-Agent“ aus und wählen Sie den gewünschten User-Agent aus.

Hier ist das Format des User-Agent-Headers:

Mac: Mozilla/5.0 (Macintosh; Intel Mac OS X 10_12_6) AppleWebKit/604.3.5 (KHTML, like Gecko) Version/11.0.3 Safari/604.3.5

4. Edge-User-Agents

Edge-User-Agents sind die standardmäßigen Browser-User-Agents, die auf Windows-Geräten verwendet werden. Edge-User-Agents bieten hervorragende Leistung und Stabilität, was sie zu einer beliebten Wahl für Web-Scraping-Projekte mit Windows-Geräten macht. Edge-User-Agents bieten zudem eine große Auswahl an Erweiterungen und Plugins, um die Web-Scraping-Fähigkeiten zu verbessern.

Um Edge-User-Agents für das Web-Scraping zu verwenden, müssen Sie den User-Agent in den Browsereinstellungen ändern. Öffnen Sie dazu die Entwicklertools in Edge, wählen Sie die Registerkarte „Netzwerk“ aus und klicken Sie auf das Dropdown-Menü „User-Agent“. Dort können Sie den User-Agent auswählen, den Sie für das Web-Scraping verwenden möchten.

Hier ist das Format des User-Agent-Headers:

Windows: Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/58.0.3029.110 Safari/537.3 Edge/16.16299

Bot-User-Agents

Bot-User-Agents sind eine Art von User-Agenten, die beim Web-Scraping eingesetzt werden und das Verhalten von Suchmaschinen-Bots simulieren. Hier sind einige der gängigsten Bot-User-Agents, die beim Web-Scraping verwendet werden:

1. Googlebot-User-Agents

Googlebot ist ein Bot-User-Agent, der von Google zum Crawlen und Indizieren von Websites verwendet wird. Er ist ein beliebter User-Agent für das Web-Scraping, da er Zugriff auf eine riesige Datenmenge im Internet bietet.

Um Googlebot für das Web-Scraping zu verwenden, können Sie folgende Schritte ausführen:

  1. Öffnen Sie eine Eingabeaufforderung oder ein Terminalfenster.

  2. Geben Sie den folgenden Befehl ein: „curl -A [User-Agent] [URL der Webseite]“ (ersetzen Sie [User-Agent] durch den entsprechenden Googlebot-User-Agent und [URL der Webseite] durch die URL der Seite, die Sie scrapen möchten).

  3. Drücken Sie die Eingabetaste, um den Befehl auszuführen.

  4. Der HTML-Inhalt der Webseite wird im Terminalfenster angezeigt.

Weiterführende Links:

- Übersicht über Google-Crawler

2. Bingbot-User-Agents

Bingbot ist ein weiterer beliebter Bot-User-Agent, der dafür entwickelt wurde, Webseiten für die Bing-Suchmaschine zu crawlen und zu indexieren. Wie Googlebot ist auch Bingbot ein nützliches Tool für das Web-Scraping.

Um Bingbot für das Web-Scraping zu verwenden, können Sie folgende Schritte ausführen:

  1. Öffnen Sie eine Eingabeaufforderung oder ein Terminalfenster.

  2. Geben Sie den folgenden Befehl ein: „curl -A [User-Agent] [URL der Webseite]“ (ersetzen Sie [User-Agent] durch den entsprechenden Bingbot-User-Agent und [URL der Webseite] durch die URL der Seite, die Sie scrapen möchten).

  3. Drücken Sie die Eingabetaste, um den Befehl auszuführen.

  4. Der HTML-Inhalt der Webseite wird im Terminalfenster angezeigt.

Weiterführende Links:

- Bingbot überprüfen

- Übersicht über Bing-Crawler

3. DuckDuckbot-User-Agents

DuckDuckbot ist ein Bot-User-Agent, der von der Suchmaschine DuckDuckGo verwendet wird. Er dient dazu, Webseiten für die Suchmaschine zu crawlen und zu indexieren.

Um DuckDuckbot für das Web-Scraping zu nutzen, können Sie folgende Schritte ausführen:

  1. Öffnen Sie eine Eingabeaufforderung oder ein Terminalfenster.

  2. Geben Sie den folgenden Befehl ein: „curl -A [User-Agent] [URL der Webseite]“ (ersetzen Sie [User-Agent] durch den entsprechenden DuckDuckbot-User-Agent und [URL der Webseite] durch die URL der Seite, die Sie scrapen möchten).

  3. Drücken Sie die Eingabetaste, um den Befehl auszuführen.

  4. Der HTML-Inhalt der Webseite wird im Terminalfenster angezeigt.

Weiterführende Links:

- Was ist DuckDuckBot und was macht es?

4. Yahoo! Slurp-User-Agents

Yahoo! Slurp ist der Bot-User-Agent, den Yahoo verwendet, um Websites für Suchmaschinenergebnisse zu crawlen und zu indexieren. Yahoo! Slurp ist in hohem Maße anpassbar und bietet verschiedene Einstellungen zur Optimierung der Datenextraktion.

Um Yahoo! Slurp für das Web-Scraping zu verwenden, können Sie folgende Schritte befolgen:

  1. Öffnen Sie eine Eingabeaufforderung oder ein Terminalfenster.

  2. Geben Sie den folgenden Befehl ein: „curl -A [User-Agent] [URL der Webseite]“ (ersetzen Sie [User-Agent] durch den entsprechenden Yahoo! Slurp-User-Agent und [URL der Webseite] durch die URL der Seite, die Sie scrapen möchten).

  3. Drücken Sie die Eingabetaste, um den Befehl auszuführen.

  4. Der HTML-Inhalt der Webseite wird im Terminalfenster angezeigt.

Hilfreiche Links:

- Warum crawlt Slurp meine Seite?

So wählen Sie den besten User-Agent aus

Bei der Auswahl des besten User-Agents für das Web-Scraping sind mehrere Faktoren zu berücksichtigen.

Das Verhalten der Website verstehen

Es ist unerlässlich, das Verhalten der Zielwebsite zu verstehen. Dazu gehören die Struktur der Website, ihre Inhalte und die Art und Weise, wie sie mit Web-Scraping-Tools interagiert. Dieses Wissen hilft Ihnen dabei, den User-Agent zu ermitteln, der für Ihr Web-Scraping-Projekt am besten geeignet ist.

Menschliches Verhalten nachahmen

Das Nachahmen menschlichen Verhaltens ist eine Schlüsselstrategie, um beim Web-Scraping nicht entdeckt zu werden. Indem Sie Ihre Web-Scraping-Aktivitäten so gestalten, dass sie den Anschein erwecken, als würden sie von einem Menschen ausgeführt, können Sie eine Erkennung durch die Website vermeiden und das Risiko einer Sperrung verringern. Dies lässt sich durch die Verwendung von User-Agents erreichen, die gängige Browser imitieren, oder durch die Anpassung der Intervalle zwischen den Anfragen sowie durch Randomisierung in Ihrem Web-Scraping-Prozess.

Wechselnder Einsatz von User-Agents

Der wechselnde Einsatz von User-Agents ist eine wichtige Technik, um Adresssperren zu verhindern und eine erfolgreiche Datenextraktion bei größeren Web-Scraping-Projekten sicherzustellen. Dabei wird während des Web-Scraping-Prozesses zwischen verschiedenen User-Agents gewechselt, um eine Erkennung durch die Website zu vermeiden. Durch den wechselnden Einsatz von User-Agents können Sie sicherstellen, dass Ihre Web-Scraping-Maßnahmen effektiv und effizient sind.

Fazit

Zusammenfassend lässt sich sagen, dass User-Agents beim Web-Scraping eine entscheidende Rolle spielen. Browser-User-Agents und Bot-User-Agents sind die am häufigsten verwendeten User-Agents für das Web-Scraping. Bei der Auswahl eines User-Agents ist es wichtig, Faktoren wie das Verhalten der Website und den Wechsel der User-Agents zu berücksichtigen.

Wenn Sie auf der Suche nach einem leistungsstarken Web-Scraping-Tool sind, das fortschrittliche User-Agents nutzt, sollten Sie sich unbedingt Geonode ansehen. Wir bieten eine Reihe von Funktionen und Tools, mit denen Sie Daten effizient und ethisch einwandfrei extrahieren können. Besuchen Sie uns noch heute, um mehr zu erfahren!

Quellenangaben

Google. (o. J.). Übersicht über den Google Crawler (User-Agent) | Google Search Central | Dokumentation | Google Developers. Abgerufen am 13. April 2023 von https://developers.google.com/search/docs/crawling-indexing/overview-google-crawlers

Johnson, A., & Anderson, C. (19. März 2023). Was sind die gängigsten User-Agents? TechyGeeksHome. Abgerufen am 13. April 2023 von https://blog.techygeekshome.info/2021/08/what-are-the-most-common-user-agents/

Wu, S. (3. Mai 2022). Grundlagen des Web-Scrapings. Medium. Abgerufen am 13. April 2023 von https://towardsdatascience.com/web-scraping-basics-82f8b5acd45c