Amazonbot: Amazons Crawler und seine Steuerung
Amazonbot sammelt Inhalte zur Verbesserung von Amazon-Produkten und -Diensten; die Daten können auch zum Training von KI-Modellen verwendet werden. Amazon nennt daneben eigene Kennungen für Such- und Nutzerabrufe. Diese Einordnung steht in der Amazonbot-Dokumentation.
Stand geprüft am 08.09.2026 aus der Dokumentation von Amazon.
| Betreiber | Amazon |
|---|---|
| Abrufart | Trainingsabruf |
| Zweck | Verbessert Amazons Produkte und Dienste; die Inhalte können für das Training von Amazons KI-Modellen verwendet werden. Für Suche und Nutzerabruf nennt Amazon getrennte Tokens (Amzn-SearchBot, Amzn-User).may be used to train Amazon AI models |
| User-Agent | Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; Amazonbot/0.1) Chrome/W.X.Y.Z Safari/537.36 (laut Dokumentation)Im Zeitraum kein Treffer auf patrickstolp.de. |
| robots.txt-Token | Amazonbot |
| IP-Liste veröffentlicht | ja: https://developer.amazon.com/amazonbot/ip-addresses/ (Stand der Liste 30.04.2026, abgerufen am 08.09.2026) HTML-Seite mit eingebetteten Einzeladressen (ipv4Prefix ohne CIDR), kein reiner JSON-Endpunkt |
| IP-Verifikation | Abgleich der Absender-IP gegen die veröffentlichte Liste (Stand der Liste 30.04.2026, abgerufen am 08.09.2026) |
| beachtet robots.txt (dokumentiert) | ja, laut Dokumentationrespect the Robots Exclusion Protocol, honoring the user-agent and the allow/disallow directivesKein crawl-delay. Amazon nennt zusätzlich rel=nofollow sowie die Meta-Angaben noindex, none und noarchive; noarchive beschreibt Amazon dabei ausdrücklich als Ausschluss vom Modelltraining. Das ist Amazons eigene Bedeutung, keine universelle Meta-Regel. Nutzerabrufe über Amzn-User folgen laut Amazon möglicherweise nicht allen robots.txt-Anweisungen. |
| Treffer mit dieser Kennung auf patrickstolp.de (07.–08.09.2026) | kein Treffer im Zeitraum |
| Wirkung des Blockierens |
|
| Primärquelle | Amazonbot |
| geprüft am |
Welche Amazon-Kennung passt zu Deinem Ziel?
Abschnitt betitelt „Welche Amazon-Kennung passt zu Deinem Ziel?“| Kennung | Dokumentierter Zweck |
|---|---|
| Amazonbot | Produkte und Dienste verbessern, mögliche Trainingsnutzung |
| Amzn-SearchBot | Sucherlebnisse in Amazon-Produkten, etwa Alexa |
| Amzn-User | Aktuelle Webinformationen auf Nutzeranfrage abrufen |
Die Einstellungen sind laut Amazon unabhängig. Eine Amazonbot-Regel ist deshalb keine pauschale Sperre für alle drei Abrufarten. Bei Amzn-User weist der Betreiber zusätzlich darauf hin, dass möglicherweise nicht alle robots.txt-Anweisungen befolgt werden.
Wie sperrst Du Amazonbot?
Abschnitt betitelt „Wie sperrst Du Amazonbot?“Für sämtliche Pfade verwendest Du:
User-agent: Amazonbot
Disallow: /Amazon erklärt, bei automatischen Abrufen die User-agent-, Allow- und Disallow-Anweisungen zu beachten. Änderungen können ungefähr 24 Stunden benötigen. Crawl-delay wird nicht unterstützt. Quelle ist die Betreiberdokumentation.
Prüfe die vollständige Datei im robots.txt-Tester. Wenn Du eine eigene Amazonbot-Gruppe anlegst, gelten die Regeln der Stern-Gruppe nicht zusätzlich. Für unterschiedliche Pfade gehören daher alle benötigten Regeln in die passende Gruppe. Diese Gruppenauswahl folgt RFC 9309.
Welche Besonderheit nennt Amazon für noarchive?
Abschnitt betitelt „Welche Besonderheit nennt Amazon für noarchive?“Amazon beschreibt das Robots-Meta-Signal noarchive als Ausschluss der Seite vom Modelltraining. Das ist eine konkrete Betreiberangabe und darf nicht als universelle Bedeutung für alle Suchmaschinen oder KI-Anbieter übernommen werden. Beleg ist der Abschnitt „Our Approach to Robots.txt“ in der Amazonbot-Dokumentation.
Eine Meta-Anweisung muss bei der Verarbeitung der Seite gelesen werden können. Ein robots.txt-Test allein kontrolliert sie nicht. Die Referenz zur Inhaltssteuerung unterscheidet die Regeln nach Ort und Aufgabe.
Wie prüfst Du einen Amazonbot-Treffer?
Abschnitt betitelt „Wie prüfst Du einen Amazonbot-Treffer?“Vergleiche die Kennung zusätzlich mit der Absenderadresse anhand der veröffentlichten Amazonbot-IP-Liste. Die Liste gehört zu Amazonbot; Such- und Nutzerabrufe sind getrennt zu beurteilen. Dokumentiere auch den Listenstand, damit die Grundlage Deines Abgleichs erhalten bleibt.
In meinen Zugriffslogs von patrickstolp.de vom 7. und 8. September 2026 gab es keinen Treffer mit Amazonbot-Kennung. Ich kann für diesen Zeitraum deshalb weder Abrufpfade noch eine eigene Prüfung der Regelbefolgung zeigen.
Dieser fehlende Treffer belegt nicht, dass Amazon keine Inhalte meiner Website kennt oder verwendet. Die Beobachtung umfasst zwei Tage auf einem Server. Sie enthält weder eine vollständige Abrufhistorie noch Angaben über spätere Datenverwendung. Die Crawler-Auswertung erläutert diese Grenze.
Primärquellen
- About AmazonBot · Amazon · abgerufen am · Betreiberregel ohne belastbar ausgewiesenes Publikationsdatum, keine empirische Stichprobe: Amazonbot verbessert Amazons Produkte und Dienste, die Inhalte können dem KI-Training dienen; Amzn-SearchBot steht für Sucherlebnisse, Amzn-User für Nutzeranfragen, die Einstellungen sind unabhängig und brauchen etwa 24 Stunden; automatische Abrufe folgen User-agent, Allow und Disallow, kein crawl-delay; noarchive beschreibt Amazon ausdrücklich als Ausschluss vom Modelltraining; Nutzerabrufe folgen möglicherweise nicht allen robots.txt-Anweisungen; keine Zusage einer tatsächlichen Trainingsaufnahme
- Amazonbot IP addresses · Amazon · abgerufen am · Nur Herkunftsprüfung für Amazonbot, nicht für Such- oder Nutzerabruf: HTML-Seite mit eingebettetem Datenblock statt reinem JSON-Endpunkt, creationTime der eingebetteten Daten 30.04.2026, die ipv4Prefix-Werte sind Einzeladressen
- RFC 9309: Robots Exclusion Protocol · IETF (Koster, Illyes, Zeller, Sassman, September 2022) · abgerufen am · Normativer Standard: Gruppenauswahl und Pfadregeln in der robots.txt (Abschnitt 2.2.1); die produktspezifische Wirkung eines Tokens stammt vom Betreiber, nicht aus dem RFC
- Eigene Auswertung der Zugriffslogs von patrickstolp.de (Auswertung v3) · Patrick Stolp · abgerufen am · Eigene, nicht veröffentlichte Datengrundlage, 07.–08.09.2026: 2.578 Logzeilen, keine Amazonbot-Kennung im Zeitraum; der fehlende Treffer belegt weder eine Regelbefolgung noch, dass Amazon keine Inhalte der Website kennt oder verwendet
Verwandte Referenzen
Herausgeber und verantwortlicher Autor: Patrick Stolp · Redaktion · Impressum · Datenschutz