Perplexity-User: Nutzerabrufe und die Grenzen von robots.txt
Perplexity-User kann eine Webseite abrufen, um eine Nutzerfrage zu beantworten und einen Quellenlink bereitzustellen. Der Betreiber beschreibt diese Abrufart nicht als Webcrawler oder als Sammlung für das Training von KI-Basismodellen. Quelle ist die Perplexity-Botdokumentation.
Stand geprüft am 08.09.2026 aus der Dokumentation von Perplexity und eigener Logprüfung (07.–08.09.2026).
| Betreiber | Perplexity |
|---|---|
| Abrufart | Nutzerabruf |
| Zweck | Ruft eine Seite ab, wenn eine Person Perplexity eine Frage stellt; laut Perplexity kein Webcrawl und keine Sammlung für das Training von KI-Basismodellen.supports user actions within Perplexity. When users ask Perplexity a question, it might visit a web page |
| User-Agent | Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; Perplexity-User/1.0; +https://perplexity.ai/perplexity-user) (laut Dokumentation)0 von 25 Treffern im Zeitraum aus den veröffentlichten Perplexity-Bereichen, 15 davon mit Scanner-Mustern. |
| robots.txt-Token | Perplexity-User |
| IP-Liste veröffentlicht | ja: https://www.perplexity.com/perplexity-user.json (Stand der Liste 17.10.2025, abgerufen am 08.09.2026) JSON (ipv4Prefix) |
| IP-Verifikation | Abgleich der Absender-IP gegen die veröffentlichte Liste (Stand der Liste 17.10.2025, abgerufen am 08.09.2026) |
| beachtet robots.txt (dokumentiert) | nein, laut Dokumentationthis fetcher generally ignores robots.txt rules |
| Treffer mit dieser Kennung auf patrickstolp.de (07.–08.09.2026) | 0 von 25 Kennungstreffern IP-verifiziert; 15 der 25 mit Scanner-Mustern (überlappende Zählung) Scanner-Muster werden über alle Kennungstreffer gezählt, nicht nur über die IP-verifizierten. |
| Wirkung des Blockierens |
|
| Primärquelle | Perplexity Crawlers |
| geprüft am |
Beachtet Perplexity-User robots.txt?
Abschnitt betitelt „Beachtet Perplexity-User robots.txt?“Perplexity erklärt ausdrücklich, dass dieser Nutzerabruf robots.txt in der Regel ignoriert. Eine Sperrgruppe ist damit keine verlässliche Möglichkeit, den Abruf zu verhindern. Die Einschränkung „in der Regel“ stammt aus der Dokumentation; sie bedeutet nicht, dass ausnahmslos jeder Abruf gleich abläuft.
Syntaktisch lässt sich diese Gruppe formulieren:
User-agent: Perplexity-User
Disallow: /Der robots.txt-Tester kann dafür ein ausgeschlossenes Abrufziel ausgeben. Das wäre eine Aussage über die passende Regel, keine Bestätigung ihrer Befolgung durch Perplexity-User. Eine zusätzliche Teilfreigabe löst diese grundsätzliche Grenze nicht.
Wenn Du Inhalte nur bestimmten Personen zugänglich machen möchtest, brauchst Du eine Zugriffskontrolle auf Serverebene. robots.txt ist laut RFC 9309 kein Schutz vor unberechtigten Zugriffen.
Welche Treffer gab es in meinen Logs?
Abschnitt betitelt „Welche Treffer gab es in meinen Logs?“Auf patrickstolp.de gab es im ausgewerteten Zeitraum vom 7. und 8. September 2026 insgesamt 25 Treffer mit Perplexity-User-Kennung. Keine der Absenderadressen passte zur zugeordneten Betreiberliste. Bei 15 Treffern wurden typische Scanner-Pfade angefragt.
Eigene Beobachtung: Zugriffslogs von patrickstolp.de, 07.–08.09.2026
Der IP-Abgleich vergleicht die Absender-IP mit den veröffentlichten Listen der Betreiber, abgerufen am 08.09.2026. Zugriffe auf typische Scan-Ziele wie /.aws/credentials oder /.env werden zusätzlich gezählt und überschneiden sich mit den übrigen Gruppen. Solche Pfade allein beweisen keine gefälschte Kennung. 2.578 Logzeilen an 2 Tagen. Es werden keine IP-Adressen ausgegeben.
| Zeitraum | 07.–08.09.2026 |
|---|---|
| Treffer mit Kennung Perplexity-User | 25 |
| IP-Abgleich | 0 von 25 |
| mit Scanner-Pfaden (überlappende Zählung über alle Kennungstreffer) | 15 |
| eindeutige Absender-IPs | 1 (nur gezählt) |
| Statuscodes | 2xx 0 · 3xx 3 · 4xx 5 · 5xx 0 · sonstige/fehlend 17 |
| Abrufe von /robots.txt | 0 |
| Abrufe von /llms.txt | 0 |
| Treffer auf Pfade, die im gespeicherten robots.txt-Stand gesperrt sind | 0 |
| häufigste Pfade (nur IP-verifiziert) | – |
Die Zahlen beschreiben Zugriffe auf eine einzelne Website. Sie zeigen weder, wie häufig die Bots im gesamten Web auftreten, noch ob abgerufene Inhalte in KI-Antworten verwendet wurden. Der robots.txt-Abgleich nutzt einen gespeicherten Stand; daraus lässt sich kein damaliger Regelverstoß ableiten. Ausgewertet am 08.09.2026.
Damit ist keiner dieser Abrufe per IP als Perplexity-User bestätigt. Aus den 25 Kennungstreffern lassen sich weder 25 Nutzerfragen noch 25 Abrufe durch Perplexity ableiten. Auch die Scanner-Pfade kann ich dem Anbieter auf dieser Grundlage nicht zuschreiben.
Wie prüfst Du eigene Nutzerabrufe?
Abschnitt betitelt „Wie prüfst Du eigene Nutzerabrufe?“Verwende für den IP-Abgleich die Liste für Perplexity-User. Die Liste für PerplexityBot gehört zum anderen Eintrag. Halte neben Kennung, Zeitpunkt und Pfad auch den verwendeten Listenstand fest.
Selbst ein bestätigter Abruf verrät noch nicht, welche Antwort daraus entstanden ist. Für den Nachweis eines Quellenlinks brauchst Du die konkrete Antwort und die dort angegebene URL. Die Referenz zum Zitatbeleg führt durch diese Prüfung.
Wenn Du den automatischen Suchabruf steuern möchtest, lies den separaten Steckbrief zu PerplexityBot. Die beiden Kennungen sollten auch in Deiner Logauswertung getrennt bleiben.
- PerplexityBot: Suchabrufe erkennen und steuern
Baut den Suchindex von Perplexity auf; laut Perplexity sammelt dieser Abruf nicht für das Training von KI-Basismodellen.
Token
PerplexityBot· Indexabruf
Primärquellen
- Perplexity Crawlers · Perplexity · abgerufen am · Betreiberdokumentation ohne ausgewiesenes Veröffentlichungsdatum, keine empirische Stichprobe: Perplexity-User ruft Seiten für Nutzerfragen ab, gilt nicht als Webcrawl und nicht als Sammlung für das Training von Basismodellen; robots.txt wird laut Perplexity in der Regel ignoriert – „generally“ ist nicht „ausnahmslos“
- Veröffentlichte IP-Bereiche (Perplexity-User) · Perplexity · abgerufen am · Betreiberliste mit creationTime 17.10.2025, vier Adressbereiche: Abgleichskriterium für die Herkunft einer Kennung; kein Zitat- oder Nutzungsnachweis
- Veröffentlichte IP-Bereiche (PerplexityBot) · Perplexity · abgerufen am · Betreiberliste mit creationTime 07.02.2025, acht Adressbereiche: gehört zum Indexabruf PerplexityBot und ist für den Nutzerabruf nicht das passende Abgleichskriterium
- RFC 9309: Robots Exclusion Protocol · IETF (Koster, Illyes, Zeller, Sassman, September 2022) · abgerufen am · Normativer Standard: robots.txt ist keine Zugangskontrolle (Abschnitt 1); aus einer syntaktisch gültigen Gruppe folgt keine Befolgung durch den Bot
- Eigene Auswertung der Zugriffslogs von patrickstolp.de (Auswertung v3) · Patrick Stolp · abgerufen am · Eigene, nicht veröffentlichte Datengrundlage, 07.–08.09.2026: 2.578 Logzeilen, 25 Treffer mit Perplexity-User-Kennung, davon kein per IP bestätigter Abruf; kein Beleg für einen Regelverstoß Perplexitys
Verwandte Referenzen
Herausgeber und verantwortlicher Autor: Patrick Stolp · Redaktion · Impressum · Datenschutz