Zum Inhalt springen

Perplexity-User: Nutzerabrufe und die Grenzen von robots.txt

Geprüft am Autor Patrick StolpVeröffentlicht

Perplexity-User kann eine Webseite abrufen, um eine Nutzerfrage zu beantworten und einen Quellenlink bereitzustellen. Der Betreiber beschreibt diese Abrufart nicht als Webcrawler oder als Sammlung für das Training von KI-Basismodellen. Quelle ist die Perplexity-Botdokumentation.

Stand geprüft am 08.09.2026 aus der Dokumentation von Perplexity und eigener Logprüfung (07.–08.09.2026).

BetreiberPerplexity
AbrufartNutzerabruf
ZweckRuft eine Seite ab, wenn eine Person Perplexity eine Frage stellt; laut Perplexity kein Webcrawl und keine Sammlung für das Training von KI-Basismodellen.
supports user actions within Perplexity. When users ask Perplexity a question, it might visit a web page
User-AgentMozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; Perplexity-User/1.0; +https://perplexity.ai/perplexity-user) (laut Dokumentation)
0 von 25 Treffern im Zeitraum aus den veröffentlichten Perplexity-Bereichen, 15 davon mit Scanner-Mustern.
robots.txt-TokenPerplexity-User
IP-Liste veröffentlichtja: https://www.perplexity.com/perplexity-user.json (Stand der Liste 17.10.2025, abgerufen am 08.09.2026)
JSON (ipv4Prefix)
IP-VerifikationAbgleich der Absender-IP gegen die veröffentlichte Liste (Stand der Liste 17.10.2025, abgerufen am 08.09.2026)
beachtet robots.txt (dokumentiert)nein, laut Dokumentation
this fetcher generally ignores robots.txt rules
Treffer mit dieser Kennung auf patrickstolp.de (07.–08.09.2026)0 von 25 Kennungstreffern IP-verifiziert; 15 der 25 mit Scanner-Mustern (überlappende Zählung)
Scanner-Muster werden über alle Kennungstreffer gezählt, nicht nur über die IP-verifizierten.
Wirkung des Blockierens
Trainingsabruf
Keine dokumentierte Wirkung.
Suchabruf
Keine dokumentierte Wirkung auf den Index.
Nutzerabruf
robots.txt wird laut Perplexity in der Regel ignoriert; für eine Sperre ist dokumentiert keine verlässliche Sperrwirkung zugesichert.
PrimärquellePerplexity Crawlers
geprüft am

Perplexity erklärt ausdrücklich, dass dieser Nutzerabruf robots.txt in der Regel ignoriert. Eine Sperrgruppe ist damit keine verlässliche Möglichkeit, den Abruf zu verhindern. Die Einschränkung „in der Regel“ stammt aus der Dokumentation; sie bedeutet nicht, dass ausnahmslos jeder Abruf gleich abläuft.

Syntaktisch lässt sich diese Gruppe formulieren:

User-agent: Perplexity-User
Disallow: /

Der robots.txt-Tester kann dafür ein ausgeschlossenes Abrufziel ausgeben. Das wäre eine Aussage über die passende Regel, keine Bestätigung ihrer Befolgung durch Perplexity-User. Eine zusätzliche Teilfreigabe löst diese grundsätzliche Grenze nicht.

Wenn Du Inhalte nur bestimmten Personen zugänglich machen möchtest, brauchst Du eine Zugriffskontrolle auf Serverebene. robots.txt ist laut RFC 9309 kein Schutz vor unberechtigten Zugriffen.

Auf patrickstolp.de gab es im ausgewerteten Zeitraum vom 7. und 8. September 2026 insgesamt 25 Treffer mit Perplexity-User-Kennung. Keine der Absenderadressen passte zur zugeordneten Betreiberliste. Bei 15 Treffern wurden typische Scanner-Pfade angefragt.

Eigene Beobachtung: Zugriffslogs von patrickstolp.de, 07.–08.09.2026

Der IP-Abgleich vergleicht die Absender-IP mit den veröffentlichten Listen der Betreiber, abgerufen am 08.09.2026. Zugriffe auf typische Scan-Ziele wie /.aws/credentials oder /.env werden zusätzlich gezählt und überschneiden sich mit den übrigen Gruppen. Solche Pfade allein beweisen keine gefälschte Kennung. 2.578 Logzeilen an 2 Tagen. Es werden keine IP-Adressen ausgegeben.

Zeitraum07.–08.09.2026
Treffer mit Kennung Perplexity-User25
IP-Abgleich0 von 25
mit Scanner-Pfaden (überlappende Zählung über alle Kennungstreffer)15
eindeutige Absender-IPs1 (nur gezählt)
Statuscodes2xx 0 · 3xx 3 · 4xx 5 · 5xx 0 · sonstige/fehlend 17
Abrufe von /robots.txt0
Abrufe von /llms.txt0
Treffer auf Pfade, die im gespeicherten robots.txt-Stand gesperrt sind0
häufigste Pfade (nur IP-verifiziert)

Die Zahlen beschreiben Zugriffe auf eine einzelne Website. Sie zeigen weder, wie häufig die Bots im gesamten Web auftreten, noch ob abgerufene Inhalte in KI-Antworten verwendet wurden. Der robots.txt-Abgleich nutzt einen gespeicherten Stand; daraus lässt sich kein damaliger Regelverstoß ableiten. Ausgewertet am 08.09.2026.

Damit ist keiner dieser Abrufe per IP als Perplexity-User bestätigt. Aus den 25 Kennungstreffern lassen sich weder 25 Nutzerfragen noch 25 Abrufe durch Perplexity ableiten. Auch die Scanner-Pfade kann ich dem Anbieter auf dieser Grundlage nicht zuschreiben.

Verwende für den IP-Abgleich die Liste für Perplexity-User. Die Liste für PerplexityBot gehört zum anderen Eintrag. Halte neben Kennung, Zeitpunkt und Pfad auch den verwendeten Listenstand fest.

Selbst ein bestätigter Abruf verrät noch nicht, welche Antwort daraus entstanden ist. Für den Nachweis eines Quellenlinks brauchst Du die konkrete Antwort und die dort angegebene URL. Die Referenz zum Zitatbeleg führt durch diese Prüfung.

Wenn Du den automatischen Suchabruf steuern möchtest, lies den separaten Steckbrief zu PerplexityBot. Die beiden Kennungen sollten auch in Deiner Logauswertung getrennt bleiben.

Primärquellen

  1. Perplexity Crawlers · Perplexity · abgerufen am · Betreiberdokumentation ohne ausgewiesenes Veröffentlichungsdatum, keine empirische Stichprobe: Perplexity-User ruft Seiten für Nutzerfragen ab, gilt nicht als Webcrawl und nicht als Sammlung für das Training von Basismodellen; robots.txt wird laut Perplexity in der Regel ignoriert – „generally“ ist nicht „ausnahmslos“
  2. Veröffentlichte IP-Bereiche (Perplexity-User) · Perplexity · abgerufen am · Betreiberliste mit creationTime 17.10.2025, vier Adressbereiche: Abgleichskriterium für die Herkunft einer Kennung; kein Zitat- oder Nutzungsnachweis
  3. Veröffentlichte IP-Bereiche (PerplexityBot) · Perplexity · abgerufen am · Betreiberliste mit creationTime 07.02.2025, acht Adressbereiche: gehört zum Indexabruf PerplexityBot und ist für den Nutzerabruf nicht das passende Abgleichskriterium
  4. RFC 9309: Robots Exclusion Protocol · IETF (Koster, Illyes, Zeller, Sassman, September 2022) · abgerufen am · Normativer Standard: robots.txt ist keine Zugangskontrolle (Abschnitt 1); aus einer syntaktisch gültigen Gruppe folgt keine Befolgung durch den Bot
  5. Eigene Auswertung der Zugriffslogs von patrickstolp.de (Auswertung v3) · Patrick Stolp · abgerufen am · Eigene, nicht veröffentlichte Datengrundlage, 07.–08.09.2026: 2.578 Logzeilen, 25 Treffer mit Perplexity-User-Kennung, davon kein per IP bestätigter Abruf; kein Beleg für einen Regelverstoß Perplexitys

Verwandte Referenzen

Herausgeber und verantwortlicher Autor: Patrick Stolp · Redaktion · Impressum · Datenschutz