Zum Inhalt springen

Applebot-Extended: Die Nutzung für KI-Training steuern

Geprüft am Autor Patrick StolpVeröffentlicht

Applebot-Extended steuert, ob von Applebot erfasste Websiteinhalte für das Training von Apples allgemeinen KI-Basismodellen verwendet werden dürfen. Der Token ruft selbst keine Seiten ab. Apple erläutert diese Trennung in der Applebot-Dokumentation.

Stand geprüft am 08.09.2026 aus der Dokumentation von Apple.

BetreiberApple
AbrufartSteuer-Token ohne eigenen Bot
ZweckSteuert, ob von Applebot gecrawlte Inhalte für das Training der Apple-Foundation-Modelle verwendet werden.
User-Agentkein eigener User-Agent
Apple dokumentiert: kein eigener User-Agent, nur ein robots.txt-Token. Der Abruf läuft über Applebot.
robots.txt-TokenApplebot-Extended
IP-Liste veröffentlichtListe des abrufenden Crawlers: https://search.developer.apple.com/applebot.json (Stand der Liste 31.07.2026, abgerufen am 08.09.2026)
JSON (ipv4Prefix); Liste von Applebot, da der Abruf darüber läuft
Keine eigene Applebot-Extended-IP-Liste: Der Abgleich prüft nur, ob ein Abruf von Applebot stammt, und sagt nichts über die Trainingsnutzung.
IP-Verifikationentfällt: kein eigener dokumentierter Abruf unter diesem Token; die veröffentlichte Liste gehört zum abrufenden Crawler
beachtet robots.txt (dokumentiert)ja, laut Dokumentation
Als Token in robots.txt ausgewertet.
Treffer mit dieser Kennung auf patrickstolp.de (07.–08.09.2026)kein Treffer im Zeitraum
Wirkung des Blockierens
Trainingsabruf
Inhalte werden nicht für das Training der allgemeinen Apple-Foundation-Modelle verwendet. Die Nutzung als zusätzlicher aktueller Kontext bei der Erzeugung einer Antwort ist damit nicht ausgeschlossen; dafür nennt Apple nosnippet, für die Indexierung noindex.
Suchabruf
Suchaufnahme weiterhin möglich; keine Rankingwirkung durch die Extended-Regel. Zitat: „Webpages that disallow Applebot-Extended can still be included in search results.“ Beschreibung und Webantwort steuern nosnippet und noindex, nicht die Extended-Regel.
Nutzerabruf
Nicht zutreffend.
PrimärquelleAbout Applebot
geprüft am

Für sämtliche Pfade lautet die robots.txt-Gruppe:

User-agent: Applebot-Extended
Disallow: /

Die Regel betrifft die Inhaltsnutzung. Ob Applebot eine Seite abrufen darf, musst Du anhand der für Applebot geltenden Regeln gesondert prüfen. Apple unterscheidet beide Aufgaben ausdrücklich in seiner Dokumentation.

Im robots.txt-Tester kannst Du denselben Pfad für beide Kennungen auswerten. Ein erlaubter Applebot-Abruf und eine ausschließende Applebot-Extended-Regel können gleichzeitig richtig sein. Die Ausgabe ist dabei kein Nachweis, dass ein Trainingsdatensatz tatsächlich verändert wurde.

Apple erklärt, dass Seiten trotz einer ausschließenden Applebot-Extended-Regel weiterhin in Suchergebnissen vorkommen können. Die Regel wird nicht als Rankingfaktor berücksichtigt. Das steht unter „Applebot-Extended“ und „About search rankings“ in der Betreiberdokumentation.

Das ist keine Garantie für eine konkrete Platzierung. Für die Prüfung bedeutet es: Du musst eine Trainingsentscheidung nicht mit einer Abrufsperre für Applebot gleichsetzen.

Verhindert die Regel auch die Verwendung in KI-Antworten?

Abschnitt betitelt „Verhindert die Regel auch die Verwendung in KI-Antworten?“

Apple trennt das Training von der Nutzung als zusätzlichem aktuellem Kontext bei der Erzeugung einer Antwort. Für diese zweite Nutzung nennt Apple nosnippet als Steuerung. Ein Extended-Ausschluss allein deckt daher nicht jede Verwendung in generativen Antworten ab. Quelle ist „About Applebot“.

Wenn Du eine solche Einstellung prüfst, notiere zuerst das gewünschte Ergebnis. „Nicht zum Training verwenden“ und „nicht als Grundlage einer Webantwort verwenden“ sind verschiedene Anforderungen. Die Referenz zur Inhaltssteuerung ordnet die passenden Regeln ein.

Im Logausschnitt von patrickstolp.de vom 7. und 8. September 2026 gab es keinen Treffer mit Applebot-Extended-Kennung. Das ist bei einem Token ohne eigenen Crawler keine auffällige Lücke.

Unter der tatsächlichen Abrufkennung Applebot standen dagegen 30 Einträge. 18 davon waren durch den IP-Abgleich bestätigt, zwölf lagen außerhalb der zugeordneten Liste. Diese Zahlen beschreiben Applebot. Ich zähle sie nicht als Applebot-Extended-Abrufe und leite daraus keine Trainingsnutzung ab.

Die Crawler-Auswertung erklärt das Verfahren und die Grenzen der eigenen Beobachtung.

  • Google-Extended: Training und Grounding steuern

    Steuert, ob von Google gecrawlte Inhalte für das Training künftiger Gemini-Generationen (Gemini Apps, Vertex AI) und für Grounding dort verwendet werden dürfen. Der Abruf selbst läuft über bestehende Google-User-Agents.

    Token Google-Extended · Steuer-Token ohne eigenen Bot

Primärquellen

  1. About Applebot · Apple · abgerufen am · Betreiberregel, veröffentlicht 04.09.2026, keine empirische Stichprobe: Applebot-Extended crawlt nicht, sondern regelt das Training der allgemeinen Foundation-Modelle; Suchaufnahme weiterhin möglich, keine Rankingwirkung durch die Extended-Regel; nosnippet steuert Beschreibung, Webantwort und die Nutzung als zusätzlichen aktuellen Kontext, noindex die Indexierung; aus einem Abruf folgt keine Trainingsaufnahme
  2. RFC 9309: Robots Exclusion Protocol · IETF (Koster, Illyes, Zeller, Sassman, September 2022) · abgerufen am · Normativer Standard: Gruppenauswahl und Regelauswertung in der robots.txt; die produktspezifische Nutzungswirkung eines Tokens stammt vom Betreiber, nicht aus dem RFC
  3. Eigene Auswertung der Zugriffslogs von patrickstolp.de (Auswertung v3) · Patrick Stolp · abgerufen am · Eigene, nicht veröffentlichte Datengrundlage, 07.–08.09.2026: 2.578 Logzeilen, kein Treffer mit Applebot-Extended-Kennung; unter der Kennung Applebot 30 Treffer, davon 18 per IP bestätigt; Applebot-Treffer sind nicht Applebot-Extended zuzuordnen und belegen keine Trainingsnutzung

Verwandte Referenzen

Herausgeber und verantwortlicher Autor: Patrick Stolp · Redaktion · Impressum · Datenschutz