Applebot-Extended: Die Nutzung für KI-Training steuern
Applebot-Extended steuert, ob von Applebot erfasste Websiteinhalte für das Training von Apples allgemeinen KI-Basismodellen verwendet werden dürfen. Der Token ruft selbst keine Seiten ab. Apple erläutert diese Trennung in der Applebot-Dokumentation.
Stand geprüft am 08.09.2026 aus der Dokumentation von Apple.
| Betreiber | Apple |
|---|---|
| Abrufart | Steuer-Token ohne eigenen Bot |
| Zweck | Steuert, ob von Applebot gecrawlte Inhalte für das Training der Apple-Foundation-Modelle verwendet werden. |
| User-Agent | kein eigener User-Agent Apple dokumentiert: kein eigener User-Agent, nur ein robots.txt-Token. Der Abruf läuft über Applebot. |
| robots.txt-Token | Applebot-Extended |
| IP-Liste veröffentlicht | Liste des abrufenden Crawlers: https://search.developer.apple.com/applebot.json (Stand der Liste 31.07.2026, abgerufen am 08.09.2026) JSON (ipv4Prefix); Liste von Applebot, da der Abruf darüber läuft Keine eigene Applebot-Extended-IP-Liste: Der Abgleich prüft nur, ob ein Abruf von Applebot stammt, und sagt nichts über die Trainingsnutzung. |
| IP-Verifikation | entfällt: kein eigener dokumentierter Abruf unter diesem Token; die veröffentlichte Liste gehört zum abrufenden Crawler |
| beachtet robots.txt (dokumentiert) | ja, laut Dokumentation Als Token in robots.txt ausgewertet. |
| Treffer mit dieser Kennung auf patrickstolp.de (07.–08.09.2026) | kein Treffer im Zeitraum |
| Wirkung des Blockierens |
|
| Primärquelle | About Applebot |
| geprüft am |
Wie schließt Du die Trainingsnutzung aus?
Abschnitt betitelt „Wie schließt Du die Trainingsnutzung aus?“Für sämtliche Pfade lautet die robots.txt-Gruppe:
User-agent: Applebot-Extended
Disallow: /Die Regel betrifft die Inhaltsnutzung. Ob Applebot eine Seite abrufen darf, musst Du anhand der für Applebot geltenden Regeln gesondert prüfen. Apple unterscheidet beide Aufgaben ausdrücklich in seiner Dokumentation.
Im robots.txt-Tester kannst Du denselben Pfad für beide Kennungen auswerten. Ein erlaubter Applebot-Abruf und eine ausschließende Applebot-Extended-Regel können gleichzeitig richtig sein. Die Ausgabe ist dabei kein Nachweis, dass ein Trainingsdatensatz tatsächlich verändert wurde.
Bleibt die Seite in Apples Suche auffindbar?
Abschnitt betitelt „Bleibt die Seite in Apples Suche auffindbar?“Apple erklärt, dass Seiten trotz einer ausschließenden Applebot-Extended-Regel weiterhin in Suchergebnissen vorkommen können. Die Regel wird nicht als Rankingfaktor berücksichtigt. Das steht unter „Applebot-Extended“ und „About search rankings“ in der Betreiberdokumentation.
Das ist keine Garantie für eine konkrete Platzierung. Für die Prüfung bedeutet es: Du musst eine Trainingsentscheidung nicht mit einer Abrufsperre für Applebot gleichsetzen.
Verhindert die Regel auch die Verwendung in KI-Antworten?
Abschnitt betitelt „Verhindert die Regel auch die Verwendung in KI-Antworten?“Apple trennt das Training von der Nutzung als zusätzlichem aktuellem Kontext bei der Erzeugung einer Antwort. Für diese zweite Nutzung nennt Apple nosnippet als Steuerung. Ein Extended-Ausschluss allein deckt daher nicht jede Verwendung in generativen Antworten ab. Quelle ist „About Applebot“.
Wenn Du eine solche Einstellung prüfst, notiere zuerst das gewünschte Ergebnis. „Nicht zum Training verwenden“ und „nicht als Grundlage einer Webantwort verwenden“ sind verschiedene Anforderungen. Die Referenz zur Inhaltssteuerung ordnet die passenden Regeln ein.
Welche Abrufe habe ich bei Apple beobachtet?
Abschnitt betitelt „Welche Abrufe habe ich bei Apple beobachtet?“Im Logausschnitt von patrickstolp.de vom 7. und 8. September 2026 gab es keinen Treffer mit Applebot-Extended-Kennung. Das ist bei einem Token ohne eigenen Crawler keine auffällige Lücke.
Unter der tatsächlichen Abrufkennung Applebot standen dagegen 30 Einträge. 18 davon waren durch den IP-Abgleich bestätigt, zwölf lagen außerhalb der zugeordneten Liste. Diese Zahlen beschreiben Applebot. Ich zähle sie nicht als Applebot-Extended-Abrufe und leite daraus keine Trainingsnutzung ab.
Die Crawler-Auswertung erklärt das Verfahren und die Grenzen der eigenen Beobachtung.
- Google-Extended: Training und Grounding steuern
Steuert, ob von Google gecrawlte Inhalte für das Training künftiger Gemini-Generationen (Gemini Apps, Vertex AI) und für Grounding dort verwendet werden dürfen. Der Abruf selbst läuft über bestehende Google-User-Agents.
Token
Google-Extended· Steuer-Token ohne eigenen Bot
Primärquellen
- About Applebot · Apple · abgerufen am · Betreiberregel, veröffentlicht 04.09.2026, keine empirische Stichprobe: Applebot-Extended crawlt nicht, sondern regelt das Training der allgemeinen Foundation-Modelle; Suchaufnahme weiterhin möglich, keine Rankingwirkung durch die Extended-Regel; nosnippet steuert Beschreibung, Webantwort und die Nutzung als zusätzlichen aktuellen Kontext, noindex die Indexierung; aus einem Abruf folgt keine Trainingsaufnahme
- RFC 9309: Robots Exclusion Protocol · IETF (Koster, Illyes, Zeller, Sassman, September 2022) · abgerufen am · Normativer Standard: Gruppenauswahl und Regelauswertung in der robots.txt; die produktspezifische Nutzungswirkung eines Tokens stammt vom Betreiber, nicht aus dem RFC
- Eigene Auswertung der Zugriffslogs von patrickstolp.de (Auswertung v3) · Patrick Stolp · abgerufen am · Eigene, nicht veröffentlichte Datengrundlage, 07.–08.09.2026: 2.578 Logzeilen, kein Treffer mit Applebot-Extended-Kennung; unter der Kennung Applebot 30 Treffer, davon 18 per IP bestätigt; Applebot-Treffer sind nicht Applebot-Extended zuzuordnen und belegen keine Trainingsnutzung
Verwandte Referenzen
Herausgeber und verantwortlicher Autor: Patrick Stolp · Redaktion · Impressum · Datenschutz