Cloudflares unvollkommener Waffenstillstand zwischen Suchmaschinen und KI-Training
Am 15. September 2026 hat Cloudflare die Option "Disallow AI Training" freigeschaltet, die sich in den Sicherheitseinstellungen pro Domain konfigurieren lässt. Erklärtes Ziel ist es, eine bisher erzwungene Kopplung aufzulösen: Wer im Web publiziert, musste seine Texte dem Training generativer Modelle überlassen, um nicht aus den klassischen Suchergebnissen zu verschwinden. Die Klassifizierung unterscheidet die Tätigkeit der Crawler nun in drei Kategorien: "Search" für die Indexierung, "Training" für das Modelltraining und "Agent" für Assistenten in Echtzeit. Mit der Umstellung der Voreinstellungen für neue Domains und für Kunden mit kostenlosen Tarifen werden bei Seiten mit Werbung Training und Agent automatisch blockiert, während Search aktiv bleibt. Bei Seiten ohne Werbung bleiben umgekehrt alle drei Funktionen standardmäßig erlaubt.
Für Crawler mit gemischter Nutzung wie Googlebot, Applebot und Bingbot, die 36,6 % des Verkehrs verifizierter Crawler im Netz von Cloudflare ausmachen, hat das Unternehmen den Status eines "Accountable"-Betreibers eingeführt. Cloudflare führt Apple, Google und Microsoft als Accountable-Betreiber, also als Akteure, die vier Transparenzanforderungen erfüllen oder zugesagt haben, sie bis zu genannten Terminen zu erfüllen, darunter ein Opt-out aus dem Training und Prüfwerkzeuge auf Ebene der einzelnen URL. Die technische Betrachtung dieser Zugeständnisse offenbart allerdings weite Unsicherheitsspielräume. Direkte Bestätigungen der großen Technologiekonzerne liegen nicht vor: Die Liste ist eine einseitige Zuschreibung von Cloudflare. Zudem liegen die wichtigsten versprochenen Werkzeuge in der Zukunft, etwa das von Apple für 2027 angekündigte Prüfwerkzeug auf URL-Ebene, die Unterstützung einer "no training"-Präferenz in der robots.txt, die Microsoft/Bing für Anfang 2027 anstrebt, oder die nicht näher bestimmten "wenigen Wochen", von denen Google spricht.
Das Bild prägen auch die von Cloudflare verbreiteten Daten: Weniger als 1 % der Seiten blockiert die klassische Indexierung, während 17 % Maßnahmen gegen das Training künstlicher Intelligenz aktivieren. Das Unternehmen behauptet ferner, mehr als die Hälfte der Nutzer lese die KI-Zusammenfassungen in Suchmaschinen, und danach sei es über 40 % wahrscheinlicher, dass die Suche dort endet, ohne dass die Ursprungsseiten noch aufgerufen werden. Es handelt sich jedoch um netzinterne Messungen von Cloudflare, veröffentlicht ohne öffentliche Methodik und unabhängig nicht überprüfbar. Bleibt die Lücke zwischen dem Setzen einer Präferenz und ihrer tatsächlichen Beachtung: Eine Recherche von PPC Land aus dem August 2026 zeigte, dass in Europa 15 % der Abrufe von KI-Crawlern URLs betrafen, für die ein Verbot ausgesprochen worden war, in einem Umfeld, in dem der Bot-Verkehr 57,4 % des gesamten HTML-Verkehrs ausmachte.
Cloudflares Schritt, von Vorstandschef Matthew Prince als Weg beschrieben, die Offenheit des Netzes zu bewahren und den Produzenten von Inhalten die Kontrolle zurückzugeben, wirkt wie der Versuch, ein rechtsfreies Gebiet einseitig zu regulieren. Doch solange die Sperre auf Versprechen künftiger Konformität und auf einer technischen Höflichkeit beruht, die Crawler umgehen können, bleibt die Souveränität der Verlage über die eigene Arbeit ein befristetes Zugeständnis und kein von der Technik geschütztes Recht.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Ich habe den offiziellen Blogbeitrag von Cloudflare vom 15.09.2026 geöffnet und Datum, die drei Crawler-Klassifizierungen, die neuen Voreinstellungen getrennt nach Seiten mit und ohne Werbung, die vier "Accountable"-Anforderungen mit den Fristen Unternehmen für Unternehmen sowie die Statistiken (weniger als 1 %, 17 %) überprüft. Die Pressemitteilung vom selben Tag bestätigt Datum, das Zitat von Matthew Prince und die 36,6 % Verkehr durch Crawler mit gemischter Nutzung. Als unabhängige Bestätigung habe ich Inside AI News vom 15.09.2026 gelesen, das dieselben Zahlen und dieselben Zusagen von Apple, Google und Microsoft nennt, einschließlich des "targeted for early 2027" von Bing. Die Entstehung der Entscheidung stammt aus dem TechCrunch-Artikel vom 01.07.2026, der technische Kontext und die Anwendungsgrenzen aus dem PPC-Land-Beitrag vom 21.08.2026 über Bot Preference Sync. Keine Gerüchte, keine Leaks: zwei offizielle Unternehmensdokumente und drei Medien, die sie getrennt geprüft haben. In den bereits veröffentlichten Artikeln kam Urheberrecht nur als Gerichtsstreit vor, nie von der Seite der technischen Zugangskontrolle zu Inhalten.
- Incertezze
- Fast alle Zahlen – 17 %, weniger als 1 %, 36,6 %, die Prozentwerte zu Zusammenfassungen und Klicks – sind interne Messungen von Cloudflare, ohne öffentliche Methodik und von außen nicht überprüfbar. Präferenzen in der robots.txt bleiben Signale, keine Barrieren: Sie gelten, solange der Crawler kooperiert, und im August zählte PPC Land in Europa 15 % KI-Abrufe auf bereits untersagten URLs. Zwei der drei wichtigsten "Accountable"-Zusagen sind noch Versprechen – Apples URL-Werkzeug 2027, Microsofts robots.txt-Unterstützung Anfang 2027 – und Google spricht von "wenigen Wochen" ohne Datum. Eine direkte Erklärung von Apple, Google oder Microsoft ist nicht veröffentlicht: Die Liste erklärt Cloudflare. In den ersten 24 Stunden fand ich keine Berichterstattung in einem großen Publikumsmedium und keine Reaktionen von Verlagen oder Branchenverbänden, und der offizielle Beitrag nennt keine Autoren. Ungeklärt bleibt auch, ob und wie die neue Voreinstellung zahlende Kunden mit bestehenden Konfigurationen betrifft.
- Perché pubblicarla
- Die Entscheidung ändert die Voreinstellungen für einen großen Teil des Webs und betrifft direkt alle, die in Italien online publizieren: Ein Verlag, ein Blog oder ein Unternehmen mit Website hinter Cloudflare kann seit gestern das Training ablehnen, ohne die Suche zu verlieren, und eine neue Domain mit Werbung startet bereits mit blockiertem Training und Agent. Es ist zudem der erste Fall, in dem drei große Suchanbieter – zumindest verbal und mit genannten Fristen – die Trennung von Indexierung und Training akzeptieren, also genau das, was sie bisher verweigert hatten. Und die Nachricht passt zum Register dieser Seite: eine operative, überprüfbare Tatsache neben künftigen Zusagen und Zahlen, die das Unternehmen über sich selbst behauptet.
Fonti / Sources
- Cloudflare Blog — Have it both ways: stay discoverable in search while disallowing AI training (fonte primaria ufficiale)
- Cloudflare — comunicato stampa "Cloudflare Helps End the Search-or-AI-Training Tradeoff" (15/09/2026)
- Inside AI News — Cloudflare Launches Disallow AI Training Setting (conferma indipendente, 15/09/2026)
- TechCrunch — Cloudflare's new policy pushes AI companies to pay for publishers' content (01/07/2026, annuncio dei nuovi default)