Niedoskonały rozejm Cloudflare między wyszukiwarkami a trenowaniem SI
15 września 2026 roku Cloudflare uruchomiła opcję "Disallow AI Training", konfigurowalną dla każdej domeny w ustawieniach bezpieczeństwa. Deklarowanym celem jest zerwanie więzi dotąd wymuszonej na tych, którzy publikują w sieci: oddać własne teksty na trenowanie modeli generatywnych, byle nie zniknąć z tradycyjnych wyników wyszukiwania. Klasyfikacja dzieli teraz działalność robotów na trzy kategorie: "Search" dla indeksowania, "Training" dla trenowania i "Agent" dla asystentów działających w czasie rzeczywistym. Wraz ze zmianą ustawień domyślnych dla nowych domen i dla klientów planów darmowych witryny wyświetlające reklamy będą miały automatycznie zablokowane Training i Agent, podczas gdy Search pozostanie włączony. Odwrotnie w witrynach bez reklam: wszystkie trzy funkcje pozostaną domyślnie dozwolone.
Do obsługi robotów o mieszanym przeznaczeniu, takich jak Googlebot, Applebot i Bingbot, które stanowią 36,6% ruchu zweryfikowanych robotów w sieci Cloudflare, firma wprowadziła status operatora "Accountable". Cloudflare wskazuje Apple, Google i Microsoft jako operatorów Accountable, czyli podmioty, które spełniają — albo zobowiązały się spełnić w zadeklarowanych terminach — cztery wymogi przejrzystości, w tym możliwość wypisania się z trenowania oraz narzędzia inspekcji na poziomie pojedynczego adresu URL. Analiza techniczna tych ustępstw pozostawia jednak szerokie marginesy niepewności. Wielkie firmy technologiczne nie wydały bezpośrednich potwierdzeń: lista jest jednostronnym przypisaniem Cloudflare. Ponadto najważniejsze obiecane narzędzia są odroczone w przyszłość, jak narzędzie inspekcji na poziomie URL ogłoszone przez Apple na 2027 rok, obsługa preferencji "no training" w robots.txt, którą Microsoft/Bing stawia sobie za cel na początek 2027 roku, czy nieokreślone bliżej "kilka tygodni" wskazane przez Google.
Obraz wyznaczają także dane rozpowszechnione przez Cloudflare, według których mniej niż 1% witryn blokuje klasyczne indeksowanie, a 17% włącza rozwiązania mające uniemożliwić trenowanie sztucznych inteligencji. Firma twierdzi też, że ponad połowa użytkowników czyta w wyszukiwarkach streszczenia SI i że po ich przeczytaniu prawdopodobieństwo, iż użytkownik zakończy tam wyszukiwanie, nie przechodząc do witryn źródłowych, rośnie o ponad 40%. To jednak pomiary wewnętrzne sieci Cloudflare, upublicznione bez jawnej metodologii i niemożliwe do niezależnej weryfikacji. Pozostaje wreszcie rozziew między ustawieniem preferencji a ich rzeczywistym poszanowaniem: śledztwo PPC Land z sierpnia 2026 roku pokazywało, że w Europie 15% pobrań robotów SI dotyczyło adresów URL, dla których wyrażono zakaz, w sytuacji gdy ruch generowany przez boty stanowił 57,4% całego ruchu HTML.
Posunięcie Cloudflare, streszczone przez prezesa Matthew Prince'a jako sposób na zachowanie otwartości sieci przez zwrócenie kontroli twórcom treści, przypomina próbę jednostronnego uregulowania terytorium bez prawa. Dopóki jednak blokada opiera się na obietnicach przyszłej zgodności i na technicznej uprzejmości, którą roboty mogą obejść, suwerenność wydawców nad własną pracą pozostaje tymczasowym ustępstwem, a nie prawem chronionym przez technologię.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Otworzyłam oficjalny wpis na blogu Cloudflare z 15.09.2026 i sprawdziłam datę, trzy klasyfikacje robotów, nowe ustawienia domyślne rozdzielone na witryny z reklamami i bez, cztery wymogi "Accountable" wraz z terminami firma po firmie oraz statystyki (mniej niż 1%, 17%). Komunikat prasowy z tego samego dnia potwierdza datę, cytat Matthew Prince'a i 36,6% ruchu robotów o mieszanym przeznaczeniu. Jako niezależne potwierdzenie przeczytałam Inside AI News z 15.09.2026, gdzie podano te same liczby i te same zobowiązania Apple, Google i Microsoftu, w tym "targeted for early 2027" Binga. Genezę decyzji wzięłam z artykułu TechCrunch z 01.07.2026, a kontekst techniczny i granice stosowania z tekstu PPC Land z 21.08.2026 o Bot Preference Sync. Żadnych plotek ani przecieków: dwa oficjalne dokumenty firmy i trzy redakcje, które sprawdziły je osobno. W dotychczas opublikowanych artykułach prawo autorskie pojawiało się wyłącznie jako spór sądowy, nigdy od strony technicznej kontroli dostępu do treści.
- Incertezze
- Niemal wszystkie liczby — 17%, mniej niż 1%, 36,6%, odsetki dotyczące streszczeń i kliknięć — to pomiary wewnętrzne Cloudflare, bez jawnej metodologii i nieweryfikowalne z zewnątrz. Preferencje w robots.txt pozostają sygnałami, nie barierami: działają, dopóki robot współpracuje, a w sierpniu PPC Land liczyła w Europie 15% pobrań SI z adresów już zakazanych. Dwa z trzech najważniejszych zobowiązań "Accountable" to wciąż obietnice — narzędzie Apple na poziomie URL w 2027 roku, obsługa robots.txt Microsoftu na początek 2027 — a Google mówi o "kilku tygodniach" bez daty. Nie ma opublikowanego bezpośredniego oświadczenia Apple, Google ani Microsoftu: listę ogłasza Cloudflare. W pierwszych 24 godzinach nie znalazłam materiału w dużym medium ogólnoinformacyjnym ani reakcji wydawców czy organizacji branżowych, a oficjalny wpis nie podaje autorów. Niejasne pozostaje też, czy i jak nowe ustawienie domyślne dotyka klientów płatnych z wcześniejszymi konfiguracjami.
- Perché pubblicarla
- Decyzja zmienia ustawienia domyślne dla dużej części sieci i dotyczy bezpośrednio tych, którzy publikują online we Włoszech: wydawca, blog lub firma z witryną za Cloudflare może od wczoraj odmówić trenowania, nie tracąc wyszukiwania, a nowa domena z reklamami startuje już z zablokowanym Training i Agent. To także pierwszy przypadek, gdy trzech dużych dostawców wyszukiwania zgadza się — przynajmniej w słowach i z ogłoszonymi terminami — rozdzielić indeksowanie od trenowania, czyli dokładnie na to, czego dotąd odmawiali. I wiadomość pasuje do rejestru serwisu: fakt operacyjny i sprawdzalny obok zobowiązań na przyszłość i liczb, które firma podaje o sobie samej.
Fonti / Sources
- Cloudflare Blog — Have it both ways: stay discoverable in search while disallowing AI training (fonte primaria ufficiale)
- Cloudflare — comunicato stampa "Cloudflare Helps End the Search-or-AI-Training Tradeoff" (15/09/2026)
- Inside AI News — Cloudflare Launches Disallow AI Training Setting (conferma indipendente, 15/09/2026)
- TechCrunch — Cloudflare's new policy pushes AI companies to pay for publishers' content (01/07/2026, annuncio dei nuovi default)