Недосконале перемир'я Cloudflare між пошуковими системами й навчанням ШІ
15 вересня 2026 року Cloudflare увела в дію опцію "Disallow AI Training", яку налаштовують для кожного домену в параметрах безпеки. Заявлена мета — розірвати зв'язок, досі накинутий усім, хто публікує в мережі: віддавати власні тексти на навчання генеративних моделей, аби лише не зникнути зі звичайних результатів пошуку. Класифікація тепер поділяє роботу сканерів на три категорії: "Search" — індексація, "Training" — навчання, "Agent" — помічники, що працюють у реальному часі. Зі зміною типових значень для нових доменів і для клієнтів безкоштовних тарифів на сайтах із рекламою Training і Agent блокуються автоматично, а Search залишається ввімкненим. Натомість на сайтах без реклами всі три функції за замовчуванням лишаються дозволеними.
Для сканерів змішаного призначення — Googlebot, Applebot і Bingbot, на які припадає 36,6% трафіку перевірених сканерів у мережі Cloudflare, — компанія запровадила статус оператора "Accountable". Cloudflare називає Apple, Google і Microsoft операторами Accountable, тобто тими, хто виконує — або зобов'язався виконати до оголошених термінів — чотири вимоги прозорості, серед них відмову від навчання та інструменти перевірки на рівні окремої адреси URL. Проте технічний розбір цих поступок залишає широкі поля невизначеності. Великі технологічні компанії не оприлюднили прямих підтверджень: перелік — одностороннє приписування Cloudflare. До того ж головні обіцяні інструменти віднесені в майбутнє: інструмент перевірки на рівні URL, оголошений Apple на 2027 рік, підтримка налаштування "no training" у robots.txt, яку Microsoft/Bing ставить за мету на початок 2027 року, або неуточнені "кілька тижнів", про які говорить Google.
Картину задають і дані, поширені Cloudflare: менш як 1% сайтів блокує класичну індексацію, тоді як 17% вмикають засоби проти навчання штучного інтелекту. Компанія твердить також, що понад половина користувачів читає зведення ШІ в пошукових системах і що після їхнього прочитання ймовірність завершити пошук саме там, не переходячи на сайти-джерела, вища більш ніж на 40%. Це, однак, вимірювання в межах мережі Cloudflare, оприлюднені без відкритої методики й непроверені незалежно. Лишається й розрив між налаштуванням переваг і їхнім реальним дотриманням: розслідування PPC Land у серпні 2026 року показувало, що в Європі 15% звернень ШІ-сканерів стосувалися адрес URL, для яких було висловлено заборону, — за умов, коли трафік ботів становив 57,4% усього HTML-трафіку.
Крок Cloudflare, який виконавчий директор Метью Принс підсумував як спосіб зберегти відкритість мережі, повернувши контроль тим, хто творить зміст, скидається на спробу самотужки врегулювати територію без законів. Але поки блокування тримається на обіцянках майбутньої відповідності й на технічній ввічливості, яку сканери можуть обійти, суверенність видавців над власною працею залишається тимчасовою поступкою, а не правом, захищеним технологією.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Я відкрила офіційний запис у блозі Cloudflare від 15.09.2026 і перевірила дату, три класифікації сканерів, нові типові значення, окремі для сайтів із рекламою та без неї, чотири вимоги "Accountable" зі термінами по кожній компанії та статистику (менш як 1%, 17%). Пресреліз того самого дня підтверджує дату, цитату Метью Принса та 36,6% трафіку сканерів змішаного призначення. Як незалежне підтвердження прочитала Inside AI News від 15.09.2026: ті самі числа й ті самі зобов'язання Apple, Google і Microsoft, включно з "targeted for early 2027" у Bing. Передісторію рішення взяла зі статті TechCrunch від 01.07.2026, технічний контекст і межі застосування — з матеріалу PPC Land від 21.08.2026 про Bot Preference Sync. Ні чуток, ні витоків: два офіційні документи компанії і три видання, які перевірили їх окремо. У вже опублікованих матеріалах авторське право поставало лише як судовий спір, ніколи з боку технічного контролю доступу до змісту.
- Incertezze
- Майже всі наведені числа — 17%, менш як 1%, 36,6%, частки щодо зведень і переходів — це внутрішні вимірювання Cloudflare, без відкритої методики й без можливості перевірити їх іззовні. Переваги в robots.txt лишаються сигналами, не бар'єрами: вони діють, поки сканер співпрацює, а в серпні PPC Land нарахувала в Європі 15% звернень ШІ до вже заборонених адрес. Два з трьох найважливіших зобов'язань "Accountable" — ще обіцянки: інструмент Apple на рівні URL у 2027 році, підтримка robots.txt у Microsoft на початку 2027 року; Google говорить про "кілька тижнів" без дати. Прямої заяви Apple, Google чи Microsoft не опубліковано: перелік оголошує Cloudflare. За перші добу я не знайшла матеріалів у великому загальному виданні й реакцій видавців або галузевих об'єднань, а авторів офіційного запису не зазначено. Не з'ясовано й те, чи і як нове типове значення торкається платних клієнтів із наявними налаштуваннями.
- Perché pubblicarla
- Рішення змінює типові значення для великої частини мережі й прямо стосується тих, хто публікує онлайн в Італії: видавець, блог або компанія з сайтом за Cloudflare від учора може відмовити в навчанні, не втративши пошук, а новий домен із рекламою стартує вже із заблокованими Training і Agent. Це ще й перший випадок, коли три великі постачальники пошуку погоджуються — хоч би на словах і з оголошеними термінами — відокремити індексацію від навчання, тобто саме на те, у чому досі відмовляли. І новина пасує регістру сайту: робочий, перевірюваний факт поряд з обіцянками на майбутнє й числами, які компанія заявляє про себе.
Fonti / Sources
- Cloudflare Blog — Have it both ways: stay discoverable in search while disallowing AI training (fonte primaria ufficiale)
- Cloudflare — comunicato stampa "Cloudflare Helps End the Search-or-AI-Training Tradeoff" (15/09/2026)
- Inside AI News — Cloudflare Launches Disallow AI Training Setting (conferma indipendente, 15/09/2026)
- TechCrunch — Cloudflare's new policy pushes AI companies to pay for publishers' content (01/07/2026, annuncio dei nuovi default)