Несовершенное перемирие Cloudflare между поиском и обучением ИИ
15 сентября 2026 года Cloudflare включила опцию "Disallow AI Training", настраиваемую для каждого домена в разделе безопасности. Заявленная цель — разорвать связку, до сих пор навязанную всем, кто публикует в сети: отдавать свои тексты на обучение генеративных моделей, лишь бы не исчезнуть из обычных результатов поиска. Классификация теперь делит работу сборщиков данных на три категории: "Search" — индексация, "Training" — обучение, "Agent" — помощники, работающие в реальном времени. С изменением значений по умолчанию для новых домена и для клиентов бесплатных тарифов у сайтов с рекламой Training и Agent блокируются автоматически, а Search остаётся включённым. И наоборот: у сайтов без рекламы все три функции по умолчанию остаются разрешёнными.
Для сборщиков смешанного назначения — Googlebot, Applebot и Bingbot, на которые приходится 36,6% трафика проверенных сборщиков в сети Cloudflare, — компания ввела статус "Accountable"-оператора. Cloudflare называет Apple, Google и Microsoft операторами Accountable, то есть теми, кто выполняет — или обязался выполнить к объявленным срокам — четыре требования прозрачности, среди них отказ от обучения и инструменты проверки на уровне отдельного адреса URL. Однако технический разбор этих уступок оставляет широкие зоны неопределённости. Крупные технологические компании не выпустили прямых подтверждений: список — односторонняя атрибуция Cloudflare. К тому же главные обещанные инструменты отнесены в будущее: инструмент проверки на уровне URL, объявленный Apple на 2027 год, поддержка предпочтения "no training" в robots.txt, которую Microsoft/Bing ставит целью на начало 2027 года, и не уточнённые "несколько недель", о которых говорит Google.
Картину задают и данные, распространённые Cloudflare: менее 1% сайтов блокируют классическую индексацию, тогда как 17% включают средства против обучения искусственного интеллекта. Компания утверждает также, что более половины пользователей читают сводки ИИ в поисковиках и что после их прочтения вероятность закончить поиск на этом, не переходя на сайты-источники, выше более чем на 40%. Но это измерения внутри сети Cloudflare, опубликованные без методики и не проверяемые независимо. Остаётся и разрыв между настройкой предпочтений и их реальным соблюдением: расследование PPC Land в августе 2026 года показывало, что в Европе 15% обращений ИИ-сборщиков касались адресов URL, для которых запрет был выражен, — при том что трафик ботов составлял 57,4% всего HTML-трафика.
Ход Cloudflare, который глава компании Мэтью Принс описал как способ сохранить открытость сети, вернув контроль тем, кто создаёт содержание, похож на попытку в одиночку урегулировать территорию без законов. Но пока запрет держится на обещаниях будущего соответствия и на технической вежливости, которую сборщики могут обойти, власть издателей над собственной работой остаётся временной уступкой, а не правом, защищённым технологией.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Я открыла официальную запись в блоге Cloudflare от 15.09.2026 и проверила дату, три классификации сборщиков, новые значения по умолчанию, различающиеся для сайтов с рекламой и без, четыре требования "Accountable" со сроками по каждой компании и статистику (менее 1%, 17%). Пресс-релиз того же дня подтверждает дату, цитату Мэтью Принса и 36,6% трафика сборщиков смешанного назначения. Как независимое подтверждение я прочла Inside AI News от 15.09.2026: те же цифры и те же обязательства Apple, Google и Microsoft, включая "targeted for early 2027" у Bing. Предысторию решения взяла из статьи TechCrunch от 01.07.2026, технический контекст и границы применения — из материала PPC Land от 21.08.2026 о Bot Preference Sync. Ни слухов, ни утечек: два официальных документа компании и три издания, проверившие их отдельно. В уже опубликованных материалах авторское право у нас появлялось только как судебный спор, никогда со стороны технического контроля доступа к содержанию.
- Incertezze
- Почти все приведённые числа — 17%, менее 1%, 36,6%, доли по сводкам и переходам — это внутренние измерения Cloudflare, без публичной методики и без возможности проверить их извне. Предпочтения в robots.txt остаются сигналами, а не барьерами: они действуют, пока сборщик сотрудничает, и в августе PPC Land фиксировала в Европе 15% обращений ИИ к уже запрещённым адресам. Два из трёх самых важных обязательств "Accountable" — пока обещания: инструмент Apple на уровне URL в 2027 году, поддержка robots.txt у Microsoft в начале 2027 года; Google говорит о "нескольких неделях" без даты. Прямого заявления Apple, Google или Microsoft не опубликовано: список объявляет Cloudflare. За первые сутки я не нашла публикаций в крупном общественно-политическом издании и реакций издателей или отраслевых объединений, а авторы официальной записи не указаны. Остаётся неясным и то, затрагивает ли новое значение по умолчанию платных клиентов с уже существующими настройками.
- Perché pubblicarla
- Решение меняет значения по умолчанию для большой части сети и прямо касается тех, кто публикует в интернете в Италии: издатель, блог или компания с сайтом за Cloudflare с вчерашнего дня может отказаться от обучения, не теряя поиск, а новый домен с рекламой стартует уже с заблокированными Training и Agent. Это ещё и первый случай, когда три крупных поисковых поставщика соглашаются — хотя бы на словах и с объявленными сроками — отделить индексацию от обучения, то есть именно на то, в чём до сих пор отказывали. И новость подходит регистру сайта: рабочий, проверяемый факт рядом с обещаниями на будущее и с цифрами, которые компания заявляет о себе.
Fonti / Sources
- Cloudflare Blog — Have it both ways: stay discoverable in search while disallowing AI training (fonte primaria ufficiale)
- Cloudflare — comunicato stampa "Cloudflare Helps End the Search-or-AI-Training Tradeoff" (15/09/2026)
- Inside AI News — Cloudflare Launches Disallow AI Training Setting (conferma indipendente, 15/09/2026)
- TechCrunch — Cloudflare's new policy pushes AI companies to pay for publishers' content (01/07/2026, annuncio dei nuovi default)