Щомісяця AI-краулери від великих лабораторій і десятків менш відомих стартапів обходять мільйони сайтів, забираючи текст для навчання моделей і для RAG-систем, які відповідають користувачам напряму, не спрямовуючи їх на оригінальну сторінку. Трафік від таких ботів давно вимірюється мільярдами запитів на день, а видавці роками намагалися це зупинити — і роками програвали, бо дотримання robots.txt для краулера є справою добровільною: хочеш — ігноруй.

Cloudflare вирішила змінити правила гри не через суди чи лобіювання, а через інфраструктуру, яку контролює сама компанія. За даними TechCrunch, нова політика змушує AI-компанії або платити видавцям за доступ до їхнього контенту, або залишатися поза межами інфраструктури, крізь яку проходить значна частка світового вебтрафіку.

Для AI-білдерів це не абстрактна новина про видавничий бізнес. Це зміна вартості й доступності даних, на яких будуються моделі, агенти та пошукові асистенти — і зміна, яку окремий видавець ніколи не міг би провести самотужки, оскільки в нього просто немає технічних важелів впливу на трафік чужих компаній.

Чому саме Cloudflare здатна це продавити

Cloudflare обслуговує величезну частку HTTP-трафіку у світі: за різними оцінками, через мережу компанії щодня проходить значна частина всіх запитів в інтернеті — від звичайних сайтів до API. Це дає їй важіль, недоступний окремому видавцю з файлом robots.txt, і саме тому нова політика має шанс реально змінити поведінку великих AI-компаній, а не залишитися декларацією.

У чому суть нової політики

Технічно нова модель складається з двох частин, які працюють разом.

Що це означає для AI-білдерів на практиці

Наслідки виходять далеко за межі видавничого ринку і стосуються будь-кого, хто будує продукти на основі відкритих веб-даних.

Висновок AiiN

Це продовження старого конфлікту між видавцями та платформами, що індексують їхній контент, — конфлікту, який раніше вели Google News та Facebook. Тільки цього разу правила встановлює не суд чи регулятор, а інфраструктурна компанія, яка технічно здатна їх виконати без жодного судового рішення. Очікуємо, що інші CDN- та bot-management-провайдери підуть за цим прикладом, а постачання даних для моделей перетвориться на такий самий контрактний ланцюжок постачання, як хмарні сервіси чи GPU-потужності. Практичний висновок для AI-білдерів: ставтеся до доступу до контенту як до окремої статті бюджету й ризику постачання, а не як до безкоштовного побічного продукту відкритого вебу — і закладайте це в економіку продукту вже зараз, а не тоді, коли краулер вперше отримає HTTP 402.