TL;DR
1 lipca 2026 Cloudflare ogłosiło największą zmianę w zarządzaniu ruchem botów od lat: od 15 września 2026 crawlery AI zostaną podzielone na trzy kategorie (wyszukiwarkowe, agentowe i treningowe), a na stronach wyświetlających reklamy boty treningowe i agentowe będą domyślnie blokowane. Przez Cloudflare przechodzi znacząca część polskiego internetu — jeśli Twoja strona z niego korzysta, we wrześniu może po cichu zniknąć z odpowiedzi ChatGPT, Perplexity czy Claude, albo odwrotnie: zyskać kontrolę, której nigdy nie miała.
Poniżej wyjaśniamy, co dokładnie się zmienia, jak sprawdzić własną konfigurację i jak ją ustawić w zależności od tego, czy zależy Ci na widoczności w AI, ochronie treści — czy jednym i drugim naraz.
Co dokładnie zmienia Cloudflare
Ogłoszenie z 1 lipca (Cloudflare nazwało je „Content Independence Day") wprowadza trzy mechanizmy:
| Mechanizm | Na czym polega |
|---|---|
| Podział crawlerów na trzy kategorie. | Boty wyszukiwarkowe (budują indeksy i odsyłają ruch), boty agentowe (wykonują zadania na zlecenie użytkownika, np. porównują oferty) i boty treningowe (zbierają dane do trenowania modeli). Każdą kategorię można kontrolować osobno. |
| Nowe ustawienia domyślne od 15 września 2026. | Na stronach z reklamami: boty wyszukiwarkowe przepuszczane, treningowe i agentowe — blokowane. Właściciel może te domyślne zmienić w każdej chwili, ale musi to zrobić świadomie. |
| Content Signals w robots.txt. | Nowy parametr use= z wartościami immediate (natychmiastowe użycie w odpowiedzi), reference (cytowanie z odesłaniem) i full (pełne wykorzystanie, w tym trening) — czytelna deklaracja, na co pozwalasz. |
Do tego ewoluuje model płatności: Pay Per Crawl zmienia się w Pay Per Use — rozliczenie następuje wtedy, gdy treść realnie zasila odpowiedź AI, a nie przy samym pobraniu. Kontekst skali: według danych przytaczanych przez TechCrunch ponad połowa ruchu crawlerów AI to wielokrotne pobieranie stron, które się nie zmieniły.
Kogo to dotyczy — i jak sprawdzić, czy Ciebie
Zmiana obejmuje witryny korzystające z Cloudflare jako proxy/CDN/WAF. Jak to sprawdzić w 3 minuty:
- Sprawdź nagłówki odpowiedzi serwera. W narzędziach deweloperskich przeglądarki (zakładka Sieć) otwórz swoją stronę i poszukaj nagłówków server: cloudflare lub cf-ray. Ich obecność oznacza, że ruch przechodzi przez Cloudflare.
- Zapytaj wykonawcę strony lub hosting. Cloudflare bywa włączane na poziomie DNS przez agencje i hostingi — właściciel firmy często o tym nie wie.
- Zaloguj się do panelu Cloudflare (jeśli masz dostęp) i sprawdź sekcję AI Crawl Control — tam zobaczysz, które boty odwiedzają witrynę i co jest obecnie blokowane.
Kluczowe pytanie przed 15 września: czy Twoja strona wyświetla reklamy (np. AdSense)? Jeśli tak — nowe blokady obejmą ją automatycznie. Jeśli nie — domyślne ustawienia będą łagodniejsze, ale świadoma konfiguracja i tak jest wskazana.
Które boty są które: mapa dla właściciela firmy
Decyzje o blokowaniu wymagają rozróżnienia botów — blokada jednego nie oznacza blokady pozostałych funkcji tej samej firmy:
| Bot | Firma | Kategoria | Co się stanie po blokadzie |
|---|---|---|---|
| OAI-SearchBot | OpenAI | wyszukiwarkowy | strona znika z wyników ChatGPT Search — tracisz ruch odsyłany |
| GPTBot | OpenAI | treningowy | treść nie trafia do trenowania modeli; widoczność w ChatGPT Search zostaje |
| ChatGPT-User | OpenAI | agentowy | agent nie odwiedzi strony na żywo na prośbę użytkownika |
| PerplexityBot | Perplexity | wyszukiwarkowy | strona wypada z cytowań Perplexity |
| ClaudeBot | Anthropic | treningowy | treść nie zasila trenowania Claude |
| Googlebot | wyszukiwarkowy | nie dotyczy zmiany — indeksowanie Google działa po staremu |
Pełne, aktualne listy botów publikują OpenAI, Perplexity, Anthropic i Google w swojej dokumentacji — przed decyzją sprawdź źródło, bo role botów bywają doprecyzowywane.
Trzy scenariusze konfiguracji
Widoczność w AI
Scenariusz 1: firma chce być widoczna w AI (typowe B2B i e-commerce). Ruch z odpowiedzi AI konwertuje — dane branżowe z USA mówią o wyraźnie wyższej konwersji niż z klasycznych źródeł. Konfiguracja: przepuść boty wyszukiwarkowe (OAI-SearchBot, PerplexityBot) i agentowe, rozważ blokadę wyłącznie treningowych, w Content Signals ustaw co najmniej reference. Po 15 września zweryfikuj, czy nowe domyślne blokady nie wycięły botów, na których Ci zależy.
Monetyzacja treści
Scenariusz 2: wydawca/twórca treści chce monetyzacji. Zostaw domyślne blokady treningowe, przetestuj Pay Per Use dla botów, które chcą więcej niż cytowania. To pierwszy realny mechanizm negocjacyjny między właścicielem treści a firmami AI.
Dane wrażliwe i przewaga konkurencyjna
Scenariusz 3: dane wrażliwe lub przewaga konkurencyjna w treści. Blokuj treningowe i agentowe, przepuść wyszukiwarkowe tylko jeśli chcesz ruchu z odsyłaczy. Pamiętaj: robots.txt i blokady Cloudflare kontrolują crawl, ale nie usuwają z indeksów tego, co już pobrano.
Pułapki, na które trzeba uważać
| Pułapka | Na co uważać |
|---|---|
| Cicha utrata widoczności. | Najczęstszy błąd po 15 września będzie brzmiał: nikt nic nie zmieniał, a cytowania w ChatGPT spadły. Zanotuj stan przed zmianą (seria pomiarów na stałym zestawie zapytań), żeby mieć porównanie. |
| Bot-shadowing przez WAF. | Reguły anty-botowe (nie tylko Cloudflare) potrafią blokować boty AI od dawna — sprawdź logi serwera: czy OAI-SearchBot i PerplexityBot w ogóle dostają odpowiedzi 200? |
| Mylenie kategorii. | Blokada GPTBot (trening) nie wycina Cię z ChatGPT Search — za to blokada OAI-SearchBot tak. Decyzje podejmuj na poziomie konkretnego bota, nie firmy. |
| Content Signals to deklaracja, nie zamek. | Parametr use= wyraża wolę właściciela; egzekwowanie zależy od uczciwości bota oraz technicznych blokad. Traktuj go jako warstwę prawno-komunikacyjną, nie zabezpieczenie. |
Checklista przed 15 września
- [ ] Ustal, czy Twoja witryna przechodzi przez Cloudflare (nagłówki cf-ray / pytanie do hostingu).
- [ ] Sprawdź, czy strona wyświetla reklamy — to warunek najostrzejszych domyślnych blokad.
- [ ] Zrób serię pomiarów widoczności w AI (stały zestaw zapytań w ChatGPT, Perplexity, AI Mode) jako punkt odniesienia.
- [ ] Przejrzyj logi: które boty AI odwiedzają stronę i z jakim kodem odpowiedzi.
- [ ] Wybierz scenariusz (widoczność / monetyzacja / ochrona) i skonfiguruj kategorie botów w panelu Cloudflare.
- [ ] Zaktualizuj robots.txt o Content Signals zgodnie z decyzją.
- [ ] Po 15 września powtórz pomiary widoczności i porównaj z punktem odniesienia.
FAQ
Nie wiem, czy moja strona korzysta z Cloudflare. Jak to sprawdzić najszybciej?
Otwórz stronę z narzędziami deweloperskimi przeglądarki i sprawdź nagłówki odpowiedzi: server cloudflare lub cf-ray oznaczają ruch przez Cloudflare. Możesz też zapytać hosting lub wykonawcę strony — usługa bywa włączana na poziomie DNS bez wiedzy właściciela.
Czy zmiana Cloudflare wpłynie na moją pozycję w Google?
Nie. Googlebot należy do kategorii wyszukiwarkowej, która pozostaje przepuszczana, a zmiana nie dotyczy indeksowania Google. Wpływ dotyczy widoczności w narzędziach AI: ChatGPT, Perplexity, Claude i podobnych.
Chcę być cytowany w ChatGPT. Które boty muszę przepuścić?
Minimum to OAI-SearchBot, który buduje indeks ChatGPT Search. Warto też przepuścić ChatGPT-User, by agent mógł odwiedzić stronę na żywo. Blokada GPTBot dotyczy wyłącznie trenowania modeli i nie wycina strony z wyników wyszukiwania ChatGPT.
Czy mogę zarobić na dostępie botów AI do moich treści?
Cloudflare rozwija model Pay Per Use, w którym rozliczenie następuje, gdy treść realnie zasila odpowiedź AI. To opcja głównie dla wydawców z unikalnymi treściami; typowa strona firmowa więcej zyska na widoczności niż na opłatach.
Zablokowałem wszystkie boty AI rok temu. Czy coś muszę zmieniać?
Przejrzyj decyzję na nowo: od tego czasu ruch odsyłany z odpowiedzi AI wyraźnie urósł i dobrze konwertuje. Rozważ przepuszczenie botów wyszukiwarkowych przy utrzymaniu blokady treningowych — to kompromis między widocznością a ochroną treści.
Czy Content Signals w robots.txt są prawnie wiążące?
To narzędzie deklaracji woli właściciela treści — jego status prawny nie jest jeszcze przetestowany w sądach. Traktuj je jako czytelny komunikat dla uczciwych botów i dokumentację Twojej decyzji, a realną kontrolę opieraj na blokadach technicznych.
Podsumowanie
15 września 2026 Cloudflare zmieni domyślne zasady gry: na stronach z reklamami boty treningowe i agentowe AI zostaną zablokowane bez pytania. Dla jednych firm to ryzyko cichego zniknięcia z odpowiedzi ChatGPT i Perplexity, dla innych — pierwsza realna dźwignia kontroli i monetyzacji treści. Kluczowe działania: ustal, czy korzystasz z Cloudflare, zmierz obecną widoczność w AI jako punkt odniesienia, rozróżnij boty wyszukiwarkowe od treningowych i agentowych, wybierz świadomie jeden z trzech scenariuszy konfiguracji — i powtórz pomiary po wejściu zmian, żeby wiedzieć, co naprawdę się stało.
Powiązane materiały
Źródła
Poniższe źródła dokumentują nową politykę Cloudflare wobec ruchu botów AI oraz oficjalne stanowiska OpenAI i Google w tej sprawie.
- Your site, your rules: new AI traffic options for all customers — ogłoszenie nowych domyślnych ustawień ruchu AI (kategorie Training i Agent blokowane od 15.09.2026 na stronach z reklamami) (odczyt: 26.07.2026).
- AI Crawl Control — oficjalna dokumentacja narzędzia do monitorowania i kontrolowania dostępu crawlerów AI do treści witryny (odczyt: 26.07.2026).
- Overview of OpenAI Crawlers — oficjalny wykaz i opis crawlerów OpenAI (GPTBot, OAI-SearchBot, OAI-AdsBot, ChatGPT-User) (odczyt: 26.07.2026).
- Overview of Google crawlers and fetchers (user agents) — oficjalna dokumentacja Google Search Central opisująca kategorie crawlerów Google (odczyt: 26.07.2026).
- Cloudflare's new policy pushes AI companies to pay for publishers' content — relacja prasowa o nowej polityce Cloudflare, w tym wypowiedź CEO Matthew Prince'a (odczyt: 26.07.2026).
Historia aktualizacji
Datę modyfikacji zmieniamy wyłącznie po istotnej aktualizacji treści.
- — pierwsza publikacja po weryfikacji bieżących źródeł.
Aktualne informacje handlowe
Sprawdźmy, jaki następny krok ma sens
Na nowe zapytanie odpowiadamy zwykle w ciągu 24 godzin. Po zapoznaniu się z podstawowymi informacjami możemy przygotować wstępną diagnozę w ciągu dwóch dni roboczych, jeżeli zakres i dostępne dane na to pozwalają. Pełny audyt jest osobnym produktem, a jego zakres i termin ustalamy indywidualnie.
ZGŁOŚ STRONĘ DO WSTĘPNEJ DIAGNOZY →
Szczegóły cenowe i warunki współpracy
Niska cena może oznaczać węższy zakres, a nie automatycznie spam lub karę. Zakres, odpowiedzialność, sposób wdrożenia i aktualne ceny usług sprawdź w cenniku oraz indywidualnej ofercie. Zobacz aktualny cennik usług.
