Přeskočit na obsah

Cloudflare a AI roboti: Search, Agent a Training

Cloudflare rozlišuje u AI robotů tři chování — Search, Agent a Training. Co která volba znamená, kde je past se smíšenými roboty a co čeká nové domény.

~900 slov 6 častých otázek ~5 minut čtení Aktualizováno: 2. 8. 2026
Cloudflare a AI roboti: Search, Agent a Training
Stručná odpověď

Cloudflare řídí AI roboty podle chování, ne podle jména: rozlišuje Search, Agent a Training. U každé kategorie zvolíte, jestli ji blokovat všude, jen na stránkách s reklamou, nebo vůbec ne. Od 15. září 2026 dostávají nově zakládané domény jiné výchozí hodnoty; existující doméně se nic samo nepřepne.

Cloudflare řídí AI roboty podle chování, ne podle jména: rozlišuje Search, Agent a Training. U každé kategorie zvolíte, jestli ji blokovat všude, jen na stránkách s reklamou, nebo vůbec ne. Od 15. září 2026 dostávají nově zakládané domény jiné výchozí hodnoty; existující doméně se nic samo nepřepne.

Pokud jste někdy četli návod ve stylu „zablokujte Bytespider a povolte GPTBot“, je zastaralý. Cloudflare dnes nabízí řízení podle kategorií chování, ne podle jednotlivých jmen robotů.

Co se změnilo a proč to má termín

Od 1. července 2026 může každý zákazník, včetně bezplatného plánu, nastavit chování AI robotů podle tří kategorií zvlášť. U každé z nich jsou tři volby: blokovat na všech stránkách, blokovat jen na stránkách s reklamou, nebo neblokovat.

Dnes jsou podle Cloudflare všechny tři kategorie ve výchozím stavu povolené. Od 15. září 2026 se to mění pro nově zakládané domény: ty mají dostat Training a Agent blokované na stránkách s reklamou a Search povolený. Změnový log k témuž dni dodává, že pod blokaci tréninku spadnou i roboti, kteří kombinují Search a Training.

Tři chování místo seznamu jmen

Aspekt Co to je Co pro vás znamená
Search Chování, které sbírá nebo indexuje obsah, aby z něj později umělo odpovídat Podle Cloudflare chování, které nejpřirozeněji vrací návštěvníky
Agent Automatická činnost jednající v reálném čase za konkrétního člověka Sem patří asistenti, kteří něco vyřizují za uživatele
Training Procházení, které bere obsah na trénink nebo doladění modelu Obsah se natrvalo vstřebá do modelu, návštěvu nečekejte

Rozdíl mezi nimi není akademický. Jako důvod, proč nechává Search povolený i v nových výchozích hodnotách, Cloudflare uvádí, že je to chování, které nejpřirozeněji vrací návštěvníky zpět a že je v zájmu většiny majitelů webů ho povolit.

Tady je nejdůležitější věta celého článku, a je přímo z oznámení Cloudflare: blokace kategorie Training zasáhne i roboty, kteří kombinují Search a Training zároveň.

Podle dokumentace spadají pod starý přepínač i smíšení roboti. Pokud jste se na tuhle volbu spoléhali, ověřte si její aktuální chování v dokumentaci — zvlášť právě u smíšených robotů.

Postup

  1. Otevřete AI Crawl Control u konkrétního webu

    Nastavení je vždy pro jeden web, ne pro celý účet. Vyberte doménu a otevřete AI Crawl Control; když ho v menu nevidíte, zkuste vyhledávání v administraci.

  2. V záložce Crawlers zjistěte, kdo k vám chodí

    Tabulka ukazuje AI roboty, kteří žádají o přístup, a u každého sloupec Action s volbou Allow nebo Block.

  3. Rozhodněte každou kategorii zvlášť

    Search, Agent a Training mají vlastní volbu: blokovat všude, blokovat jen na stránkách s reklamou, nebo neblokovat.

  4. Ověřte smíšené roboty

    Blokace Training zasáhne i roboty patřící zároveň do Search. Pokud vám na jejich přístupu záleží, projděte si to znovu.

Rozhraní Cloudflare se průběžně mění, takže se držte spíš názvu AI Crawl Control než konkrétní cesty v menu. Vedle záložky Crawlers tam najdete i přehled a metriky.

Jak se u každé kategorie rozhodnout

Univerzální odpověď neexistuje, ale rozcestník ano. A jestli řešíte tu obecnější otázku — totiž jestli vůbec chcete být v AI odpovědích — patří k tomu rozhodovací rámec kolem odhlášení.

  • Chcete hlavně omezit použití obsahu pro trénink modelů? Řešte kategorii Training — a počítejte s tím, co je napsané výš o smíšených robotech.
  • Záleží vám, aby vás AI nástroje mohly citovat? Pak je Search ta kategorie, kterou nechcete zavírat jako první.
  • Vyděláváte hlavně reklamou? Volba „blokovat jen na stránkách s reklamou“ existuje přesně pro tenhle případ.
  • Nevíte, co vám AI kanál nese? Tohle je nejčastější stav — a nejlepší první krok není nastavovat, ale změřit.

Jak to souvisí s robots.txt

Nijak se to nevylučuje, jsou to dvě vrstvy nad sebou:

  • robots.txt je žádost. Slušný robot ji respektuje, ostatní ji ignorují. Podrobně to rozebírá robots.txt pro AI roboty.
  • CDN je vynucení. Robot se k obsahu nedostane, ať ho robots.txt zajímá, nebo ne.

Rozumné je mít obojí a pro většinu majitelů webů stačí zapamatovat si jedinou větu: robots.txt je signál, Cloudflare je vynucení.

Časté chyby

01

Zakázat trénink a čekat, že citace zůstanou

Smíšené roboty spadnou pod blokaci tréninku. Obojí nejde vždycky oddělit.

02

Nechat výchozí nastavení a nevědět jaké

Dnes je povoleno vše, od 15. září dostávají nové domény jiné. Podívejte se, co máte vy.

03

Blokovat podle jména robota

User-agent si do hlavičky napíše kdokoli, takže blokace podle jména je děravá. Dokumentace Cloudflare u robotů rozlišuje ověřené a neověřené.

04

Spoléhat jen na jednu vrstvu

Samotný robots.txt nic nevynutí, samotná blokace na CDN zase nedá slušným robotům signál.

Kde má tenhle článek hranice

Neřeší jiná CDN. Je to návod ke Cloudflare; jinde vypadá nastavení jinak.

Nemapuje jména robotů na kategorie. Dokumentace Cloudflare je takto nepřiřazuje, takže to tady dělat nebudeme ani my.

Co si odnést

Změna je hlavně pojmová: místo hádání, který robot je ten zlý, se rozhodujete o třech chováních. Otázka „chci, aby si mě někdo mohl načíst a odpovědět na dotaz?“ se odpovídá líp než „mám blokovat CCBot?“.

Prakticky si odneste tři věci. Podívejte se, jaké nastavení váš web dnes má. U kategorie Training počítejte s tím, že zasáhne i smíšené roboty. A pokud netušíte, co vám AI kanál nese, není prvním krokem nastavovat, ale změřit.


Pokud nejdřív potřebujete zjistit, jestli vám z AI nástrojů vůbec někdo chodí, dává smysl začít měřením: AI SEO audit za 3 600 Kč projde měření i viditelnost a řekne, z čeho se rozhodovat.

Zdroje: oznámení Cloudflare „Your site, your rules“, changelog z 1. 7. 2026 a dokumentace AI Crawl Control. Stav k 19. 7. 2026 — nastavení i termíny se můžou měnit, článek budeme aktualizovat.

Sniper Design
Pomoc s implementací

Nechcete to řešit interně? Postavíme to za vás.

V Sniper Design děláme kompletní AI SEO — strategii, audit, implementaci i obsah. Zlatý partner Upgates i Shoptetu, přes 600 e‑shopů na CZ trhu. Na AI vyhledávání připravujeme návrhy homepage, obsahovou strukturu i audity klientských webů.

  • 600+ e‑shopů
  • Vlastní e‑shop MEGA DETAIL
FAQČasté otázky

Časté otázky, které k tématu nejčastěji padají

Co Cloudflare u AI robotů vlastně rozlišuje?
Tři chování místo jmen robotů. Search je chování, které sbírá nebo indexuje obsah, aby z něj později mohlo čerpat při odpovědích. Agent je automatická činnost jednající v reálném čase za konkrétního člověka. Training je procházení, které bere obsah na trénink nebo doladění modelu. U každé kategorie se rozhodujete samostatně.
Co se mění 15. září 2026?
Podle změnového logu Cloudflare dostanou k tomuto datu nově zakládané domény jiné výchozí hodnoty: Training a Agent blokované na stránkách s reklamou, Search povolený. Ke stejnému dni mají pod blokaci tréninku spadnout i roboti, kteří kombinují Search a Training. Existující doméně se ale nic samo nepřepne a vlastní nastavení si můžete zvolit kdykoli.
Přijdu blokací tréninku o citace v AI odpovědích?
Cloudflare k dopadu na citace nic neuvádí, takže to nikdo netvrdí za něj. Uvádí ale, že blokace kategorie Training zasáhne i roboty, kteří kombinují Search a Training zároveň. Praktický důsledek může být ten, že robot z takového obsahu nebude mít z čeho čerpat; přesný dopad na citace ani na návštěvnost z toho ale odvodit nejde. Rozhodujte se s vědomím, že tyhle dvě věci nejdou vždy oddělit.
Je to dostupné i na bezplatném plánu?
Ano. Cloudflare uvádí, že novou správu AI provozu mají všichni zákazníci včetně Free plánu. Na bezplatných plánech se roboti rozpoznávají podle user-agent řetězce, placené Bot Management detekci vylepšuje.
Nahradí tohle nastavení robots.txt?
Ne, jsou to dvě různé vrstvy. Robots.txt je žádost, kterou slušný robot respektuje a ostatní ignorují. Blokace na úrovni CDN je vynucení — robot se k obsahu nedostane. Rozumné je mít obojí: robots.txt jako signál a CDN jako pojistku.
Proč Cloudflare nechává Search povolený?
Ve svém oznámení to zdůvodňuje tím, že Search je chování, které nejpřirozeněji vrací návštěvníky zpět, a že je podle nich v zájmu většiny majitelů webů ho povolit. Je to jejich vyjádření a zdůvodnění vlastního rozhodnutí, ne nezávislé měření.
Čtěte dál

Související články

Všechny články v blogu Zpět na úvod