Přeskočit na obsah

Kdy robots.txt nestačí: roboti vyvolaní uživatelem

OpenAI, Google i Perplexity mají fetchery vyvolané uživatelem. OpenAI u nich píše, že robots.txt „nemusí platit“, Google a Perplexity, že ji „obvykle ignorují“.

~800 slov 6 častých otázek ~4 minut čtení Aktualizováno: 13. 9. 2026
Kdy robots.txt nestačí: roboti vyvolaní uživatelem
Stručná odpověď

Když si obsah vyžádá uživatel v konverzaci, nejde o automatické procházení. U OpenAI, Googlu a Perplexity se proto na robots.txt podle dokumentace nedá spolehnout. OpenAI to u ChatGPT-User píše jako „nemusí platit“, Google u devíti svých fetcherů a Perplexity u Perplexity-User jako „obvykle ignorují“. Anthropic naopak u Claude-User uvádí, že robots.txt respektuje.

Kdy robots.txt nestačí: roboti vyvolaní uživatelem

U části AI robotů nemusí robots.txt zabrat. Nejsou to crawlery, které si procházejí web — je to požadavek, který vznikl z konkrétní otázky konkrétního člověka v konverzaci. A tři velcí provozovatelé to mají takhle popsané ve své dokumentaci.

ProvozovatelRobotCo dokumentace říkáCo z toho plyne
OpenAIChatGPT-Userakci vyvolal uživatel, proto pravidla robots.txt nemusí platitpravidlo v robots.txt tenhle provoz nezastaví jistě
Googledevět fetcherůo stažení požádal uživatel, proto obvykle ignorují robots.txttotéž, o něco silněji řečeno
PerplexityPerplexity-Usero stažení požádal uživatel, proto obvykle ignoruje robots.txttotéž

Citace jsou z oficiální dokumentace, čteno 12. srpna 2026, v mém překladu. OpenAI to píše slaběji („nemusí platit“) než Google a Perplexity („obvykle ignorují“), ale pro provoz webu z toho plyne totéž: na tuhle vrstvu se nedá spolehnout. Anthropic to má jinak: u Claude-User uvádí, že robots.txt respektuje (dokumentace aktualizovaná 7. 4. 2026, čteno 13. 9. 2026).

Co s tím na svém webu udělat

Rozhodovat se dá ve třech krocích. Bez prvního nemá smysl dělat druhý.

  1. Zjistěte, jestli ten provoz vůbec máte. V logu serveru si vyfiltrujte ChatGPT-User, Perplexity-User a Google-Agent. U hodně webů to budou jednotky požadavků měsíčně a je hotovo.
  2. Rozhodněte, co je pro vás horší. Přes tyhle roboty chodí obsah k člověku, který se na vás zrovna ptá. Blokace ušetří obsah, ale může znamenat i konec těch návštěv. Odhad hodnoty takové návštěvy má samostatný článek.
  3. Teprve pak zasáhněte — a na serveru. V robots.txt to podle dokumentace nedořešíte.

Když se rozhodnete omezovat

  • Nespoléhat na samotný user agent jde podvrhnout — Google to u téhle kategorie sám píše. Spolehlivější je ověření podle IP a reverzního DNS tam, kde provozovatel rozsahy publikuje.
  • Blokovat úzce, ne plošně špatně napsané pravidlo odřízne i běžné návštěvníky. Pište pravidlo na konkrétní user agent, ne na vzor, který sedne na půlku internetu.
  • Po nasazení se podívat do logů za týden zkontrolujte, koho jste vlastně zablokovali. Tohle je jediný způsob, jak poznat, že pravidlo bere víc, než mělo.
  • Nechat robots.txt tak jak je pravidlo pro fetcher tam neškodí, jen na něj nespoléhejte jako na jistotu.
  • Zapsat si datum a důvod seznamy user agentů se mění a za rok už nikdo nebude vědět, proč to pravidlo vzniklo.

Jak ověřit robota podle IP a reverzního DNS, rozebírá ověřování AI robotů; kdo rozsahy vůbec publikuje a kdo ne, samostatný článek.

Kterých robotů se to týká

U OpenAI je to ChatGPT-User, u Perplexity Perplexity-User. Google jich do téhle kategorie řadí devět:

Google-CWS · FeedFetcher-Google · Google-GeminiNotebook · Google-Agent · GoogleMessages · Google-Pinpoint · GoogleProducer · Google-Read-Aloud · Google-Site-Verification

Důležité je, že sem patří i Google-Agent a Google-GeminiNotebook. Když se tedy bavíme o agentech, kteří chodí na weby za uživatele, bavíme se o provozu, u kterého robots.txt podle dokumentace neplatí spolehlivě.

Kolik českých webů to řeší

Ze stejného měření 80 domén z 12. srpna 2026:

RobotPravidlo má
GPTBot (automatický)12 z 80
Google-Extended (automatický)10 z 80
PerplexityBot (automatický)9 z 80
ChatGPT-User (vyvolaný uživatelem)5 z 80
OAI-SearchBot (automatický)4 z 80
Perplexity-User (vyvolaný uživatelem)3 z 80
kterýkoli z devíti fetcherů Googlu0 z 80

Věta, kterou si z toho odnést: pokud máte v robots.txt jen GPTBota nebo Google-Extended, roboty vyvolané uživatelem tím neřešíte. Všech pět webů s pravidlem pro ChatGPT-User ho má jako přídavek k blokaci tréninku, ne samostatně.

Tři chyby, které se u toho dělají

Považovat robots.txt za hranici, kterou nikdo nepřekročí

U celé jedné kategorie robotů podle dokumentace nejde o spolehlivou řídicí vrstvu.

Mluvit o porušování pravidel

Provozovatelé to popisují předem. Kdo tvrdí, že roboti robots.txt porušují, míchá dvě různé věci.

Blokovat jako první krok

Chodí přes ně lidé, které k vám poslala AI odpověď. Blokace je legitimní volba, ale má cenu.

Limity

  • Je to čtení dokumentace k 12. srpnu 2026 (údaj o Anthropicu k 13. září 2026), ne měření chování. Netestoval jsem, jestli se roboti podle svých pravidel řídí — ani jedním směrem.
  • Vlastní čísla jsou z jednoho odečtu robots.txt na nenáhodném vzorku 80 domén (33 médií, 47 e-shopů z jedné platformy).
  • Seznamy user agentů se mění. I během přípravy tohohle článku přibyl v dokumentaci OpenAI čtvrtý agent — OAI-AdsBot, který ověřuje bezpečnost stránek nabízených jako reklama v ChatGPT. Doplnil jsem ho do tabulky v článku o opt-outech, kde jsem do té doby psal, že roboti OpenAI jsou tři.

Shrnutí

OpenAI, Google i Perplexity popisují kategorii robotů vyvolaných uživatelem, u které robots.txt podle jejich dokumentace není spolehlivá řídicí vrstva. Google do ní řadí i agentní použití.

Ve vzorku 80 českých webů má pravidlo pro ChatGPT-User pět z nich a pro fetchery Googlu nikdo. Kdo po zvážení dopadů chce tenhle provoz omezovat, musí to řešit na serveru — a nejdřív se podívat do logu, jestli ho vůbec má.

Sniper Design
Pomoc s implementací

Nechcete to řešit interně? Postavíme to za vás.

V Sniper Design děláme kompletní AI SEO — strategii, audit, implementaci i obsah. Zlatý partner Upgates i Shoptetu, přes 600 e‑shopů na CZ trhu. Na AI vyhledávání připravujeme návrhy homepage, obsahovou strukturu i audity klientských webů.

  • 600+ e‑shopů
  • Vlastní e‑shop MEGA DETAIL
FAQČasté otázky

Časté otázky, které k tématu nejčastěji padají

Platí robots.txt pro ChatGPT-User?
Podle dokumentace OpenAI nemusí. Píše, že akce jsou vyvolané uživatelem, a proto pravidla robots.txt nemusí platit; ChatGPT-User zároveň neslouží k automatickému procházení webu.
Znamená to, že ti roboti robots.txt porušují?
Ne. Provozovatelé to dopředu popisují ve své dokumentaci, takže je to popsané chování, ne porušení pravidla. Robots.txt se podle nich vztahuje na automatické procházení, ne na požadavek vyvolaný uživatelem.
Jak takového robota zablokuju?
Zasáhnout jde jen na úrovni serveru; robots.txt na to podle dokumentace nestačí. Samotný user agent je ale podvrhnutelný, takže spolehlivější je ověření podle IP tam, kde provozovatel rozsahy publikuje. A počítejte s tím, že za takovým požadavkem stojí člověk, kterého k vám poslala AI odpověď.
Které fetchery Google do téhle kategorie řadí?
Devět: Google-CWS, FeedFetcher-Google, Google-GeminiNotebook, Google-Agent, GoogleMessages, Google-Pinpoint, GoogleProducer, Google-Read-Aloud a Google-Site-Verification. Patří sem tedy i agentní použití.
Kolik českých webů to řeší?
Ve vzorku 80 domén k 12. srpnu 2026 mělo pravidlo pro ChatGPT-User pět webů, pro Perplexity-User tři a pro kterýkoli z devíti fetcherů Googlu nikdo.
Jak poznám, že je robot pravý?
Tam, kde provozovatel publikuje IP rozsahy a ověřovací postup, ověřujte podle IP a reverzního DNS. Google to pro tuhle kategorii publikuje a sám upozorňuje, že user agent jde podvrhnout. Postup rozebírá samostatný článek o ověřování AI robotů.
Čtěte dál

Související články

Všechny články v blogu Zpět na úvod