Filtry jsou hlavně problém procházení
Faceted navigace je filtrování výpisu podle parametrů — barvy, velikosti, ceny, značky. Když každá kombinace vytvoří vlastní adresu, vyrobí i pár zaškrtávátek v kategorii tisíce až desetitisíce adres — obvykle mnohem víc, než kolik má kategorie užitečných vstupních stránek. Google to popisuje stejně: implementace filtrů přes parametry v adrese umí vyrobit nekonečný prostor adres.
Dokumentace jmenuje dva následky. Když jsou takové adresy pro robota objevitelné, projde jich velké množství, než vyhodnotí, že jsou k ničemu. A protože ten čas někde chybí, objevování nových užitečných stránek se zpomalí. V dokumentaci je to tedy především otázka procházení a spotřeby zdrojů. Jakmile ale z nějaké kombinace uděláte indexovatelnou stránku, přidá se k tomu i obsah: bez vlastního textu z ní snadno vznikne tenká stránka.
Pro AI éru z toho neplyne, že máte spekulovat o rozpočtu procházení AI robotů — doklad k tomu nikdo nezveřejnil. Plyne z toho něco jednoduššího: stránky, na kterých vám záleží, musí být normálně dostupné a prolinkované, zatímco nekonečné kombinace filtrů nemají zdržovat nikoho.
Co Google dokumentuje — a co ne
Dokument Managing crawling of faceted navigation URLs (naposledy aktualizovaný 18. 12. 2025) nabízí dvě cesty a je u nich nezvykle přímý:
| Aspekt | Nepotřebujete filtry v indexu | Potřebujete je tam |
|---|---|---|
| Co Google radí | zabránit procházení filtrovaných adres | držet se pravidel pro tvar adres a počítat s náklady |
| Čím to udělat | zákaz v robots.txt nebo filtrování přes fragment adresy | oddělovač &, stabilní pořadí filtrů v cestě, žádné duplicitní filtry |
| Co to stojí | výrazně menší náklad na procházení; robot blokované adresy nemá načítat | podle dokumentace „velké množství výpočetních zdrojů“ kvůli počtu adres a jejich vykreslování |
Fragment ale není univerzální řešení architektury filtrů. Dává smysl jen tam, kde filtrovaný stav nepotřebujete jako samostatnou stránku a kde zvládnete udržet ovládání použitelné pro lidi — sdílení adresy filtrovaného výpisu tím ztratíte.
K první cestě Google dodává větu, kterou stojí za to citovat celou: často není dobrý důvod nechat filtrované položky procházet, protože to spotřebovává zdroje serveru bez užitku nebo se zanedbatelným užitkem — a místo toho stačí nechat procházet stránky jednotlivých produktů a jeden výpis bez filtrů.
Čtyři nástroje a jejich skutečná síla
Tohle je nejpraktičtější část dokumentace, protože Google sám říká, co funguje líp a co hůř:
Od nejsilnějšího po nejslabší
- Zákaz v robots.txt Dokumentace uvádí přímo ukázku se zákazem parametrů typu ?color= a ?size= a s výjimkou pro jeden nefiltrovaný výpis. Robot blokovanou adresu nemá načítat, takže náklad na stažení nevznikne — samotnou adresu ale znát může.
- Filtrování přes fragment adresy Google fragmenty (část za #) při procházení a indexaci obecně nepodporuje. Filtr zapsaný jako #color=green tak podle dokumentace nemá na procházení žádný vliv — ani kladný, ani záporný.
- rel=canonical na nefiltrovanou verzi Označené jako dlouhodobě méně účinné. Objem procházení nekanonických adres může časem klesnout; je to postupný a nezaručený efekt, ne zákaz.
- rel=nofollow na odkazech Také méně účinné a navíc křehké: atribut musí být na každém odkazu, který na tu adresu míří. Stačí jeden odkaz bez něj a efekt padá.
Pořadí není náhoda. První dva nástroje snižují počet samostatně procházených filtrovaných adres: robots.txt blokuje načtení konkrétních adres, fragment za # obvykle samostatnou adresu k procházení vůbec nevytvoří. rel=canonical se vyhodnocuje až po stažení stránky, takže náklad na procházení už vznikl. rel=nofollow sice robot vidí dřív, na odkazující stránce, ale je křehký: stačí jeden odkaz bez něj a spolehlivá zábrana to není.
Kdy filtrovaná stránka zaslouží vlastní místo
Teď ta část, kterou Google nedokumentuje a která je rozhodnutím majitele webu. Filtrovaná stránka dává smysl jako samostatná stránka jen tehdy, když splní všechny tři podmínky najednou:
Tři podmínky, ne jedna
- Lidé tu kombinaci opravdu hledají Doložte to daty, ne dojmem: hledanost fráze, dotazy ve vyhledávání na webu, dotazy v Search Console. „Dámské zimní bundy do −20 °C“ ano, „bundy seřazené od nejlevnějších“ ne.
- Stránka nese vlastní obsah Nadpis, úvodní odstavec k výběru, případně vlastní FAQ. Když je jediný rozdíl proti kategorii jiné pořadí stejných produktů, vlastní stránku si nezaslouží.
- Kombinace je stabilní a nevyprázdní se Adresa, která dnes vrací dvacet produktů a příští měsíc nula, je horší než žádná. Sezónní a skladově vratké kombinace nechte zavřené.
Pokud kombinace projde, přestaňte s ní zacházet jako s filtrem. Udělejte z ní řádnou stránku s vlastní adresou v cestě (/bundy/zimni-damske/), prolinkujte ji z kategorie normálním odkazem a dejte ji do sitemapy. Filtr pak zůstane jen ovládacím prvkem pro člověka, ne cestou k indexovatelné adrese. Jak má taková adresa vypadat, rozebírá URL struktura pro AI, co má být v jejím textu texty kategorií pro AI.
Prázdné kombinace a prázdné kategorie
Dvě situace, u kterých má Google konkrétní pokyn, a obě se v praxi dělají špatně:
Co vracet
- Kombinace filtrů bez výsledků → 404 Dokumentace to říká výslovně: vrátit stavový kód 404 přímo na té adrese, kde k tomu došlo, a nepřesměrovávat na společnou chybovou stránku. Platí to i pro nesmyslné kombinace, duplicitní filtry a neexistující stránkovací adresy; výjimku dokumentace připouští u jednostránkových aplikací.
- Kategorie bez produktů → noindex, nebo 404 Průvodce adresami pro e-shopy radí u kategorie bez položek použít meta značku noindex; když web prázdné kategorie sám odstraňuje, zvážit rovnou 404.
- Nikam neodkazovat na stránky bez užitečného obsahu Tentýž průvodce to formuluje jako obecné pravidlo: na stránky bez užitečného obsahu neodkazujte, nebo je aspoň neindexujte.
Jak to udělat krok za krokem
-
Zjistěte, jak filtry vypadají v adrese
Zaškrtněte filtr a podívejte se, co se stane s adresou. Parametr (?color=), cesta (/zelene/), nebo fragment (#color=)? Každá varianta má jiné důsledky.
-
Zjistěte, jestli na ně vede odkaz
Filtry jako zaškrtávátka ve formuláři robot odkazem neprojde, filtry jako odkazy ano. V našem měření Shoptetu nemělo 43 ze 46 vyhodnotitelných kategorií na filtrovanou adresu ani jeden odkaz — u většiny kontrolovaných kategorií to vypadalo jako výchozí chování platformy. Neplatí to ale pro každou šablonu a úpravu, takže si to ověřte na vlastním webu.
-
Projděte robots.txt
Najdete ho na vasedomena.cz/robots.txt. Hledejte pravidla pro parametry filtrů — ?color=, ?size=, ?price= nebo parametry vaší platformy. Když už blokované jsou, nepřidávejte k tomu noindex a hlavně si filtry sami neprolinkujte vlastní úpravou šablony.
-
Vyberte kombinace, které si zaslouží vlastní stránku
Podle tří podmínek výš. Obvykle jich budou jednotky, ne desítky. Zbytek nechte zavřený.
-
Ověřte prázdné kombinace
Zaškrtejte kombinaci, která nemůže mít výsledky, a zkontrolujte stavový kód — v prohlížeči na kartě Síť nebo příkazem curl -I s tou adresou. Má být 404 na té adrese, ne 200 s prázdným výpisem ani přesměrování.
-
Zkontrolujte, co je v sitemapě
Do sitemapy patří kanonické adresy, které chcete v indexu — typicky samostatné vstupní stránky. Běžné parametrické a filtrované varianty tam nepatří.
Co z toho platí pro AI roboty
Tady je potřeba být opatrný. Dokument o filtrech je psaný pro Googlebota a o AI robotech neuvádí nic. Co se dá říct doloženě:
- Pravidla v
robots.txtplatí pro roboty, kteří soubor respektují, a jen když na ně dopadnou: buď obecnou skupinouUser-agent: *, nebo skupinou s jejich vlastním jménem. Pozor na to, že když robot vlastní skupinu má, obecná pravidla z*se na něj už použít nemusí. Který AI robot se jak jmenuje a co povolit, rozebírá AI roboti v robots.txt. - Jak AI roboti hospodaří s procházením, nikdo z jejich provozovatelů veřejně nepopisuje. Nemám tedy doklad, že se filtrovaný prostor projeví u nich stejně jako u Googlu.
- Co platí bez ohledu na robota: stránka, která není normálně prolinkovaná a zároveň je zakázaná v robots.txt, není spolehlivě dostupný zdroj pro vyhledávač ani pro AI systémy, které pravidla respektují. Když si tedy filtrovanou kombinaci vyberete jako důležitou, musí na ni vést běžný odkaz.
Přehled ostatních vrstev e-shopu má SEO pro e-shopy v AI éře.
Časté chyby
Zákaz v robots.txt plus noindex na téže adrese
Zákaz procházení funguje, ale zároveň brání tomu, aby vyhledávací robot noindex vůbec uviděl. Chcete-li stránku dostat z indexu pravidlem noindex, nesmí být blokovaná.
Prázdná kombinace vrací 200 s prázdným výpisem
Dokumentace chce 404 na té adrese. Prázdná stránka s kódem 200 je pro robota platná stránka bez obsahu.
Spoléhat na canonical jako na zákaz
Google ho označuje za dlouhodobě méně účinný. Náklad na procházení navíc vznikne tak jako tak, protože stránka se musí stáhnout.
Prolinkovat filtry vlastní úpravou šablony
Na platformě, kde filtry odkazem nejsou, je to jediná změna potřebná k tomu, aby se z nevinných zaškrtávátek stal procházený prostor adres.
Shrnutí
- Filtry jsou hlavně problém procházení — Google jmenuje nadměrné procházení a pomalejší objevování nových stránek. Jakmile z kombinace uděláte indexovatelnou stránku, přidá se k tomu i její vlastní obsah.
- Výchozí volba je nepustit robota dovnitř: zákaz v robots.txt, nebo filtrování přes fragment adresy, který se neprochází.
- Canonical a nofollow jsou podle dokumentace slabší: canonical se vyhodnocuje až po stažení stránky, nofollow sice dřív, ale musí být na každém odkazu, jinak spolehlivou zábranou není.
- Vlastní stránku si zaslouží jen kombinace s doloženou poptávkou, vlastním obsahem a stabilním výsledkem — a pak z ní udělejte řádnou adresu, ne filtr.
- Prázdná kombinace má vrátit 404 na své adrese, ne přesměrování.
Nevíte, kolik adres váš e-shop robotům nabízí a kolik z nich k něčemu je? AI SEO Wireframe Pack za 1 490 Kč obsahuje strukturu kategorie i produktu včetně toho, co má být odkaz a co jen ovládací prvek. Pokud chcete stav svého webu posoudit zvenčí, AI SEO audit za 3 600 Kč projde robots.txt, parametrické adresy i sitemapu a ukáže, kde se procházení tříští.
Zdroje: Google Search Central — Managing crawling of faceted navigation URLs (aktualizováno 18. 12. 2025), Designing a URL structure for ecommerce websites a Block Search indexing with noindex (obojí aktualizováno 10. 12. 2025) · vlastní měření 47 e-shopů na Shoptetu (8. 8. 2026); pro kontrolu odkazů na filtrované adresy bylo vyhodnotitelných 46 kategorií. Vše ověřeno 5. 9. 2026.