Přeskočit na obsah

Filtry na Shoptetu kryje robots.txt, stránkování ne

Měření 47 e-shopů: filtrované adresy zakazuje robots.txt a většinou na ně nevede odkaz. Strana 2 kategorie je index,follow, bez canonicalu a v sitemapě chybí.

~1 200 slov 6 častých otázek ~6 minut čtení Aktualizováno: 8. 8. 2026
Filtry na Shoptetu kryje robots.txt, stránkování ne
Stručná odpověď

Změřil jsem kategorie na 47 e-shopech běžících na Shoptetu. Filtrované adresy jsou ve vzorku kryté robots.txt a z kategorie na ně většinou nevede odkaz, protože filtry jsou formulářová zaškrtávátka. Druhá strana kategorie naopak u všech třiceti měřených případů neměla rel=canonical, byla index,follow a v sitemapě nebyla.

Filtrované adresy jsou u e-shopů klasické strašidlo: tisíce tenkých stránek, které vzniknou z pár zaškrtávátek. Šel jsem to na Shoptetu změřit a čekal jsem, že najdu problém.

Našel jsem ho jinde. Ve vzorku nevypadají jako první problém filtry, ale stránkování. U filtrů působí zároveň zákaz v robots.txt a absence odkazů z kategorie. Druhá strana kategorie je naopak samostatně indexovatelná a bez canonicalu.

Co jsem měřil — a co ne

Vzorek je stejný jako v druhém dílu: 47 e-shopů, kategorie jsem našel u 46. U každého jsem si nejdřív načetl jeho robots.txt, pak z homepage vybral odkazy, které ten soubor nezakazuje, a našel mezi nimi kategorii.

Po opravě chyby v prvním průchodu jsem celé měření zopakoval; dál pracuju jen s opravenými daty. Co se stalo, popisuju na konci.

Kategorie: na straně 1 konzistentní signály

Zjištění na straně 1Počet
rel=canonical přítomný46 z 46
canonical míří sám na sebe46 z 46
meta robots = index,follow46 z 46
rel=next na další stranu31 z 46

Na straně 1 byl stav konzistentní: canonical sám na sebe a index,follow u všech 46 případů.

Filtry: zakázané a navíc neodkazované

Výchozí robots.txt má 40 zákazů a mezi nimi parametry ?priceMin, ?priceMax, ?order, ?parameterId, ?availabilityId, ?manufacturerId, ?stock, ?pv* a ?dd*. Tedy přesně ty, kterými se filtruje a řadí.

Důležitější než ten zákaz je ale druhý faktor:

ZjištěníPočet
kategorií bez jediného odkazu s filtrovým parametrem43 ze 46
kategorií, kde nějaký takový odkaz je3 (jeden, šest a jeden)
zaškrtávacích políček na kategoriimedián 15, maximum 437
hodnot filtrů na kategoriimedián 6, maximum 399

Ve většině měřených kategorií nejsou filtry realizované jako odkazy na parametrickou adresu, ale jako zaškrtávátka ve formuláři. Robot, který prochází web po odkazech, se k filtrované adrese z téhle kategorie běžně nedostane — a robots.txt ji navíc zakazuje. Pokud jste si filtry sami neprolinkovali, není to ve vzorku první technická priorita.

Filtrovaný prostor je přitom obrovský. Jedna z měřených kategorií měla 437 zaškrtávacích políček; kombinacemi by z toho vznikly řádově statisíce adres. Ty adresy existují, ale z měřené kategorie se k nim odkazem většinou nedá dojít.

Stránkování: samostatně indexovatelné strany bez canonicalu

Tady je ten skutečný nález. Kategorie se stránkuje adresou typu /kategorie/strana-2/ a tu výchozí robots.txt nezakazuje. Ze 47 e-shopů měl jediný vlastní pravidlo, kterým si stránkování zavřel — a je to týž obchod, který si v druhém dílu robots.txt upravoval. U něj jsem stranu 2 nestahoval.

Zbylých třicet vypadá takhle:

Zjištění na straně 2Počet
rel=canonical0 z 30
meta robots = index,follow30 z 30
rel=prev na předchozí stranu30 z 30
vlastní titulek se slovem „Strana“30 z 30

Všimněte si toho prvního řádku pořádně: není to canonical mířící na stranu 1. Je to absence značky. Strana 1 canonical má a míří sama na sebe. Strana 2 nemá v hlavičce rel=canonical vůbec.

A do třetice: v sitemapě stránkované adresy nejsou — ani u jednoho z 39 e-shopů, u kterých se sitemapa dala přečíst. Stejně tak tam není žádná adresa s otazníkem.

Dohromady to znamená, že strana 2, 3 a 4 vaší kategorie jsou samostatně indexovatelné stránky s výpisem produktů, které za vás vytvořila platforma. rel=canonical jsem u nich neviděl a v dostupných sitemapách se neobjevovaly.

Co si z toho odnést

Pořadí, ve kterém to dává smysl řešit:

  1. Ověřte, že z kategorií nevedou odkazy na filtrované adresy.
  2. Otevřete stranu 2 kategorie a rozhodněte se, jestli chcete, aby byla samostatně indexovatelná.
  3. noindex na adresách zakázaných v robots.txt neřešte — ten problém neřeší.

Řešit filtry, protože se to tak dělá

Ve vzorku proti nim působí dva faktory zároveň — zákaz v robots.txt a to, že z kategorie na ně většinou nevede odkaz. Čas strávený jejich „opravováním“ je čas, který jinde chybí.

Dávat noindex na adresy zakázané v robots.txt

Nefunguje to a dokumentace Googlu to říká výslovně: je-li stránka blokovaná v robots.txt, crawler se k noindex na ní nedostane. Pokud chcete noindex použít, stránka pro něj musí být přístupná.

Prolinkovat si filtry vlastní úpravou

Tím změníte ten druhý faktor: na zakázanou adresu nově povede odkaz. A zakázaná adresa, na kterou odkaz vede, se podle Googlu ve výsledcích objevit může — noindex na ní, jak už víme, nepomůže.

Co si projít na vlastním e-shopu

  • Otevřít kategorii a najít odkaz s otazníkem Pokud tam žádný nevede, nebude to ve většině případů první věc k řešení. Pokud ano, přidala ho úprava šablony nebo doplněk.
  • Otevřít stranu 2 kategorie a hledat canonical V měřeném vzorku ho nemělo ani jedno z třiceti. Vaše rozhodnutí, jestli to tak chcete.
  • Zkontrolovat, jestli stránkování není v sitemapě Ve vzorku nebylo nikde. Sitemapa je tedy neposílá jako preferované adresy k procházení.
  • Neřešit noindex tam, kde platí robots.txt Kombinace nefunguje. Vyberte jedno: buď zákaz procházení, nebo noindex na přístupné stránce.
  • Vědět, kolik filtrů kategorie nabízí Na jedné měřené kategorii jich bylo 437. Kombinacemi vzniká obrovský prostor adres — dobré vědět, i když se na ně nedá dojít.

Kam tenhle článek patří

Čtvrtý díl bloku o Shoptetu a viditelnosti v AI. Předchozí měřily formát strukturovaných dat, robots.txt a AI roboty a produktová pole proti požadavkům Googlu. Poslední díl se podívá na blogový modul.

Obecné souvislosti mezi strukturou adres a čitelností pro stroje rozebírá AI friendly struktura URL.

Sniper Design
Pomoc s implementací

Nechcete to řešit interně? Postavíme to za vás.

V Sniper Design děláme kompletní AI SEO — strategii, audit, implementaci i obsah. Zlatý partner Upgates i Shoptetu, přes 600 e‑shopů na CZ trhu. Na AI vyhledávání připravujeme návrhy homepage, obsahovou strukturu i audity klientských webů.

  • 600+ e‑shopů
  • Vlastní e‑shop MEGA DETAIL
FAQČasté otázky

Časté otázky, které k tématu nejčastěji padají

Musím na Shoptetu řešit filtrované adresy?
Ve změřeném vzorku obvykle ne jako první prioritu. Výchozí robots.txt zakazuje parametry jako priceMin, order, parameterId, manufacturerId nebo pv a dd. Z kategorie na filtrovanou adresu navíc většinou nevede odkaz, protože filtry jsou zaškrtávátka ve formuláři. Výjimkou je situace, kdy jste si filtrované adresy sami prolinkovali nebo na ně vedou odkazy odjinud.
Mám dát na filtrované adresy noindex?
Ne, pokud je ta adresa zároveň blokovaná v robots.txt. Dokumentace Googlu říká přímo, že když crawler stránku kvůli robots.txt neotevře, pravidlo noindex na ní neuvidí — pro tuhle adresu tedy signál prakticky nefunguje. Pokud noindex použít chcete, stránka pro crawler musí být přístupná.
Co je důležité vědět o stránkování?
Nejde nutně o chybu, ale o technický stav, o kterém je dobré vědět. Druhá strana kategorie nemá v měřeném vzorku rel=canonical ani jednou ze třiceti, má meta robots index,follow, vlastní titulek se slovem Strana a robots.txt ji nezakazuje. Je to tedy samostatně indexovatelná stránka s výpisem produktů, kterou platforma vytvořila za vás.
Má strana 2 canonical na stranu 1?
Nemá žádný. To je důležitý rozdíl — není to canonical mířící jinam, je to absence značky. Strana 1 canonical má a míří sama na sebe, strana 2 nemá v hlavičce rel=canonical vůbec.
Je absence canonicalu na stránkování chyba?
Sama o sobě ne. Google od roku 2019 nepoužívá rel=next a rel=prev jako indexační signál a stránkované stránky bere jako samostatné dokumenty. Navíc jsem neměřil, jestli jsou ty adresy skutečně v indexu — jen jaké signály e-shop vydává. Je to rozhodnutí, které za vás udělala platforma, a stojí za to o něm vědět.
Jak velký je ten filtrovaný prostor?
Na jedné měřené kategorii bylo až 437 zaškrtávacích políček a 399 hodnot filtrů. Kombinací by z toho vzniklo obrovské množství adres. Právě proto je dobré si všimnout, že se na ně robot nedostane odkazem ani přes robots.txt.
Čtěte dál

Související články

Všechny články v blogu Zpět na úvod