ChatGPT se navenek chová dvěma způsoby. Buď odpoví z toho, co se naučil při tréninku — pak odpověď obvykle nemá odkazy a váš web se v ní neuplatní jako citace. Nebo si dohledá aktuální stránky a ty ocituje. Provozovatel webu si tenhle rozdíl přímo vynutit nemůže.
Tenhle rozdíl vysvětluje většinu zmatku kolem toho, proč se web „někdy objeví a někdy ne“. Není za tím trik, ale rozdíl v tom, odkud odpověď čerpá. Roli hraje i to, že odpovědi mezi pokusy kolísají samy o sobě.
Dva režimy, dva úplně jiné příběhy
| Aspekt | Odpověď z paměti | Odpověď s vyhledáváním |
|---|---|---|
| Odkud informace pochází | Z textů, na kterých se model trénoval | Z konkrétních stránek načtených právě teď |
| Jsou v odpovědi odkazy | Obvykle ne | Obvykle ano, navázané na tvrzení v textu |
| Jak čerstvé to je | Nanejvýš k datu konce tréninku | Potenciálně aktuální, podle toho, co se načetlo |
| Může se objevit váš web | Ne jako zdroj — nanejvýš jako znalost o značce | Ano, jako citovaný zdroj |
| Co s tím zmůžete | Nepřímo: aby se o vás psalo jinde | Přímo: aby vás našel a měl co citovat |
Co je knowledge cutoff a proč vás zajímá
Model má hranici znalostí — datum, ke kterému končí texty, na kterých se učil. Každá verze modelu má tu hranici jinde a bývá zpravidla rok i víc do minulosti; u modelů generace GPT-5 se uvádějí data v roce 2025. Přesné datum si ověřte v dokumentaci ke konkrétnímu modelu, protože se s každou verzí posouvá.
Cokoli, co se stalo nebo vyšlo později, model z paměti neví. Musel by si to dohledat.
Kdy se vyhledávání spustí a kdy ne
O tom, jestli se vyhledávání použije, rozhoduje systém na straně služby podle povahy dotazu. Časově citlivé otázky ho spouštějí spolehlivěji než obecné výklady:
Co vyhledávání spouští spíš
- Aktuální dění a novinky Cokoli, co se mohlo změnit po konci tréninku. Systém vyhodnotí, že odpověď nejspíš vyžaduje aktuální data.
- Ceny, dostupnost, parametry Konkrétní čísla, u kterých by odpověď z paměti byla riskantní.
- Dotazy na konkrétní firmu nebo produkt Podle zkušenosti častěji u menších subjektů, o kterých model z tréninku nemá dost. Pravidlo to ale není.
- Otázky, kde uživatel sám chce zdroje Formulace typu najdi mi, podle čeho to je nebo odkud to máš.
Naopak u obecných výkladů, definic a ustálených postupů model často odpoví rovnou. Nejde to ale odhadnout spolehlivě — jedna analýza cestovatelských dotazů zjistila, že zhruba třetina z nich skončila bez živého vyhledávání, i když by se od nich čekal opak.
Tři vrstvy, které se pletou
Než půjdeme dál, stojí za to oddělit tři věci, které se v běžné debatě slévají:
Co je co
- Natrénovaná znalost Co se model naučil při tréninku. Uzavřené k datu cutoffu, bez odkazů, bez vlivu vašeho dnešního webu.
- Živé načtení zdrojů Když si systém k dotazu dohledá aktuální stránky. Tady se o vaši citaci hraje.
- Zobrazení odkazů v rozhraní To, co vidíte jako uživatel. Souvisí s druhou vrstvou, ale není to totéž — jak přesně se odkazy párují na tvrzení, se liší.
Když se v článcích píše, že „AI použila váš web”, nebývá jasné, která z těch vrstev se myslí. Pro rozhodování je klíčová prostřední.
Jak vyhledávání probíhá
Když se režim spustí, proběhne zhruba tohle:
- Model si vaši otázku přeloží do jednoho nebo víc vyhledávacích dotazů — často jinými slovy, než jste použili vy.
- Pošle je do vyhledávacího indexu. Historicky a v řadě pozorování se u ChatGPT zmiňuje microsoftí vyhledávací infrastruktura, ale OpenAI veřejně nepopisuje, kam přesně dotazy posílá — berte to jako pravděpodobnou, ne potvrzenou cestu.
- Pracuje jen s omezeným výběrem nalezených výsledků, ne s celým indexem. Kolik jich je, se liší dotaz od dotazu.
- Z nich složí odpověď a k jednotlivým tvrzením připojí odkazy na zdroje.
Dva body z toho stojí za zdůraznění. Model nehledá vaši frázi, ale svoji — proto samotná optimalizace na přesné znění dotazu nestačí a důležitější je pokrýt téma a odpovědět jasně. A pracuje jen s úzkým výběrem výsledků, ne s celým indexem; dostat se do té skupiny je celá hra.
Podrobněji rozebíráme výběr zdrojů v článku o tom, jak AI cituje zdroje.
Co z toho plyne pro váš web
| Aspekt | Chcete uspět u dotazů s vyhledáváním | Chcete něco zmoct i u odpovědí z paměti |
|---|---|---|
| První podmínka | Jako minimum neblokovat vyhledávací roboty OpenAI a být dostupný běžným vyhledávačům | Aby se značka a související informace objevovaly v datech, ze kterých si model tvoří obecné znalosti |
| Kde být k nalezení | Ve vyhledávacím indexu, ze kterého se čerpá. Orientačně: hledejte site:vasedomena.cz v Bingu — je to hrubý signál, ne důkaz indexace | V odborných textech, diskuzích a katalozích |
| Co dělat s obsahem | Přímé odpovědi hned na začátku stránky | Dostat značku do textů, které píšou jiní |
| Jak rychle se to projeví | Řádově dny až týdny | Nejdřív s další generací modelu — kdy to bude, nikdo zvenčí neví |
Levý sloupec je práce, kterou máte pod kontrolou a která se dá měřit. Rozebíráme ji v návodu, jak být citovaný v ChatGPT. Pravý sloupec je dlouhodobá práce na tom, aby se o vás psalo — k tomu se hodí článek o zmínkách o značce.
Jak si to ověřit na vlastním webu
Diagnostika je jednoduchá a nudná, ale je jediná, kterou máte:
- Vyberte 10 až 20 dotazů, kterými k vám lidé reálně chodí.
- U každého si zapište, jestli odpověď obsahovala odkazy — a pokud ano, na které domény.
- Když odkazy většinou nejsou, nemá smysl začínat přepisem stránek. Řešíte jinou věc.
- Když odkazy jsou, ale bez vás, podívejte se, kdo se opakuje. To je váš skutečný konkurent v tomhle kanálu.
Časté chyby
Číst nepřítomnost v odpovědi jako chybu obsahu
Firma vidí, že ji ChatGPT nezmínil, a přepisuje stránku. Přitom u toho dotazu vyhledávání ani neproběhlo.
Fix: Nejdřív se podívejte, jestli odpověď vůbec obsahuje odkazy. Když ne, nejspíš nešlo o odpověď postavenou na citovaných webových zdrojích — a přepis stránky na tom nic nezmění.
Optimalizovat na přesné znění dotazu
Model vaši otázku přepíše do vlastních vyhledávacích dotazů. Doslovná shoda s tím, co napsal uživatel, tak ztrácí smysl.
Fix: Pokrývejte téma a jeho okolí, ne konkrétní formulaci. Model si stejně vytvoří vlastní dotazy.
Spoléhat, že se nový obsah dostane do modelu
Vydaný článek se v natrénované paměti neobjeví. Ta je uzavřená k datu konce tréninku.
Fix: Počítejte s tím, že do paměti modelu se dostanete až s další generací, pokud vůbec. Čerstvý obsah se hraje přes vyhledávání.
Ověřovat viditelnost jedním pokusem
Odpovědi kolísají mezi pokusy a liší se podle formulace. Z jednoho dotazu se nedá usoudit nic.
Fix: Projděte víc dotazů a zapište, u kterých byly odkazy a u kterých ne. Teprve to něco říká.
Co si z článku odnést
Pro praxi je užitečné rozlišovat dva navenek viditelné způsoby, jak odpověď vzniká. Jedna obvykle přijde bez viditelných webových citací a váš web se v ní neuplatní; druhá pracuje s omezeným výběrem živě dohledaných zdrojů a některé z nich zobrazí jako odkazy. Co přesně o tom rozhoduje, zvenčí nezjistíte.
Pro praxi z toho plyne jedna střízlivá věc: než začnete něco měnit, podívejte se, jestli v odpovědích na vaše dotazy vůbec bývají odkazy. Když ano, má práce na obsahu přímý smysl. Když ne, řešíte jiný problém — a přepisování stránek vám ho nevyřeší.