Guide4 min čtení

Jak blokovat AI trénování a nezablokovat vyhledávání

Rozlišujte trénovací, vyhledávací a uživatelské boty. Praktický checklist pro český web, Cloudflare, robots.txt a měření dopadu bez falešných slibů.

Petr VlčekPublikováno 29. 9. 2026

Pokyn „zablokujte AI boty“ je příliš hrubý. Jeden robot může pomáhat vyhledávání, jiný sbírá materiál pro trénování modelu a další na stránku přichází na přímý požadavek uživatele. Špatně zvolené pravidlo může zároveň chránit obsah a odříznout část obchodní viditelnosti.

Cloudflare v září 2026 představil nastavení Disallow AI Training. Je důležité rozumět jeho výhodám i omezením, než ho někdo zapne na českém e-shopu nebo vydavatelském webu.

  • Rozhodněte o účelu přístupu, nikoli o neurčité kategorii „AI“. Trénování, běžné vyhledávání, AI souhrny a návštěva agenta nejsou totožné.
  • Kontrolujte robots.txt i skutečné blokování na CDN/WAF. Vyjádřená preference nemusí zastavit nepoctivého robota; firewall naopak může zablokovat i legitimní vyhledávač.
  • Po změně sledujte dohledatelnost v ČR. Pravidlo, které funguje syntakticky, ještě neprokazuje správný dopad na organické či AI výsledky.

Metodika a zdroje

Redakčně ověřeno k 2026-09-28.

Prošli jsme oznámení Cloudflare z 15. září, oficiální popis botů OpenAI a doporučení Googlu pro AI ve Vyhledávání. Návod neurčuje, jaké právní nastavení je vhodné pro váš obsah, ani netvrdí, že váš web používá Cloudflare. Konkrétní pravidlo vyžaduje kontrolu skutečné infrastruktury.

Stejná stránka, různé druhy přístupu

ÚčelPříkladCo se rozhoduje
Dohledání ve vyhledáváníGooglebot, Bingbot, OAI-SearchBotMá služba umět stránky najít a zobrazit?
Trénování modeluGPTBot, příslušný Google-Extended controlMá se obsah použít při tvorbě modelu?
Přístup na pokyn člověkaChatGPT-User a další agentiSmí asistent otevřít tuto URL pro konkrétní úlohu?

OpenAI rozlišuje OAI-SearchBot pro vyhledávání v ChatGPT, GPTBot pro obsah, který může být použit k trénování, a ChatGPT-User pro některé uživatelské akce. Podle jeho dokumentace lze první povolit a druhý zakázat. U návštěv spuštěných člověkem nemusí robots.txt fungovat stejně jako u automatického crawlování. Změna pravidla také zpětně nemaže dříve získaný obsah a sama negarantuje citaci.

Co znamená nové nastavení Cloudflare

U webů, které používají Cloudflare AI Crawl Control, volba Disallow AI Training zveřejňuje příslušné preference v robots.txt, ponechává vybrané „Accountable“ smíšené roboty pro vyhledávání a ostatní trénovací roboty blokuje. Samostatná volba Block podle Cloudflare může nyní blokovat i smíšené Googlebot a Bingbot, tedy zasáhnout běžné vyhledávání. Označení „Accountable“ zahrnuje jak existující schopnosti, tak závazky provozovatelů do budoucna; není to potvrzení, že všechno už funguje.

Důležitá výjimka je Bing. Cloudflare sám uvádí, že jeho Disallow AI Training dnes automaticky nepřenáší zákaz trénování pro Bingbot přes robots.txt. Microsoft má podporu doménové preference teprve připravovat. Cloudflare odkazuje na současnou možnost NOARCHIVE, ale Microsoft uvádí, že takto označený obsah se neobjeví v odpovědích Bing Chat, i když zůstane v běžných výsledcích Bingu. Zákaz trénování tedy může dnes stát část AI viditelnosti. Nelze pravdivě napsat „jedním přepínačem jsme zakázali trénování všude a vyhledávání zůstalo beze změny“.

Bezpečný postup pro český web

  1. Uložte výchozí stav: veřejné robots.txt, nastavení CDN/WAF, logy přístupů, důležité URL a výchozí data v Search Console a Bing Webmaster Tools.
  2. Pojmenujte cíl: například „nechceme trénování, ale chceme zůstat dohledatelní v Googlu, Bingu a vyhledávání ChatGPT“.
  3. Rozlište boty: u každého provozovatele ověřte oficiální vyhledávací, trénovací a uživatelský přístup. U smíšených botů se nerozhoduje stejně jako u botů používaných jen k trénování.
  4. Zvolte úzké pravidlo: jen pro weby s Cloudflare kontrolujte zvlášť Search, Training a Agent. U jiné infrastruktury použijte její skutečně dostupné prostředky; obecný návod nekopírujte naslepo.
  5. Ověřte dopad: stáhněte veřejné robots.txt, zkontrolujte WAF rozhodnutí a skutečné požadavky, testujte několik klíčových stránek. Dohledatelnost sledujte v čase. Jeden úspěšný požadavek není důkaz dlouhodobého zařazení do výsledků.

Soukromý obsah chraňte přihlášením a oprávněními; robots.txt není zabezpečení. Vydavatel závislý na proklikách může zvolit přísnější pravidla než e-shop závislý na objevování katalogu. Dobrá volba má popsaný důvod, konkrétní URL, odpovědnou osobu a způsob ověření.

Časté dotazy

Stejné otázky a odpovědi posíláme i jako strukturovaná data (FAQPage), aby je AI enginy mohly citovat doslovně.

Lze zakázat GPTBot a ponechat vyhledávání v ChatGPT?
Podle OpenAI mají GPTBot a OAI-SearchBot oddělené role a nastavení. První souvisí s obsahem pro trénování modelů, druhý s vyhledáváním v ChatGPT. Povolení jednoho a zákaz druhého jsou možné podle skutečného robots.txt a firewallu. Povolený přístup ale nezaručuje citaci.
Zakáže Cloudflare jedním přepínačem všechno AI trénování?
Takovou univerzální záruku nelze dát. Cloudflare uvádí, že volba Disallow AI Training zatím automaticky nepřenáší zákaz trénování pro Bingbot. Microsoftův současný NOARCHIVE ponechá běžné výsledky vyhledávání, ale vyřadí obsah z odpovědí Bing Chat. Tento dopad na AI viditelnost posuďte zvlášť a pravidla ověřte v dokumentaci i logu.
Chrání robots.txt soukromé stránky?
Ne. Robots.txt vyjadřuje preference spolupracujícím robotům; neověřuje identitu ani nezabezpečuje obsah. Soukromé stránky chraňte přihlášením a oprávněními. U veřejného webu kontrolujte robots.txt spolu s CDN a firewall pravidly, aby omylem nevypadlo vyhledávání.

Primární zdroje a omezení

Ověřeno 28. 9. 2026. Stav služeb a závazků robotů se může měnit; před zásahem zkontrolujte aktuální pravidla a logy konkrétního webu.

Guide

Sdílet článekSdílet na XLinkedIn


Související články


Vaše GEO Score

Vytvořte si obhajitelný základ viditelnosti v AI

Použijte opakované kontroly podporovaných enginů, abyste viděli, zda se značka objevuje, v jakém kontextu a jak se výsledek mění v čase.