
Robots.txt říká vyhledávačům, co na webu procházet. Jak ho správně nastavit, jakých chyb se vyvarovat a jak ho otestovat – praktický návod.
Robots.txt je jednoduchý textový soubor v kořeni webu, kterým říkáte vyhledávacím robotům, které části webu mají a nemají procházet. Je to jeden z prvních souborů, který robot při návštěvě webu načte, takže jeho správné nastavení patří k základům technického SEO.
V tomto návodu vám jako SEO specialista ukážu, jak robots.txt funguje, co do něj patří, jakých chyb se vyvarovat a jak ho otestovat. Tématicky navazuje na Technické SEO: kompletní průvodce pro rok 2026.
Co je robots.txt a k čemu slouží
Robots.txt je standard, který vyhledávačům sděluje pravidla pro procházení webu. Najdete ho na adrese vasedomena.cz/robots.txt a jeho hlavním úkolem je usměrnit roboty tak, aby neztráceli čas na nepodstatných nebo citlivých částech webu.
Typicky se jím blokuje administrace, košík, interní vyhledávání nebo duplicitní parametrické adresy. Důležité je rozumět tomu, že robots.txt je pokyn, nikoli zámek – seriózní roboti jako Googlebot ho respektují, ale neslouží k zabezpečení obsahu.
Pokud chcete něco skutečně skrýt, řešte to přihlášením nebo zabezpečením na úrovni serveru, ne robots.txt. Paradoxně platí, že vypsání citlivé cesty do robots.txt může zájemcům naopak prozradit, kde se daná sekce nachází – proto se k zabezpečení vůbec nehodí.
Kde robots.txt najdete a jak vypadá
Soubor musí být umístěný v kořeni domény, tedy přesně na vasedomena.cz/robots.txt – jinde ho roboti hledat nebudou. Jde o obyčejný text bez formátování, kde se pravidla zapisují po řádcích.
Každé pravidlo má svého adresáta (User-agent) a sadu příkazů, co smí a nesmí procházet. U WordPressu nebo e-shopových platforem bývá robots.txt generovaný automaticky a upravit ho lze přes SEO plugin nebo nastavení systému.
Než cokoli změníte, vždy si stávající obsah souboru zazálohujte, protože i jeden špatný řádek může ovlivnit viditelnost celého webu.
Základní direktivy: User-agent, Disallow a Allow
Robots.txt stojí na několika málo příkazech. User-agent určuje, pro kterého robota pravidlo platí (hvězdička znamená pro všechny).
Disallow zakazuje procházení dané cesty, Allow naopak výjimku povoluje. Příkazy se kombinují do bloků, takže můžete mít jiná pravidla pro Googlebot a jiná pro ostatní roboty.
Čím jednodušší a přehlednější soubor je, tím menší je riziko chyby. V praxi si vystačíte s několika řádky – složité konstrukce s desítkami pravidel bývají spíš zdrojem problémů než užitku a hůř se v nich hledají chyby.

Co robots.txt umí a co ne
Nejčastější nedorozumění je záměna procházení a indexace. Robots.txt řídí procházení – tedy zda robot stránku načte.
Neřídí ale indexaci, takže blokovaná stránka se i tak může objevit ve výsledcích, jen bez popisku a obsahu. Pokud chcete stránku z výsledků skutečně vyřadit, použijte meta tag noindex a robota k ní naopak pusťte, aby tento pokyn viděl.
Kombinace „blokace v robots.txt + noindex“ je proto chyba: robot se ke stránce nedostane a pokyn noindex nikdy nepřečte. Toto rozlišení je klíčové pro správnou práci s indexací.
Co do robots.txt patří a co ne
Aby soubor pomáhal a neškodil, držte se osvědčeného rozsahu. Hodí se zablokovat:
- administraci a přihlašování (např. /wp-admin/),
- košík, pokladnu a uživatelské účty na e-shopu,
- interní vyhledávání a jeho výsledkové stránky,
- duplicitní parametrické a filtrované URL bez SEO hodnoty.
Naopak do robots.txt nepatří blokace stránek, které chcete z indexu (na to je noindex), ani blokace CSS a JS souborů, které Google potřebuje k vykreslení stránky.
Jak přidat odkaz na sitemapu
Do robots.txt patří i řádek s odkazem na XML sitemapu, díky kterému roboti snáz najdou seznam vašich důležitých URL. Stačí uvést plnou adresu sitemapy, obvykle na samostatném řádku na konci souboru.
Tím vyhledávačům usnadníte objevování obsahu, zvlášť u nových nebo rozsáhlých webů. I když sitemapu odešlete přímo v Search Console, uvedení v robots.txt je dobrý zvyk a pokrývá i další vyhledávače včetně Seznamu.
Ujistěte se, že odkazovaná sitemapa skutečně existuje a vrací stav 200, jinak posíláte roboty do slepé uličky.
Přehled nejčastějších direktiv
Pro rychlou orientaci shrnuje hlavní příkazy tabulka:
| Direktiva | Význam | Příklad |
|---|---|---|
| User-agent | Komu pravidlo platí | User-agent: * |
| Disallow | Zákaz procházení cesty | Disallow: /wp-admin/ |
| Allow | Výjimka ze zákazu | Allow: /wp-admin/admin-ajax.php |
| Sitemap | Odkaz na sitemapu | Sitemap: https://…/sitemap.xml |
Časté chyby v robots.txt, které vídám
Špatně nastavený robots.txt patří mezi nejzákeřnější technické problémy, protože web vypadá v pořádku, ale ztrácí viditelnost. Nejčastěji narážím na:
- Disallow: / omylem ponechaný z vývoje, který blokuje celý web,
- blokaci CSS a JS, kvůli které Google web špatně vykreslí,
- snahu vyřadit stránku z indexu přes robots.txt místo noindexu,
- odkaz na neexistující nebo přesměrovanou sitemapu,
- překlepy v cestách, které pravidlo zneúčinní.
Robots.txt vs meta robots vs noindex
Tyto tři nástroje se často pletou, ale každý slouží k něčemu jinému. Robots.txt řídí, kam robot smí; meta robots a noindex řídí, co se smí zobrazit ve výsledcích.
Když chcete stránku schovat z vyhledávání, použijte noindex. Když chcete jen ušetřit crawl budget a nepouštět roboty do nepodstatných sekcí, použijte robots.txt.
Canonical pak řeší duplicity tím, že určí hlavní verzi stránky. Správná kombinace těchto nástrojů je jádro čisté indexace a vyplatí se jí věnovat pozornost dřív, než začnete řešit obsah a odkazy.
Jednoduchá pomůcka: ptejte se, zda chcete řešit, KAM robot smí (robots.txt), nebo CO se smí zobrazit ve výsledcích (noindex). Jakmile si tuto otázku zodpovíte, výběr správného nástroje je téměř vždy jednoznačný.
Jak robots.txt otestovat
Po každé úpravě si soubor ověřte, ať omylem nezablokujete něco důležitého. Základní kontrola je otevřít vasedomena.cz/robots.txt v prohlížeči a přečíst si ho.
Důkladněji pomůže nástroj Kontrola URL v Google Search Console, který u konkrétní adresy řekne, zda je blokovaná. U větších webů se vyplatí projít klíčové šablony (kategorie, produkt, článek) a ověřit, že jsou průchozí.
Test je otázka pár minut, ale ušetří vám týdny ztracené viditelnosti, které by jinak způsobila přehlédnutá blokace. U kritických webů se vyplatí kontrolu robots.txt zařadit i do checklistu po každém nasazení nové verze webu, kdy se chyby objevují nejčastěji.
Robots.txt u e-shopů a WordPressu
U WordPressu robots.txt obvykle řeší SEO plugin a ve výchozím stavu blokuje jen administraci, což je v pořádku. U e-shopů je situace složitější kvůli množství parametrických a filtrovaných URL, které dokážou zbytečně spotřebovat crawl budget.
Tam se vyplatí promyslet, které filtry mají SEO hodnotu a které jen tříští procházení. Cílem není zablokovat co nejvíc, ale nechat roboty soustředit se na stránky, které mají reálný vyhledávací potenciál.
U velkých e-shopů doporučuji nastavení robots.txt konzultovat společně s celkovou strategií indexace. Špatně nastavené filtry totiž dokážou vygenerovat statisíce kombinací URL, na kterých robot promrhá čas, místo aby procházel produkty a kategorie, na kterých vám reálně záleží.
Čím začít: priority u robots.txt
Nejdřív si zkontrolujte, že soubor neobsahuje globální Disallow: / a že neblokuje CSS, JS ani důležité sekce. Pak doplňte odkaz na sitemapu a zablokujte jen zjevně nepodstatné URL. Po každé změně proveďte test v Search Console. Robots.txt je malý soubor s velkým dopadem, proto k němu přistupujte opatrně a konzervativně.
- Robots.txt řídí procházení, ne indexaci.
- Pro vyřazení z výsledků slouží noindex, ne robots.txt.
- Nikdy neblokujte CSS a JS potřebné k vykreslení.
- Vždy doplňte odkaz na sitemapu a soubor po změně otestujte.
Nejste si jistí, zda váš robots.txt neblokuje něco důležitého? Rád to prověřím v rámci SEO analýzy nebo komplexní optimalizace webových stránek.
Často kladené otázky
Musí mít každý web soubor robots.txt?
Nutně ne, ale doporučuje se ho mít. Bez něj robot prochází web bez omezení, což u malého webu nevadí, ale u většího zbytečně plýtvá crawl budgetem. I jednoduchý robots.txt s odkazem na sitemapu je lepší než žádný.
Zabezpečím robots.txt citlivá data?
Ne. Robots.txt je veřejně přístupný a jen doporučuje robotům, kam nechodit. Citlivý obsah chraňte přihlášením nebo na úrovni serveru, nikdy ne pouhým záznamem v robots.txt, který naopak prozradí, kde se daná sekce nachází.
Proč je moje stránka ve výsledcích, i když je blokovaná?
Protože robots.txt brání procházení, ne indexaci. Google může adresu zobrazit bez popisku jen na základě odkazů. Pro skutečné vyřazení použijte noindex a stránku v robots.txt naopak odblokujte, aby robot pokyn viděl.
Můžu robots.txt upravit ve WordPressu?
Ano, nejčastěji přes SEO plugin, který umožní obsah souboru editovat bez zásahu do serveru. Po úpravě vždy ověřte výsledek v prohlížeči a v Search Console, ať nedojde k nechtěné blokaci.
Jak často robots.txt kontrolovat?
Po každé větší změně webu, migraci nebo redesignu a jinak orientačně jednou za čas. Právě při těchto změnách nejčastěji vznikají chyby, jako je zapomenutý Disallow z testovacího prostředí.
Blokovat v robots.txt vyhledávání na webu?
Ano, výsledkové stránky interního vyhledávání obvykle nemají SEO hodnotu a generují nekonečné množství URL. Jejich blokace v robots.txt je běžná a smysluplná praxe, která šetří crawl budget.