Robots.txt a Sitemap.xml: Jak je správně nastavit
Robots.txt — co to je a jak funguje
Soubor robots.txt je textový soubor, který říká robotům vyhledávačů, kam na vašem webu můžou a kam ne. Technicky vzato je to první místo, kam se Google podívá, když váš web navštíví — vždycky se vyptá na https://vasestranka.cz/robots.txt.
Základní direktivy jsou dvě: User-agent (o jakého robota jde) a Disallow (kam nesmí). Oficiální dokumentace od Googlu to rozebírá podrobně, tady je praktický příklad:
User-agent: *
Disallow: /admin/
Disallow: /wp-admin/
Allow: /wp-admin/admin-ajax.php
Sitemap: https://vasestranka.cz/sitemap.xml
Co to znamená? User-agent: * platí pro všechny roboty. Disallow: /admin/ zakáže procházení adresářů s administrací — nikdo tam stejně nemá co dělat. Allow zase povolí konkrétní cestu uvnitř jinak zakázaného adresáře (WordPress AJAX vyžaduje ten soubor dostupný).
Direktiva Sitemap není nutná, ale šikovná — řeknete Googlu, kde má najít mapu webu. Ušetříte mu práci a sobě nervové body.
Nejčastější chyby v robots.txt
Paradoxně největší problém není moc restriktivní robots.txt, ale naopak případy, kdy web blokuje věci, které by blokovat neměl. Tyhle chyby vidím pravidelně:
Zablokované CSS a JavaScript
User-agent: *
Disallow: /css/
Disallow: /js/
Možná vám to přijde logické — proč by Google potřeboval vaše styly a skripty? Jenže potřebuje. Bez nich nevidí, jak web vypadá, a nemůže posoudit mobilní přívětivost nebo user experience. Nikdy neblokujte /css/ a /js/.
Blokace celého webu
User-agent: *
Disallow: /
Stane se to častěji, než by člověk čekal. Někdo při vývoji zakáže celý web, pak ho spustí a zapomene robots.txt upravit. Google respektuje instrukce — takže váš web v indexu prostě není. A vy se divíte, proč není návštěvnost.
Kontrola je jednoduchá: zadejte do prohlížeče https://vasestranka.cz/robots.txt a podívejte se, co tam je. Pokud vidíte Disallow: /, máte problém.
Špatné cesty
Disallow: admin/
Takhle napsaná cesta blokuje pouze adresáře uvnitř jednotlivých složek (https://web.cz/neco/admin/), ale nezakáže https://web.cz/admin/. Lomítko na začátku záleží.
Správně:
Disallow: /admin/
Divoké karty (wildcards)
Google podporuje * (cokoliv) a $ (konec adresy), ale nepoužívejte je, pokud jim nerozumíte:
Disallow: /*.pdf$
Tohle zakáže všechna PDF napříč celým webem. Často to člověk myslí dobře, ale zablokuje tím něco, co chtěl viditelné.
Sitemap.xml — proč ji mít a jak vygenerovat
Sitemap.xml je seznam URL adres na vašem webu. Je to návod pro Google — tady jsou stránky, které existují, tady jsou kategorie, tady je blog. Formát je XML, vypadá to nějak takhle:
<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
<url>
<loc>https://vasestranka.cz/</loc>
<lastmod>2026-02-10</lastmod>
<changefreq>daily</changefreq>
<priority>1.0</priority>
</url>
<url>
<loc>https://vasestranka.cz/blog/clanek</loc>
<lastmod>2026-02-05</lastmod>
<changefreq>monthly</changefreq>
<priority>0.8</priority>
</url>
</urlset>
Pár poznámek:
- loc — URL stránky (povinné)
- lastmod — Datum poslední změny (nepovinné, ale užitečné)
- changefreq — Jak často se mění (Google to většinou ignoruje)
- priority — Relativní důležitost v rámci webu (0.0–1.0, taky často ignorováno)
Google doporučuje uvádět hlavně loc a lastmod. Zbytek je spíš orientační.
Jak sitemap vygenerovat
Ruční psaní XML je nesmysl. Používejte buď plugin v CMS, nebo samostatný generátor.
WordPress:
- Yoast SEO (SEO → Obecné → Funkce → XML sitemaps)
- Rank Math — stejný princip
- Mnoho dalších
Jiné CMS:
- Shoptet a Shopify mají sitemap automaticky
- Webnode taky
- Custom weby — použijte knihovnu nebo napište vlastní endpoint
Generátory:
- XML-Sitemaps.com — zdarma pro weby do 500 stránek
- Screaming Frog SEO Spider — desktop nástroj, umí sitemap i crawling
Po vygenerování sitemap nahrajte na root webu: https://vasestranka.cz/sitemap.xml.
Jak robots.txt a sitemap spolupracují
Sitemap neříká Googlu, co nesmí indexovat — jenom mu usnadňuje práci tím, že mu ukáže, co existuje. Robots.txt naopak přímo zakazuje přístup.
Důležité: Pokud URL zablokujete v robots.txt, ale máte ji v sitemap.xml, Google to bude hlásit jako chybu v Search Console. Logika je prostá — buď ji chcete v indexu (pak ji neblokujte), nebo ne (pak ji nedávejte do sitemap).
Nejlepší praxe je uvést v robots.txt cestu k sitemap:
User-agent: *
Disallow: /admin/
Disallow: /checkout/
Sitemap: https://vasestranka.cz/sitemap.xml
Google si tak rovnou přečte, kde mapu najde. Nemusí hledat. Sitemap můžete mít i několik — například jednu pro stránky, jednu pro blog, třetí pro obrázky:
Sitemap: https://vasestranka.cz/sitemap_pages.xml
Sitemap: https://vasestranka.cz/sitemap_blog.xml
Sitemap: https://vasestranka.cz/sitemap_images.xml
Jak zkontrolovat nastavení
Google Search Console
Search Console má sekci Sitemaps, kde můžete mapu odeslat a sledovat, kolik URL Google objevil a kolik jich indexoval. Pokud vidíte desítky chyb, je na čase se na to podívat.
Robots.txt můžete otestovat přímo v Search Console: Nastavení → Nástroj pro testování souboru robots.txt. Zadáte URL a console vám řekne, jestli by Google danou stránku mohl procházet nebo ne.
SEO Radar
V našem auditu kontrolujeme nejen existenci robots.txt a sitemap.xml, ale i jejich dostupnost (HTTP status 200), validitu formátu sitemap a přítomnost častých chyb — například blokaci CSS/JS nebo duplicitní URL v mapě. Dostanete konkrétní doporučení, pokud něco chybí nebo je špatně.
Audit také ověřuje, jestli není celý web zablokovaný přes Disallow: / — jeden z nejčastějších důvodů, proč nový web prostě není v Googlu.
Často kladené otázky
Musím mít robots.txt? Ne. Pokud soubor neexistuje, Google zkusí všechny stránky procházet. Ale lepší je ho mít — už kvůli direktivě Sitemap a blokaci admin sekcí.
Můžu v robots.txt zakázat indexaci konkrétní stránky?
Můžete zakázat procházení, ne indexaci. Google si může stránku stejně zaindexovat, pokud na ni vede odkaz odjinud. Správná metoda je meta tag <meta name="robots" content="noindex"> nebo X-Robots-Tag v HTTP hlavičce.
Kolik URL může být v sitemap? Maximum je 50 000 URL nebo 50 MB (nekomprimovaně). Pokud máte víc stránek, použijte sitemap index — XML soubor, který odkazuje na více dílčích sitemap.
Musím sitemap odeslat do Search Console? Nemusíte, ale určitě by jste měli. Google ji tak najde rychleji a vy uvidíte statistiky — kolik URL bylo objeveno, kolik indexováno a kde jsou problémy.
Jak často aktualizovat sitemap?
Záleží na tom, jak často přidáváte obsah. U blogu nebo e-shopu ideálně automaticky při přidání článku/produktu. Statický web stačí obnovit ručně při změnách. A po aktualizaci pošlete ping Googlu přes Search Console nebo endpoint https://www.google.com/ping?sitemap=URL.
Tip: Vyzkoušejte si bezplatný SEO audit a ověřte si, že máte robots.txt i sitemap.xml správně nastavené. Audit vám ukáže přesné problémy a návod na jejich opravu.