Robots.txt a Sitemap.xml: Jak je správně nastavit

2026-02-04 Martin Šikula

Robots.txt — co to je a jak funguje

Soubor robots.txt je textový soubor, který říká robotům vyhledávačů, kam na vašem webu můžou a kam ne. Technicky vzato je to první místo, kam se Google podívá, když váš web navštíví — vždycky se vyptá na https://vasestranka.cz/robots.txt.

Jak robots.txt a sitemap spolupracují Sitemap.xml vypíše stránky webu, robots.txt řekne Googlu, kde ji najít, a Search Console ukáže, kolik URL objevil a indexoval. 1 Sitemap.xml se seznamem URL stránky, kategorie, blog 2 Řádek Sitemap v robots.txt Google ví, kde mapu najít 3 Odeslání v Search Console sekce Sitemaps 4 Kontrola v Search Console kolik URL objeveno a indexováno URL blokovaná v robots.txt a zároveň v sitemapu je chyba v Search Console.
Jak robots.txt a sitemap spolupracují

Základní direktivy jsou dvě: User-agent (o jakého robota jde) a Disallow (kam nesmí). Oficiální dokumentace od Googlu to rozebírá podrobně, tady je praktický příklad:

User-agent: *
Disallow: /admin/
Disallow: /wp-admin/
Allow: /wp-admin/admin-ajax.php
Sitemap: https://vasestranka.cz/sitemap.xml

Co to znamená? User-agent: * platí pro všechny roboty. Disallow: /admin/ zakáže procházení adresářů s administrací — nikdo tam stejně nemá co dělat. Allow zase povolí konkrétní cestu uvnitř jinak zakázaného adresáře (WordPress AJAX vyžaduje ten soubor dostupný).

Direktiva Sitemap není nutná, ale šikovná — řeknete Googlu, kde má najít mapu webu. Ušetříte mu práci a sobě nervové body.

Nejčastější chyby v robots.txt

Paradoxně největší problém není moc restriktivní robots.txt, ale naopak případy, kdy web blokuje věci, které by blokovat neměl. Tyhle chyby vidím pravidelně:

Zablokované CSS a JavaScript

User-agent: *
Disallow: /css/
Disallow: /js/

Možná vám to přijde logické — proč by Google potřeboval vaše styly a skripty? Jenže potřebuje. Bez nich nevidí, jak web vypadá, a nemůže posoudit mobilní přívětivost nebo user experience. Nikdy neblokujte /css/ a /js/.

Blokace celého webu

User-agent: *
Disallow: /

Stane se to častěji, než by člověk čekal. Někdo při vývoji zakáže celý web, pak ho spustí a zapomene robots.txt upravit. Google respektuje instrukce — takže váš web v indexu prostě není. A vy se divíte, proč není návštěvnost.

Kontrola je jednoduchá: zadejte do prohlížeče https://vasestranka.cz/robots.txt a podívejte se, co tam je. Pokud vidíte Disallow: /, máte problém.

Špatné cesty

Disallow: admin/

Takhle napsaná cesta blokuje pouze adresáře uvnitř jednotlivých složek (https://web.cz/neco/admin/), ale nezakáže https://web.cz/admin/. Lomítko na začátku záleží.

Správně:

Disallow: /admin/

Divoké karty (wildcards)

Google podporuje * (cokoliv) a $ (konec adresy), ale nepoužívejte je, pokud jim nerozumíte:

Disallow: /*.pdf$

Tohle zakáže všechna PDF napříč celým webem. Často to člověk myslí dobře, ale zablokuje tím něco, co chtěl viditelné.

Sitemap.xml — proč ji mít a jak vygenerovat

Sitemap.xml je seznam URL adres na vašem webu. Je to návod pro Google — tady jsou stránky, které existují, tady jsou kategorie, tady je blog. Formát je XML, vypadá to nějak takhle:

<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
  <url>
    <loc>https://vasestranka.cz/</loc>
    <lastmod>2026-02-10</lastmod>
    <changefreq>daily</changefreq>
    <priority>1.0</priority>
  </url>
  <url>
    <loc>https://vasestranka.cz/blog/clanek</loc>
    <lastmod>2026-02-05</lastmod>
    <changefreq>monthly</changefreq>
    <priority>0.8</priority>
  </url>
</urlset>

Pár poznámek:

  • loc — URL stránky (povinné)
  • lastmod — Datum poslední změny (nepovinné, ale užitečné)
  • changefreq — Jak často se mění (Google to většinou ignoruje)
  • priority — Relativní důležitost v rámci webu (0.0–1.0, taky často ignorováno)

Google doporučuje uvádět hlavně loc a lastmod. Zbytek je spíš orientační.

Jak sitemap vygenerovat

Ruční psaní XML je nesmysl. Používejte buď plugin v CMS, nebo samostatný generátor.

WordPress:

  • Yoast SEO (SEO → Obecné → Funkce → XML sitemaps)
  • Rank Math — stejný princip
  • Mnoho dalších

Jiné CMS:

  • Shoptet a Shopify mají sitemap automaticky
  • Webnode taky
  • Custom weby — použijte knihovnu nebo napište vlastní endpoint

Generátory:

  • XML-Sitemaps.com — zdarma pro weby do 500 stránek
  • Screaming Frog SEO Spider — desktop nástroj, umí sitemap i crawling

Po vygenerování sitemap nahrajte na root webu: https://vasestranka.cz/sitemap.xml.

Jak robots.txt a sitemap spolupracují

Sitemap neříká Googlu, co nesmí indexovat — jenom mu usnadňuje práci tím, že mu ukáže, co existuje. Robots.txt naopak přímo zakazuje přístup.

Důležité: Pokud URL zablokujete v robots.txt, ale máte ji v sitemap.xml, Google to bude hlásit jako chybu v Search Console. Logika je prostá — buď ji chcete v indexu (pak ji neblokujte), nebo ne (pak ji nedávejte do sitemap).

Nejlepší praxe je uvést v robots.txt cestu k sitemap:

User-agent: *
Disallow: /admin/
Disallow: /checkout/
Sitemap: https://vasestranka.cz/sitemap.xml

Google si tak rovnou přečte, kde mapu najde. Nemusí hledat. Sitemap můžete mít i několik — například jednu pro stránky, jednu pro blog, třetí pro obrázky:

Sitemap: https://vasestranka.cz/sitemap_pages.xml
Sitemap: https://vasestranka.cz/sitemap_blog.xml
Sitemap: https://vasestranka.cz/sitemap_images.xml

Jak zkontrolovat nastavení

Google Search Console

Search Console má sekci Sitemaps, kde můžete mapu odeslat a sledovat, kolik URL Google objevil a kolik jich indexoval. Pokud vidíte desítky chyb, je na čase se na to podívat.

Robots.txt můžete otestovat přímo v Search Console: Nastavení → Nástroj pro testování souboru robots.txt. Zadáte URL a console vám řekne, jestli by Google danou stránku mohl procházet nebo ne.

SEO Radar

V našem auditu kontrolujeme nejen existenci robots.txt a sitemap.xml, ale i jejich dostupnost (HTTP status 200), validitu formátu sitemap a přítomnost častých chyb — například blokaci CSS/JS nebo duplicitní URL v mapě. Dostanete konkrétní doporučení, pokud něco chybí nebo je špatně.

Audit také ověřuje, jestli není celý web zablokovaný přes Disallow: / — jeden z nejčastějších důvodů, proč nový web prostě není v Googlu.

Často kladené otázky

Musím mít robots.txt? Ne. Pokud soubor neexistuje, Google zkusí všechny stránky procházet. Ale lepší je ho mít — už kvůli direktivě Sitemap a blokaci admin sekcí.

Můžu v robots.txt zakázat indexaci konkrétní stránky? Můžete zakázat procházení, ne indexaci. Google si může stránku stejně zaindexovat, pokud na ni vede odkaz odjinud. Správná metoda je meta tag <meta name="robots" content="noindex"> nebo X-Robots-Tag v HTTP hlavičce.

Kolik URL může být v sitemap? Maximum je 50 000 URL nebo 50 MB (nekomprimovaně). Pokud máte víc stránek, použijte sitemap index — XML soubor, který odkazuje na více dílčích sitemap.

Musím sitemap odeslat do Search Console? Nemusíte, ale určitě by jste měli. Google ji tak najde rychleji a vy uvidíte statistiky — kolik URL bylo objeveno, kolik indexováno a kde jsou problémy.

Jak často aktualizovat sitemap? Záleží na tom, jak často přidáváte obsah. U blogu nebo e-shopu ideálně automaticky při přidání článku/produktu. Statický web stačí obnovit ručně při změnách. A po aktualizaci pošlete ping Googlu přes Search Console nebo endpoint https://www.google.com/ping?sitemap=URL.

Tip: Vyzkoušejte si bezplatný SEO audit a ověřte si, že máte robots.txt i sitemap.xml správně nastavené. Audit vám ukáže přesné problémy a návod na jejich opravu.

Zpět na blog Spustit audit