Tester sitemapy

Kontrola sitemap.xml: najde ji Google?

Sitemapa je seznam stránek, který dáváte vyhledávači do ruky. Když chybí, je rozbitá nebo na ni nic neodkazuje, Google si web skládá sám a pomalu. Zadejte adresu a zjistěte, jak na tom ta Vaše je.

202 kontrol 22 kategorií výsledek za 30 s bez registrace
Sitemapa krok za krokem: od souboru po indexaci Sitemap.xml v kořeni domény, odkaz v robots.txt, ruční odeslání v Search Console — a Google podle ní stránky objevuje. 1 Sitemap.xml v kořeni webu obvykle na adrese /sitemap.xml 2 Řádek Sitemap v robots.txt nebo test najde sitemapu sám 3 Odeslání v Search Console urychlí první načtení 4 Indexace objevení nezaručuje zařazení do indexu
Sitemapa krok za krokem: od souboru po indexaci

Co zjistíte

  • Jestli sitemap.xml na doméně vůbec existuje a vrací platný XML dokument, ne chybovou stránku nebo prázdnou odpověď.
  • Jestli je XML syntakticky validní, nebo dokument obsahuje chyby, které parser vyhledávače odmítne.
  • Odkazuje-li na sitemapu robots.txt, nebo si ji test musí najít sám na obvyklé cestě — a jestli případný odkaz v robots.txt míří na vlastní doménu, ne na cizí.
  • Kolik URL sitemapa obsahuje a jestli se blíží limitu 50 000 adres nebo 50 MB dat.
  • Zda jsou všechny adresy zapsané jako absolutní URL se schématem a doménou, ne jen jako holé cesty.
  • Jestli je u adres vyplněné pole lastmod a jestli má formát, který Google umí přečíst.
  • Jak vypadá canonical tag testované stránky — ukazuje-li sama na sebe a nebije-li se s nastaveným meta robots noindex.

K čemu sitemapa je a k čemu ne

Sitemapa pomáhá Googlu objevit stránky, které by jinak musel dohledávat proklikáváním webu. Nic víc a nic míň. Neurčuje pořadí, v jakém se stránky zobrazí ve výsledcích, a její přítomnost nezaručuje zařazení adres do indexu — o tom rozhoduje obsah a jeho kvalita, ne seznam v XML souboru.

Nejvíc pomůže tam, kde je samotné objevování stránek problém. Nový web bez zpětných odkazů čeká na první procházení déle, a sitemapa tuhle čekací dobu zkracuje. Velký e-shop se stovkami produktů se bez ní spoléhá jen na interní prolinkování, které bývá u kategorií a filtrů děravé. Web po přestavbě, kde se změnila celá struktura URL, potřebuje robota nasměrovat na nové adresy rychle, ne čekat, až je najde sám. A stránka, která visí tři kliky od homepage a nikde jinde na ni nevede odkaz, dostane díky sitemapě aspoň šanci, aby ji Google vůbec objevil.

Formát, který Google čte

Sitemapa je XML dokument s kořenovým prvkem urlset, uvnitř kterého každá adresa dostane vlastní blok url s povinným tagem loc — plnou, absolutní URL stránky. Volitelný tag lastmod nese datum poslední změny obsahu a má smysl ho vyplňovat jen tehdy, když skutečně odpovídá realitě, datum, které se mění při každém načtení stránky bez ohledu na obsah, přestane Google časem brát vážně.

Weby s víc než 50 000 adresami nebo přes 50 MB dat v jednom souboru sitemapu rozdělují na části a spojují je indexovým souborem — sitemapou, která místo na jednotlivé stránky odkazuje na jiné sitemapy. Celý soubor lze navíc odeslat komprimovaný jako sitemap.xml.gz. Google gzip rozbalí sám, a ušetří to přenos dat na obou stranách.

Chyby, které sitemapu znehodnotí

Přesměrované adresy v sitemapě nutí robota k extra kroku navíc, který zpomaluje procházení a signalizuje neaktuální data. Stránky s noindex, které v seznamu zůstaly, posílají Googlu protichůdný signál — sitemapa říká „projdi mě“, meta tag říká „nezařazuj“.

Adresa s http:// tam, kde web dávno běží na https, je stejný případ zbytečného přesměrování, jen skrytý za jiným protokolem. Parametrizované filtry, tedy varianty stejné kategorie s desítkami kombinací v query stringu, sitemapu nafouknou o duplicity, které do ní nepatří.

Lastmod nastavené na dnešní datum u úplně všeho, generované automaticky skriptem bez ohledu na to, co se opravdu změnilo, ztrácí smysl ve chvíli, kdy si toho Google všimne poprvé. A sitemapa umístěná na jiné doméně, která navíc neobsahuje ani jednu adresu auditovaného webu, se v praxi rovná tomu, že sitemapa neexistuje — takový odkaz z robots.txt audit nepřebírá a soubor hledá přímo na testované doméně.

Po opravě

Opravenou sitemapu má smysl odeslat v Search Console přes sekci Sitemapy, i když ji Google dřív nebo později najde sám podle odkazu v robots.txt. Ruční odeslání jen urychlí první načtení a dá Vám zpětnou vazbu — stav „Úspěch“ znamená, že Google soubor přijal a zpracoval bez chyb.

Kontrolu stejné adresy má smysl spustit znovu po každé úpravě — opakovaný test téže stránky se do denního limitu nepočítá. Tlačítko Spustit znovu na výsledkovce vlastní kontroly sitemapu stáhne načisto, takže opravu potvrdí obratem. Nabízí se jen zadavateli kontroly, kdo dostal odkaz na výsledek, vidí uloženou verzi. Kdo chce vidět, jak spolu robots.txt a sitemapa souvisí a jak se navzájem doplňují, najde podrobný postup v článku Robots.txt a Sitemap.xml: Jak je správně nastavit.

Co test u sitemapy kontroluje Test sitemapy ověří dostupnost souboru, platné XML, absolutní adresy na vlastní doméně, pole lastmod a limit 50 000 URL nebo 50 MB dat. ✓ Dostupnost souboru ✓ Platné XML ✓ Absolutní tvar adres ✓ Vlastní doména ✓ Pole lastmod ✓ Limit 50 000 URL / 50 MB Test načte sitemapu do 5 MB; u větších počítá adresy jen v načtené části.
Co test u sitemapy kontroluje

Co kontrola prověří

Sitemap (7 kontrol)

  • Dostupnost — Kontrola dostupnosti sitemap.xml
  • Platnost XML — Kontrola XML validity sitemapy
  • Počet URL — Informace o počtu URL v sitemapě
  • Absolutní URL — Kontrola absolutních URL
  • lastmod — Kontrola lastmod značek
  • Limit 50 000 URL — Kontrola limitu počtu URL
  • changefreq/priority — Kontrola changefreq a priority

Canonical a indexace (6 kontrol)

  • Canonical URL — Kontrola canonical URL tagu
  • Meta robots — Kontrola meta robots direktivy
  • Hreflang — Kontrola hreflang tagů
  • Canonical odkazující na sebe — Kontrola self-referencing canonical URL
  • Více značek canonical — Kontrola duplicitních canonical tagů
  • Konflikt canonical a noindex — Kontrola konfliktu canonical a noindex

Možná se ptáte

Nejčastěji v kořeni webu jako /sitemap.xml. Test se nejdřív podívá do robots.txt na řádek Sitemap:, a když tam řádek není, zkusí přímo /sitemap.xml. Sitemapu na cizí doméně test nepřebírá, i když na ni robots.txt odkazuje.

Jeden soubor nejvýš 50 000 adres a 50 MB nekomprimovaných dat. Větší weby dělí sitemapu na části a spojují je indexovým souborem. Test načte sitemapu do velikosti 5 MB; u větších souborů ověří dostupnost a spočítá adresy jen v načtené části, platnost formátu u nich nehodnotí.

Ne, jen ty, které chcete mít v indexu. Stránky s noindex, přesměrované adresy a filtrace kategorií do sitemapy nepatří. Jednotlivé adresy ze sitemapy test nenavštěvuje; kontroluje strukturu souboru, absolutní tvar adres, pole lastmod a jejich počet, a u testované stránky porovná canonical s meta robots.

Shoptet ano, automaticky. WordPress od verze 5.5 také, běžně na /wp-sitemap.xml; SEO pluginy ji nahrazují vlastní. WooCommerce sitemapu produktů přidává přes stejný mechanismus. Test ukáže, kterou z nich web reálně nabízí.

Řešíte i soulad se zákonem?

SEO Radar prověří i právní stránku webu a řekne, jestli jsme na něčem narazili. Podrobný rozbor, návod na opravu i pravidelné hlídání nabízí Certito — najdete ho na certito.cz.

SEO Radar

Auditujeme Váš web

0%
Stahování
Technika & indexace
Obsah, rychlost & AI
Vyhodnocení
Připravuji audit...
Audit dokončen!