Sitemap a robots.txt na firemním webu: jak Google správně indexovat stránky

Firemní web může mít skvělé texty, rychlé načítání i přehlednou navigaci — a přesto se ve vyhledávání neobjeví tam, kde byste čekali. Často za tím nestojí špatné SEO jako celek, ale drobná technická vrstva, kterou snadno přehlédnete: soubor robots.txt a XML sitemap. Tyto dva nástroje Googleu říkají, které stránky smí procházet, které má ignorovat a kde najde přehled důležitých URL vašeho webu. Pokud je nemáte nastavené, nebo jsou chybně, robot vyhledávače může projít špatné stránky, minout ty důležité, nebo strávit čas místo tam, kde vám má přivést zákazníky.

Na rozdíl od složitých technických úprav nepotřebujete být programátor. Stačí pochopit základní logiku, zkontrolovat pár souborů a propojit web s nástroji, které Google nabízí zdarma. V tomto článku si vysvětlíme, co sitemap a robots.txt dělají, jak je nastavit na běžném firemním webu a jak poznat, že fungují správně.

Co je XML sitemap a proč ji firemní web potřebuje

XML sitemap je strukturovaný seznam adres (URL) vašeho webu. Není určen návštěvníkům — čte ho robot vyhledávače. U malého prezentačního webu s pěti stránkami může Google projít web i bez sitemapy, ale u většího obsahu, blogu nebo e-shopu už se vyplatí mít jasný seznam prioritních stránek.

Sitemap pomáhá zejména v těchto situacích:

  • web je nový a zatím na něj nevedou žádné externí odkazy,
  • máte hlubší strukturu — blog, kategorie služeb, reference,
  • některé stránky nejsou propojené z hlavní navigace,
  • pravidelně přidáváte nový obsah a chcete, aby se rychle objevil ve vyhledávání.

Sitemap nezaručuje první místo ve výsledcích. Říká vyhledávači: „Tyto stránky existují a stojí za to je znát.“ Formát a pravidla popisuje standard na sitemaps.org. Podrobný popis pro majitele webů najdete v dokumentaci Google k přehledu sitemap.

Jak sitemap vytvořit a kam ji umístit

Na většině moderních webů sitemap vznikne automaticky. WordPress, Shoptet, Webnode nebo web vytvořený na míru obvykle generuje soubor typu sitemap.xml nebo rozdělené sitemapy pro různé typy obsahu. První krok je tedy ověřit, zda sitemapu už máte — zkuste v prohlížeči otevřít adresu https://vase-domena.cz/sitemap.xml (případně sitemap_index.xml u WordPressu).

Pokud sitemap chybí, máte několik možností:

  • použít vestavěnou funkci vašeho redakčního systému nebo e-shopu,
  • nainstalovat doplňkový modul, který sitemap generuje a aktualizuje,
  • nechat sitemapu vytvořit při tvorbě webu — spolehlivější než ruční údržba seznamu desítek URL.

Sitemap by měla obsahovat stránky, které chcete ve vyhledávání. Obvykle sem patří homepage, služby, ceník, kontakt, reference a články blogu. Naopak do sitemapy nepatří stránky s duplicitním obsahem, interní vyhledávání, přihlašovací obrazovky nebo děkovací stránky po odeslání formuláře — ty návštěvníky nehledají a zbytečně zatěžují crawl budget u větších webů.

Po vytvoření sitemapu ji přidejte do Google Search Console. V sekci Sitemapy zadáte URL souboru; Google pak sleduje, kolik stránek načetl a zda narazil na chyby. Podrobný postup pro sestavení souboru popisuje také návod Google k vytvoření sitemap.

Co dělá robots.txt a jak ho nastavit bez chyb

Soubor robots.txt leží v kořenovém adresáři webu — typicky na adrese https://vase-domena.cz/robots.txt. Je to textový soubor s pravidly pro roboty: které složky nebo stránky smí procházet a které ne. Na rozdíl od sitemapy robots.txt spíše omezuje přístup než ho otevírá.

Typický firemní web má jednoduchý robots.txt, který povolí procházení celého veřejného webu a případně zakáže administraci nebo technické složky. Například:

User-agent: *
Disallow: /wp-admin/
Allow: /wp-admin/admin-ajax.php
Sitemap: https://vase-domena.cz/sitemap.xml

Důležité je vědět, co robots.txt neumí: nezabrání indexaci stránky, pokud na ni vede odkaz z jiného webu. Slouží spíše k řízení procházení. Pokud chcete stránku skutečně skrýt z výsledků vyhledávání, použijte meta tag noindex nebo nastavení v Search Console — ne spoléhejte jen na Disallow v robots.txt.

Největší riziko u malých firem je příliš restriktivní robots.txt. Jeden špatný řádek Disallow: / může celý web uzavřít robotům. Proto po každé úpravě soubor zkontrolujte a ověřte, že veřejné stránky zůstávají dostupné. Oficiální vysvětlení pravidel najdete v dokumentaci k souboru robots.txt.

Jak sitemap a robots.txt ověřit a udržovat v pořádku

Nastavení není jednorázová akce. Po redesignu webu, změně domény nebo přidání blogu je potřeba sitemap i robots.txt zkontrolovat znovu. Praktický postup:

  1. Otevřete robots.txt a sitemap.xml v prohlížeči — oba soubory by měly vracet kód 200, ne chybu 404.
  2. V Search Console ověřte, že je sitemap odeslaná a bez chyb; sledujte počet indexovaných stránek v reportu Pokrytí.
  3. Po větší úpravě webu požádejte o přeindexování klíčových URL — u menšího webu stačí aktualizovat sitemapu.
  4. Při migraci na novou doménu nastavte přesměrování 301, aktualizujte sitemapu na nové adrese a robots.txt upravte na nové doméně.

Pokud používáte staging verzi webu (testovací kopii), ujistěte se, že má v robots.txt zákaz indexace (Disallow: / nebo meta noindex), aby se testovací obsah neobjevil ve vyhledávání místo ostrého webu. Tato chyba se u firem opakuje častěji, než byste čekali.

Nejčastější chyby a jak se jim vyhnout

V praxi se opakují stejné problémy. Sitemap obsahuje URL, které vracejí chybu 404 nebo přesměrování — Google pak reportuje varování a může důvěryhodnost signálů snížit. Robots.txt omylem blokuje CSS nebo JavaScript; Google pak hůř vykresluje stránku a posuzuje kvalitu. Chybí odkaz na sitemap v robots.txt, takže robot soubor hledá déle. Sitemap není v Search Console odeslaná, takže majitel webu nevidí chyby včas.

Další častá situace: firma má sitemapu i robots.txt správně, ale web má pomalé načítání, tenké texty nebo chybějící interní prolinkování. Technické soubory jsou základ — ne náhrada kvalitního obsahu a dobré struktury webu. Fungují nejlépe v kombinaci s přehlednou navigací, smysluplnými meta titulky a pravidelným obsahem, který odpovídá na otázky vašich zákazníků.

Sitemap a robots.txt jsou nenápadné, ale důležité stavební kameny firemního webu. Sitemap Googleu předá seznam stránek, které chcete ve vyhledávání. Robots.txt řídí, kam smí robot chodit, a ideálně na sitemapu odkazuje. Oba soubory zkontrolujte po spuštění webu, po větších změnách a v Search Console sledujte, zda Google stránky skutečně indexuje.

Nemusíte vše řešit sami. Ve WebRift jsme tvůrci webových stránek pro malé a střední firmy a při každém projektu dbáme na to, aby sitemap, robots.txt i základní SEO nastavení byly součástí dodávky — spolu s rychlým načítáním a responzivním zobrazením. Pokud chcete web, u kterého nemusíte hádat, zda ho Google správně prochází, napište nám přes kontaktní formulář na webrift.cz. Probereme váš obor, strukturu webu i cíle a navrhneme řešení, které bude fungovat od prvního dne online.