Meta robots na firemním webu: kdy použít noindex a co to znamená pro SEO
Firemní web má desítky stránek, ale ne všechny mají být vidět ve vyhledávání. Některé slouží jen pro testování, interní přehled nebo děkování po odeslání formuláře. Právě zde přichází na řadu meta robots – malý signál v kódu stránky, který vyhledávačům říká, zda obsah indexovat, sledovat odkazy, nebo obojí nechat být. Pro majitele malé firmy jde o praktický nástroj: pomůže udržet ve výsledcích Google jen stránky, které přivádějí zákazníky, a zároveň snížit riziko duplicitního obsahu.
Co je meta robots a kde ho vyhledávač hledá
Meta robots je HTML direktiva umístěná obvykle v hlavičce stránky. Nejčastěji ji uvidíte ve tvaru <meta name="robots" content="noindex, nofollow">, ale stejnou roli může plnit HTTP hlavička X-Robots-Tag nebo soubor robots.txt – ty ale nefungují úplně stejně, což je důležité si zapamatovat.
Google stránku nejdřív načte a teprve pak zjistí, zda ji má zařadit do indexu. Meta robots tedy neblokuje přístup bota na stránku (na rozdíl od některých pravidel v robots.txt), ale říká mu, co s obsahem udělat poté, co ho uvidí. Pro firemní web to znamená: i stránka s noindex může být „prochozená“, ale neměla by se objevovat jako výsledek vyhledávání.
U většiny redakčních systémů nemusíte sahat do kódu. WordPress, Shoptet, Webnode nebo jiný tvůrce webu nabízí u jednotlivých stránek přepínač „Skrýt před vyhledávači“ – v pozadí často právě nastaví noindex. Přesto se vyplatí vědět, co se děje pod kapotou, abyste omylem nezablokovali důležitou službu nebo celý blog.
Noindex, nofollow a další hodnoty v praxi
Hodnota index (výchozí stav) znamená: stránku můžeme zařadit do výsledků vyhledávání, pokud splňuje ostatní pravidla kvality. noindex říká opak – stránku neindexujte. Hodnota follow dovoluje botovi projít odkazy na stránce a nofollow tuto stopu u odkazů omezuje (u moderních vyhledávačů spíše jako nápovědu než jako tvrdé pravidlo).
Nejčastější kombinace na firemních webech:
- index, follow – běžná stránka služby, článek blogu nebo kontakt; chcete návštěvnost z Google.
- noindex, follow – stránka, kterou nechcete ve vyhledávání, ale odkazy z ní mají smysl (např. poděkování po formuláři s dalšími kroky).
- noindex, nofollow – testovací verze, náhled pro klienta, interní dokumentace; minimum rizika, že se obsah dostane do indexu.
Existují i direktivy jako noarchive (neukládat cache) nebo nosnippet (omezit úryvek ve výsledcích). U běžného firemního webu je skoro nepoužíváte, spíše u specifických právních textů nebo kampaňových stránek, kde nechcete, aby Google zobrazoval automatický popisek.
Meta robots se liší od kanonické adresy (canonical). Canonical říká: „hlavní verze obsahu je jinde“. Noindex říká: „tuto verzi vůbec neindexujte“. Obě direktivy se dají kombinovat, ale u začátečníků platí jednoduché pravidlo: nejdřív sjednoťte obsah a URL, teprve potom řešte noindex u stránek, které do vyhledávání opravdu nepatří.
Kdy na firemním webu noindex použít – a kdy ne
Typické situace, kde dává noindex smysl:
- Poděkovací stránka po odeslání poptávky – nemá přinášet organickou návštěvnost, často obsahuje málo unikátního textu.
- Interní nebo testovací stránky na stejné doméně – náhled redesignu, kopie produktu pro schválení.
- Filtry a řazení v e-shopu – stovky variant URL se stejným obsahem (pokud nemáte jiné technické řešení).
- Archivní obsah, který nechcete mazat, ale už není aktuální – například stará akce „Sleva 2022“.
- Stránky s velmi tenkým obsahem – prázdné kategorie blogu, tagy bez popisu, vyhledávací výsledky s jedním slovem.
Naopak noindex nepatří na titulní stránku, hlavní služby, kontakt, blogové články ani lokální landing pages – tam chcete být vidět. Častá chyba: někdo nastaví noindex na celý web během vývoje a po spuštění zapomene přepínač vypnout. Web pak měsíce „mizí“ z vyhledávání, i když obsah i rychlost jsou v pořádku.
Stejně opatrně přistupujte k hromadnému noindex u tagů a kategorií. Blog bez kategorií je nepřehledný; kategorie s noindex ale může být správně, pokud jsou jen technickým štítkem a nemají vlastní text. Ideální je u každé důležité kategorie krátký úvod – pak má stránka důvod být indexovaná.
Jak meta robots nastavit v CMS a jak to ověřit
V redakčním systému hledejte sekci SEO u stránky: „Viditelnost ve vyhledávačích“, „Indexace“ nebo plugin typu Yoast či Rank Math ve WordPressu. U celého webu bývá globální přepínač „Discourage search engines from indexing this site“ – ten používejte jen na testovací doméně, ne na ostré adrese.
Po úpravě vždy ověřte výsledek:
- Otevřete stránku v prohlížeči, zobrazte zdrojový kód (Ctrl+U) a vyhledejte
meta name="robots". - V Google Search Console použijte nástroj pro kontrolu URL – uvidíte, zda Google stránku indexuje a jakou direktivu našel.
- U důležitých stránek zkontrolujte také robots.txt – nesmí blokovat cestu k obsahu, který chcete indexovat (robots.txt neumí „noindex“, jen omezit procházení).
Pokud migrujete web nebo měníte strukturu, meta robots doplňte o 301 přesměrování u starých adres a o sitemap, kde jsou jen stránky určené k indexaci. Search Console pak lépe pochopí, co je záměr a co omyl.
Meta robots versus robots.txt a souvislost s obsahem
Robots.txt na začátku řekne botovi: „ sem nechoď“. Když stránku z robots.txt vyloučíte, Google ji nemusí vůbec načíst – a pak neuvidí ani noindex v HTML. Naopak stránka s noindex v robots.txt povolená může být načtena a z indexu vyřazena. Pro firemní web proto platí: citlivé náhledy raději noindex + silné heslo nebo jiná doména; robots.txt používejte spíše na složky typu /wp-admin/ nebo na technické soubory.
SEO není jen o značkách v kódu. Stránka s noindex, kterou odkazujete z menu hlavní navigace, mate uživatele i vyhledávače – signál je rozporný. Lepší je takovou stránku z menu skrýt a nechat ji jen jako cíl formuláře. Stejně tak duplicitní tiskové verze článků nebo PDF kopie textu z webu: pokud jsou veřejné, zvažte noindex nebo canonical na HTML verzi.
Dlouhodobě se vyplatí jednoduchá tabulka pro tým: název stránky, URL, index ano/ne, důvod. Při každém větším článku nebo nové službě zkontrolujete jeden řádek a předejdete tomu, že Google začne zobrazovat „děkujeme za odeslání“ místo kontaktní stránky.
Shrnutí: co si odnést do praxe
Meta robots je přímý pokyn vyhledávači, zda má stránku ukazovat ve výsledcích. Na firemním webu používejte noindex hlavně u poděkování, testů, tenkých archivů a technických výpisů – ne u služeb a článků, které mají přivádět poptávky. Nastavujte ho v SEO nastavení stránky, po spuštění webu zkontrolujte, že globální blokace indexace není zapnutá, a výsledek ověřte ve zdrojovém kódu i v Google Search Console.
Když sjednotíte noindex srozumitelnou strukturou webu, canonical tagy u duplicit a kvalitním obsahem na indexovaných stránkách, Google lépe pochopí, které adresy jsou vaše „vitrína“. Méně náhodných stránek ve vyhledávání znamená víc pozornosti pro ty, které skutečně prodávají vaše služby – a to je cíl každého firemního webu.