Noindex: co znamená zákaz indexace a kdy ho použít
Noindex je pokyn pro vyhledávače, aby konkrétní URL neindexovaly, a tedy ji nezobrazovaly ve výsledcích vyhledávání. Jde o přesný a poměrně rychlý způsob, jak vyloučit obsah z organického vyhledávání, aniž by bylo nutné odstraňovat stránku z webu nebo blokovat přístup robotům. V moderním SEO (včetně AIO/AEO – optimalizace pro odpovědní systémy a agenty) je správné použití noindexu klíčové pro udržování „čistého“ indexu a řízení viditelnosti obsahu s nízkou hodnotou nebo citlivého obsahu.
Jak noindex funguje: zásada „mohu přečíst, ale neuložím“
Vyhledávač musí mít možnost stránku přečíst, aby zjistil, že obsahuje noindex. Proto se noindex téměř vždy kombinuje s tím, že URL neblokujete v souboru robots.txt. Pokud byste robotovi přístup zakázali, k pokynu noindex by se nedostal. Po zjištění noindexu vyhledávač URL odstraní z indexu nebo ji do něj vůbec nezařadí.
Způsoby implementace noindexu
Existují dva hlavní způsoby, jak vyhledávačům sdělit noindex – meta tag v HTML a HTTP hlavička. Obě řešení mohou fungovat pro HTML i jiné typy souborů (prostřednictvím hlavičky).
- Meta robots v HTML – vložený do
<head>:
<meta name="robots" content="noindex, follow">
- X-Robots-Tag v HTTP odpovědi – vhodný pro PDF, obrázky, soubory ke stažení nebo v případě, že nemáte kontrolu nad HTML šablonou:
X-Robots-Tag: noindex, follow
Obě formy podporují také cílení na konkrétního robota (např. googlebot, bingbot):
<meta name="googlebot" content="noindex, follow"> X-Robots-Tag: googlebot: noindex, follow
„noindex, follow“ vs. „noindex, nofollow“ a co se děje s odkazy
Kombinace noindex, follow způsobí, že samotná stránka nebude v indexu, ale vyhledávač může následovat odkazy na ní. V praxi to pomáhá zachovat přenos signálů na další stránky. U dlouhodobě noindexovaných URL však mohou některé vyhledávače odkazy časem ignorovat, pokud se URL téměř nikdy znovu neprochází. noindex, nofollow je přísnější režim, který výslovně žádá o ignorování odkazů – používá se výjimečně (např. dočasně při vysokém riziku spamu na stránce s UGC).
Noindex a robots.txt: častý omyl
Robots.txt nezná direktivu noindex a neměl by se používat k vyloučení z indexu. Jde o soubor pro řízení přístupu robotů, nikoli pro řízení indexace. Pokud URL zakážete v souboru robots.txt, robot se k meta tagu nebo hlavičce s noindexem nedostane – výsledek může být paradoxně opačný (URL se v indexu objeví bez obsahu, pouze jako odkaz bez úryvků). Proto platí doporučení: pokud chcete stránku odstranit z výsledků, použijte noindex (meta tag/hlavičku) a URL v souboru robots.txt neblokujte.
Noindex a kanonikalizace: co má přednost
rel="canonical" navrhuje preferovanou URL pro indexaci. Noindex je direktivní pokyn; pokud stránka obsahuje noindex a zároveň odkazuje kanonickým odkazem na jinou URL, vyhledávač zpravidla respektuje noindex u dané stránky a může indexovat cílovou kanonickou URL (pokud nemá noindex). Nespoléhejte se však na kanonický odkaz jako na náhradu za noindex – jde o rozdílné nástroje pro rozdílné účely.
Noindex a „indexifembedded“: zvláštní případ vloženého obsahu
Stránka může mít noindex, ale pomocí direktivy indexifembedded povolit indexaci svého vloženého obsahu, pokud se zobrazuje prostřednictvím <iframe> na jiné stránce. Použití:
<meta name="robots" content="noindex, indexifembedded">
To je užitečné pro widgety a komponenty, které samy o sobě nemají hodnotu jako plnohodnotná stránka, ale smysl mají, když jsou vložené jinde.
Typické použití noindexu v praxi
- Interní vyhledávání a „thin“ stránky filtrů (faceted navigation), které vytvářejí duplicity nebo nekvalitní kombinace parametrů.
- Staging/preview prostředí, testovací URL, varianty A/B bez produkčního významu.
- Citlivý obsah (neveřejná oznámení, dočasné informace, právní dokumenty) – pokud nechcete indexaci, ale nechcete ani ověřování oprávnění.
- Nákupní košík, pokladna, účet a další transakční kroky, u nichž indexace nepřináší hodnotu a může uživatele mást.
- Stránky s nízkou přidanou hodnotou (štítky, archivy, stránkování), pokud je nedokážete kvalitně zpracovat.
Noindex v kontextu AIO/AEO a „odpovědních“ systémů
Agentní a odpovědní systémy (vyhledávání v ChatGPT/LLM, Answer Engines) si často vytvářejí vlastní indexy a signály. Noindex omezuje šum, zlepšuje návaznost interních odkazů a pomáhá soustředit „pozornost“ na obsah, který má být v odpovědích reprezentativní. V kombinaci s kvalitní strukturou (Schema.org), E-E-A-T a rychlostí (Core Web Vitals) přispívá k vyšší přesnosti extrakce faktů a citací.
Vzorové implementace podle typu obsahu
- Stránky HTML: do šablony
<head>vložte<meta name="robots" content="noindex, follow">a zajistěte, aby se vykreslila už v původním HTML (ne až po hydrataci JavaScriptem). - PDF/obrázky/soubory: nastavte hlavičku
X-Robots-Tag: noindexna serveru (Apache/Nginx/CDN) pro konkrétní cesty nebo vzory. - Parametrické URL: u nežádoucích kombinací parametrů použijte noindex (nebo nastavte canonical na čistou verzi) a zvažte také zapouzdření filtrů do fragmentu URL (pokud nevyžadujete indexaci).
Konfigurace na serveru a v CDN: příklady
Apache (.htaccess):
<FilesMatch ".(pdf|docx)$"> Header set X-Robots-Tag "noindex, noarchive" </FilesMatch>
Nginx:
location ~* .(pdf|docx)$ { add_header X-Robots-Tag "noindex, noarchive"; }
HTTP na úrovni CDN: vytvořte pravidla podle vzoru URL (např. /preview/*) a přidejte hlavičku X-Robots-Tag.
Interakce s dalšími direktivami a meta tagy
- noarchive: brání zobrazení „uložené“ verze. Přidejte tam, kde nechcete archivní kopie.
- nosnippet / max-snippet: kontrola úryvků (snippets). Neovlivňuje indexaci, ale prezentaci výsledku – u noindexu to nemá význam, ale při dočasném nasazení to může být užitečné.
- unavailable_after: datum, po kterém se stránka nemá zobrazovat. Praktické u časově omezených nabídek.
- noimageindex: zabraňuje indexaci obrázků dané stránky ve vyhledávání obrázků.
Nejčastější chyby při nasazování noindexu
- Blokování v robots.txt a současné nasazení noindexu – robot se k pokynu nedostane.
- Zpožděné vkládání meta tagu prostřednictvím JavaScriptu – prohlížeč/robot ho při prvním procházení nemusí spolehlivě zachytit.
- Konfliktní signály:
noindex+ snaha o bohaté úryvky (FAQ/HowTo). Pokud stránku nechcete indexovat, neřešte pro ni rozšířené výsledky. - Náhodné převzetí nastavení ze šablony – globální layout s noindexem, který se přenese na celý web (kritická chyba). Přidejte testy/kontrolu CI.
- Trvalý noindex na důležité URL – zapomenutý příznak po nasazení (např. při přechodu z testovacího prostředí do produkce).
Monitorování a QA: jak ověřit, že noindex funguje
- Kontrola zdrojového kódu: zkontrolujte, že meta tag je v
<head>a není přepsán jiným tagem. - HTTP hlavičky: ověřte odpověď serveru (curl, vývojářské nástroje „Network“), zda obsahuje
X-Robots-Tag. - Logy a RUM: sledujte aktivitu robotů při procházení noindex URL – měla by probíhat, ale indexace by měla směřovat k nule.
- Search Console/Bing Webmaster: stav indexace, případná upozornění, živé testy URL.
Doba odstranění z indexu a opětovná indexace po zrušení noindexu
Odstranění z výsledků není okamžité – závisí na frekvenci procházení a signálech důležitosti URL. Po odstranění noindexu nebo jeho zrušení je vhodné podpořit opětovné procházení interním prolinkováním, odesláním souboru sitemap a případně ruční žádostí o opětovnou indexaci. Během přechodného období se URL může krátce zobrazovat bez popisu (pouze jako odkaz), než se stav ustálí.
Alternativy k noindexu: kdy sáhnout po jiných nástrojích
- Autentizace/Autorizace: pokud stránku nemá vidět nikdo bez přístupu, chraňte ji heslem a nenahrazujte to noindexem.
- HTTP 410/404: pokud je obsah trvale odstraněný, je lepší vrátit stav 410 (Gone) nebo 404 (Not Found) namísto noindexu.
- Canonical: u duplicit, kde má existovat pouze jedna indexovaná verze, upřednostněte kanonikalizaci; noindex používejte spíše pro „nežádoucí“ varianty bez hodnoty.
Specifika frameworků JavaScriptu a dynamického vykreslování
Ujistěte se, že noindex je v HTML už v prvním bajtu (SSR/SSG nebo vykreslení na edge). Vložení meta tagu po hydrataci může přijít pozdě. U SPA zvažte vykreslování kritických šablon na serveru, aby robot direktivy spolehlivě viděl.
Kontrolní seznam pro bezpečné nasazení noindexu
- URL není blokována v souboru
robots.txt(alespoň do doby, než bude odstraněna z indexu). - Meta tag/hlavička s noindexem se zobrazuje konzistentně ve všech variantách (http/https, www/non-www, s/bez koncového lomítka, s kampaňovými parametry).
- V CI je test, který selže, pokud se noindex objeví v „money“ šablonách.
- Po zrušení noindexu je aktivován spouštěč opětovného procházení (aktualizovaný soubor sitemap, interní odkazy, načtení).
Příklady správného a nesprávného použití
Správně: interní vyhledávání (/search?q=...) má noindex, follow, ale v souboru robots.txt není blokováno; PDF s ceníkem pro B2B partnery má X-Robots-Tag: noindex, noarchive.
Nesprávně: celá sekce /blog/ má omylem noindex; nebo je filtr ?color=red zakázán v souboru robots.txt a zároveň má stránka meta tag noindex – robot se k pokynu nedostane.
Shrnutí
Noindex je přesný nástroj pro kontrolu indexace: umožňuje robotům stránku projít, ale brání jejímu zařazení do výsledků. Implementujte ho buď prostřednictvím <meta name="robots" content="noindex, (no)follow"> v HTML, nebo pomocí X-Robots-Tag v HTTP odpovědi (ideální pro zdroje jiné než HTML). Vyhněte se kombinaci s blokováním v souboru robots.txt, sledujte stav v nástrojích pro webmastery a mějte zavedenou ochranu CI/QA proti nechtěnému nasazení. Správné použití noindexu čistí index, zlepšuje informační architekturu a zvyšuje kvalitu signálů v ekosystémech SEO i AIO/AEO.
