Noindex: zákaz indexace stránky vyhledávači

Noindex: Zákaz indexácie stránky vyhľadávačmi

Noindex: co znamená zákaz indexace a kdy ho použít

Noindex je pokyn pro vyhledávače, aby konkrétní URL neindexovaly, a tedy ji nezobrazovaly ve výsledcích vyhledávání. Jde o přesný a poměrně rychlý způsob, jak vyloučit obsah z organického vyhledávání, aniž by bylo nutné odstraňovat stránku z webu nebo blokovat přístup robotům. V moderním SEO (včetně AIO/AEO – optimalizace pro odpovědní systémy a agenty) je správné použití noindexu klíčové pro udržování „čistého“ indexu a řízení viditelnosti obsahu s nízkou hodnotou nebo citlivého obsahu.

Jak noindex funguje: zásada „mohu přečíst, ale neuložím“

Vyhledávač musí mít možnost stránku přečíst, aby zjistil, že obsahuje noindex. Proto se noindex téměř vždy kombinuje s tím, že URL neblokujete v souboru robots.txt. Pokud byste robotovi přístup zakázali, k pokynu noindex by se nedostal. Po zjištění noindexu vyhledávač URL odstraní z indexu nebo ji do něj vůbec nezařadí.

Způsoby implementace noindexu

Existují dva hlavní způsoby, jak vyhledávačům sdělit noindex – meta tag v HTML a HTTP hlavička. Obě řešení mohou fungovat pro HTML i jiné typy souborů (prostřednictvím hlavičky).

  • Meta robots v HTML – vložený do <head>:
<meta name="robots" content="noindex, follow">
  • X-Robots-Tag v HTTP odpovědi – vhodný pro PDF, obrázky, soubory ke stažení nebo v případě, že nemáte kontrolu nad HTML šablonou:
X-Robots-Tag: noindex, follow

Obě formy podporují také cílení na konkrétního robota (např. googlebot, bingbot):

<meta name="googlebot" content="noindex, follow"> X-Robots-Tag: googlebot: noindex, follow

„noindex, follow“ vs. „noindex, nofollow“ a co se děje s odkazy

Kombinace noindex, follow způsobí, že samotná stránka nebude v indexu, ale vyhledávač může následovat odkazy na ní. V praxi to pomáhá zachovat přenos signálů na další stránky. U dlouhodobě noindexovaných URL však mohou některé vyhledávače odkazy časem ignorovat, pokud se URL téměř nikdy znovu neprochází. noindex, nofollow je přísnější režim, který výslovně žádá o ignorování odkazů – používá se výjimečně (např. dočasně při vysokém riziku spamu na stránce s UGC).

Noindex a robots.txt: častý omyl

Robots.txt nezná direktivu noindex a neměl by se používat k vyloučení z indexu. Jde o soubor pro řízení přístupu robotů, nikoli pro řízení indexace. Pokud URL zakážete v souboru robots.txt, robot se k meta tagu nebo hlavičce s noindexem nedostane – výsledek může být paradoxně opačný (URL se v indexu objeví bez obsahu, pouze jako odkaz bez úryvků). Proto platí doporučení: pokud chcete stránku odstranit z výsledků, použijte noindex (meta tag/hlavičku) a URL v souboru robots.txt neblokujte.

Noindex a kanonikalizace: co má přednost

rel="canonical" navrhuje preferovanou URL pro indexaci. Noindex je direktivní pokyn; pokud stránka obsahuje noindex a zároveň odkazuje kanonickým odkazem na jinou URL, vyhledávač zpravidla respektuje noindex u dané stránky a může indexovat cílovou kanonickou URL (pokud nemá noindex). Nespoléhejte se však na kanonický odkaz jako na náhradu za noindex – jde o rozdílné nástroje pro rozdílné účely.

Noindex a „indexifembedded“: zvláštní případ vloženého obsahu

Stránka může mít noindex, ale pomocí direktivy indexifembedded povolit indexaci svého vloženého obsahu, pokud se zobrazuje prostřednictvím <iframe> na jiné stránce. Použití:

<meta name="robots" content="noindex, indexifembedded">

To je užitečné pro widgety a komponenty, které samy o sobě nemají hodnotu jako plnohodnotná stránka, ale smysl mají, když jsou vložené jinde.

Typické použití noindexu v praxi

  • Interní vyhledávání a „thin“ stránky filtrů (faceted navigation), které vytvářejí duplicity nebo nekvalitní kombinace parametrů.
  • Staging/preview prostředí, testovací URL, varianty A/B bez produkčního významu.
  • Citlivý obsah (neveřejná oznámení, dočasné informace, právní dokumenty) – pokud nechcete indexaci, ale nechcete ani ověřování oprávnění.
  • Nákupní košík, pokladna, účet a další transakční kroky, u nichž indexace nepřináší hodnotu a může uživatele mást.
  • Stránky s nízkou přidanou hodnotou (štítky, archivy, stránkování), pokud je nedokážete kvalitně zpracovat.

Noindex v kontextu AIO/AEO a „odpovědních“ systémů

Agentní a odpovědní systémy (vyhledávání v ChatGPT/LLM, Answer Engines) si často vytvářejí vlastní indexy a signály. Noindex omezuje šum, zlepšuje návaznost interních odkazů a pomáhá soustředit „pozornost“ na obsah, který má být v odpovědích reprezentativní. V kombinaci s kvalitní strukturou (Schema.org), E-E-A-T a rychlostí (Core Web Vitals) přispívá k vyšší přesnosti extrakce faktů a citací.

Vzorové implementace podle typu obsahu

  • Stránky HTML: do šablony <head> vložte <meta name="robots" content="noindex, follow"> a zajistěte, aby se vykreslila už v původním HTML (ne až po hydrataci JavaScriptem).
  • PDF/obrázky/soubory: nastavte hlavičku X-Robots-Tag: noindex na serveru (Apache/Nginx/CDN) pro konkrétní cesty nebo vzory.
  • Parametrické URL: u nežádoucích kombinací parametrů použijte noindex (nebo nastavte canonical na čistou verzi) a zvažte také zapouzdření filtrů do fragmentu URL (pokud nevyžadujete indexaci).

Konfigurace na serveru a v CDN: příklady

Apache (.htaccess):

<FilesMatch ".(pdf|docx)$"> Header set X-Robots-Tag "noindex, noarchive" </FilesMatch>

Nginx:

location ~* .(pdf|docx)$ { add_header X-Robots-Tag "noindex, noarchive"; }

HTTP na úrovni CDN: vytvořte pravidla podle vzoru URL (např. /preview/*) a přidejte hlavičku X-Robots-Tag.

Interakce s dalšími direktivami a meta tagy

  • noarchive: brání zobrazení „uložené“ verze. Přidejte tam, kde nechcete archivní kopie.
  • nosnippet / max-snippet: kontrola úryvků (snippets). Neovlivňuje indexaci, ale prezentaci výsledku – u noindexu to nemá význam, ale při dočasném nasazení to může být užitečné.
  • unavailable_after: datum, po kterém se stránka nemá zobrazovat. Praktické u časově omezených nabídek.
  • noimageindex: zabraňuje indexaci obrázků dané stránky ve vyhledávání obrázků.

Nejčastější chyby při nasazování noindexu

  • Blokování v robots.txt a současné nasazení noindexu – robot se k pokynu nedostane.
  • Zpožděné vkládání meta tagu prostřednictvím JavaScriptu – prohlížeč/robot ho při prvním procházení nemusí spolehlivě zachytit.
  • Konfliktní signály: noindex + snaha o bohaté úryvky (FAQ/HowTo). Pokud stránku nechcete indexovat, neřešte pro ni rozšířené výsledky.
  • Náhodné převzetí nastavení ze šablony – globální layout s noindexem, který se přenese na celý web (kritická chyba). Přidejte testy/kontrolu CI.
  • Trvalý noindex na důležité URL – zapomenutý příznak po nasazení (např. při přechodu z testovacího prostředí do produkce).

Monitorování a QA: jak ověřit, že noindex funguje

  • Kontrola zdrojového kódu: zkontrolujte, že meta tag je v <head> a není přepsán jiným tagem.
  • HTTP hlavičky: ověřte odpověď serveru (curl, vývojářské nástroje „Network“), zda obsahuje X-Robots-Tag.
  • Logy a RUM: sledujte aktivitu robotů při procházení noindex URL – měla by probíhat, ale indexace by měla směřovat k nule.
  • Search Console/Bing Webmaster: stav indexace, případná upozornění, živé testy URL.

Doba odstranění z indexu a opětovná indexace po zrušení noindexu

Odstranění z výsledků není okamžité – závisí na frekvenci procházení a signálech důležitosti URL. Po odstranění noindexu nebo jeho zrušení je vhodné podpořit opětovné procházení interním prolinkováním, odesláním souboru sitemap a případně ruční žádostí o opětovnou indexaci. Během přechodného období se URL může krátce zobrazovat bez popisu (pouze jako odkaz), než se stav ustálí.

Alternativy k noindexu: kdy sáhnout po jiných nástrojích

  • Autentizace/Autorizace: pokud stránku nemá vidět nikdo bez přístupu, chraňte ji heslem a nenahrazujte to noindexem.
  • HTTP 410/404: pokud je obsah trvale odstraněný, je lepší vrátit stav 410 (Gone) nebo 404 (Not Found) namísto noindexu.
  • Canonical: u duplicit, kde má existovat pouze jedna indexovaná verze, upřednostněte kanonikalizaci; noindex používejte spíše pro „nežádoucí“ varianty bez hodnoty.

Specifika frameworků JavaScriptu a dynamického vykreslování

Ujistěte se, že noindex je v HTML už v prvním bajtu (SSR/SSG nebo vykreslení na edge). Vložení meta tagu po hydrataci může přijít pozdě. U SPA zvažte vykreslování kritických šablon na serveru, aby robot direktivy spolehlivě viděl.

Kontrolní seznam pro bezpečné nasazení noindexu

  • URL není blokována v souboru robots.txt (alespoň do doby, než bude odstraněna z indexu).
  • Meta tag/hlavička s noindexem se zobrazuje konzistentně ve všech variantách (http/https, www/non-www, s/bez koncového lomítka, s kampaňovými parametry).
  • V CI je test, který selže, pokud se noindex objeví v „money“ šablonách.
  • Po zrušení noindexu je aktivován spouštěč opětovného procházení (aktualizovaný soubor sitemap, interní odkazy, načtení).

Příklady správného a nesprávného použití

Správně: interní vyhledávání (/search?q=...) má noindex, follow, ale v souboru robots.txt není blokováno; PDF s ceníkem pro B2B partnery má X-Robots-Tag: noindex, noarchive.

Nesprávně: celá sekce /blog/ má omylem noindex; nebo je filtr ?color=red zakázán v souboru robots.txt a zároveň má stránka meta tag noindex – robot se k pokynu nedostane.

Shrnutí

Noindex je přesný nástroj pro kontrolu indexace: umožňuje robotům stránku projít, ale brání jejímu zařazení do výsledků. Implementujte ho buď prostřednictvím <meta name="robots" content="noindex, (no)follow"> v HTML, nebo pomocí X-Robots-Tag v HTTP odpovědi (ideální pro zdroje jiné než HTML). Vyhněte se kombinaci s blokováním v souboru robots.txt, sledujte stav v nástrojích pro webmastery a mějte zavedenou ochranu CI/QA proti nechtěnému nasazení. Správné použití noindexu čistí index, zlepšuje informační architekturu a zvyšuje kvalitu signálů v ekosystémech SEO i AIO/AEO.