BLOG

Google neindexuje můj web? Nejčastější důvody a jak je opravit

Google neindexuje web

Publikujete nový web nebo článek.

Pošlete URL do Google Search Console.

Počkáte den.

Pak dva.

Pak týden.

A pořád nic.

Stránka se v Googlu nezobrazuje.

První reakce bývá:

Google můj web ignoruje.

Ve skutečnosti ale může být důvodů celá řada.

Někdy je problém čistě technický.

Jindy Google stránku zná, ale nechce ji zatím zařadit do indexu.

A někdy si problém způsobíme sami například nastavením noindex, robots.txt nebo špatnou kanonickou URL.

Podívejme se proto na nejčastější důvody, proč Google stránku neindexuje, a hlavně na to, jak zjistit konkrétní příčinu.

Co vlastně znamená indexace?

Než začneme řešit problém, je dobré odlišit dvě věci:

procházení stránky a indexaci stránky.

Google nejprve musí stránku najít a navštívit.

Tomu se říká crawling.

Potom analyzuje její obsah, strukturu, metadata a další informace a rozhoduje, zda ji zařadí do svého indexu.

Teprve stránka uložená v indexu se může běžně zobrazovat ve výsledcích vyhledávání. Google zároveň výslovně upozorňuje, že ne každá stránka, kterou zpracuje, musí být automaticky indexovaná.

Takže:

Google stránku zná ≠ stránka je indexovaná.

A:

stránka je indexovaná ≠ bude vysoko ve výsledcích.

To jsou tři rozdílné fáze.

Jak zjistit, jestli Google stránku indexuje?

Nejlepší výchozí bod je Google Search Console.

Použijte nástroj:

Kontrola adresy URL

Zadejte přesnou URL stránky a Search Console vám ukáže, co o ní Google ví.

Můžete zjistit například:

  • zda je URL v indexu,
  • jestli ji Google může načíst,
  • zda není blokovaná,
  • kterou canonical URL Google vybral,
  • kdy byla naposledy procházená,
  • zda je stránka vhodná k indexaci.

Google doporučuje nástroj Kontrola adresy URL právě pro situace, kdy chcete zjistit, proč konkrétní stránka není ve výsledcích.

První kontrola: Je stránka opravdu veřejně dostupná?

Zní to banálně.

Ale první krok je vždy:

Lze URL normálně otevřít bez přihlášení?

Zkontrolujte:

  • zda stránka nevrací chybu 404,
  • zda není chráněná heslem,
  • zda není dostupná jen přihlášeným uživatelům,
  • zda server nevrací chybu 5xx,
  • zda není problém s DNS nebo hostingem.

Pokud stránku Googlebot vůbec nedokáže načíst, indexace je samozřejmě problém.

Google uvádí mezi běžné překážky například serverové a síťové chyby nebo zablokovaný přístup crawleru.

1. Stránka obsahuje noindex

Jedna z nejčastějších příčin.

Ve zdrojovém kódu může být například:

<meta name="robots" content="noindex">

Tím Googlu říkáte:

Tuto stránku neindexuj.

A Google tento pokyn respektuje.

noindex může být nastaven:

  • přímo v HTML,
  • přes SEO plugin,
  • přes HTTP hlavičku X-Robots-Tag,
  • prostřednictvím nastavení CMS.

Google uvádí, že pokud crawler stránku navštíví a najde noindex, stránku z výsledků vyhledávání vyřadí.

WordPress: pozor na nastavení viditelnosti

Ve WordPressu stojí za kontrolu:

Nastavení → Zobrazování → Viditelnost pro vyhledávače

Pokud je aktivní volba:

Zakázat prohledávání obsahu tohoto webu vyhledávači

může WordPress na web přidávat pravidla, která indexaci blokují.

Tohle se někdy stává po vývoji webu, kdy se web z testovacího prostředí přesune do ostrého provozu, ale nastavení zůstane stejné.

2. robots.txt blokuje Googlebot

Dalším častým viníkem je:

robots.txt

Soubor typicky najdete na adrese:

https://domena.cz/robots.txt

Může obsahovat například:

User-agent: *
Disallow: /

To znamená:

neprocházej nic.

U ostrého webu by to samozřejmě byl zásadní problém.

Ale pozor na jednu důležitou věc.

robots.txt není nástroj určený k bezpečnému odstranění stránky z výsledků vyhledávání.

Google výslovně uvádí, že robots.txt primárně řídí crawling, nikoliv samotné vyřazení URL z indexu. Blokovaná URL se za určitých okolností může stále objevit ve výsledcích, například pokud na ni vedou odkazy.

Pokud stránku skutečně nechcete indexovat, vhodnější je noindex nebo omezení přístupu.

3. Stránka není nikde interně prolinkovaná

Stránka existuje.

Je v sitemapě.

Ale žádná jiná část webu na ni neodkazuje.

To je typický případ tzv. orphan page.

Google ji může najít například přes sitemapu.

Ale interní struktura webu mu zároveň naznačuje:

Tato stránka asi není příliš důležitá.

Pokud jde o důležitou stránku, měla by mít přirozené interní odkazy z dalších relevantních míst.

Například článek o:

interním prolinkování

by měl být dostupný z dalších SEO článků.

A stránka služby by měla být propojena z:

  • homepage,
  • menu,
  • souvisejících článků,
  • dalších relevantních služeb.

Interní odkazy nepomáhají pouze s navigací.

Pomáhají také Googlu stránky objevovat a chápat jejich vztahy.

4. Stránka není v sitemapě

Sitemap není podmínkou indexace.

Google může stránku najít i jinak.

U většiny webů ale dává XML sitemap velký smysl.

Pomáhá vyhledávači zjistit:

Tohle jsou URL, které považujeme za důležité.

Google navíc doporučuje při větším množství nových nebo aktualizovaných stránek použít právě sitemapu místo ručního odesílání každé URL.

Pokud používáte WordPress a SEO plugin, sitemap se zpravidla generuje automaticky.

Je ale dobré ověřit:

  • že existuje,
  • že se načte,
  • že obsahuje správné URL,
  • že v ní nejsou neindexovatelné stránky,
  • že je přidaná v Search Console.

5. Google ještě stránku neprošel

Někdy není problém vůbec žádný.

Článek jste publikovali před několika hodinami.

Google ho prostě ještě nenavštívil.

U nového nebo méně často procházeného webu může trvat delší dobu, než se crawler vrátí.

V Search Console můžete použít:

Kontrola adresy URL → Požádat o indexování

Tím URL odešlete do fronty ke zpracování.

Neznamená to ale:

Google stránku okamžitě indexuje.

Google výslovně uvádí, že samotná žádost nezaručuje indexaci. Může to trvat den, ale také výrazně déle.

Proto nemá smysl tlačítko mačkat desetkrát denně.

6. Google stránku prošel, ale nezaindexoval

Tohle je mnohem zajímavější případ.

V Search Console můžete například vidět stav:

Procházeno – momentálně neindexováno

Google tedy:

  • stránku našel,
  • navštívil ji,
  • dokázal ji přečíst,
  • ale rozhodl se ji aktuálně nezařadit do indexu.

A tady už často není problém v robots.txt.

Je potřeba podívat se na samotnou stránku.

Je obsah dostatečně hodnotný?

Představte si web s deseti stránkami, které vypadají takto:

Tvorba webu Praha

Text 300 slov.

Tvorba webu Brno

Téměř stejný text.

Tvorba webu Ostrava

Opět stejný text s vyměněným městem.

Technicky mohou být všechny stránky v pořádku.

Ale Google si může položit otázku:

Proč bych měl indexovat všechny?

Pokud stránka nepřináší nic nového, může být problém v její hodnotě a originalitě.

Google během indexace posuzuje obsah stránky a zároveň zjišťuje, zda nejde o duplicitu jiné URL.

7. Google považuje stránku za duplicitu

V Search Console můžete narazit například na:

Duplicitní stránka – Google vybral jinou kanonickou stránku

To znamená, že Google našel více velmi podobných URL.

Například:

/produkt/

/produkt/?utm_source=facebook

/kategorie/produkt/

nebo několik téměř identických stránek.

Google je seskupí a vybere jednu hlavní, tzv. canonical URL.

Ostatní varianty se nemusí samostatně indexovat.

A to může být úplně správně.

Co je canonical URL?

Canonical URL je verze stránky, kterou považujete za hlavní.

Do HTML lze například přidat:

<link rel="canonical" href="https://domena.cz/hlavni-stranka/">

Tím Googlu naznačujete:

Pokud existují podobné varianty, preferujeme tuto URL.

Je ale důležité vědět, že canonical je signál, nikoliv absolutní příkaz.

Google může na základě dalších signálů vybrat jinou canonical URL.

V Search Console proto sledujte:

Canonical URL deklarovaná uživatelem

a:

Canonical URL vybraná Googlem

Pokud jsou rozdílné, stojí za to zjistit proč.

8. Canonical odkazuje na špatnou stránku

Tohle už je vyloženě technická chyba.

Máte například článek:

/jak-zrychlit-wordpress/

ale canonical říká:

/technicke-seo/

Google tím dostává informaci:

Tento článek je duplicitní a hlavní verze je jiná URL.

Výsledkem může být, že původní stránku samostatně neindexuje.

Každá samostatná stránka, kterou chcete indexovat, by zpravidla měla mít self-referencing canonical, tedy canonical směřující sama na sebe, pokud není záměrně součástí duplicitní skupiny.

Google právě self-referential canonical uvádí mezi doporučenými postupy.

9. Stránka přesměrovává jinam

Pokud URL vrací:

301

nebo:

302

Google obvykle nebude indexovat původní URL jako samostatnou cílovou stránku.

To může být naprosto správně.

Například:

/stara-sluzba/

→ 301 →

/nova-sluzba/

Pak chcete indexovat novou stránku.

Problém nastává, pokud přesměrování vzniklo omylem.

Typicky:

  • špatné pravidlo v .htaccess,
  • plugin pro redirecty,
  • změna URL,
  • automatická úprava CMS.

Proto je při problému s indexací dobré ověřit i HTTP stav URL.

10. Stránka vrací soft 404

Soft 404 je zajímavý případ.

Stránka technicky vrátí:

HTTP 200 OK

ale její obsah prakticky říká:

Tato stránka neexistuje.

Například:

  • prázdná produktová stránka,
  • stránka bez obsahu,
  • chybová hláška,
  • stránka s minimální hodnotou.

Google ji může vyhodnotit jako soft 404 a nezaindexovat ji běžným způsobem.

Správná skutečně neexistující stránka by měla obvykle vracet:

404

nebo:

410.

11. Server blokuje Googlebot

Někdy je stránka dostupná vám, ale ne crawleru.

Příčinou může být například:

  • firewall,
  • CDN,
  • bezpečnostní plugin,
  • ochrana proti botům,
  • hosting,
  • rate limiting.

Typická situace:

Bezpečnostní systém vidí velké množství automatických požadavků a začne blokovat crawler.

Proto je užitečné v Search Console použít:

Otestovat živou URL

Pokud se stránka vám načte, ale Google ji nedokáže načíst, problém může být právě někde mezi serverem a Googlebotem.

12. Stránka potřebuje JavaScript, který Google nezpracuje správně

Google umí JavaScript renderovat a při procházení používá moderní verzi Chrome. Přesto mohou vzniknout situace, kdy důležitý obsah není pro crawler dobře dostupný.

Například:

  • obsah se načte až po komplikované interakci,
  • JavaScript selže,
  • API blokuje crawler,
  • část obsahu vyžaduje přihlášení,
  • renderování generuje chybu.

U běžného WordPress webu to není nejčastější příčina.

U moderních JavaScript aplikací už ale ano.

13. Stránka nemá dost interních odkazů

Nejde jen o to, zda existuje jeden odkaz.

Záleží také na celkové struktuře.

Představte si důležitou službu, na kterou vede jediný odkaz ze starého článku z roku 2021.

A pak jinou službu, která je:

  • v hlavním menu,
  • na homepage,
  • v několika relevantních článcích,
  • v přehledu služeb.

Je zřejmé, která působí jako důležitější část webu.

Správné interní prolinkování proto pomáhá Googlu pochopit hierarchii webu.

14. Nový web nemá ještě vybudované signály

U úplně nové domény bývá normální, že indexace není okamžitá.

Google zatím:

  • web téměř nezná,
  • nemá historii,
  • má málo externích odkazů,
  • neví, jak často se obsah mění.

To neznamená, že musíte nakoupit stovky backlinků.

Dává větší smysl postupně budovat:

  • kvalitní obsah,
  • interní strukturu,
  • přirozené zpětné odkazy,
  • sitemapu,
  • pravidelné aktualizace.

S růstem webu se obvykle zlepšuje i schopnost Googlu nové stránky rychleji objevovat.

15. Obsah je příliš podobný jiným stránkám

Tohle se velmi často týká:

  • lokálních landing pages,
  • produktových variant,
  • kategorií,
  • automaticky generovaných stránek.

Pokud máte deset stránek a mezi nimi se mění pouze:

  • město,
  • název služby,
  • dvě věty,

Google nemusí vidět důvod indexovat všechny.

Řešení není:

Přidáme každé stránce dalších 500 slov.

Řešení je:

udělat každou stránku skutečně užitečnou pro její konkrétní účel.

Například lokální stránka může obsahovat:

  • relevantní lokální reference,
  • zkušenosti z dané oblasti,
  • specifika služby,
  • lokální kontaktní informace,
  • konkrétní FAQ.

16. URL je velmi hluboko ve struktuře webu

Představte si cestu:

Homepage
→ Kategorie
→ Podkategorie
→ Archiv
→ Strana 8
→ Článek

Pokud je důležitá stránka dostupná pouze přes několik úrovní navigace, její objevení i význam mohou být slabší.

Důležité stránky by měly být dostupné rozumně jednoduše.

Ne nutně všechny přímo z homepage.

Ale logicky a bez zbytečně hluboké struktury.

Jak zjistit konkrétní důvod v Google Search Console?

Začněte:

Indexování → Stránky

Search Console vám rozdělí URL na:

  • indexované,
  • neindexované.

U neindexovaných pak ukazuje konkrétní důvody.

Můžete narazit například na:

Stránka s přesměrováním

Vyloučeno značkou noindex

Blokováno souborem robots.txt

Procházeno – momentálně neindexováno

Nalezeno – momentálně neindexováno

Duplicitní stránka

A právě konkrétní stav je klíčový.

Nemá totiž smysl řešit robots.txt, pokud Search Console jasně říká:

Google stránku prošel a rozhodl se ji nezaindexovat.

Stejně tak nemá smysl přepisovat obsah stránky, kterou Google nemůže vůbec navštívit.

„Nalezeno – momentálně neindexováno“

Google o URL ví.

Ale zatím ji neprošel.

Důvod může souviset například s tím, že:

  • web má velké množství URL,
  • stránka je málo důležitá,
  • crawler zatím neměl důvod ji prioritizovat.

Zkontrolujte:

  • interní odkazy,
  • sitemapu,
  • kvalitu stránky,
  • zda nevznikají tisíce zbytečných URL.

U velkých e-shopů může být problém například ve filtrech a parametrech, které generují obrovské množství adres.

„Procházeno – momentálně neindexováno“

Tento stav znamená něco jiného.

Google stránku už navštívil.

Proto bych se díval především na:

  • kvalitu obsahu,
  • duplicity,
  • podobnost s jinými stránkami,
  • canonical,
  • interní význam stránky.

Opakované klikání na:

Požádat o indexování

samo o sobě tento problém pravděpodobně nevyřeší.

Jak rychle Google indexuje novou stránku?

Na to neexistuje pevná odpověď.

Může jít o:

  • několik hodin,
  • jeden den,
  • několik dní,
  • týdny.

Google sám uvádí, že po žádosti o indexaci může proces běžně trvat den, ale někdy také jeden až dva týdny nebo déle, a žádost sama o sobě indexaci negarantuje.

U zavedeného webu může Google nový článek najít velmi rychle.

U nové domény to může být podstatně pomalejší.

Pomůže odeslání sitemap?

Ano, sitemap má smysl.

Ale není to:

sitemap.xml = garantovaná indexace.

Sitemap Googlu říká:

Tyto URL považujeme za důležité.

Google ji použije jako jeden ze signálů při objevování a canonicalizaci URL.

Pořád ale sám rozhoduje, co indexovat.

Pomůže tlačítko „Požádat o indexování“?

Ano.

Je užitečné například:

  • po publikování důležité nové stránky,
  • po větší aktualizaci,
  • po opravě technického problému.

Ale opět:

není to tlačítko „přidat do Googlu“.

Google URL pouze zařadí do fronty pro opětovné zpracování.

Co bych zkontroloval jako první?

Pokud stránka není indexovaná, postupoval bych v tomto pořadí:

  1. Otevřít Kontrolu adresy URL v Search Console.
  2. Zjistit přesný stav URL.
  3. Ověřit, že stránka vrací 200 OK.
  4. Zkontrolovat noindex.
  5. Zkontrolovat robots.txt.
  6. Ověřit canonical.
  7. Zkontrolovat, zda je URL v sitemapě.
  8. Zkontrolovat interní odkazy.
  9. Posoudit kvalitu a unikátnost obsahu.
  10. Teprve potom požádat o opětovnou indexaci.

Díky tomu neřešíte problém naslepo.

Co nedělat, když Google stránku neindexuje?

Nedoporučuji:

  • posílat žádost o indexaci každý den,
  • náhodně měnit URL,
  • kupovat okamžitě zpětné odkazy,
  • přidávat stovky slov jen kvůli délce,
  • odstranit canonical bez pochopení problému,
  • blokovat stránku robots.txt a současně očekávat, že Google uvidí její noindex.

Právě poslední situace je častý zdroj zmatku.

Pokud Googlebot stránku kvůli robots.txt nemůže navštívit, neuvidí na ní ani noindex. Google na tuto kombinaci výslovně upozorňuje.

Indexace není totéž co dobrá pozice

Ještě jedna zásadní věc.

Pokud Search Console ukazuje:

URL je na Googlu

znamená to pouze:

Stránka je indexovaná.

Ne:

Stránka bude na první stránce Googlu.

Po indexaci teprve začíná druhá část:

  • relevance,
  • obsah,
  • interní odkazy,
  • externí odkazy,
  • konkurence,
  • technická kvalita,
  • uživatelský záměr.

Proto je dobré oddělit dvě otázky:

Proč stránka není indexovaná?

a:

Proč indexovaná stránka nemá dobré pozice?

Na druhou otázku už mnohem lépe odpoví data z Google Search Console o pozicích, zobrazeních a kliknutích.

Nejlepší řešení je nejdřív správně diagnostikovat problém

Indexace může selhat kvůli jednomu řádku v HTML.

Ale také kvůli celé struktuře webu.

Proto neexistuje jedno univerzální řešení typu:

Přidejte sitemap a za dva dny jste v Googlu.

Nejdřív je potřeba zjistit:

V jaké fázi problém vzniká?

Google stránku nenašel?

Nemůže ji projít?

Může ji projít, ale nesmí ji indexovat?

Považuje ji za duplicitu?

Nebo ji prošel, ale nepovažuje ji zatím za dostatečně hodnotnou?

Jakmile znáte odpověď, oprava bývá výrazně jednodušší.

Co si z toho odnést?

Pokud Google stránku neindexuje, nezačínejte panikařit.

Začněte daty.

Otevřete Google Search Console.

Zkontrolujte konkrétní URL.

A zjistěte přesný stav.

Nejčastější příčiny bývají:

  • noindex,
  • blokace crawleru,
  • chybná canonical URL,
  • duplicita,
  • přesměrování,
  • chybějící interní odkazy,
  • slabý nebo příliš podobný obsah,
  • serverový problém.

A někdy stránka jednoduše potřebuje čas.

Dobře postavený web by ale měl Googlu jeho práci co nejvíce usnadnit.

Jasná struktura.

Správné technické nastavení.

Kvalitní obsah.

Interní odkazy.

Sitemap.

A žádné protichůdné signály.

Protože obsah, který Google nedokáže správně najít a indexovat, nemá šanci získat návštěvnost z organického vyhledávání.


Google stránku neindexuje a nevíte proč?

Problém může být v jednom nastavení, ale také ve struktuře, obsahu nebo technickém stavu celého webu.

Při auditu a optimalizaci webu zkontrolujeme indexaci, technické SEO, interní odkazy, obsah i další překážky, které mohou web ve vyhledávání brzdit.

Zjistíme konkrétní příčinu a určíme, co má smysl opravit jako první. Nechte si zkontrolovat web.

Picture of Aleš Zita

Aleš Zita

Aleš Zita jsem webový vývojář a zakladatel Allimedia. Tvorbě webů, e-shopů a webových aplikací se věnuji od roku 2009. Specializuji se na WordPress, WooCommerce, programování v Nette a Laravelu, vývoj pluginů na míru, integrace a technickou optimalizaci webů. Mám zkušenosti s desítkami reálných projektů pro firmy a podnikatele a jsem také autorem vlastních pluginů publikovaných v oficiálním repozitáři WordPress.org.

Picture of Aleš Zita

Aleš Zita

Aleš Zita jsem webový vývojář a zakladatel Allimedia. Tvorbě webů, e-shopů a webových aplikací se věnuji od roku 2009. Specializuji se na WordPress, WooCommerce, programování v Nette a Laravelu, vývoj pluginů na míru, integrace a technickou optimalizaci webů. Mám zkušenosti s desítkami reálných projektů pro firmy a podnikatele a jsem také autorem vlastních pluginů publikovaných v oficiálním repozitáři WordPress.org.