Jak dostat web do Googlu: co udělat, aby se stránky zaindexovaly

Indexace znamená, že vyhledávač vaši stránku zná a může ji ukázat ve výsledcích. Bez ní je jedno, jak dobrý máte obsah.

Tenhle text má dvě části: jak indexaci nastartovat u nového webu a co dělat, když se konkrétní stránka tvrdošíjně neindexuje.

Nový web: čtyři kroky

1. Ověřte web v nástrojích pro webmastery. U Googlu je to Search Console, u Seznamu vlastní nástroj. Ověření se dělá souborem na webu nebo záznamem v DNS. Bez toho jste slepí a nedozvíte se, co vyhledávač vidí.

2. Zkontrolujte, že ho nikam nepouštíte omylem zakázaně. Dvě nejčastější chyby, které vzniknou při vývoji a zůstanou:

  • robots.txt se zákazem pro všechny roboty
  • značka noindex v hlavičce stránek

Obojí je pozůstatek testovacího prostředí a odhalí se to za minutu. Zkontrolujte to jako první, protože všechno ostatní je bez toho zbytečné.

3. Vytvořte a odešlete sitemapu. Většina redakčních systémů i e-shopových platforem ji generuje sama. Zkontrolujte, že v ní jsou adresy, které chcete indexovat, a nejsou v ní ty, které nechcete. Odešlete ji v obou nástrojích pro webmastery.

4. Dejte na web odkaz odjinud. Robot se na nový web nejrychleji dostane po odkazu ze stránky, kterou už zná. Stačí jeden z místa, kde už jste: firemní zápis, profil na sítích, oborový katalog.

Pak čekejte. Nový web bývá zaindexovaný v řádu dnů až týdnů.

Když se stránka neindexuje

Nejdřív zjistěte, co vyhledávač o té adrese ví. V Search Console je na to kontrola konkrétní adresy, která rovnou řekne důvod. Tenhle krok nepřeskakujte, ušetří vám hádání.

Pak projděte příčiny v tomhle pořadí, od nejčastějších:

Nastavení stránky. noindex, zákaz v robots.txt, kanonický odkaz mířící na jinou stránku. Kanonický odkaz je nejzáludnější, protože stránka vypadá v pořádku, jen vyhledávači říká „nezajímej se o mě, důležitá je tamta“.

Stránka není odkud dostupná. Když na ni nevede odkaz z žádné jiné stránky a není v sitemapě, robot k ní nemá jak přijít.

Vrací něco jiného než 200. Přesměrování, chyba serveru, měkká 404. Ověřte, co adresa opravdu vrací, ne co vidíte v prohlížeči.

Obsah načítá až JavaScript. Google si s tím většinou poradí, ale trvá to déle a někdy to nevyjde. U e-shopu se to týká hlavně výpisů a filtrů.

Stránka nenese nic navíc. Tohle je nejčastější důvod u větších e-shopů. Když má sto variant produktu vlastní adresu s téměř shodným obsahem, vyhledávač zaindexuje jednu a zbytek odloží. Není to chyba, je to úspora jeho kapacity.

Nástroj, který vám ukáže technický stav celého webu naráz, najdete v katalogu mezi SEO nástroji. U menšího webu stačí bezplatná verze do pěti set adres.

Nejčastější past u e-shopů

Filtry. Kombinace „modrá + velikost L + do 500 Kč“ vytvoří adresu a e-shop jich umí vygenerovat tisíce. Vyhledávač je projde, zjistí, že jsou skoro shodné, a utratí za to kapacitu, kterou měl věnovat vašim kategoriím a produktům.

Řešení není mazat filtry, ale nastavit, které kombinace se mají indexovat a které ne. Obvykle se indexuje jedna nebo dvě kombinace, po kterých je poptávka, a zbytek se z indexace vyřadí.

Tohle je nejčastější technický problém českých e-shopů a řeší se nastavením, ne psaním obsahu.

Co indexaci neurychlí

  • Ruční požadavek o indexaci u každé stránky. Funguje jednorázově a jen někdy. Nedá se z toho udělat postup.
  • Odesílání sitemapy opakovaně. Vyhledávač si ji stáhne, když uzná za vhodné.
  • Nakoupené odkazy. Neurychlí indexaci a přinesou riziko.

Co ji urychlí doopravdy: web, který se často mění a na kterém je co číst. Vyhledávač se vrací tam, kde naposledy něco našel.

Kontrolní seznam

Jednorázově

  • Ověřit web v Search Console i v nástroji Seznamu
  • Zkontrolovat robots.txt, jestli nezakazuje víc, než má
  • Projít web crawlerem a najít stránky s noindex nebo cizím kanonickým odkazem
  • Odeslat sitemapu na obou místech
  • Získat aspoň jeden odkaz z už zaindexovaného webu

U e-shopu navíc

  • Nastavit, které kombinace filtrů se smí indexovat
  • Ověřit, že stránkování negeneruje kopie téhož obsahu
  • Zkontrolovat, že varianty produktu nemají každá vlastní indexovanou adresu

Průběžně

  • Jednou měsíčně zkontrolovat počet zaindexovaných stránek proti počtu, který čekáte
  • Podívat se na hlášené důvody vyloučení a opravit ty, které jsou vaše chyba

Poslední bod je ten nejužitečnější. Rozdíl mezi počtem stránek, které máte, a počtem, které jsou v indexu, je nejlepší ukazatel technického zdraví webu, jaký se dá získat zdarma.

Časté dotazy

Jak dlouho trvá, než Google zaindexuje nový web?

U nového webu dny až týdny, u zavedeného webu novou stránku často do několika dnů. Rychlost se dá podpořit sitemapou a odkazem z už zaindexované stránky, ale vynutit se nedá. Ruční požadavek o indexaci ji urychlí jen někdy.

Proč se moje stránka neindexuje?

Nejčastěji kvůli nastavení, ne kvůli obsahu: značka noindex, zákaz v robots.txt, kanonický odkaz mířící jinam, nebo stránka nedostupná z žádného odkazu. Druhá skupina důvodů je obsahová: stránka je téměř shodná s jinou nebo nenese nic navíc.

Musím posílat sitemapu?

Nemusíte, ale vyplatí se. Sitemapa vyhledávači řekne, které adresy považujete za důležité a kdy se naposledy změnily. U e-shopu s tisíci produkty je to rozdíl mezi rychlou a pomalou indexací.

Řeším indexaci na Seznamu zvlášť?

Ano. Seznam má vlastní nástroj pro webmastery a vlastní robota. Většina technických opatření se překrývá, ale ověření webu a odeslání sitemapy je potřeba udělat na obou místech.

Jednou za čas e-mail, který stojí za otevření

Co je nového mezi nástroji, co reálně funguje a co je jen hezky zabalené. Žádný spam, odhlášení jedním klikem.