Jak dostat web do Googlu: co udělat, aby se stránky zaindexovaly
Indexace znamená, že vyhledávač vaši stránku zná a může ji ukázat ve výsledcích. Bez ní je jedno, jak dobrý máte obsah.
Tenhle text má dvě části: jak indexaci nastartovat u nového webu a co dělat, když se konkrétní stránka tvrdošíjně neindexuje.
Nový web: čtyři kroky
1. Ověřte web v nástrojích pro webmastery. U Googlu je to Search Console, u Seznamu vlastní nástroj. Ověření se dělá souborem na webu nebo záznamem v DNS. Bez toho jste slepí a nedozvíte se, co vyhledávač vidí.
2. Zkontrolujte, že ho nikam nepouštíte omylem zakázaně. Dvě nejčastější chyby, které vzniknou při vývoji a zůstanou:
robots.txtse zákazem pro všechny roboty- značka
noindexv hlavičce stránek
Obojí je pozůstatek testovacího prostředí a odhalí se to za minutu. Zkontrolujte to jako první, protože všechno ostatní je bez toho zbytečné.
3. Vytvořte a odešlete sitemapu. Většina redakčních systémů i e-shopových platforem ji generuje sama. Zkontrolujte, že v ní jsou adresy, které chcete indexovat, a nejsou v ní ty, které nechcete. Odešlete ji v obou nástrojích pro webmastery.
4. Dejte na web odkaz odjinud. Robot se na nový web nejrychleji dostane po odkazu ze stránky, kterou už zná. Stačí jeden z místa, kde už jste: firemní zápis, profil na sítích, oborový katalog.
Pak čekejte. Nový web bývá zaindexovaný v řádu dnů až týdnů.
Když se stránka neindexuje
Nejdřív zjistěte, co vyhledávač o té adrese ví. V Search Console je na to kontrola konkrétní adresy, která rovnou řekne důvod. Tenhle krok nepřeskakujte, ušetří vám hádání.
Pak projděte příčiny v tomhle pořadí, od nejčastějších:
Nastavení stránky. noindex, zákaz v robots.txt, kanonický odkaz mířící na jinou stránku. Kanonický odkaz je nejzáludnější, protože stránka vypadá v pořádku, jen vyhledávači říká „nezajímej se o mě, důležitá je tamta“.
Stránka není odkud dostupná. Když na ni nevede odkaz z žádné jiné stránky a není v sitemapě, robot k ní nemá jak přijít.
Vrací něco jiného než 200. Přesměrování, chyba serveru, měkká 404. Ověřte, co adresa opravdu vrací, ne co vidíte v prohlížeči.
Obsah načítá až JavaScript. Google si s tím většinou poradí, ale trvá to déle a někdy to nevyjde. U e-shopu se to týká hlavně výpisů a filtrů.
Stránka nenese nic navíc. Tohle je nejčastější důvod u větších e-shopů. Když má sto variant produktu vlastní adresu s téměř shodným obsahem, vyhledávač zaindexuje jednu a zbytek odloží. Není to chyba, je to úspora jeho kapacity.
Nástroj, který vám ukáže technický stav celého webu naráz, najdete v katalogu mezi SEO nástroji. U menšího webu stačí bezplatná verze do pěti set adres.
Nejčastější past u e-shopů
Filtry. Kombinace „modrá + velikost L + do 500 Kč“ vytvoří adresu a e-shop jich umí vygenerovat tisíce. Vyhledávač je projde, zjistí, že jsou skoro shodné, a utratí za to kapacitu, kterou měl věnovat vašim kategoriím a produktům.
Řešení není mazat filtry, ale nastavit, které kombinace se mají indexovat a které ne. Obvykle se indexuje jedna nebo dvě kombinace, po kterých je poptávka, a zbytek se z indexace vyřadí.
Tohle je nejčastější technický problém českých e-shopů a řeší se nastavením, ne psaním obsahu.
Co indexaci neurychlí
- Ruční požadavek o indexaci u každé stránky. Funguje jednorázově a jen někdy. Nedá se z toho udělat postup.
- Odesílání sitemapy opakovaně. Vyhledávač si ji stáhne, když uzná za vhodné.
- Nakoupené odkazy. Neurychlí indexaci a přinesou riziko.
Co ji urychlí doopravdy: web, který se často mění a na kterém je co číst. Vyhledávač se vrací tam, kde naposledy něco našel.
Kontrolní seznam
Jednorázově
- Ověřit web v Search Console i v nástroji Seznamu
- Zkontrolovat robots.txt, jestli nezakazuje víc, než má
- Projít web crawlerem a najít stránky s noindex nebo cizím kanonickým odkazem
- Odeslat sitemapu na obou místech
- Získat aspoň jeden odkaz z už zaindexovaného webu
U e-shopu navíc
- Nastavit, které kombinace filtrů se smí indexovat
- Ověřit, že stránkování negeneruje kopie téhož obsahu
- Zkontrolovat, že varianty produktu nemají každá vlastní indexovanou adresu
Průběžně
- Jednou měsíčně zkontrolovat počet zaindexovaných stránek proti počtu, který čekáte
- Podívat se na hlášené důvody vyloučení a opravit ty, které jsou vaše chyba
Poslední bod je ten nejužitečnější. Rozdíl mezi počtem stránek, které máte, a počtem, které jsou v indexu, je nejlepší ukazatel technického zdraví webu, jaký se dá získat zdarma.
Časté dotazy
Jak dlouho trvá, než Google zaindexuje nový web?
U nového webu dny až týdny, u zavedeného webu novou stránku často do několika dnů. Rychlost se dá podpořit sitemapou a odkazem z už zaindexované stránky, ale vynutit se nedá. Ruční požadavek o indexaci ji urychlí jen někdy.
Proč se moje stránka neindexuje?
Nejčastěji kvůli nastavení, ne kvůli obsahu: značka noindex, zákaz v robots.txt, kanonický odkaz mířící jinam, nebo stránka nedostupná z žádného odkazu. Druhá skupina důvodů je obsahová: stránka je téměř shodná s jinou nebo nenese nic navíc.
Musím posílat sitemapu?
Nemusíte, ale vyplatí se. Sitemapa vyhledávači řekne, které adresy považujete za důležité a kdy se naposledy změnily. U e-shopu s tisíci produkty je to rozdíl mezi rychlou a pomalou indexací.
Řeším indexaci na Seznamu zvlášť?
Ano. Seznam má vlastní nástroj pro webmastery a vlastní robota. Většina technických opatření se překrývá, ale ověření webu a odeslání sitemapy je potřeba udělat na obou místech.
Jednou za čas e-mail, který stojí za otevření
Co je nového mezi nástroji, co reálně funguje a co je jen hezky zabalené. Žádný spam, odhlášení jedním klikem.