Případová studie: e-shop s 12 tisíci produkty, z nichž v indexu bylo 8 procent
E-shop s dvanácti tisíci produkty měl podle Search Console v indexu necelý tisíc adres. Zbytek se opakovaně objevoval ve stavu Nalezeno, zatím neprohledáno. Příčina nebyla v obsahu ani v odkazech, ale v tom, kolik adres web robotovi nabízel.
Výchozí stav
| Ukazatel | Hodnota |
|---|---|
| Produktů v katalogu | 12 400 |
| Adres v indexu | 986 |
| Adres, které robot znal | přes 400 000 |
| Podíl požadavků na parametrické adresy | 91 % |
| Průměrná doba odpovědi serveru | 1 240 ms |
Kde se braly čtyři sta tisíc adres
- Kombinace filtrů. Sedm filtrů, každý s několika hodnotami, se dal libovolně kombinovat a každá kombinace měla vlastní adresu.
- Řazení. Šest způsobů řazení, každý jako další parametr.
- Stránkování nad kombinacemi. Každá kombinace měla vlastní stránkování.
- Parametry kampaní. Odkazy z newsletterů vytvořily další sadu.
Co se opravovalo a v jakém pořadí
- Řazení sjednoceno kanonickou adresou na výpis bez parametru. Odstranilo šestinu adres okamžitě.
- Kombinace dvou a víc filtrů dány na noindex, ale ponechány průchozí, aby robot našel produkty.
- Jednotlivé filtry, na které lidé hledají, ponechány indexovatelné s vlastním titulkem a krátkým textem.
- Kanonická adresa na dalších stranách výpisu opravena tak, aby ukazovala sama na sebe. Předtím mířila na první stranu, takže se produkty z dalších stran neindexovaly.
- Parametry kampaní vyřazeny kanonickou adresou.
- Zapnuta cache na straně serveru, doba odpovědi klesla pod 400 ms.
Výsledek po čtyřech měsících
| Ukazatel | Před | Po |
|---|---|---|
| Adres v indexu | 986 | 11 200 |
| Podíl požadavků na parametrické adresy | 91 % | 12 % |
| Doba odpovědi serveru | 1 240 ms | 380 ms |
| Zobrazení ve vyhledávání | základ | + 240 % |
Co z toho plyne obecně
- Když se produkty neindexují, hledejte nejdřív, kolik adres web robotovi nabízí.
- Kanonická adresa na první stranu výpisu je nejrozšířenější chyba v e-shopech a sama o sobě dokáže odříznout většinu sortimentu.
- Zákaz procházení není totéž co zákaz indexace. Filtry se mají procházet, ale neindexovat.
- Rychlost serveru rozhoduje o tom, kolik toho robot stihne.
Časté dotazy
Jak dlouho trvalo, než se indexace zvedla?
První pohyb byl vidět po třech týdnech, ustálený stav po zhruba čtyřech měsících. Robot musí nejdřív přestat chodit na adresy, které se zakázaly, a teprve pak přesune kapacitu jinam. Zrychlit to jde jen omezeně.
Šlo to vyřešit jen sitemapou?
Ne. Sitemapa je nabídka, ne příkaz. Když robot spotřebuje kapacitu na kombinace filtrů, produkty ze sitemapy si stejně nestihne vzít. Musí se nejdřív odstranit to, co kapacitu žere.
Další čtení
Případová studie: migrace webu na nové adresy bez ztráty pozic
Změna struktury adres u webu se čtyřmi sty stránkami. Co se dělalo předem, co po nasazení a kde se to obvykle pokazí.
Pojmy z tohoto textu
- Duplicitní obsah Tentýž nebo velmi podobný text na víc adresách. Není to postih, ale vyhledávač si vybere jednu verzi a ostatní potlačí.
- Tenký obsah Stránka, která na svůj dotaz neodpoví. S délkou to souvisí jen volně, krátká a přesná odpověď tenká není.
- Kanonická adresa Značka v hlavičce stránky, kterou webu říkáte, která adresa je ta hlavní, když je tentýž obsah dostupný na víc adresách.
- Noindex Pokyn, kterým stránce zakážete objevit se ve výsledcích hledání. Stránka zůstane přístupná lidem i robotům, jen nepůjde do indexu.
- Robots.txt Textový soubor v kořeni webu, kterým se robotům říká, kam smí a kam ne. Neřeší indexaci, jen procházení.
- XML sitemapa Seznam adres webu ve strojově čitelném formátu. Vyhledávači usnadní hledání stránek, ale nezaručí jejich zařazení.
Nevíte, jestli se vás to týká?
Pusťte kontrolu na svůj web a uvidíte, jestli tenhle problém máte. Trvá to necelou minutu.