Případová studie: e-shop s 12 tisíci produkty, z nichž v indexu bylo 8 procent

E-shop s dvanácti tisíci produkty měl podle Search Console v indexu necelý tisíc adres. Zbytek se opakovaně objevoval ve stavu Nalezeno, zatím neprohledáno. Příčina nebyla v obsahu ani v odkazech, ale v tom, kolik adres web robotovi nabízel.

Výchozí stav

Ukazatel Hodnota
Produktů v katalogu 12 400
Adres v indexu 986
Adres, které robot znal přes 400 000
Podíl požadavků na parametrické adresy 91 %
Průměrná doba odpovědi serveru 1 240 ms

Kde se braly čtyři sta tisíc adres

  1. Kombinace filtrů. Sedm filtrů, každý s několika hodnotami, se dal libovolně kombinovat a každá kombinace měla vlastní adresu.
  2. Řazení. Šest způsobů řazení, každý jako další parametr.
  3. Stránkování nad kombinacemi. Každá kombinace měla vlastní stránkování.
  4. Parametry kampaní. Odkazy z newsletterů vytvořily další sadu.

Co se opravovalo a v jakém pořadí

  1. Řazení sjednoceno kanonickou adresou na výpis bez parametru. Odstranilo šestinu adres okamžitě.
  2. Kombinace dvou a víc filtrů dány na noindex, ale ponechány průchozí, aby robot našel produkty.
  3. Jednotlivé filtry, na které lidé hledají, ponechány indexovatelné s vlastním titulkem a krátkým textem.
  4. Kanonická adresa na dalších stranách výpisu opravena tak, aby ukazovala sama na sebe. Předtím mířila na první stranu, takže se produkty z dalších stran neindexovaly.
  5. Parametry kampaní vyřazeny kanonickou adresou.
  6. Zapnuta cache na straně serveru, doba odpovědi klesla pod 400 ms.

Výsledek po čtyřech měsících

Ukazatel Před Po
Adres v indexu 986 11 200
Podíl požadavků na parametrické adresy 91 % 12 %
Doba odpovědi serveru 1 240 ms 380 ms
Zobrazení ve vyhledávání základ + 240 %

Co z toho plyne obecně

  • Když se produkty neindexují, hledejte nejdřív, kolik adres web robotovi nabízí.
  • Kanonická adresa na první stranu výpisu je nejrozšířenější chyba v e-shopech a sama o sobě dokáže odříznout většinu sortimentu.
  • Zákaz procházení není totéž co zákaz indexace. Filtry se mají procházet, ale neindexovat.
  • Rychlost serveru rozhoduje o tom, kolik toho robot stihne.

Časté dotazy

Jak dlouho trvalo, než se indexace zvedla?

První pohyb byl vidět po třech týdnech, ustálený stav po zhruba čtyřech měsících. Robot musí nejdřív přestat chodit na adresy, které se zakázaly, a teprve pak přesune kapacitu jinam. Zrychlit to jde jen omezeně.

Šlo to vyřešit jen sitemapou?

Ne. Sitemapa je nabídka, ne příkaz. Když robot spotřebuje kapacitu na kombinace filtrů, produkty ze sitemapy si stejně nestihne vzít. Musí se nejdřív odstranit to, co kapacitu žere.

Jakub Knytl

Patnáct let opravuji weby českým firmám a e-shopům. Většina problémů, o kterých tu píšu, mě potkala u klienta dřív, než jsem o nich napsal.

Další čtení

Pojmy z tohoto textu

Nevíte, jestli se vás to týká?

Pusťte kontrolu na svůj web a uvidíte, jestli tenhle problém máte. Trvá to necelou minutu.

156 kontrol, výsledek do minuty. Bez registrace, bez karty, bez e-mailu.