Stránkování výpisů: jak ho udělat, aby se produkty indexovaly
U e-shopu s tisícem produktů vede k většině z nich jediná cesta: druhá, třetí a další strana výpisu. Když se stránkování udělá špatně, robot se ke zboží na konci nedostane a to zboží prostě není v indexu. Přitom nejde o vzácný stav, potkává většinu českých e-shopů.
Jak má stránkování vypadat
- Každá strana má vlastní adresu v podobě
/kategorie/?strana=2nebo/kategorie/strana-2/. Obojí funguje, důležité je, aby adresa existovala i bez JavaScriptu. - Každá strana má kanonickou adresu sama na sebe. Ne na první stranu.
- Každá strana je indexovatelná. Bez noindex.
- Strany na sebe odkazují běžnými odkazy se značkou
a href, ne tlačítkem, které volá skript. - Titulek dalších stran se liší, obvykle doplněním pořadí. Bez toho hlásí kontroly duplicitní titulky napříč desítkami stránek.
- Úvodní text kategorie je jen na první straně. Na dalších by vytvářel duplicitu bez užitku.
Čtyři obvyklé chyby a jejich následek
| Chyba | Následek |
|---|---|
| Kanonická adresa všech stran míří na první | Produkty z dalších stran se neindexují |
| Noindex na druhé a dalších stranách | Robot po čase přestane strany navštěvovat, produkty vypadnou |
| Nekonečné načítání bez odkazů | Robot vidí jen první dávku, zbytek webu neexistuje |
| Stejný titulek na všech stranách | Desítky duplicitních titulků, horší proklik |
Zobrazit vše jako alternativa
Když se všechny položky vejdou na jednu stránku bez toho, aby se načítala pomalu, je to nejjednodušší řešení. Hranicí je zhruba dvě stě položek a doba načtení do dvou sekund. U větších výpisů se stránka stane pomalou a problém s rychlostí je horší než problém se stránkováním.
Filtry a řazení
Filtry vytvářejí kombinace adres, kterých můžou být tisíce. Bez ošetření robot tráví čas jejich procházením místo produktů.
- Užitečné filtry nechte indexovat. Kombinace, na kterou lidé hledají, například značka nebo velikost, si zaslouží vlastní indexovatelnou stránku s vlastním titulkem.
- Kombinace dvou a víc filtrů dejte na noindex, ale nechte je procházet, ať robot najde produkty.
- Řazení nikdy neindexujte. Stejný obsah v jiném pořadí. Kanonická adresa má mířit na výpis bez parametru řazení.
- Parametry sledování kampaní vyřaďte kanonickou adresou na čistou verzi.
Jak si stránkování ověřit
- Otevřete druhou stranu výpisu a ve zdrojovém kódu najděte
canonical. Musí ukazovat na druhou stranu. - Hledejte
noindex. Nemá tam být. - Vypněte v prohlížeči JavaScript a stránku načtěte znovu. Odkazy na další strany musí zůstat viditelné.
- V Search Console zadejte adresu produktu z poslední strany výpisu. Když hlásí Nenalezeno v indexu, cesta k němu nevede.
Časté dotazy
Mám na druhé straně výpisu nastavit kanonickou adresu na první stranu?
Ne. Je to nejrozšířenější chyba ve stránkování. Kanonická adresa na první stranu říká, že druhá strana je totéž co první, což není pravda, protože obsahuje jiné produkty. Robot pak odkazy z druhé strany bere s menší vahou a produkty na konci výpisu se do indexu nemusí dostat vůbec. Každá strana má mít kanonickou adresu sama na sebe.
Platí ještě rel next a rel prev?
Google je od roku 2019 nepoužívá a veřejně to oznámil. Seznam s nimi nikdy nepracoval. Nechat je v kódu neškodí, ale nic to nepřinese. Místo nich záleží na tom, aby na sebe strany odkazovaly běžnými odkazy, které robot projde.
Je lepší nekonečné načítání, nebo klasické stránkování?
Pro indexaci klasické stránkování s odkazy. Nekonečné načítání i tlačítko načíst další fungují přes JavaScript a robot je obvykle nespustí, takže vidí jen první dávku produktů. Když nekonečné načítání chcete kvůli pohodlí návštěvníka, doplňte pod něj skutečné odkazy na jednotlivé strany a nechte je v kódu i pro robota.
Související návody
JavaScript a SEO: kdy robot obsah uvidí a kdy ne
Google JavaScript spustí, ale s odkladem a ne vždycky. Seznam s ním pracuje omezeně. Obsah, na kterém závisí návštěvnost, patří do HTML.
Stavové kódy HTTP: co který znamená pro vyhledávač
Kód odpovědi je první věc, kterou robot uvidí. Rozhoduje, jestli stránku vůbec zpracuje a jestli si má pamatovat starou adresu.
Noindex a nofollow: kdy je použít a kdy si jimi ublížíte
Noindex vyřadí stránku z výsledků, nofollow zruší předání váhy odkazem. Většina webů je používá na místech, kde nemají co dělat.
Pojmy z tohoto textu
- Duplicitní obsah Tentýž nebo velmi podobný text na víc adresách. Není to postih, ale vyhledávač si vybere jednu verzi a ostatní potlačí.
- Tenký obsah Stránka, která na svůj dotaz neodpoví. S délkou to souvisí jen volně, krátká a přesná odpověď tenká není.
- Kanonická adresa Značka v hlavičce stránky, kterou webu říkáte, která adresa je ta hlavní, když je tentýž obsah dostupný na víc adresách.
- Noindex Pokyn, kterým stránce zakážete objevit se ve výsledcích hledání. Stránka zůstane přístupná lidem i robotům, jen nepůjde do indexu.
- Robots.txt Textový soubor v kořeni webu, kterým se robotům říká, kam smí a kam ne. Neřeší indexaci, jen procházení.
- XML sitemapa Seznam adres webu ve strojově čitelném formátu. Vyhledávači usnadní hledání stránek, ale nezaručí jejich zařazení.
Nevíte, jestli se vás to týká?
Pusťte kontrolu na svůj web a uvidíte, jestli tenhle problém máte. Trvá to necelou minutu.