Kanonická adresa: nejtišší způsob, jak vypnout půlku webu
Jedna špatná kanonická adresa v šabloně umí vyřadit z hledání většinu webu bez jediné chybové hlášky. Ukážeme, kde se to láme a jak si to ověřit.
Oblast kontroly
Jestli se web vůbec může dostat do vyhledávání
Nejdražší chyba v SEO není špatný titulek, ale stránka, kterou vyhledávač vůbec nesmí načíst. Tato část hlídá, co robotům brání v přístupu a co jim naopak říkáte sami.
Jedna špatná kanonická adresa v šabloně umí vyřadit z hledání většinu webu bez jediné chybové hlášky. Ukážeme, kde se to láme a jak si to ověřit.
Noindex vyřadí stránku z výsledků, nofollow zruší předání váhy odkazem. Většina webů je používá na místech, kde nemají co dělat.
Kdy nasadit 301, kdy 302, jak sjednotit doménu jedním skokem a proč zkracovat řetězce. Návod z praxe včetně .htaccess, WordPressu a Shoptetu.
Jeden zapomenutý řádek a web zmizí z Googlu i ze Seznamu. Projděte si syntaxi robots.txt, pravidlo nejdelší shody i rozhodnutí, jestli pustit GPTBot.
Sitemapa plná přesměrování a filtrů škodí víc, než pomáhá. Co do ní patří, proč Google ignoruje priority a jak poznáte, že je zaneřáděná.
Úplný seznam. Váha je počet bodů, o které se při chybě přijde, seřazeno od nejtěžší kontroly.
| Kontrola | Proč na ní záleží | Váha |
|---|---|---|
| Web odpovídá | Když server neodpoví, nezáleží na ničem dalším. Robot to zkusí párkrát a pak stránku z indexu vyřadí. | 10 |
| Značka robots nezakazuje indexaci | Meta značka s hodnotou noindex řekne vyhledávači, ať stránku do výsledků nedává. Na ostrém webu to bývá pozůstatek z vývoje. | 10 |
| Robots.txt neblokuje celý web | Řádek Disallow s lomítkem zavře robotovi celý web. Je to nejčastější následek spuštění webu z testovací verze. | 10 |
| Úvodní stránka vrací stav 200 | Stavový kód je první věc, kterou robot čte. Cokoliv jiného než 200 na hlavní adrese znamená potíž. | 8 |
| Hlavička X-Robots-Tag nezakazuje indexaci | Zákaz indexace umí poslat i server v HTTP hlavičce. V HTML ho neuvidíte, a proto se hledá nejhůř. | 8 |
| Web běží jen na jedné adrese | Když web odpovídá s www i bez www a obojí vrací obsah, existuje pro vyhledávač dvakrát. Síla odkazů se pak dělí. | 8 |
| Kanonická adresa míří na sebe sama | Kanonická adresa mířící jinam vyřadí stránku z výsledků ve prospěch cizí adresy. Chybný canonical umí vypnout půlku webu. | 7 |
| Robots.txt je v pořádku | Když robots.txt vrací chybu 5xx, Google přestane web procházet celý, dokud se soubor neopraví. Stejně tak vadí, když místo textu vrací HTML nebo je… | 6 |
| Stránka má kanonickou adresu | Kanonická adresa říká, která verze stránky je ta pravá. Bez ní si vyhledávač vybere sám a nemusí vybrat dobře. | 6 |
| Web má XML sitemapu | Sitemapa je seznam stránek, které chcete mít v indexu. U nových a rozsáhlých webů výrazně zrychluje zaindexování. | 6 |
| Sitemapa neobsahuje chybné adresy jen pro členy | Sitemapa má obsahovat jen finální adresy se stavem 200. Přesměrování a chyby v ní snižují důvěru v celý soubor. | 6 |
| Nezabezpečená verze přesměrovává na https | Bez přesměrování zůstává v indexu i verze bez zabezpečení. Prohlížeč u ní návštěvníka varuje. | 6 |
| Kanonická adresa je uvedená jen jednou | Dvě různé kanonické adresy na jedné stránce vyhledávač zmatou a obě obvykle ignoruje. Nejčastěji to vzniká, když web používá dva SEO pluginy najednou. | 5 |
| Robots.txt neblokuje styly a skripty | Google stránku vykresluje. Když mu zakážete CSS a JavaScript, uvidí rozsypaný web a může ho vyhodnotit jako nepoužitelný na mobilu. | 5 |
| Podíl neindexovatelných stránek jen pro členy | Když je velká část procházených stránek zakázaná k indexaci, robot spotřebovává kapacitu na obsah, který nikdy neuvidí ve výsledcích. | 5 |
| Soubor robots.txt existuje | Robots.txt je první soubor, který robot na webu stáhne. Bez něj se sice indexuje, ale přicházíte o řízení přístupu a odkaz na sitemapu. | 4 |
| Sitemapa obsahuje jen indexovatelné stránky jen pro členy | Stránka se zákazem indexace nebo s kanonickou adresou mířící jinam do sitemapy nepatří. Posíláte tím vyhledávači protichůdné pokyny. | 4 |
| Vstupní adresa nepřesměrovává přes několik kroků | Každý krok přesměrování stojí čas a část přenesené síly odkazu. Řetězec delší než dva kroky je zbytečná zátěž. | 4 |
| Robots.txt odkazuje na sitemapu | Řádek Sitemap je nejjednodušší způsob, jak robotovi říct, kde má seznam stránek. Platí pro Google i pro Seznam. | 3 |
| Kanonická adresa je úplná a zabezpečená | Relativní nebo nezabezpečená kanonická adresa se dá vyložit více způsoby. Vyhledávač si pak vybere podle svého. | 3 |
| Sitemapa obsahuje jen adresy z této domény jen pro členy | Adresy z cizí domény vyhledávač ze sitemapy ignoruje. Bývá to stopa po stěhování webu nebo po testovací verzi. | 3 |
| Adresy mají jednotný tvar jen pro členy | Adresa s lomítkem na konci a bez něj jsou pro vyhledávač dvě různé stránky, pokud obě vracejí obsah. | 3 |
| Poměr nalezených a procházených stránek jen pro členy | Když sitemapa hlásí stovky adres a z navigace se jich dá dojít jen pár, část webu je pro robota i pro návštěvníka schovaná. | 3 |
| Sitemapa uvádí datum poslední změny jen pro členy | Údaj lastmod je jediná hodnota ze sitemapy, se kterou Google prokazatelně pracuje. Pomáhá mu poznat, co se změnilo. | 2 |
Kontrola projde web, najde konkrétní chyby z této oblasti a u každé řekne, co s ní.