Co se stane, když canonical tagy nastavíte špatně
Canonical tagy jsou užitečné, ale nejsou neškodné. Špatný canonical může skrýt stránku, kterou jste chtěli nechat rankovat, sloučit signály do nesprávné URL a zbytečně ztížit ladění indexace.
Obsah
- Canonical tag není guma na duplicitní obsah
- Co se stane, když canonical míří na nesprávnou URL
- 1. Zaindexuje se nesprávná URL
- 2. Rankingové signály se sloučí na nesprávném místě
- 3. Vyhledávače tag ignorují
- 4. Ladění je zbytečně obtížné
- Nejdražší chyby v canonical tagách
- Kanonikalizace všeho na homepage
- Kanonikalizace stránkovaných stránek na první stránku
- Kanonikalizace filtrovaných stránek bez kontroly vyhledávacího záměru
- Směřování canonical tagů na přesměrované nebo blokované URL
- Míchání canonical a noindex, jako by znamenaly totéž
- Praktický audit canonical tagů
- Self-referencing canonical je obvykle dobrý výchozí stav
- Canonical tagy by měly odpovídat skutečné URL politice webu
- Závěr
Canonical tag není guma na duplicitní obsah
Canonical tag říká vyhledávačům, které URL dáváte přednost, když několik URL obsahuje stejný nebo podstatně podobný obsah. Běžná HTML verze vypadá takto:
<link rel="canonical" href="https://example.com/preferred-page/">
Existuje také verze v HTTP hlavičce, která se hodí hlavně pro ne-HTML soubory, například PDF:
Link: <https://example.com/preferred-file.pdf>; rel="canonical"
Zní to poměrně jednoduše. Problém začíná ve chvíli, kdy týmy začnou canonical tagy brát jako bezpečný způsob, jak uklidit cokoli nepohodlného: fasetovou navigaci, tracking parametry, tiskové stránky, téměř duplicitní produktové stránky, stránkování, staging URL a staré kampaně.
Canonical tagy nejsou tlačítko pro smazání. Nejsou přesměrování. Nejsou náhradou informační architektury. A není zaručeno, že budou respektovány.
Vyhledávače používají canonical tagy jako silná vodítka. Porovnávají canonical tag s dalšími signály: přesměrováními, interními odkazy, URL v sitemapách, hreflang anotacemi, podobností obsahu, HTTP stavovými kódy a URL, na které uživatelé a crawlery skutečně narážejí. Pokud jsou tyto signály v rozporu, vyhledávač může váš canonical ignorovat nebo zvolit úplně jinou kanonickou URL.
Proto může být špatné nastavení canonical tagů tak matoucí. Značka v prohlížeči vypadá správně, ale ve výsledcích vyhledávání se objeví nesprávná stránka — nebo ta správná zmizí.
Co se stane, když canonical míří na nesprávnou URL
Když vyhledávač narazí na duplicitní nebo téměř duplicitní URL, obvykle je seskupí do clusteru a jednu URL vybere jako kanonickou. Zvolená kanonická URL je verze, která bude nejpravděpodobněji zaindexována a zobrazena ve výsledcích vyhledávání. Signály z duplicit se mohou sloučit do této zvolené URL.
Pokud váš canonical tag míří na špatnou stránku, může se stát několik věcí.
1. Zaindexuje se nesprávná URL
Představte si, že máte dvě URL:
/mens-running-shoes//sale/mens-running-shoes/
Pokud výprodejová stránka kanonikalizuje na hlavní stránku kategorie, může to být v pořádku, jestliže je obsah téměř totožný a výprodejová URL je jen filtrovanou verzí. Pokud má ale výprodejová stránka vlastní texty, unikátní produkty a vlastní poptávku ve vyhledávání, canonical ji může potlačit.
Stránka může být stále procházená. Uživatelům může být stále dostupná. Vyhledávače se ale mohou rozhodnout, že ji nebudou indexovat samostatně, protože jste jim řekli, že preferovanou verzí je jiná URL.
To je nejčastější selhání canonical tagů: ne dramatický technický výpadek, ale tiché zmizení z indexu.
2. Rankingové signály se sloučí na nesprávném místě
Canonical tagy se často používají ke konsolidaci signálů, jako jsou odkazy a varianty duplicitního obsahu. To je užitečné, když jsou duplicity skutečně rovnocenné. Je to riskantní, když nejsou.
Pokud má blogový článek tracking URL jako:
/guide-to-canonical-tags/?utm_source=newsletter/guide-to-canonical-tags/?utm_source=linkedin
Pak dává smysl kanonikalizovat obě na /guide-to-canonical-tags/.
Pokud ale španělská verze, tisková verze s dodatečným obsahem nebo produktová varianta s jiným záměrem míří na stejný canonical, můžete slučovat signály, které by měly zůstat oddělené. Výsledkem může být slabší relevance pro všechny z nich.
Canonical tagy jsou o rovnocennosti. Pokud dvě stránky naplňují odlišné vyhledávací záměry, pravděpodobně by se neměly navzájem kanonikalizovat.
3. Vyhledávače tag ignorují
Canonical není příkaz. Pokud kanonický cíl přesměrovává, vrací 404, je blokovaný, má noindex nebo obsahuje velmi odlišný obsah, vyhledávače ho mohou ignorovat.
V jednom smyslu je to dobře: špatný canonical ne vždy zničí indexaci. Zároveň to ale znamená, že nemůžete předpokládat, že tag dělá to, co si myslíte. Stránka může deklarovat jeden canonical, zatímco Google vybere jiný.
To je zvlášť časté, když si interní odkazy, sitemapy a canonical tagy odporují. Pokud každý interní odkaz míří na /product, sitemap uvádí /product/ a canonical míří na https://www.example.com/product?ref=main, vytvořili jste malý spor mezi vlastními signály.
Vyhledávače umějí takový spor dobře vyřešit. Ne vždy ho ale vyřeší tak, jak jste zamýšleli.
4. Ladění je zbytečně obtížné
Špatné canonical tagy málokdy selžou nahlas. Vytvářejí symptomy, které vypadají jako jiné SEO problémy:
- „Zjištěno, momentálně neindexováno“ nebo podobné indexační vakuum
- Nesprávná URL rankuje na dotaz
- URL s parametry se objevují v reportech
- Stránky kategorií se nezobrazují, přestože jsou procházetelné
- Mezinárodní stránky se slučují do nesprávné jazykové verze
- Nové šablony se spustí s menším počtem indexovaných stránek, než se čekalo
Proto by ladění canonical tagů mělo zahrnovat surové HTML, vykreslené HTML, HTTP hlavičky, přesměrování a záznamy v sitemapě. Pokud už zkoumáte řetězce přesměrování nebo nesoulad hlaviček, platí stejné návyky; praktický workflow pro HTTP kontrolu, jako je ten v našem průvodci laděním přesměrování a HTTP hlaviček v produkci, obvykle odhalí rozpory v canonical tagách rychleji než zírání do pole v CMS.
Nejdražší chyby v canonical tagách
Kanonikalizace všeho na homepage
To se stále děje. Pole v šabloně zůstane prázdné, plugin jako fallback použije kořen webu a najednou stovky stránek deklarují homepage jako kanonickou.
Vyhledávače to mohou ignorovat, protože obsah je očividně jiný. Pokud je ale dost signálů neuspořádaných, některé stránky mohou být vyřazeny nebo nesprávně seskupeny. Přinejmenším na každé stránce posíláte zbytečné a rozporné vodítko.
Homepage téměř nikdy není kanonickou URL pro interní stránku.
Kanonikalizace stránkovaných stránek na první stránku
Některé weby dlouho kanonikalizovaly /category/page/2/, /page/3/ a další stránky zpět na první stránku. Záměrem bylo vyhnout se duplicitním stránkám kategorií.
Problém je v tom, že stránkované stránky nejsou duplicity. Obsahují jiné položky a pomáhají crawlerům objevovat hlubší obsah. Kanonikalizace všech na první stránku může snížit šanci, že vyhledávače pozdější stránky plně zpracují.
Stránkované stránky by obvykle měly mít self-referencing canonical, pokud neexistuje konkrétní důvod ke konsolidaci.
Kanonikalizace filtrovaných stránek bez kontroly vyhledávacího záměru
Fasetová navigace vytváří obtížná rozhodnutí. Některé filtrované URL jsou odpad:
?sort=price_ascending?view=grid?sessionid=123
Jiné mohou být hodnotné vstupní stránky:
/sofas/blue//laptops/16gb-ram//hotels/paris/pet-friendly/
Plošná pravidla pro canonical často smažou užitečné vyhledávací stránky spolu se zbytečným šumem parametrů. Než budete filtrované stránky kanonikalizovat, zeptejte se, zda má filtrovaná stránka stabilní obsah, interní odkazy, poptávku ve vyhledávání a odlišnou potřebu uživatele.
Pokud je odpověď ano, možná si zaslouží být indexovatelná se self-referencing canonical.
Směřování canonical tagů na přesměrované nebo blokované URL
Kanonický cíl by měl být čistý, indexovatelný a vracet 200 OK. Nesměrujte canonical tagy na URL, které přesměrovávají, vracejí chyby, vyžadují cookies, jsou blokované přes robots.txt nebo nesou noindex.
To je jedna z nejsnazších kontrol k automatizaci. Projděte web crawlerem a označte kanonické cíle, které nevracejí čistou odpověď 200.
Míchání canonical a noindex, jako by znamenaly totéž
rel="canonical" a noindex řeší odlišné problémy.
Použijte canonical, když existují duplicity a chcete konsolidovat signály do preferované URL. Použijte noindex, když nechcete, aby se stránka vůbec indexovala.
Použití obojího dohromady posílá neobratnou zprávu: „Neindexujte tuto stránku, ale zároveň ji použijte jako duplicitní signál pro jinou stránku.“ Vyhledávače si s tím často poradí, ale není to čistá instrukce. Pokud je stránka duplicitní, kanonikalizujte ji. Pokud se nemá zobrazovat ve vyhledávání a nemá žádný užitečný duplicitní vztah, zvažte noindex.
Praktický audit canonical tagů
K nalezení mnoha problémů s canonical tagy nepotřebujete velkou SEO platformu. Začněte crawláním, několika vzorky URL a tabulkou.
U každé důležité šablony zkontrolujte:
- Má stránka právě jeden canonical tag? Více canonical tagů vytváří nejednoznačnost.
- Je canonical absolutní? Použijte celou URL včetně protokolu a hostname.
- Vrací kanonický cíl
200 OK? Vyhněte se přesměrovaným, blokovaným nebo chybujícím cílům. - Je kanonický cíl indexovatelný? Žádný
noindex, žádný blok v robots, žádný požadavek na autentizaci. - Je obsah skutečně rovnocenný? Podobný neznamená vždy rovnocenný.
- Souhlasí interní odkazy? Odkazujte na kanonický formát URL všude, kde je to možné.
- Souhlasí sitemap? Sitemapy by obecně měly uvádět kanonické, indexovatelné URL.
- Souhlasí hreflang tagy? Mezinárodní stránky potřebují konzistentní vztahy mezi canonical a hreflang.
- Odpovídá vykreslené HTML surovému HTML? JavaScript může tagy měnit nebo vkládat.
- Jaký canonical vybral vyhledávač? Inspekční nástroje mohou odhalit, kdy se vámi deklarovaný canonical liší od vybraného canonical.
Tady může pomoci i Lighthouse, ale jen v rámci svých limitů. Dokáže označit některé problémy s procházením a dokumentem, ale nerozumí vašemu obchodnímu záměru ani canonical strategii. Berte ho jako jeden vstup, ne jako rozsudek. Pokud potřebujete klidnější způsob, jak oddělit užitečná zjištění od šumu, podívejte se, jak číst report Lighthouse bez paniky.
Self-referencing canonical je obvykle dobrý výchozí stav
Každá důležitá indexovatelná stránka by obvykle měla deklarovat sama sebe jako kanonickou. Ne proto, že by si s tím vyhledávače bez tagu nedokázaly poradit. Ale proto, že self-referencing canonical snižuje nejednoznačnost, když parametry, tracking odkazy, zkopírované URL a zvláštnosti CMS vytvářejí alternativní cesty ke stejnému obsahu.
Pro čistou produktovou stránku je obvykle správné toto:
<link rel="canonical" href="https://example.com/products/linen-shirt/">
U tracking URL by canonical obvykle měl mířit zpět na čistou verzi:
<link rel="canonical" href="https://example.com/products/linen-shirt/">
U skutečně odlišné produktové varianty záleží. Pokud mají červená, modrá a černá košile stejný popis a mění se jen barva, jedna kanonická produktová stránka může stačit. Pokud má každá varianta samostatnou poptávku, recenze, obrázky, sklad a interní odkazy, mohou dávat smysl samostatné indexovatelné stránky.
Neexistuje univerzální canonical pravidlo pro varianty. Existuje jen otázka: jsou tyto stránky pro hledajícího zaměnitelné?
Canonical tagy by měly odpovídat skutečné URL politice webu
Většina chyb v canonical tagách je symptomem hlubšího problému s URL politikou. Web se nerozhodl, zda záleží na koncových lomítkách, zda se mají URL s velkými písmeny správně načítat, zda jsou povolené parametry, zda HTTP přesměrovává na HTTPS nebo zda je kanonické www.
Vyberte jednu čistou verzi každé URL a zařiďte, aby s ní souhlasil celý systém:
- Přesměrujte nepreferované verze URL na preferované verze.
- Interně odkazujte na preferované verze.
- Vkládejte preferované verze do XML sitemap.
- Na preferovaných stránkách používejte self-referencing canonical.
- Kanonikalizujte pouze skutečné duplicity na preferovanou URL.
Když všechny tyto signály míří stejným směrem, canonical tagy začnou být nudné. To je cílem.
Závěr
Canonical tagy jsou silné, protože ovlivňují indexaci a konsolidaci signálů. Ze stejného důvodu jsou nebezpečné.
Špatný canonical stránku z vyhledávání vždy neodstraní. Vyhledávače ho mohou ignorovat. Spoléhat se ale na to, že vyhledávače zachrání špatné signály, není strategie. Bezpečnější přístup je vyhradit kanonikalizaci pro skutečné duplicity, udržovat cíle čisté a indexovatelné a zajistit, aby interní odkazy, přesměrování, sitemapy a canonical tagy vyprávěly stejný příběh.
Canonical tagy nejsou místo, kam schovávat chaotickou architekturu. Jsou místo, kde potvrzujete, že byla uklizena.