SEO & Discoverability

Co se stane, když canonical tagy nastavíte špatně

Canonical tagy jsou užitečné, ale nejsou neškodné. Špatný canonical může skrýt stránku, kterou jste chtěli nechat rankovat, sloučit signály do nesprávné URL a zbytečně ztížit ladění indexace.

The Wux Webtools Team The Wux Webtools Team 11 min čtení S asistencí AI, lidsky zkontrolováno
Overlapping web pages with one preferred canonical page highlighted and warning markers on incorrect duplicates.
Obsah
  1. Canonical tag není guma na duplicitní obsah
  2. Co se stane, když canonical míří na nesprávnou URL
  3. 1. Zaindexuje se nesprávná URL
  4. 2. Rankingové signály se sloučí na nesprávném místě
  5. 3. Vyhledávače tag ignorují
  6. 4. Ladění je zbytečně obtížné
  7. Nejdražší chyby v canonical tagách
  8. Kanonikalizace všeho na homepage
  9. Kanonikalizace stránkovaných stránek na první stránku
  10. Kanonikalizace filtrovaných stránek bez kontroly vyhledávacího záměru
  11. Směřování canonical tagů na přesměrované nebo blokované URL
  12. Míchání canonical a noindex, jako by znamenaly totéž
  13. Praktický audit canonical tagů
  14. Self-referencing canonical je obvykle dobrý výchozí stav
  15. Canonical tagy by měly odpovídat skutečné URL politice webu
  16. Závěr

Canonical tag není guma na duplicitní obsah

Canonical tag říká vyhledávačům, které URL dáváte přednost, když několik URL obsahuje stejný nebo podstatně podobný obsah. Běžná HTML verze vypadá takto:

<link rel="canonical" href="https://example.com/preferred-page/">

Existuje také verze v HTTP hlavičce, která se hodí hlavně pro ne-HTML soubory, například PDF:

Link: <https://example.com/preferred-file.pdf>; rel="canonical"

Zní to poměrně jednoduše. Problém začíná ve chvíli, kdy týmy začnou canonical tagy brát jako bezpečný způsob, jak uklidit cokoli nepohodlného: fasetovou navigaci, tracking parametry, tiskové stránky, téměř duplicitní produktové stránky, stránkování, staging URL a staré kampaně.

Canonical tagy nejsou tlačítko pro smazání. Nejsou přesměrování. Nejsou náhradou informační architektury. A není zaručeno, že budou respektovány.

Vyhledávače používají canonical tagy jako silná vodítka. Porovnávají canonical tag s dalšími signály: přesměrováními, interními odkazy, URL v sitemapách, hreflang anotacemi, podobností obsahu, HTTP stavovými kódy a URL, na které uživatelé a crawlery skutečně narážejí. Pokud jsou tyto signály v rozporu, vyhledávač může váš canonical ignorovat nebo zvolit úplně jinou kanonickou URL.

Proto může být špatné nastavení canonical tagů tak matoucí. Značka v prohlížeči vypadá správně, ale ve výsledcích vyhledávání se objeví nesprávná stránka — nebo ta správná zmizí.

Co se stane, když canonical míří na nesprávnou URL

Když vyhledávač narazí na duplicitní nebo téměř duplicitní URL, obvykle je seskupí do clusteru a jednu URL vybere jako kanonickou. Zvolená kanonická URL je verze, která bude nejpravděpodobněji zaindexována a zobrazena ve výsledcích vyhledávání. Signály z duplicit se mohou sloučit do této zvolené URL.

Pokud váš canonical tag míří na špatnou stránku, může se stát několik věcí.

1. Zaindexuje se nesprávná URL

Představte si, že máte dvě URL:

  • /mens-running-shoes/
  • /sale/mens-running-shoes/

Pokud výprodejová stránka kanonikalizuje na hlavní stránku kategorie, může to být v pořádku, jestliže je obsah téměř totožný a výprodejová URL je jen filtrovanou verzí. Pokud má ale výprodejová stránka vlastní texty, unikátní produkty a vlastní poptávku ve vyhledávání, canonical ji může potlačit.

Stránka může být stále procházená. Uživatelům může být stále dostupná. Vyhledávače se ale mohou rozhodnout, že ji nebudou indexovat samostatně, protože jste jim řekli, že preferovanou verzí je jiná URL.

To je nejčastější selhání canonical tagů: ne dramatický technický výpadek, ale tiché zmizení z indexu.

2. Rankingové signály se sloučí na nesprávném místě

Canonical tagy se často používají ke konsolidaci signálů, jako jsou odkazy a varianty duplicitního obsahu. To je užitečné, když jsou duplicity skutečně rovnocenné. Je to riskantní, když nejsou.

Pokud má blogový článek tracking URL jako:

  • /guide-to-canonical-tags/?utm_source=newsletter
  • /guide-to-canonical-tags/?utm_source=linkedin

Pak dává smysl kanonikalizovat obě na /guide-to-canonical-tags/.

Pokud ale španělská verze, tisková verze s dodatečným obsahem nebo produktová varianta s jiným záměrem míří na stejný canonical, můžete slučovat signály, které by měly zůstat oddělené. Výsledkem může být slabší relevance pro všechny z nich.

Canonical tagy jsou o rovnocennosti. Pokud dvě stránky naplňují odlišné vyhledávací záměry, pravděpodobně by se neměly navzájem kanonikalizovat.

3. Vyhledávače tag ignorují

Canonical není příkaz. Pokud kanonický cíl přesměrovává, vrací 404, je blokovaný, má noindex nebo obsahuje velmi odlišný obsah, vyhledávače ho mohou ignorovat.

V jednom smyslu je to dobře: špatný canonical ne vždy zničí indexaci. Zároveň to ale znamená, že nemůžete předpokládat, že tag dělá to, co si myslíte. Stránka může deklarovat jeden canonical, zatímco Google vybere jiný.

To je zvlášť časté, když si interní odkazy, sitemapy a canonical tagy odporují. Pokud každý interní odkaz míří na /product, sitemap uvádí /product/ a canonical míří na https://www.example.com/product?ref=main, vytvořili jste malý spor mezi vlastními signály.

Vyhledávače umějí takový spor dobře vyřešit. Ne vždy ho ale vyřeší tak, jak jste zamýšleli.

4. Ladění je zbytečně obtížné

Špatné canonical tagy málokdy selžou nahlas. Vytvářejí symptomy, které vypadají jako jiné SEO problémy:

  • „Zjištěno, momentálně neindexováno“ nebo podobné indexační vakuum
  • Nesprávná URL rankuje na dotaz
  • URL s parametry se objevují v reportech
  • Stránky kategorií se nezobrazují, přestože jsou procházetelné
  • Mezinárodní stránky se slučují do nesprávné jazykové verze
  • Nové šablony se spustí s menším počtem indexovaných stránek, než se čekalo

Proto by ladění canonical tagů mělo zahrnovat surové HTML, vykreslené HTML, HTTP hlavičky, přesměrování a záznamy v sitemapě. Pokud už zkoumáte řetězce přesměrování nebo nesoulad hlaviček, platí stejné návyky; praktický workflow pro HTTP kontrolu, jako je ten v našem průvodci laděním přesměrování a HTTP hlaviček v produkci, obvykle odhalí rozpory v canonical tagách rychleji než zírání do pole v CMS.

Nejdražší chyby v canonical tagách

Kanonikalizace všeho na homepage

To se stále děje. Pole v šabloně zůstane prázdné, plugin jako fallback použije kořen webu a najednou stovky stránek deklarují homepage jako kanonickou.

Vyhledávače to mohou ignorovat, protože obsah je očividně jiný. Pokud je ale dost signálů neuspořádaných, některé stránky mohou být vyřazeny nebo nesprávně seskupeny. Přinejmenším na každé stránce posíláte zbytečné a rozporné vodítko.

Homepage téměř nikdy není kanonickou URL pro interní stránku.

Kanonikalizace stránkovaných stránek na první stránku

Některé weby dlouho kanonikalizovaly /category/page/2/, /page/3/ a další stránky zpět na první stránku. Záměrem bylo vyhnout se duplicitním stránkám kategorií.

Problém je v tom, že stránkované stránky nejsou duplicity. Obsahují jiné položky a pomáhají crawlerům objevovat hlubší obsah. Kanonikalizace všech na první stránku může snížit šanci, že vyhledávače pozdější stránky plně zpracují.

Stránkované stránky by obvykle měly mít self-referencing canonical, pokud neexistuje konkrétní důvod ke konsolidaci.

Kanonikalizace filtrovaných stránek bez kontroly vyhledávacího záměru

Fasetová navigace vytváří obtížná rozhodnutí. Některé filtrované URL jsou odpad:

  • ?sort=price_ascending
  • ?view=grid
  • ?sessionid=123

Jiné mohou být hodnotné vstupní stránky:

  • /sofas/blue/
  • /laptops/16gb-ram/
  • /hotels/paris/pet-friendly/

Plošná pravidla pro canonical často smažou užitečné vyhledávací stránky spolu se zbytečným šumem parametrů. Než budete filtrované stránky kanonikalizovat, zeptejte se, zda má filtrovaná stránka stabilní obsah, interní odkazy, poptávku ve vyhledávání a odlišnou potřebu uživatele.

Pokud je odpověď ano, možná si zaslouží být indexovatelná se self-referencing canonical.

Směřování canonical tagů na přesměrované nebo blokované URL

Kanonický cíl by měl být čistý, indexovatelný a vracet 200 OK. Nesměrujte canonical tagy na URL, které přesměrovávají, vracejí chyby, vyžadují cookies, jsou blokované přes robots.txt nebo nesou noindex.

To je jedna z nejsnazších kontrol k automatizaci. Projděte web crawlerem a označte kanonické cíle, které nevracejí čistou odpověď 200.

Míchání canonical a noindex, jako by znamenaly totéž

rel="canonical" a noindex řeší odlišné problémy.

Použijte canonical, když existují duplicity a chcete konsolidovat signály do preferované URL. Použijte noindex, když nechcete, aby se stránka vůbec indexovala.

Použití obojího dohromady posílá neobratnou zprávu: „Neindexujte tuto stránku, ale zároveň ji použijte jako duplicitní signál pro jinou stránku.“ Vyhledávače si s tím často poradí, ale není to čistá instrukce. Pokud je stránka duplicitní, kanonikalizujte ji. Pokud se nemá zobrazovat ve vyhledávání a nemá žádný užitečný duplicitní vztah, zvažte noindex.

Praktický audit canonical tagů

K nalezení mnoha problémů s canonical tagy nepotřebujete velkou SEO platformu. Začněte crawláním, několika vzorky URL a tabulkou.

U každé důležité šablony zkontrolujte:

  1. Má stránka právě jeden canonical tag? Více canonical tagů vytváří nejednoznačnost.
  2. Je canonical absolutní? Použijte celou URL včetně protokolu a hostname.
  3. Vrací kanonický cíl 200 OK? Vyhněte se přesměrovaným, blokovaným nebo chybujícím cílům.
  4. Je kanonický cíl indexovatelný? Žádný noindex, žádný blok v robots, žádný požadavek na autentizaci.
  5. Je obsah skutečně rovnocenný? Podobný neznamená vždy rovnocenný.
  6. Souhlasí interní odkazy? Odkazujte na kanonický formát URL všude, kde je to možné.
  7. Souhlasí sitemap? Sitemapy by obecně měly uvádět kanonické, indexovatelné URL.
  8. Souhlasí hreflang tagy? Mezinárodní stránky potřebují konzistentní vztahy mezi canonical a hreflang.
  9. Odpovídá vykreslené HTML surovému HTML? JavaScript může tagy měnit nebo vkládat.
  10. Jaký canonical vybral vyhledávač? Inspekční nástroje mohou odhalit, kdy se vámi deklarovaný canonical liší od vybraného canonical.

Tady může pomoci i Lighthouse, ale jen v rámci svých limitů. Dokáže označit některé problémy s procházením a dokumentem, ale nerozumí vašemu obchodnímu záměru ani canonical strategii. Berte ho jako jeden vstup, ne jako rozsudek. Pokud potřebujete klidnější způsob, jak oddělit užitečná zjištění od šumu, podívejte se, jak číst report Lighthouse bez paniky.

Self-referencing canonical je obvykle dobrý výchozí stav

Každá důležitá indexovatelná stránka by obvykle měla deklarovat sama sebe jako kanonickou. Ne proto, že by si s tím vyhledávače bez tagu nedokázaly poradit. Ale proto, že self-referencing canonical snižuje nejednoznačnost, když parametry, tracking odkazy, zkopírované URL a zvláštnosti CMS vytvářejí alternativní cesty ke stejnému obsahu.

Pro čistou produktovou stránku je obvykle správné toto:

<link rel="canonical" href="https://example.com/products/linen-shirt/">

U tracking URL by canonical obvykle měl mířit zpět na čistou verzi:

<link rel="canonical" href="https://example.com/products/linen-shirt/">

U skutečně odlišné produktové varianty záleží. Pokud mají červená, modrá a černá košile stejný popis a mění se jen barva, jedna kanonická produktová stránka může stačit. Pokud má každá varianta samostatnou poptávku, recenze, obrázky, sklad a interní odkazy, mohou dávat smysl samostatné indexovatelné stránky.

Neexistuje univerzální canonical pravidlo pro varianty. Existuje jen otázka: jsou tyto stránky pro hledajícího zaměnitelné?

Canonical tagy by měly odpovídat skutečné URL politice webu

Většina chyb v canonical tagách je symptomem hlubšího problému s URL politikou. Web se nerozhodl, zda záleží na koncových lomítkách, zda se mají URL s velkými písmeny správně načítat, zda jsou povolené parametry, zda HTTP přesměrovává na HTTPS nebo zda je kanonické www.

Vyberte jednu čistou verzi každé URL a zařiďte, aby s ní souhlasil celý systém:

  • Přesměrujte nepreferované verze URL na preferované verze.
  • Interně odkazujte na preferované verze.
  • Vkládejte preferované verze do XML sitemap.
  • Na preferovaných stránkách používejte self-referencing canonical.
  • Kanonikalizujte pouze skutečné duplicity na preferovanou URL.

Když všechny tyto signály míří stejným směrem, canonical tagy začnou být nudné. To je cílem.

Závěr

Canonical tagy jsou silné, protože ovlivňují indexaci a konsolidaci signálů. Ze stejného důvodu jsou nebezpečné.

Špatný canonical stránku z vyhledávání vždy neodstraní. Vyhledávače ho mohou ignorovat. Spoléhat se ale na to, že vyhledávače zachrání špatné signály, není strategie. Bezpečnější přístup je vyhradit kanonikalizaci pro skutečné duplicity, udržovat cíle čisté a indexovatelné a zajistit, aby interní odkazy, přesměrování, sitemapy a canonical tagy vyprávěly stejný příběh.

Canonical tagy nejsou místo, kam schovávat chaotickou architekturu. Jsou místo, kde potvrzujete, že byla uklizena.

Často kladené otázky

Může špatný canonical tag deindexovat stránku?
Ano, nepřímo. Canonical neodstraní stránku tak jako noindex, ale může vyhledávačům říct, že preferovanou verzí je jiná URL. Pokud toto vodítko přijmou, nekanonická stránka nemusí být indexována samostatně.
Je kanonikalizace řešení penalizace za duplicitní obsah?
Ne přesně. Duplicitní obsah je obvykle problém seskupování a výběru, ne penalizace. Canonical tagy pomáhají vyhledávačům vybrat preferovanou URL a konsolidovat signály, ale neopraví slabý obsah ani špatnou strukturu webu.
Měla by mít každá stránka self-referencing canonical?
Většina důležitých indexovatelných stránek ano. Self-referencing canonical pomáhá potvrdit preferovanou URL, zvlášť když existují tracking parametry, alternativní cesty nebo URL generované CMS.
Mohu kanonikalizovat stránkované stránky na první stránku?
Obvykle ne. Stránkované stránky často obsahují jiné položky a pomáhají objevování. Ve většině případů by každá stránkovaná URL měla mít self-referencing canonical, pokud stránky nejsou skutečně duplicitní.
Jaký je rozdíl mezi canonical a noindex?
Canonical říká: „tato stránka je duplicitní nebo alternativní verze; preferujte tuto jinou URL.“ Noindex říká: „nezobrazujte tuto stránku ve výsledcích vyhledávání.“ Řeší odlišné problémy a neměly by se používat zaměnitelně.

Zdroje a další čtení

  1. Google Search Central: How to specify a canonical URL
  2. Google Search Central: Canonicalization and duplicate URLs
  3. RFC 6596: The Canonical Link Relation
  4. Bing Webmaster Guidelines
O autorovi
The Wux Webtools Team

Naposledy aktualizováno:

Pokračujte ve čtení