SEO & Discoverability

Čo robia kanonické tagy, keď ich nastavíte nesprávne

Kanonické tagy sú užitočné, ale nie sú neškodné. Zlý canonical môže skryť stránku, ktorú ste chceli dostať do výsledkov, zlúčiť signály do nesprávnej URL a výrazne sťažiť ladenie indexácie.

The Wux Webtools Team The Wux Webtools Team 11 min čítania Pomocou AI, kontrolované človekom
Overlapping web pages with one preferred canonical page highlighted and warning markers on incorrect duplicates.
Obsah
  1. Kanonický tag nie je guma na duplicitný obsah
  2. Čo sa stane, keď canonical ukazuje na nesprávnu URL
  3. 1. Zaindexuje sa nesprávna URL
  4. 2. Hodnotiace signály sa skonsolidujú na nesprávnom mieste
  5. 3. Vyhľadávače tag ignorujú
  6. 4. Ladenie je zbytočne ťažké
  7. Najdrahšie chyby v canonicals
  8. Canonicalizovanie všetkého na homepage
  9. Canonicalizovanie stránkovaných stránok na prvú stranu
  10. Canonicalizovanie filtrovaných stránok bez kontroly vyhľadávacieho zámeru
  11. Smerovanie canonicals na presmerované alebo blokované URL
  12. Miešanie canonical s noindex, akoby znamenali to isté
  13. Praktický audit canonicals
  14. Self-referencing canonicals sú zvyčajne dobrý východiskový stav
  15. Kanonické tagy by mali zodpovedať skutočnej URL politike vášho webu
  16. Záver

Kanonický tag nie je guma na duplicitný obsah

Kanonický tag hovorí vyhľadávačom, ktorú URL preferujete, keď viacero URL obsahuje rovnaký alebo výrazne podobný obsah. Bežná HTML verzia vyzerá takto:

<link rel="canonical" href="https://example.com/preferred-page/">

Existuje aj verzia v HTTP hlavičke, užitočná najmä pre ne-HTML súbory, napríklad PDF:

Link: <https://example.com/preferred-file.pdf>; rel="canonical"

Znie to dosť jednoducho. Problém sa začína vtedy, keď tímy začnú kanonické tagy používať ako bezpečný spôsob, ako upratať čokoľvek nepohodlné: faceted navigation, sledovacie parametre, tlačové stránky, takmer duplicitné produktové stránky, stránkovanie, staging URL a staré kampanové stránky.

Kanonické tagy nie sú tlačidlo na vymazanie. Nie sú presmerovanie. Nie sú náhrada informačnej architektúry. A nie je zaručené, že ich vyhľadávače poslúchnu.

Vyhľadávače používajú canonicals ako silné odporúčania. Porovnávajú kanonický tag s ďalšími signálmi: presmerovaniami, internými odkazmi, URL v sitemapách, hreflang anotáciami, podobnosťou obsahu, HTTP stavovými kódmi a URL, na ktoré používatelia a crawlery skutočne narážajú. Ak si tieto signály odporujú, vyhľadávač môže váš canonical ignorovať alebo si zvoliť úplne inú kanonickú URL.

Preto vie byť nesprávne nastavenie canonicals také mätúce. Značkovanie vyzerá v prehliadači správne, no vo výsledkoch vyhľadávania sa zobrazí nesprávna stránka — alebo tá správna zmizne.

Čo sa stane, keď canonical ukazuje na nesprávnu URL

Keď vyhľadávač vidí duplicitné alebo takmer duplicitné URL, zvyčajne ich zoskupí do klastra a vyberie jednu URL ako kanonickú. Zvolená kanonická URL je verzia, ktorá sa najpravdepodobnejšie zaindexuje a zobrazí vo výsledkoch vyhľadávania. Signály z duplicít sa môžu konsolidovať do tejto zvolenej URL.

Ak váš kanonický tag ukazuje na nesprávnu stránku, môže sa stať viacero vecí.

1. Zaindexuje sa nesprávna URL

Predstavte si, že máte dve URL:

  • /mens-running-shoes/
  • /sale/mens-running-shoes/

Ak má výpredajová stránka canonical na hlavnú stránku kategórie, môže to byť v poriadku, ak je obsah takmer identický a výpredajová URL je iba filtrovaná verzia. Ak však má výpredajová stránka unikátny text, unikátne produkty a vlastný dopyt vo vyhľadávaní, canonical ju môže potlačiť.

Stránka sa stále môže crawlovať. Pre používateľov môže byť stále dostupná. Vyhľadávače sa však môžu rozhodnúť, že ju nebudú indexovať samostatne, pretože ste im povedali, že preferovaná verzia je iná URL.

Toto je najčastejšie zlyhanie canonicals: nie dramatický technický výpadok, iba tiché zmiznutie z indexu.

2. Hodnotiace signály sa skonsolidujú na nesprávnom mieste

Canonicals sa často používajú na konsolidáciu signálov, napríklad odkazov a variantov duplicitného obsahu. Je to užitočné, keď sú duplicity skutočne rovnocenné. Je to rizikové, keď nie sú.

Ak má blogový článok sledovacie URL, napríklad:

  • /guide-to-canonical-tags/?utm_source=newsletter
  • /guide-to-canonical-tags/?utm_source=linkedin

Potom je rozumné canonicalizovať obe na /guide-to-canonical-tags/.

Ak však španielska verzia, tlačová verzia s dodatočným obsahom alebo produktový variant s iným zámerom ukazuje na rovnaký canonical, môžete zlučovať signály, ktoré by mali zostať oddelené. Výsledkom môže byť slabšia relevancia pre všetky tieto stránky.

Kanonické tagy sú o rovnocennosti. Ak dve stránky uspokojujú odlišné vyhľadávacie zámery, pravdepodobne by nemali canonicalizovať jedna na druhú.

3. Vyhľadávače tag ignorujú

Canonical nie je príkaz. Ak cieľ canonicalu presmerováva, vracia 404, je blokovaný, má noindex alebo obsahuje veľmi odlišný obsah, vyhľadávače ho môžu ignorovať.

V jednom zmysle je to dobré: zlý canonical nie vždy zničí indexáciu. Zároveň to však znamená, že nemôžete predpokladať, že tag robí to, čo si myslíte. Stránka môže deklarovať jeden canonical, zatiaľ čo Google vyberie iný.

Toto je obzvlášť časté, keď si interné odkazy, sitemapy a canonicals odporujú. Ak každý interný odkaz smeruje na /product, vaša sitemap uvádza /product/ a váš canonical ukazuje na https://www.example.com/product?ref=main, vytvorili ste malý spor medzi vlastnými signálmi.

Vyhľadávače vedia takýto spor dobre vyriešiť. Nie vždy ho však vyriešia tak, ako ste zamýšľali.

4. Ladenie je zbytočne ťažké

Zlé canonicals zriedka zlyhajú nahlas. Vytvárajú symptómy, ktoré vyzerajú ako iné SEO problémy:

  • „Discovered, currently not indexed“ alebo ekvivalentné indexačné vákuum
  • Nesprávna URL sa zobrazuje pre dopyt
  • Parametrové URL sa objavujú v reportoch
  • Stránky kategórií sa nezobrazujú, hoci sú crawlable
  • Medzinárodné stránky sa zlučujú do nesprávnej jazykovej verzie
  • Nové šablóny sa spúšťajú s menším počtom zaindexovaných stránok, než sa očakávalo

Preto by ladenie canonicals malo zahŕňať surové HTML, renderované HTML, HTTP hlavičky, presmerovania a položky v sitemapách. Ak už skúmate reťazce presmerovaní alebo nesúlad hlavičiek, platia rovnaké návyky; praktický pracovný postup kontroly HTTP, ako je ten v našom sprievodcovi ladením presmerovaní a HTTP hlavičiek v produkcii, zvyčajne zachytí rozpory v canonicals rýchlejšie než pozeranie na pole v CMS.

Najdrahšie chyby v canonicals

Canonicalizovanie všetkého na homepage

Toto sa stále deje. Pole v šablóne zostane prázdne, plugin použije ako fallback koreň webu a zrazu stovky stránok deklarujú homepage ako canonical.

Vyhľadávače to môžu ignorovať, pretože obsah je očividne odlišný. Ak je však dosť signálov chaotických, niektoré stránky môžu byť vyradené alebo nesprávne zoskupené. Prinajmenšom posielate na každej stránke zbytočné a protichodné odporúčanie.

Homepage takmer nikdy nie je canonical pre internú stránku.

Canonicalizovanie stránkovaných stránok na prvú stranu

Dlho niektoré weby canonicalizovali /category/page/2/, /page/3/ a ďalšie späť na prvú stranu. Zámerom bolo vyhnúť sa duplicitným stránkam kategórií.

Problém je, že stránkované stránky nie sú duplicity. Obsahujú rôzne položky a pomáhajú crawlerom objavovať hlbší obsah. Canonicalizovanie všetkých na prvú stranu môže znížiť šancu, že vyhľadávače plne spracujú neskoršie stránky.

Stránkované stránky by zvyčajne mali mať self-referencing canonicals, pokiaľ neexistuje konkrétny dôvod na konsolidáciu.

Canonicalizovanie filtrovaných stránok bez kontroly vyhľadávacieho zámeru

Faceted navigation vytvára náročné rozhodnutia. Niektoré filtrované URL sú odpad:

  • ?sort=price_ascending
  • ?view=grid
  • ?sessionid=123

Iné môžu byť hodnotné vstupné stránky:

  • /sofas/blue/
  • /laptops/16gb-ram/
  • /hotels/paris/pet-friendly/

Plošné pravidlá pre canonicals často vymažú užitočné vyhľadávacie stránky spolu so zbytočným parametrovým šumom. Pred canonicalizovaním filtrovaných stránok sa opýtajte, či má filtrovaná stránka stabilný obsah, interné odkazy, dopyt vo vyhľadávaní a odlišnú potrebu používateľa.

Ak je odpoveď áno, možno si zaslúži byť indexovateľná so self-referencing canonicalom.

Smerovanie canonicals na presmerované alebo blokované URL

Cieľ canonicalu by mal byť čistý, indexovateľný a vracať 200 OK. Nesmerujte canonicals na URL, ktoré presmerovávajú, vracajú chyby, vyžadujú cookies, sú blokované cez robots.txt alebo nesú noindex.

Toto je jedna z najjednoduchších kontrol na automatizáciu. Precrawlujte svoj web a označte ciele canonicalov, ktoré nevracajú čistú odpoveď 200.

Miešanie canonical s noindex, akoby znamenali to isté

rel="canonical" a noindex riešia odlišné problémy.

Použite canonical, keď existujú duplicity a chcete konsolidovať signály na preferovanú URL. Použite noindex, keď nechcete, aby sa stránka vôbec indexovala.

Použiť oboje naraz vysiela nešikovnú správu: „Neindexujte túto stránku, ale zároveň ju použite ako duplicitný signál pre inú stránku.“ Vyhľadávače si s tým často vedia poradiť, ale nie je to čistá inštrukcia. Ak je stránka duplicitná, canonicalizujte ju. Ak sa nemá zobrazovať vo vyhľadávaní a nemá užitočný duplicitný vzťah, zvážte noindex.

Praktický audit canonicals

Na nájdenie mnohých problémov s canonicals nepotrebujete veľkú SEO platformu. Začnite crawlom, niekoľkými vzorkami URL a tabuľkou.

Pri každej dôležitej šablóne skontrolujte:

  1. Má stránka presne jeden kanonický tag? Viacero kanonických tagov vytvára nejednoznačnosť.
  2. Je canonical absolútny? Použite celú URL vrátane protokolu a hostname.
  3. Vracia cieľ canonicalu 200 OK? Vyhnite sa presmerovaným, blokovaným alebo chybovým cieľom.
  4. Je cieľ canonicalu indexovateľný? Žiadny noindex, žiadny robots blok, žiadna požiadavka na autentifikáciu.
  5. Je obsah skutočne rovnocenný? Podobný neznamená vždy rovnocenný.
  6. Sú interné odkazy v súlade? Odkazujte na kanonický formát URL všade, kde je to možné.
  7. Je sitemap v súlade? Sitemapy by vo všeobecnosti mali uvádzať kanonické, indexovateľné URL.
  8. Sú hreflang tagy v súlade? Medzinárodné stránky potrebujú konzistentné vzťahy medzi canonical a hreflang.
  9. Zodpovedá renderované HTML surovému HTML? JavaScript môže tagy meniť alebo vkladať.
  10. Aký canonical si vybral vyhľadávač? Nástroje na kontrolu môžu odhaliť, keď sa váš deklarovaný canonical líši od vybraného canonicalu.

Tu môže pomôcť aj Lighthouse, ale iba v rámci svojich limitov. Dokáže označiť niektoré problémy s crawlability a dokumentom, no nerozumie vášmu obchodnému zámeru ani stratégii canonicals. Berte ho ako jeden vstup, nie ako verdikt. Ak potrebujete pokojnejší spôsob, ako oddeliť užitočné zistenia od šumu, pozrite si, ako čítať Lighthouse report bez paniky.

Self-referencing canonicals sú zvyčajne dobrý východiskový stav

Každá dôležitá indexovateľná stránka by mala zvyčajne deklarovať samu seba ako canonical. Nie preto, že by na to vyhľadávače bez tagu nevedeli prísť. Ale preto, že self-referencing canonicals znižujú nejednoznačnosť, keď parametre, sledovacie odkazy, skopírované URL a zvláštnosti CMS vytvárajú alternatívne cesty k rovnakému obsahu.

Pre čistú produktovú stránku je zvyčajne správne toto:

<link rel="canonical" href="https://example.com/products/linen-shirt/">

Pre sledovaciu URL by canonical zvyčajne mal ukazovať späť na čistú verziu:

<link rel="canonical" href="https://example.com/products/linen-shirt/">

Pri skutočne odlišnom produktovom variante odpoveď závisí od situácie. Ak majú červená, modrá a čierna košeľa rovnaký opis a mení sa iba farba, jedna kanonická produktová stránka môže stačiť. Ak má každý variant samostatný dopyt, recenzie, obrázky, skladové zásoby a interné odkazy, samostatné indexovateľné stránky môžu dávať zmysel.

Neexistuje univerzálne pravidlo pre canonicals pri variantoch. Existuje iba otázka: sú tieto stránky pre hľadajúceho zameniteľné?

Kanonické tagy by mali zodpovedať skutočnej URL politike vášho webu

Väčšina chýb v canonicals je príznakom hlbšieho problému s URL politikou. Web sa nerozhodol, či záleží na koncových lomkách, či sa majú URL s veľkými písmenami načítať, či sú povolené parametre, či sa HTTP presmerúva na HTTPS alebo či je kanonické www.

Vyberte jednu čistú verziu každej URL a zlaďte s ňou celý systém:

  • Presmerujte nepreferované verzie URL na preferované verzie.
  • Interne odkazujte na preferované verzie.
  • Vkladajte preferované verzie do XML sitemap.
  • Používajte self-referencing canonicals na preferovaných stránkach.
  • Canonicalizujte iba skutočné duplicity na preferovanú URL.

Keď všetky tieto signály ukazujú rovnakým smerom, kanonické tagy začnú byť nudné. To je cieľ.

Záver

Kanonické tagy sú mocné, pretože ovplyvňujú indexáciu a konsolidáciu signálov. Z rovnakého dôvodu sú nebezpečné.

Nesprávny canonical nie vždy odstráni stránku z vyhľadávania. Vyhľadávače ho môžu ignorovať. Spoliehať sa však na to, že vyhľadávače zachránia zlé signály, nie je stratégia. Bezpečnejší prístup je vyhradiť canonicalizáciu pre skutočné duplicity, udržiavať ciele čisté a indexovateľné a zabezpečiť, aby interné odkazy, presmerovania, sitemapy a canonicals rozprávali ten istý príbeh.

Canonicals nie sú miesto, kam schováte chaotickú architektúru. Sú miesto, kde potvrdíte, že bola uprataná.

Často kladené otázky

Môže zlý kanonický tag deindexovať stránku?
Áno, nepriamo. Canonical neodstráni stránku tak ako noindex, ale môže vyhľadávačom povedať, že preferovanou verziou je iná URL. Ak toto odporúčanie prijmú, nekanonická stránka sa nemusí indexovať samostatne.
Je canonicalizácia riešenie penalizácie za duplicitný obsah?
Nie úplne. Duplicitný obsah je zvyčajne problém zhlukovania a výberu, nie penalizácie. Kanonické tagy pomáhajú vyhľadávačom vybrať preferovanú URL a konsolidovať signály, ale neopravujú slabý obsah ani zlú štruktúru webu.
Mala by mať každá stránka self-referencing canonical?
Väčšina dôležitých indexovateľných stránok by ho mala mať. Self-referencing canonical pomáha potvrdiť preferovanú URL, najmä keď existujú sledovacie parametre, alternatívne cesty alebo URL generované CMS.
Môžem canonicalizovať stránkované stránky na prvú stranu?
Zvyčajne nie. Stránkované stránky často obsahujú rôzne položky a pomáhajú objavovaniu. Vo väčšine prípadov by každá stránkovaná URL mala mať self-referencing canonical, pokiaľ stránky nie sú skutočne duplicitné.
Aký je rozdiel medzi canonical a noindex?
Canonical hovorí: „táto stránka je duplicitná alebo alternatívna verzia; preferujte túto inú URL.“ Noindex hovorí: „nezobrazujte túto stránku vo výsledkoch vyhľadávania.“ Riešia odlišné problémy a nemali by sa používať zameniteľne.

Zdroje a ďalšie čítanie

  1. Google Search Central: How to specify a canonical URL
  2. Google Search Central: Canonicalization and duplicate URLs
  3. RFC 6596: The Canonical Link Relation
  4. Bing Webmaster Guidelines
O autorovi
The Wux Webtools Team

Posledná aktualizácia:

Pokračujte v čítaní