Čo robia kanonické tagy, keď ich nastavíte nesprávne
Kanonické tagy sú užitočné, ale nie sú neškodné. Zlý canonical môže skryť stránku, ktorú ste chceli dostať do výsledkov, zlúčiť signály do nesprávnej URL a výrazne sťažiť ladenie indexácie.
Obsah
- Kanonický tag nie je guma na duplicitný obsah
- Čo sa stane, keď canonical ukazuje na nesprávnu URL
- 1. Zaindexuje sa nesprávna URL
- 2. Hodnotiace signály sa skonsolidujú na nesprávnom mieste
- 3. Vyhľadávače tag ignorujú
- 4. Ladenie je zbytočne ťažké
- Najdrahšie chyby v canonicals
- Canonicalizovanie všetkého na homepage
- Canonicalizovanie stránkovaných stránok na prvú stranu
- Canonicalizovanie filtrovaných stránok bez kontroly vyhľadávacieho zámeru
- Smerovanie canonicals na presmerované alebo blokované URL
- Miešanie canonical s noindex, akoby znamenali to isté
- Praktický audit canonicals
- Self-referencing canonicals sú zvyčajne dobrý východiskový stav
- Kanonické tagy by mali zodpovedať skutočnej URL politike vášho webu
- Záver
Kanonický tag nie je guma na duplicitný obsah
Kanonický tag hovorí vyhľadávačom, ktorú URL preferujete, keď viacero URL obsahuje rovnaký alebo výrazne podobný obsah. Bežná HTML verzia vyzerá takto:
<link rel="canonical" href="https://example.com/preferred-page/">
Existuje aj verzia v HTTP hlavičke, užitočná najmä pre ne-HTML súbory, napríklad PDF:
Link: <https://example.com/preferred-file.pdf>; rel="canonical"
Znie to dosť jednoducho. Problém sa začína vtedy, keď tímy začnú kanonické tagy používať ako bezpečný spôsob, ako upratať čokoľvek nepohodlné: faceted navigation, sledovacie parametre, tlačové stránky, takmer duplicitné produktové stránky, stránkovanie, staging URL a staré kampanové stránky.
Kanonické tagy nie sú tlačidlo na vymazanie. Nie sú presmerovanie. Nie sú náhrada informačnej architektúry. A nie je zaručené, že ich vyhľadávače poslúchnu.
Vyhľadávače používajú canonicals ako silné odporúčania. Porovnávajú kanonický tag s ďalšími signálmi: presmerovaniami, internými odkazmi, URL v sitemapách, hreflang anotáciami, podobnosťou obsahu, HTTP stavovými kódmi a URL, na ktoré používatelia a crawlery skutočne narážajú. Ak si tieto signály odporujú, vyhľadávač môže váš canonical ignorovať alebo si zvoliť úplne inú kanonickú URL.
Preto vie byť nesprávne nastavenie canonicals také mätúce. Značkovanie vyzerá v prehliadači správne, no vo výsledkoch vyhľadávania sa zobrazí nesprávna stránka — alebo tá správna zmizne.
Čo sa stane, keď canonical ukazuje na nesprávnu URL
Keď vyhľadávač vidí duplicitné alebo takmer duplicitné URL, zvyčajne ich zoskupí do klastra a vyberie jednu URL ako kanonickú. Zvolená kanonická URL je verzia, ktorá sa najpravdepodobnejšie zaindexuje a zobrazí vo výsledkoch vyhľadávania. Signály z duplicít sa môžu konsolidovať do tejto zvolenej URL.
Ak váš kanonický tag ukazuje na nesprávnu stránku, môže sa stať viacero vecí.
1. Zaindexuje sa nesprávna URL
Predstavte si, že máte dve URL:
/mens-running-shoes//sale/mens-running-shoes/
Ak má výpredajová stránka canonical na hlavnú stránku kategórie, môže to byť v poriadku, ak je obsah takmer identický a výpredajová URL je iba filtrovaná verzia. Ak však má výpredajová stránka unikátny text, unikátne produkty a vlastný dopyt vo vyhľadávaní, canonical ju môže potlačiť.
Stránka sa stále môže crawlovať. Pre používateľov môže byť stále dostupná. Vyhľadávače sa však môžu rozhodnúť, že ju nebudú indexovať samostatne, pretože ste im povedali, že preferovaná verzia je iná URL.
Toto je najčastejšie zlyhanie canonicals: nie dramatický technický výpadok, iba tiché zmiznutie z indexu.
2. Hodnotiace signály sa skonsolidujú na nesprávnom mieste
Canonicals sa často používajú na konsolidáciu signálov, napríklad odkazov a variantov duplicitného obsahu. Je to užitočné, keď sú duplicity skutočne rovnocenné. Je to rizikové, keď nie sú.
Ak má blogový článok sledovacie URL, napríklad:
/guide-to-canonical-tags/?utm_source=newsletter/guide-to-canonical-tags/?utm_source=linkedin
Potom je rozumné canonicalizovať obe na /guide-to-canonical-tags/.
Ak však španielska verzia, tlačová verzia s dodatočným obsahom alebo produktový variant s iným zámerom ukazuje na rovnaký canonical, môžete zlučovať signály, ktoré by mali zostať oddelené. Výsledkom môže byť slabšia relevancia pre všetky tieto stránky.
Kanonické tagy sú o rovnocennosti. Ak dve stránky uspokojujú odlišné vyhľadávacie zámery, pravdepodobne by nemali canonicalizovať jedna na druhú.
3. Vyhľadávače tag ignorujú
Canonical nie je príkaz. Ak cieľ canonicalu presmerováva, vracia 404, je blokovaný, má noindex alebo obsahuje veľmi odlišný obsah, vyhľadávače ho môžu ignorovať.
V jednom zmysle je to dobré: zlý canonical nie vždy zničí indexáciu. Zároveň to však znamená, že nemôžete predpokladať, že tag robí to, čo si myslíte. Stránka môže deklarovať jeden canonical, zatiaľ čo Google vyberie iný.
Toto je obzvlášť časté, keď si interné odkazy, sitemapy a canonicals odporujú. Ak každý interný odkaz smeruje na /product, vaša sitemap uvádza /product/ a váš canonical ukazuje na https://www.example.com/product?ref=main, vytvorili ste malý spor medzi vlastnými signálmi.
Vyhľadávače vedia takýto spor dobre vyriešiť. Nie vždy ho však vyriešia tak, ako ste zamýšľali.
4. Ladenie je zbytočne ťažké
Zlé canonicals zriedka zlyhajú nahlas. Vytvárajú symptómy, ktoré vyzerajú ako iné SEO problémy:
- „Discovered, currently not indexed“ alebo ekvivalentné indexačné vákuum
- Nesprávna URL sa zobrazuje pre dopyt
- Parametrové URL sa objavujú v reportoch
- Stránky kategórií sa nezobrazujú, hoci sú crawlable
- Medzinárodné stránky sa zlučujú do nesprávnej jazykovej verzie
- Nové šablóny sa spúšťajú s menším počtom zaindexovaných stránok, než sa očakávalo
Preto by ladenie canonicals malo zahŕňať surové HTML, renderované HTML, HTTP hlavičky, presmerovania a položky v sitemapách. Ak už skúmate reťazce presmerovaní alebo nesúlad hlavičiek, platia rovnaké návyky; praktický pracovný postup kontroly HTTP, ako je ten v našom sprievodcovi ladením presmerovaní a HTTP hlavičiek v produkcii, zvyčajne zachytí rozpory v canonicals rýchlejšie než pozeranie na pole v CMS.
Najdrahšie chyby v canonicals
Canonicalizovanie všetkého na homepage
Toto sa stále deje. Pole v šablóne zostane prázdne, plugin použije ako fallback koreň webu a zrazu stovky stránok deklarujú homepage ako canonical.
Vyhľadávače to môžu ignorovať, pretože obsah je očividne odlišný. Ak je však dosť signálov chaotických, niektoré stránky môžu byť vyradené alebo nesprávne zoskupené. Prinajmenšom posielate na každej stránke zbytočné a protichodné odporúčanie.
Homepage takmer nikdy nie je canonical pre internú stránku.
Canonicalizovanie stránkovaných stránok na prvú stranu
Dlho niektoré weby canonicalizovali /category/page/2/, /page/3/ a ďalšie späť na prvú stranu. Zámerom bolo vyhnúť sa duplicitným stránkam kategórií.
Problém je, že stránkované stránky nie sú duplicity. Obsahujú rôzne položky a pomáhajú crawlerom objavovať hlbší obsah. Canonicalizovanie všetkých na prvú stranu môže znížiť šancu, že vyhľadávače plne spracujú neskoršie stránky.
Stránkované stránky by zvyčajne mali mať self-referencing canonicals, pokiaľ neexistuje konkrétny dôvod na konsolidáciu.
Canonicalizovanie filtrovaných stránok bez kontroly vyhľadávacieho zámeru
Faceted navigation vytvára náročné rozhodnutia. Niektoré filtrované URL sú odpad:
?sort=price_ascending?view=grid?sessionid=123
Iné môžu byť hodnotné vstupné stránky:
/sofas/blue//laptops/16gb-ram//hotels/paris/pet-friendly/
Plošné pravidlá pre canonicals často vymažú užitočné vyhľadávacie stránky spolu so zbytočným parametrovým šumom. Pred canonicalizovaním filtrovaných stránok sa opýtajte, či má filtrovaná stránka stabilný obsah, interné odkazy, dopyt vo vyhľadávaní a odlišnú potrebu používateľa.
Ak je odpoveď áno, možno si zaslúži byť indexovateľná so self-referencing canonicalom.
Smerovanie canonicals na presmerované alebo blokované URL
Cieľ canonicalu by mal byť čistý, indexovateľný a vracať 200 OK. Nesmerujte canonicals na URL, ktoré presmerovávajú, vracajú chyby, vyžadujú cookies, sú blokované cez robots.txt alebo nesú noindex.
Toto je jedna z najjednoduchších kontrol na automatizáciu. Precrawlujte svoj web a označte ciele canonicalov, ktoré nevracajú čistú odpoveď 200.
Miešanie canonical s noindex, akoby znamenali to isté
rel="canonical" a noindex riešia odlišné problémy.
Použite canonical, keď existujú duplicity a chcete konsolidovať signály na preferovanú URL. Použite noindex, keď nechcete, aby sa stránka vôbec indexovala.
Použiť oboje naraz vysiela nešikovnú správu: „Neindexujte túto stránku, ale zároveň ju použite ako duplicitný signál pre inú stránku.“ Vyhľadávače si s tým často vedia poradiť, ale nie je to čistá inštrukcia. Ak je stránka duplicitná, canonicalizujte ju. Ak sa nemá zobrazovať vo vyhľadávaní a nemá užitočný duplicitný vzťah, zvážte noindex.
Praktický audit canonicals
Na nájdenie mnohých problémov s canonicals nepotrebujete veľkú SEO platformu. Začnite crawlom, niekoľkými vzorkami URL a tabuľkou.
Pri každej dôležitej šablóne skontrolujte:
- Má stránka presne jeden kanonický tag? Viacero kanonických tagov vytvára nejednoznačnosť.
- Je canonical absolútny? Použite celú URL vrátane protokolu a hostname.
- Vracia cieľ canonicalu
200 OK? Vyhnite sa presmerovaným, blokovaným alebo chybovým cieľom. - Je cieľ canonicalu indexovateľný? Žiadny
noindex, žiadny robots blok, žiadna požiadavka na autentifikáciu. - Je obsah skutočne rovnocenný? Podobný neznamená vždy rovnocenný.
- Sú interné odkazy v súlade? Odkazujte na kanonický formát URL všade, kde je to možné.
- Je sitemap v súlade? Sitemapy by vo všeobecnosti mali uvádzať kanonické, indexovateľné URL.
- Sú hreflang tagy v súlade? Medzinárodné stránky potrebujú konzistentné vzťahy medzi canonical a hreflang.
- Zodpovedá renderované HTML surovému HTML? JavaScript môže tagy meniť alebo vkladať.
- Aký canonical si vybral vyhľadávač? Nástroje na kontrolu môžu odhaliť, keď sa váš deklarovaný canonical líši od vybraného canonicalu.
Tu môže pomôcť aj Lighthouse, ale iba v rámci svojich limitov. Dokáže označiť niektoré problémy s crawlability a dokumentom, no nerozumie vášmu obchodnému zámeru ani stratégii canonicals. Berte ho ako jeden vstup, nie ako verdikt. Ak potrebujete pokojnejší spôsob, ako oddeliť užitočné zistenia od šumu, pozrite si, ako čítať Lighthouse report bez paniky.
Self-referencing canonicals sú zvyčajne dobrý východiskový stav
Každá dôležitá indexovateľná stránka by mala zvyčajne deklarovať samu seba ako canonical. Nie preto, že by na to vyhľadávače bez tagu nevedeli prísť. Ale preto, že self-referencing canonicals znižujú nejednoznačnosť, keď parametre, sledovacie odkazy, skopírované URL a zvláštnosti CMS vytvárajú alternatívne cesty k rovnakému obsahu.
Pre čistú produktovú stránku je zvyčajne správne toto:
<link rel="canonical" href="https://example.com/products/linen-shirt/">
Pre sledovaciu URL by canonical zvyčajne mal ukazovať späť na čistú verziu:
<link rel="canonical" href="https://example.com/products/linen-shirt/">
Pri skutočne odlišnom produktovom variante odpoveď závisí od situácie. Ak majú červená, modrá a čierna košeľa rovnaký opis a mení sa iba farba, jedna kanonická produktová stránka môže stačiť. Ak má každý variant samostatný dopyt, recenzie, obrázky, skladové zásoby a interné odkazy, samostatné indexovateľné stránky môžu dávať zmysel.
Neexistuje univerzálne pravidlo pre canonicals pri variantoch. Existuje iba otázka: sú tieto stránky pre hľadajúceho zameniteľné?
Kanonické tagy by mali zodpovedať skutočnej URL politike vášho webu
Väčšina chýb v canonicals je príznakom hlbšieho problému s URL politikou. Web sa nerozhodol, či záleží na koncových lomkách, či sa majú URL s veľkými písmenami načítať, či sú povolené parametre, či sa HTTP presmerúva na HTTPS alebo či je kanonické www.
Vyberte jednu čistú verziu každej URL a zlaďte s ňou celý systém:
- Presmerujte nepreferované verzie URL na preferované verzie.
- Interne odkazujte na preferované verzie.
- Vkladajte preferované verzie do XML sitemap.
- Používajte self-referencing canonicals na preferovaných stránkach.
- Canonicalizujte iba skutočné duplicity na preferovanú URL.
Keď všetky tieto signály ukazujú rovnakým smerom, kanonické tagy začnú byť nudné. To je cieľ.
Záver
Kanonické tagy sú mocné, pretože ovplyvňujú indexáciu a konsolidáciu signálov. Z rovnakého dôvodu sú nebezpečné.
Nesprávny canonical nie vždy odstráni stránku z vyhľadávania. Vyhľadávače ho môžu ignorovať. Spoliehať sa však na to, že vyhľadávače zachránia zlé signály, nie je stratégia. Bezpečnejší prístup je vyhradiť canonicalizáciu pre skutočné duplicity, udržiavať ciele čisté a indexovateľné a zabezpečiť, aby interné odkazy, presmerovania, sitemapy a canonicals rozprávali ten istý príbeh.
Canonicals nie sú miesto, kam schováte chaotickú architektúru. Sú miesto, kde potvrdíte, že bola uprataná.