SEO & Discoverability

Mit csinálnak a canonical tagek, ha rosszul használod őket

A canonical tagek hasznosak, de nem ártalmatlanok. Egy rossz canonical elrejtheti azt az oldalt, amelyet rangsorolni szerettél volna, a jeleket rossz URL-be vonhatja össze, és a kelleténél jóval nehezebbé teheti az indexelési hibakeresést.

The Wux Webtools Team The Wux Webtools Team 12 min olvasás AI-támogatott, ember által ellenőrzött
Overlapping web pages with one preferred canonical page highlighted and warning markers on incorrect duplicates.
Tartalomjegyzék
  1. A canonical tag nem a duplikált tartalom radírja
  2. Mi történik, ha egy canonical rossz URL-re mutat
  3. 1. A rossz URL kerül indexelésre
  4. 2. A rangsorolási jelek rossz helyre vonódnak össze
  5. 3. A keresőmotorok figyelmen kívül hagyják a taget
  6. 4. A hibakeresés szükségtelenül nehézzé válik
  7. A legdrágább canonical-hibák
  8. Minden canonicalizálása a kezdőlapra
  9. Lapozott oldalak canonicalizálása az első oldalra
  10. Szűrt oldalak canonicalizálása a keresési szándék ellenőrzése nélkül
  11. Canonicalok átirányított vagy blokkolt URL-ekre mutatnak
  12. A canonical és a noindex keverése, mintha ugyanazt jelentenék
  13. Gyakorlati canonical-audit
  14. Az önmagukra mutató canonicalok általában jó alapértelmezések
  15. A canonical tageknek illeszkedniük kell a webhely tényleges URL-politikájához
  16. A lényeg

A canonical tag nem a duplikált tartalom radírja

A canonical tag azt mondja meg a keresőmotoroknak, melyik URL-t részesíted előnyben, amikor több URL ugyanazt vagy lényegében hasonló tartalmat tartalmaz. A gyakori HTML-változat így néz ki:

<link rel="canonical" href="https://example.com/preferred-page/">

Létezik HTTP header-változat is, amely főleg nem HTML-fájloknál, például PDF-eknél hasznos:

Link: <https://example.com/preferred-file.pdf>; rel="canonical"

Ez elég egyszerűnek hangzik. A gond akkor kezdődik, amikor a csapatok a canonical tageket biztonságos rendrakó eszköznek tekintik minden kényelmetlen helyzetre: facettás navigációra, követési paraméterekre, nyomtatási oldalakra, majdnem duplikált termékoldalakra, lapozásra, staging URL-ekre és régi kampányoldalakra.

A canonical tag nem törlés gomb. Nem átirányítás. Nem helyettesíti az információs architektúrát. És nincs garancia arra, hogy be is tartják.

A keresőmotorok a canonicalokat erős jelzésként használják. Összevetik a canonical taget más jelekkel: átirányításokkal, belső linkekkel, sitemap URL-ekkel, hreflang annotációkkal, tartalmi hasonlósággal, HTTP státuszkódokkal, valamint azokkal az URL-ekkel, amelyekkel a felhasználók és a crawlerek ténylegesen találkoznak. Ha ezek a jelek ellentmondanak egymásnak, a keresőmotor figyelmen kívül hagyhatja a canonicalt, vagy akár teljesen más canonical URL-t választhat.

Ezért lehet olyan zavaros, amikor a canonicalok rosszul vannak beállítva. A jelölés helyesnek tűnik a böngészőben, mégis a rossz oldal jelenik meg a keresési találatokban — vagy a megfelelő oldal eltűnik.

Mi történik, ha egy canonical rossz URL-re mutat

Amikor egy keresőmotor duplikált vagy majdnem duplikált URL-eket lát, általában klaszterbe rendezi őket, és kiválaszt egy URL-t canonicalként. A kiválasztott canonical az a verzió, amelyet a legnagyobb eséllyel indexelnek és jelenítenek meg a keresési találatokban. A duplikátumokból származó jelek ebbe a kiválasztott URL-be vonódhatnak össze.

Ha a canonical taged rossz oldalra mutat, több dolog is történhet.

1. A rossz URL kerül indexelésre

Tegyük fel, hogy két URL-ed van:

  • /mens-running-shoes/
  • /sale/mens-running-shoes/

Ha az akciós oldal canonicalja a fő kategóriaoldalra mutat, ez rendben lehet, ha a tartalom majdnem azonos, és az akciós URL csak egy szűrt változat. De ha az akciós oldalnak egyedi szövege, egyedi termékei és saját keresési kereslete van, a canonical elnyomhatja.

Az oldalt ettől még feltérképezhetik. A felhasználók számára ettől még elérhető lehet. A keresőmotorok azonban dönthetnek úgy, hogy nem indexelik külön, mert azt mondtad nekik, hogy egy másik URL az előnyben részesített verzió.

Ez a leggyakoribb canonical-hiba: nem látványos technikai leállás, csak csendes eltűnés az indexből.

2. A rangsorolási jelek rossz helyre vonódnak össze

A canonicalokat gyakran használják jelek, például linkek és duplikált tartalomváltozatok összevonására. Ez akkor hasznos, ha a duplikátumok valóban egyenértékűek. Kockázatos, ha nem azok.

Ha egy blogcikknek ilyen követési URL-jei vannak:

  • /guide-to-canonical-tags/?utm_source=newsletter
  • /guide-to-canonical-tags/?utm_source=linkedin

Akkor ésszerű mindkettőt a /guide-to-canonical-tags/ URL-re canonicalizálni.

De ha egy spanyol verzió, egy extra tartalommal rendelkező nyomtatható verzió vagy egy eltérő szándékú termékváltozat ugyanarra a canonicalra mutat, olyan jeleket vonhatsz össze, amelyeknek külön kellene maradniuk. Az eredmény mindegyiknél gyengébb relevancia lehet.

A canonical tagek az egyenértékűségről szólnak. Ha két oldal eltérő keresési szándékot elégít ki, valószínűleg nem kellene egymásra canonicalizálni őket.

3. A keresőmotorok figyelmen kívül hagyják a taget

A canonical nem parancs. Ha a canonical célpont átirányít, 404-et ad vissza, blokkolva van, noindex értéket tartalmaz, vagy nagyon eltérő tartalom van rajta, a keresőmotorok figyelmen kívül hagyhatják.

Ez bizonyos értelemben jó: egy rossz canonical nem mindig rombolja le az indexelést. De azt is jelenti, hogy nem feltételezheted, hogy a tag azt teszi, amit gondolsz. Egy oldal deklarálhat egy canonicalt, miközben a Google egy másikat választ.

Ez különösen gyakori, amikor a belső linkek, a sitemapek és a canonicalok nem értenek egyet. Ha minden belső link a /product URL-re mutat, a sitemap a /product/ URL-t listázza, a canonical pedig a https://www.example.com/product?ref=main címre mutat, kis vitát hoztál létre a saját jeleid között.

A keresőmotorok jól oldják fel ezt a vitát. Nem mindig úgy oldják fel, ahogy te szeretted volna.

4. A hibakeresés szükségtelenül nehézzé válik

A rossz canonicalok ritkán hibáznak hangosan. Olyan tüneteket produkálnak, amelyek más SEO-problémáknak tűnnek:

  • „Felfedezve, jelenleg nincs indexelve” vagy hasonló indexelési bizonytalanság
  • Rossz URL rangsorol egy lekérdezésre
  • Paraméteres URL-ek jelennek meg a riportokban
  • Kategóriaoldalak nem jelennek meg, annak ellenére, hogy crawlolhatók
  • Nemzetközi oldalak rossz nyelvi verzióba olvadnak be
  • Új sablonok a vártnál kevesebb indexelt oldallal indulnak

Ezért a canonical-hibakeresésnek tartalmaznia kell a nyers HTML-t, a renderelt HTML-t, a HTTP headereket, az átirányításokat és a sitemap bejegyzéseket. Ha már átirányítási láncokat vagy nem egyező headereket vizsgálsz, ugyanazok a szokások érvényesek; egy gyakorlatias HTTP-ellenőrzési munkafolyamat, mint amilyen az éles környezetben történő átirányítás- és HTTP header-hibakeresésről szóló útmutatónkban szerepel, általában gyorsabban megtalálja a canonical-ellentmondásokat, mint egy CMS-mező bámulása.

A legdrágább canonical-hibák

Minden canonicalizálása a kezdőlapra

Ez még mindig előfordul. Egy sablonmező üresen marad, egy plugin visszaesik a webhely gyökércímére, és hirtelen oldalak százai deklarálják a kezdőlapot canonicalként.

A keresőmotorok ezt figyelmen kívül hagyhatják, mert a tartalom nyilvánvalóan eltérő. De ha elég sok jel rendezetlen, néhány oldal kieshet vagy rosszul klasztereződhet. Legalábbis haszontalan és ellentmondásos jelzést küldesz minden oldalon.

A kezdőlap szinte soha nem canonicalja egy belső oldalnak.

Lapozott oldalak canonicalizálása az első oldalra

Sokáig egyes webhelyek a /category/page/2/, /page/3/ és hasonló oldalakat visszakanonizálták az első oldalra. A szándék az volt, hogy elkerüljék a duplikált kategóriaoldalakat.

A probléma az, hogy a lapozott oldalak nem duplikátumok. Más elemeket tartalmaznak, és segítenek a crawlereknek mélyebb tartalmakat felfedezni. Ha mindet az első oldalra canonicalizálod, csökkenhet az esélye annak, hogy a keresőmotorok teljesen feldolgozzák a későbbi oldalakat.

Általában a lapozott oldalaknak önmagukra mutató canonicalokkal kell rendelkezniük, hacsak nincs konkrét ok az összevonásra.

Szűrt oldalak canonicalizálása a keresési szándék ellenőrzése nélkül

A facettás navigáció nehéz döntéseket teremt. Egyes szűrt URL-ek értéktelenek:

  • ?sort=price_ascending
  • ?view=grid
  • ?sessionid=123

Mások értékes landoló oldalak lehetnek:

  • /sofas/blue/
  • /laptops/16gb-ram/
  • /hotels/paris/pet-friendly/

Az általános canonical-szabályok gyakran hasznos keresési oldalakat is eltüntetnek a haszontalan paraméterzajjal együtt. Mielőtt szűrt oldalakat canonicalizálsz, kérdezd meg, hogy a szűrt oldalnak van-e stabil tartalma, belső linkjei, keresési kereslete és elkülönülő felhasználói igénye.

Ha a válasz igen, lehet, hogy megérdemli, hogy indexelhető legyen önmagára mutató canonicallel.

Canonicalok átirányított vagy blokkolt URL-ekre mutatnak

A canonical célpontnak tisztának, indexelhetőnek kell lennie, és 200 OK választ kell visszaadnia. Ne mutassanak canonicalok olyan URL-ekre, amelyek átirányítanak, hibát adnak vissza, sütiket igényelnek, robots.txt által blokkoltak, vagy noindex értéket hordoznak.

Ez az egyik legkönnyebben automatizálható ellenőrzés. Crawleld a webhelyedet, és jelöld meg azokat a canonical célpontokat, amelyek nem adnak vissza tiszta 200-as választ.

A canonical és a noindex keverése, mintha ugyanazt jelentenék

A rel="canonical" és a noindex különböző problémákat old meg.

Használj canonicalt, ha duplikátumok léteznek, és a jeleket egy előnyben részesített URL-re szeretnéd összevonni. Használj noindex értéket, ha egyáltalán nem szeretnéd, hogy egy oldal indexelve legyen.

A kettő együttes használata ügyetlen üzenetet küld: „Ne indexeld ezt az oldalt, de használd duplikált jelként egy másik oldalhoz.” A keresőmotorok gyakran meg tudják kerülni ezt, de nem tiszta utasítás. Ha egy oldal duplikátum, canonicalizáld. Ha nem kell megjelennie a keresésben, és nincs hasznos duplikált kapcsolata, fontold meg a noindex használatát.

Gyakorlati canonical-audit

Nem kell nagy SEO-platform ahhoz, hogy sok canonical-problémát megtalálj. Kezdd egy crawlal, néhány URL-mintával és egy táblázattal.

Minden fontos sablonnál ellenőrizd:

  1. Pontosan egy canonical tag van az oldalon? Több canonical tag kétértelműséget okoz.
  2. Abszolút a canonical? Használd a teljes URL-t, protokollal és hosztnévvel együtt.
  3. A canonical célpont 200 OK választ ad vissza? Kerüld az átirányított, blokkolt vagy hibázó célpontokat.
  4. Indexelhető a canonical célpont? Nincs noindex, nincs robots-blokk, nincs hitelesítési követelmény.
  5. A tartalom valóban egyenértékű? A hasonló nem mindig egyenértékű.
  6. A belső linkek egyetértenek? Ahol csak lehet, a canonical URL-formátumra linkelj.
  7. A sitemap egyetért? A sitemapeknek általában canonical, indexelhető URL-eket kell listázniuk.
  8. A hreflang tagek egyetértenek? A nemzetközi oldalaknak következetes canonical- és hreflang-kapcsolatokra van szükségük.
  9. A renderelt HTML megegyezik a nyers HTML-lel? A JavaScript módosíthat vagy beszúrhat tageket.
  10. Melyik canonicalt választotta a keresőmotor? Az ellenőrző eszközök megmutathatják, amikor a deklarált canonical eltér a kiválasztott canonicaltól.

Itt a Lighthouse is hasznos lehet, de csak a korlátain belül. Jelezhet bizonyos crawlolhatósági és dokumentumproblémákat, de nem érti a kereskedelmi szándékodat vagy a canonical-stratégiádat. Kezeld egy bemenetként, ne ítéletként. Ha nyugodtabb módra van szükséged a hasznos megállapítások és a zaj szétválasztásához, nézd meg, hogyan olvass Lighthouse riportot pánik nélkül.

Az önmagukra mutató canonicalok általában jó alapértelmezések

Minden fontos indexelhető oldalnak általában önmagát kell canonicalként deklarálnia. Nem azért, mert a keresőmotorok a tag nélkül nem tudnák kitalálni. Hanem azért, mert az önmagukra mutató canonicalok csökkentik a kétértelműséget, amikor paraméterek, követési linkek, másolt URL-ek és CMS-furcsaságok alternatív útvonalakat hoznak létre ugyanahhoz a tartalomhoz.

Egy tiszta termékoldalnál ez általában helyes:

<link rel="canonical" href="https://example.com/products/linen-shirt/">

Egy követési URL esetén a canonicalnak általában vissza kell mutatnia a tiszta verzióra:

<link rel="canonical" href="https://example.com/products/linen-shirt/">

Egy valóban eltérő termékváltozatnál a válasz attól függ. Ha a piros ing, a kék ing és a fekete ing leírása azonos, és csak a szín változik, elég lehet egy canonical termékoldal. Ha minden változatnak külön kereslete, értékelései, képei, készlete és belső linkjei vannak, külön indexelhető oldalaknak lehet értelme.

Nincs univerzális canonical-szabály a változatokra. Csak ez a kérdés van: felcserélhetők ezek az oldalak egy kereső felhasználó számára?

A canonical tageknek illeszkedniük kell a webhely tényleges URL-politikájához

A legtöbb canonical-hiba egy mélyebb URL-politikai probléma tünete. A webhely nem döntötte el, számítanak-e a záró perjelek, fel kell-e oldódniuk a nagybetűs URL-eknek, engedélyezettek-e a paraméterek, az HTTP átirányít-e HTTPS-re, vagy a www a canonical.

Válassz minden URL-ből egy tiszta verziót, és értesd egyet az egész rendszert:

  • Irányítsd át a nem preferált URL-verziókat a preferált verziókra.
  • Belsőleg a preferált verziókra linkelj.
  • A preferált verziókat tedd az XML sitemapekbe.
  • Használj önmagukra mutató canonicalokat a preferált oldalakon.
  • Csak a valódi duplikátumokat canonicalizáld a preferált URL-re.

Amikor ezek a jelek mind ugyanabba az irányba mutatnak, a canonical tagek unalmassá válnak. Ez a cél.

A lényeg

A canonical tagek azért erősek, mert befolyásolják az indexelést és a jelek összevonását. Ugyanezért veszélyesek is.

Egy rossz canonical nem mindig távolít el egy oldalt a keresésből. A keresőmotorok figyelmen kívül hagyhatják. De nem stratégia arra támaszkodni, hogy a keresőmotorok majd megmentik a rossz jeleket. A biztonságosabb megközelítés az, ha a canonicalizálást valódi duplikátumokra tartod fenn, a célpontokat tisztán és indexelhetően tartod, és a belső linkekkel, átirányításokkal, sitemapekkel és canonicalokkal ugyanazt a történetet mondatod el.

A canonicalok nem arra valók, hogy elrejtsd mögéjük a rendezetlen architektúrát. Arra valók, hogy megerősítsd: már rendbe lett téve.

Gyakran ismételt kérdések

Egy rossz canonical tag deindexelhet egy oldalt?
Igen, közvetetten. A canonical nem úgy távolít el egy oldalt, mint a noindex, de azt jelezheti a keresőmotoroknak, hogy egy másik URL az előnyben részesített verzió. Ha elfogadják ezt a jelzést, a nem canonical oldal lehet, hogy nem lesz külön indexelve.
A canonicalizálás megoldás a duplikált tartalom miatti büntetésre?
Nem egészen. A duplikált tartalom általában klaszterezési és kiválasztási probléma, nem büntetés. A canonical tagek segítenek a keresőmotoroknak kiválasztani az előnyben részesített URL-t és összevonni a jeleket, de nem javítják ki a gyenge tartalmat vagy a rossz webhelystruktúrát.
Minden oldalnak legyen önmagára mutató canonicalja?
A legtöbb fontos indexelhető oldalnak igen. Az önmagára mutató canonical segít megerősíteni az előnyben részesített URL-t, különösen akkor, ha követési paraméterek, alternatív útvonalak vagy CMS által generált URL-ek léteznek.
Canonicalizálhatom a lapozott oldalakat az első oldalra?
Általában nem. A lapozott oldalak gyakran eltérő elemeket tartalmaznak, és segítik a felfedezést. A legtöbb esetben minden lapozott URL-nek önmagára mutató canonicallel kell rendelkeznie, hacsak az oldalak nem valóban duplikáltak.
Mi a különbség a canonical és a noindex között?
A canonical azt mondja: „ez az oldal duplikált vagy alternatív verzió; részesítsd előnyben ezt a másik URL-t.” A noindex azt mondja: „ne jelenítsd meg ezt az oldalt a keresési találatokban.” Különböző problémákat oldanak meg, és nem szabad őket felcserélhetően használni.

Források és további olvasmányok

  1. Google Search Central: How to specify a canonical URL
  2. Google Search Central: Canonicalization and duplicate URLs
  3. RFC 6596: The Canonical Link Relation
  4. Bing Webmaster Guidelines
A szerzőről
The Wux Webtools Team

Utolsó frissítés:

Tovább olvasom