Mit csinálnak a canonical tagek, ha rosszul használod őket
A canonical tagek hasznosak, de nem ártalmatlanok. Egy rossz canonical elrejtheti azt az oldalt, amelyet rangsorolni szerettél volna, a jeleket rossz URL-be vonhatja össze, és a kelleténél jóval nehezebbé teheti az indexelési hibakeresést.
Tartalomjegyzék
- A canonical tag nem a duplikált tartalom radírja
- Mi történik, ha egy canonical rossz URL-re mutat
- 1. A rossz URL kerül indexelésre
- 2. A rangsorolási jelek rossz helyre vonódnak össze
- 3. A keresőmotorok figyelmen kívül hagyják a taget
- 4. A hibakeresés szükségtelenül nehézzé válik
- A legdrágább canonical-hibák
- Minden canonicalizálása a kezdőlapra
- Lapozott oldalak canonicalizálása az első oldalra
- Szűrt oldalak canonicalizálása a keresési szándék ellenőrzése nélkül
- Canonicalok átirányított vagy blokkolt URL-ekre mutatnak
- A canonical és a noindex keverése, mintha ugyanazt jelentenék
- Gyakorlati canonical-audit
- Az önmagukra mutató canonicalok általában jó alapértelmezések
- A canonical tageknek illeszkedniük kell a webhely tényleges URL-politikájához
- A lényeg
A canonical tag nem a duplikált tartalom radírja
A canonical tag azt mondja meg a keresőmotoroknak, melyik URL-t részesíted előnyben, amikor több URL ugyanazt vagy lényegében hasonló tartalmat tartalmaz. A gyakori HTML-változat így néz ki:
<link rel="canonical" href="https://example.com/preferred-page/">
Létezik HTTP header-változat is, amely főleg nem HTML-fájloknál, például PDF-eknél hasznos:
Link: <https://example.com/preferred-file.pdf>; rel="canonical"
Ez elég egyszerűnek hangzik. A gond akkor kezdődik, amikor a csapatok a canonical tageket biztonságos rendrakó eszköznek tekintik minden kényelmetlen helyzetre: facettás navigációra, követési paraméterekre, nyomtatási oldalakra, majdnem duplikált termékoldalakra, lapozásra, staging URL-ekre és régi kampányoldalakra.
A canonical tag nem törlés gomb. Nem átirányítás. Nem helyettesíti az információs architektúrát. És nincs garancia arra, hogy be is tartják.
A keresőmotorok a canonicalokat erős jelzésként használják. Összevetik a canonical taget más jelekkel: átirányításokkal, belső linkekkel, sitemap URL-ekkel, hreflang annotációkkal, tartalmi hasonlósággal, HTTP státuszkódokkal, valamint azokkal az URL-ekkel, amelyekkel a felhasználók és a crawlerek ténylegesen találkoznak. Ha ezek a jelek ellentmondanak egymásnak, a keresőmotor figyelmen kívül hagyhatja a canonicalt, vagy akár teljesen más canonical URL-t választhat.
Ezért lehet olyan zavaros, amikor a canonicalok rosszul vannak beállítva. A jelölés helyesnek tűnik a böngészőben, mégis a rossz oldal jelenik meg a keresési találatokban — vagy a megfelelő oldal eltűnik.
Mi történik, ha egy canonical rossz URL-re mutat
Amikor egy keresőmotor duplikált vagy majdnem duplikált URL-eket lát, általában klaszterbe rendezi őket, és kiválaszt egy URL-t canonicalként. A kiválasztott canonical az a verzió, amelyet a legnagyobb eséllyel indexelnek és jelenítenek meg a keresési találatokban. A duplikátumokból származó jelek ebbe a kiválasztott URL-be vonódhatnak össze.
Ha a canonical taged rossz oldalra mutat, több dolog is történhet.
1. A rossz URL kerül indexelésre
Tegyük fel, hogy két URL-ed van:
/mens-running-shoes//sale/mens-running-shoes/
Ha az akciós oldal canonicalja a fő kategóriaoldalra mutat, ez rendben lehet, ha a tartalom majdnem azonos, és az akciós URL csak egy szűrt változat. De ha az akciós oldalnak egyedi szövege, egyedi termékei és saját keresési kereslete van, a canonical elnyomhatja.
Az oldalt ettől még feltérképezhetik. A felhasználók számára ettől még elérhető lehet. A keresőmotorok azonban dönthetnek úgy, hogy nem indexelik külön, mert azt mondtad nekik, hogy egy másik URL az előnyben részesített verzió.
Ez a leggyakoribb canonical-hiba: nem látványos technikai leállás, csak csendes eltűnés az indexből.
2. A rangsorolási jelek rossz helyre vonódnak össze
A canonicalokat gyakran használják jelek, például linkek és duplikált tartalomváltozatok összevonására. Ez akkor hasznos, ha a duplikátumok valóban egyenértékűek. Kockázatos, ha nem azok.
Ha egy blogcikknek ilyen követési URL-jei vannak:
/guide-to-canonical-tags/?utm_source=newsletter/guide-to-canonical-tags/?utm_source=linkedin
Akkor ésszerű mindkettőt a /guide-to-canonical-tags/ URL-re canonicalizálni.
De ha egy spanyol verzió, egy extra tartalommal rendelkező nyomtatható verzió vagy egy eltérő szándékú termékváltozat ugyanarra a canonicalra mutat, olyan jeleket vonhatsz össze, amelyeknek külön kellene maradniuk. Az eredmény mindegyiknél gyengébb relevancia lehet.
A canonical tagek az egyenértékűségről szólnak. Ha két oldal eltérő keresési szándékot elégít ki, valószínűleg nem kellene egymásra canonicalizálni őket.
3. A keresőmotorok figyelmen kívül hagyják a taget
A canonical nem parancs. Ha a canonical célpont átirányít, 404-et ad vissza, blokkolva van, noindex értéket tartalmaz, vagy nagyon eltérő tartalom van rajta, a keresőmotorok figyelmen kívül hagyhatják.
Ez bizonyos értelemben jó: egy rossz canonical nem mindig rombolja le az indexelést. De azt is jelenti, hogy nem feltételezheted, hogy a tag azt teszi, amit gondolsz. Egy oldal deklarálhat egy canonicalt, miközben a Google egy másikat választ.
Ez különösen gyakori, amikor a belső linkek, a sitemapek és a canonicalok nem értenek egyet. Ha minden belső link a /product URL-re mutat, a sitemap a /product/ URL-t listázza, a canonical pedig a https://www.example.com/product?ref=main címre mutat, kis vitát hoztál létre a saját jeleid között.
A keresőmotorok jól oldják fel ezt a vitát. Nem mindig úgy oldják fel, ahogy te szeretted volna.
4. A hibakeresés szükségtelenül nehézzé válik
A rossz canonicalok ritkán hibáznak hangosan. Olyan tüneteket produkálnak, amelyek más SEO-problémáknak tűnnek:
- „Felfedezve, jelenleg nincs indexelve” vagy hasonló indexelési bizonytalanság
- Rossz URL rangsorol egy lekérdezésre
- Paraméteres URL-ek jelennek meg a riportokban
- Kategóriaoldalak nem jelennek meg, annak ellenére, hogy crawlolhatók
- Nemzetközi oldalak rossz nyelvi verzióba olvadnak be
- Új sablonok a vártnál kevesebb indexelt oldallal indulnak
Ezért a canonical-hibakeresésnek tartalmaznia kell a nyers HTML-t, a renderelt HTML-t, a HTTP headereket, az átirányításokat és a sitemap bejegyzéseket. Ha már átirányítási láncokat vagy nem egyező headereket vizsgálsz, ugyanazok a szokások érvényesek; egy gyakorlatias HTTP-ellenőrzési munkafolyamat, mint amilyen az éles környezetben történő átirányítás- és HTTP header-hibakeresésről szóló útmutatónkban szerepel, általában gyorsabban megtalálja a canonical-ellentmondásokat, mint egy CMS-mező bámulása.
A legdrágább canonical-hibák
Minden canonicalizálása a kezdőlapra
Ez még mindig előfordul. Egy sablonmező üresen marad, egy plugin visszaesik a webhely gyökércímére, és hirtelen oldalak százai deklarálják a kezdőlapot canonicalként.
A keresőmotorok ezt figyelmen kívül hagyhatják, mert a tartalom nyilvánvalóan eltérő. De ha elég sok jel rendezetlen, néhány oldal kieshet vagy rosszul klasztereződhet. Legalábbis haszontalan és ellentmondásos jelzést küldesz minden oldalon.
A kezdőlap szinte soha nem canonicalja egy belső oldalnak.
Lapozott oldalak canonicalizálása az első oldalra
Sokáig egyes webhelyek a /category/page/2/, /page/3/ és hasonló oldalakat visszakanonizálták az első oldalra. A szándék az volt, hogy elkerüljék a duplikált kategóriaoldalakat.
A probléma az, hogy a lapozott oldalak nem duplikátumok. Más elemeket tartalmaznak, és segítenek a crawlereknek mélyebb tartalmakat felfedezni. Ha mindet az első oldalra canonicalizálod, csökkenhet az esélye annak, hogy a keresőmotorok teljesen feldolgozzák a későbbi oldalakat.
Általában a lapozott oldalaknak önmagukra mutató canonicalokkal kell rendelkezniük, hacsak nincs konkrét ok az összevonásra.
Szűrt oldalak canonicalizálása a keresési szándék ellenőrzése nélkül
A facettás navigáció nehéz döntéseket teremt. Egyes szűrt URL-ek értéktelenek:
?sort=price_ascending?view=grid?sessionid=123
Mások értékes landoló oldalak lehetnek:
/sofas/blue//laptops/16gb-ram//hotels/paris/pet-friendly/
Az általános canonical-szabályok gyakran hasznos keresési oldalakat is eltüntetnek a haszontalan paraméterzajjal együtt. Mielőtt szűrt oldalakat canonicalizálsz, kérdezd meg, hogy a szűrt oldalnak van-e stabil tartalma, belső linkjei, keresési kereslete és elkülönülő felhasználói igénye.
Ha a válasz igen, lehet, hogy megérdemli, hogy indexelhető legyen önmagára mutató canonicallel.
Canonicalok átirányított vagy blokkolt URL-ekre mutatnak
A canonical célpontnak tisztának, indexelhetőnek kell lennie, és 200 OK választ kell visszaadnia. Ne mutassanak canonicalok olyan URL-ekre, amelyek átirányítanak, hibát adnak vissza, sütiket igényelnek, robots.txt által blokkoltak, vagy noindex értéket hordoznak.
Ez az egyik legkönnyebben automatizálható ellenőrzés. Crawleld a webhelyedet, és jelöld meg azokat a canonical célpontokat, amelyek nem adnak vissza tiszta 200-as választ.
A canonical és a noindex keverése, mintha ugyanazt jelentenék
A rel="canonical" és a noindex különböző problémákat old meg.
Használj canonicalt, ha duplikátumok léteznek, és a jeleket egy előnyben részesített URL-re szeretnéd összevonni. Használj noindex értéket, ha egyáltalán nem szeretnéd, hogy egy oldal indexelve legyen.
A kettő együttes használata ügyetlen üzenetet küld: „Ne indexeld ezt az oldalt, de használd duplikált jelként egy másik oldalhoz.” A keresőmotorok gyakran meg tudják kerülni ezt, de nem tiszta utasítás. Ha egy oldal duplikátum, canonicalizáld. Ha nem kell megjelennie a keresésben, és nincs hasznos duplikált kapcsolata, fontold meg a noindex használatát.
Gyakorlati canonical-audit
Nem kell nagy SEO-platform ahhoz, hogy sok canonical-problémát megtalálj. Kezdd egy crawlal, néhány URL-mintával és egy táblázattal.
Minden fontos sablonnál ellenőrizd:
- Pontosan egy canonical tag van az oldalon? Több canonical tag kétértelműséget okoz.
- Abszolút a canonical? Használd a teljes URL-t, protokollal és hosztnévvel együtt.
- A canonical célpont
200 OKválaszt ad vissza? Kerüld az átirányított, blokkolt vagy hibázó célpontokat. - Indexelhető a canonical célpont? Nincs
noindex, nincs robots-blokk, nincs hitelesítési követelmény. - A tartalom valóban egyenértékű? A hasonló nem mindig egyenértékű.
- A belső linkek egyetértenek? Ahol csak lehet, a canonical URL-formátumra linkelj.
- A sitemap egyetért? A sitemapeknek általában canonical, indexelhető URL-eket kell listázniuk.
- A hreflang tagek egyetértenek? A nemzetközi oldalaknak következetes canonical- és hreflang-kapcsolatokra van szükségük.
- A renderelt HTML megegyezik a nyers HTML-lel? A JavaScript módosíthat vagy beszúrhat tageket.
- Melyik canonicalt választotta a keresőmotor? Az ellenőrző eszközök megmutathatják, amikor a deklarált canonical eltér a kiválasztott canonicaltól.
Itt a Lighthouse is hasznos lehet, de csak a korlátain belül. Jelezhet bizonyos crawlolhatósági és dokumentumproblémákat, de nem érti a kereskedelmi szándékodat vagy a canonical-stratégiádat. Kezeld egy bemenetként, ne ítéletként. Ha nyugodtabb módra van szükséged a hasznos megállapítások és a zaj szétválasztásához, nézd meg, hogyan olvass Lighthouse riportot pánik nélkül.
Az önmagukra mutató canonicalok általában jó alapértelmezések
Minden fontos indexelhető oldalnak általában önmagát kell canonicalként deklarálnia. Nem azért, mert a keresőmotorok a tag nélkül nem tudnák kitalálni. Hanem azért, mert az önmagukra mutató canonicalok csökkentik a kétértelműséget, amikor paraméterek, követési linkek, másolt URL-ek és CMS-furcsaságok alternatív útvonalakat hoznak létre ugyanahhoz a tartalomhoz.
Egy tiszta termékoldalnál ez általában helyes:
<link rel="canonical" href="https://example.com/products/linen-shirt/">
Egy követési URL esetén a canonicalnak általában vissza kell mutatnia a tiszta verzióra:
<link rel="canonical" href="https://example.com/products/linen-shirt/">
Egy valóban eltérő termékváltozatnál a válasz attól függ. Ha a piros ing, a kék ing és a fekete ing leírása azonos, és csak a szín változik, elég lehet egy canonical termékoldal. Ha minden változatnak külön kereslete, értékelései, képei, készlete és belső linkjei vannak, külön indexelhető oldalaknak lehet értelme.
Nincs univerzális canonical-szabály a változatokra. Csak ez a kérdés van: felcserélhetők ezek az oldalak egy kereső felhasználó számára?
A canonical tageknek illeszkedniük kell a webhely tényleges URL-politikájához
A legtöbb canonical-hiba egy mélyebb URL-politikai probléma tünete. A webhely nem döntötte el, számítanak-e a záró perjelek, fel kell-e oldódniuk a nagybetűs URL-eknek, engedélyezettek-e a paraméterek, az HTTP átirányít-e HTTPS-re, vagy a www a canonical.
Válassz minden URL-ből egy tiszta verziót, és értesd egyet az egész rendszert:
- Irányítsd át a nem preferált URL-verziókat a preferált verziókra.
- Belsőleg a preferált verziókra linkelj.
- A preferált verziókat tedd az XML sitemapekbe.
- Használj önmagukra mutató canonicalokat a preferált oldalakon.
- Csak a valódi duplikátumokat canonicalizáld a preferált URL-re.
Amikor ezek a jelek mind ugyanabba az irányba mutatnak, a canonical tagek unalmassá válnak. Ez a cél.
A lényeg
A canonical tagek azért erősek, mert befolyásolják az indexelést és a jelek összevonását. Ugyanezért veszélyesek is.
Egy rossz canonical nem mindig távolít el egy oldalt a keresésből. A keresőmotorok figyelmen kívül hagyhatják. De nem stratégia arra támaszkodni, hogy a keresőmotorok majd megmentik a rossz jeleket. A biztonságosabb megközelítés az, ha a canonicalizálást valódi duplikátumokra tartod fenn, a célpontokat tisztán és indexelhetően tartod, és a belső linkekkel, átirányításokkal, sitemapekkel és canonicalokkal ugyanazt a történetet mondatod el.
A canonicalok nem arra valók, hogy elrejtsd mögéjük a rendezetlen architektúrát. Arra valók, hogy megerősítsd: már rendbe lett téve.