SEO & Discoverability

Mitä canonical-tagit tekevät, kun ne menevät väärin

Canonical-tagit ovat hyödyllisiä, mutta eivät harmittomia. Huono canonical voi piilottaa sivun, jonka halusit sijoittuvan, yhdistää signaalit väärään URL-osoitteeseen ja tehdä indeksoinnin vianhausta paljon vaikeampaa kuin sen pitäisi olla.

The Wux Webtools Team The Wux Webtools Team 9 min lukemista Tekoälyavusteinen, ihmisen tarkistama
Overlapping web pages with one preferred canonical page highlighted and warning markers on incorrect duplicates.
Sisällysluettelo
  1. Canonical-tagi ei ole päällekkäisen sisällön pyyhekumi
  2. Mitä tapahtuu, kun canonical osoittaa väärään URL-osoitteeseen
  3. 1. Väärä URL-osoite indeksoidaan
  4. 2. Sijoitussignaalit yhdistyvät väärään paikkaan
  5. 3. Hakukoneet sivuuttavat tagin
  6. 4. Vianhausta tulee tarpeettoman vaikeaa
  7. Kalleimmat canonical-virheet
  8. Kaiken canonicalisointi etusivulle
  9. Sivutettujen sivujen canonicalisointi sivulle yksi
  10. Suodatettujen sivujen canonicalisointi tarkistamatta hakuintentiota
  11. Canonicalien osoittaminen uudelleenohjattuihin tai estettyihin URL-osoitteisiin
  12. Canonicalin ja noindexin sekoittaminen kuin ne tarkoittaisivat samaa
  13. Käytännöllinen canonical-auditointi
  14. Itseensä viittaavat canonicalit ovat yleensä hyvä oletus
  15. Canonical-tagien pitäisi vastata sivustosi todellista URL-käytäntöä
  16. Lopputulos

Canonical-tagi ei ole päällekkäisen sisällön pyyhekumi

Canonical-tagi kertoo hakukoneille, mitä URL-osoitetta pidät ensisijaisena, kun useassa URL-osoitteessa on samaa tai olennaisesti samankaltaista sisältöä. Tavallinen HTML-versio näyttää tältä:

<link rel="canonical" href="https://example.com/preferred-page/">

Siitä on olemassa myös HTTP header -versio, joka on hyödyllinen lähinnä muille kuin HTML-tiedostoille, kuten PDF:ille:

Link: <https://example.com/preferred-file.pdf>; rel="canonical"

Se kuulostaa riittävän yksinkertaiselta. Ongelmat alkavat, kun tiimit käsittelevät canonical-tageja turvallisena tapana siistiä mitä tahansa hankalaa: fasettinavigaatiota, seurantaparametreja, tulostussivuja, lähes päällekkäisiä tuotesivuja, sivutusta, staging-URL-osoitteita ja vanhoja kampanjasivuja.

Canonical-tagit eivät ole poistopainike. Ne eivät ole uudelleenohjaus. Ne eivät korvaa informaatioarkkitehtuuria. Eikä ole taattua, että niitä noudatetaan.

Hakukoneet käyttävät canonical-tageja vahvoina vihjeinä. Ne vertaavat canonical-tagia muihin signaaleihin: uudelleenohjauksiin, sisäisiin linkkeihin, sivustokartan URL-osoitteisiin, hreflang-merkintöihin, sisällön samankaltaisuuteen, HTTP-tilakoodeihin sekä niihin URL-osoitteisiin, joihin käyttäjät ja crawlerit todella törmäävät. Jos nämä signaalit ovat ristiriidassa, hakukone voi sivuuttaa canonicalisi tai valita kokonaan toisen canonical-URL-osoitteen.

Siksi väärin tehdyt canonicalit voivat olla niin hämmentäviä. Merkintä näyttää selaimessa oikealta, mutta hakutuloksissa näkyy väärä sivu — tai oikea sivu katoaa.

Mitä tapahtuu, kun canonical osoittaa väärään URL-osoitteeseen

Kun hakukone näkee päällekkäisiä tai lähes päällekkäisiä URL-osoitteita, se yleensä ryhmittelee ne klusteriksi ja valitsee yhden URL-osoitteen canonicaliksi. Valittu canonical on se versio, joka todennäköisimmin indeksoidaan ja näytetään hakutuloksissa. Päällekkäisten versioiden signaalit voidaan yhdistää tähän valittuun URL-osoitteeseen.

Jos canonical-tagisi osoittaa väärälle sivulle, voi tapahtua useita asioita.

1. Väärä URL-osoite indeksoidaan

Oletetaan, että sinulla on kaksi URL-osoitetta:

  • /mens-running-shoes/
  • /sale/mens-running-shoes/

Jos alennussivu canonicalisoi pääkategoriasivulle, se voi olla hyvä ratkaisu, jos sisältö on lähes identtistä ja alennus-URL on vain suodatettu versio. Mutta jos alennussivulla on omaa tekstiä, omia tuotteita ja omaa hakukysyntää, canonical voi tukahduttaa sen.

Sivua saatetaan silti crawlata. Se voi yhä olla käyttäjien saatavilla. Mutta hakukoneet voivat päättää olla indeksoimatta sitä erikseen, koska kerroit niille toisen URL-osoitteen olevan ensisijainen versio.

Tämä on yleisin canonical-virhe: ei dramaattinen tekninen käyttökatko, vaan hiljainen katoaminen indeksistä.

2. Sijoitussignaalit yhdistyvät väärään paikkaan

Canonicaleja käytetään usein signaalien, kuten linkkien ja päällekkäisten sisältövarianttien, yhdistämiseen. Se on hyödyllistä, kun päällekkäiset versiot ovat aidosti vastaavia. Se on riskialtista, kun ne eivät ole.

Jos blogiartikkelilla on seurantaan käytettäviä URL-osoitteita, kuten:

  • /guide-to-canonical-tags/?utm_source=newsletter
  • /guide-to-canonical-tags/?utm_source=linkedin

Silloin molempien canonicalisointi osoitteeseen /guide-to-canonical-tags/ on järkevää.

Mutta jos espanjankielinen versio, lisäsisältöä sisältävä tulostettava versio tai eri intentioon vastaava tuotevariantti osoittaa samaan canonicaliin, saatat yhdistää signaaleja, joiden pitäisi pysyä erillään. Tuloksena voi olla heikompi relevanssi kaikille niistä.

Canonical-tagit koskevat vastaavuutta. Jos kaksi sivua täyttää eri hakuintentioita, niiden ei todennäköisesti pitäisi canonicalisoida toisiinsa.

3. Hakukoneet sivuuttavat tagin

Canonical ei ole käsky. Jos canonical-kohde uudelleenohjaa, palauttaa 404:n, on estetty, sisältää noindex-merkinnän tai sisältää hyvin erilaista sisältöä, hakukoneet voivat sivuuttaa sen.

Tämä on yhdessä mielessä hyvä asia: huono canonical ei aina tuhoa indeksointia. Mutta se tarkoittaa myös, ettet voi olettaa tagin tekevän sitä, mitä luulet. Sivu voi ilmoittaa yhden canonicalin samalla kun Google valitsee toisen.

Tämä on erityisen yleistä, kun sisäiset linkit, sivustokartat ja canonicalit ovat eri mieltä. Jos jokainen sisäinen linkki osoittaa osoitteeseen /product, sivustokarttasi listaa osoitteen /product/ ja canonicalisi osoittaa osoitteeseen https://www.example.com/product?ref=main, olet luonut pienen väittelyn omien signaaliesi välille.

Hakukoneet ovat hyviä ratkaisemaan tuon väittelyn. Ne eivät aina ratkaise sitä tarkoittamallasi tavalla.

4. Vianhausta tulee tarpeettoman vaikeaa

Huonot canonicalit epäonnistuvat harvoin äänekkäästi. Ne tuottavat oireita, jotka näyttävät muilta SEO-ongelmilta:

  • “Löydetty, ei tällä hetkellä indeksoitu” tai vastaava indeksoinnin välitila
  • Väärä URL-osoite sijoittuu hakukyselyllä
  • Parametri-URL-osoitteita näkyy raporteissa
  • Kategoriasivut eivät näy, vaikka ne ovat crawlattavissa
  • Kansainväliset sivut taittuvat väärään kieliversioon
  • Uudet sivupohjat julkaistaan niin, että indeksoituja sivuja on odotettua vähemmän

Siksi canonical-vianhaun pitäisi sisältää raaka HTML, renderöity HTML, HTTP-headerit, uudelleenohjaukset ja sivustokartan merkinnät. Jos tutkit jo uudelleenohjausketjuja tai yhteensopimattomia headereita, samat tavat pätevät; käytännöllinen HTTP-tarkastuksen työnkulku, kuten oppaassamme tuotannon uudelleenohjausten ja HTTP-headereiden vianhakuun, löytää canonical-ristiriidat yleensä nopeammin kuin CMS-kentän tuijottaminen.

Kalleimmat canonical-virheet

Kaiken canonicalisointi etusivulle

Tätä tapahtuu yhä. Sivupohjan kenttä jää tyhjäksi, plugin palaa oletuksena sivuston juureen, ja yhtäkkiä sadat sivut ilmoittavat etusivun canonicaliksi.

Hakukoneet voivat sivuuttaa tämän, koska sisältö on selvästi erilaista. Mutta jos riittävän moni signaali on sekava, jotkin sivut voidaan pudottaa tai klusteroida väärin. Vähintäänkin lähetät hyödyttömän ja ristiriitaisen vihjeen jokaisella sivulla.

Etusivu ei juuri koskaan ole sisäisen sivun canonical.

Sivutettujen sivujen canonicalisointi sivulle yksi

Pitkään jotkin sivustot canonicalisoivat osoitteet /category/page/2/, /page/3/ ja niin edelleen takaisin ensimmäiselle sivulle. Tarkoituksena oli välttää päällekkäiset kategoriasivut.

Ongelma on, että sivutetut sivut eivät ole päällekkäisiä. Ne sisältävät eri kohteita ja auttavat crawlereita löytämään syvempää sisältöä. Niiden kaikkien canonicalisointi ensimmäiselle sivulle voi vähentää todennäköisyyttä, että hakukoneet käsittelevät myöhemmät sivut kunnolla.

Yleensä sivutetuilla sivuilla pitäisi olla itseensä viittaavat canonicalit, ellei yhdistämiselle ole erityistä syytä.

Suodatettujen sivujen canonicalisointi tarkistamatta hakuintentiota

Fasettinavigaatio luo vaikeita valintoja. Osa suodatetuista URL-osoitteista on roskaa:

  • ?sort=price_ascending
  • ?view=grid
  • ?sessionid=123

Toiset voivat olla arvokkaita laskeutumissivuja:

  • /sofas/blue/
  • /laptops/16gb-ram/
  • /hotels/paris/pet-friendly/

Laajat canonical-säännöt pyyhkivät usein hyödyllisiä hakusivuja pois samalla kun ne poistavat hyödytöntä parametrikohinaa. Ennen kuin canonicalisoit suodatettuja sivuja, kysy, onko suodatetulla sivulla vakaata sisältöä, sisäisiä linkkejä, hakukysyntää ja erillinen käyttäjätarve.

Jos vastaus on kyllä, se voi ansaita indeksoitavuuden itseensä viittaavalla canonicalilla.

Canonicalien osoittaminen uudelleenohjattuihin tai estettyihin URL-osoitteisiin

Canonical-kohteen pitäisi olla siisti, indeksoitava ja palauttaa 200 OK. Älä osoita canonicaleja URL-osoitteisiin, jotka uudelleenohjaavat, palauttavat virheitä, vaativat evästeitä, ovat robots.txt-tiedoston estämiä tai sisältävät noindex-merkinnän.

Tämä on yksi helpoimmista tarkistuksista automatisoida. Crawlaa sivustosi ja merkitse canonical-kohteet, jotka eivät palauta puhdasta 200-vastausta.

Canonicalin ja noindexin sekoittaminen kuin ne tarkoittaisivat samaa

rel="canonical" ja noindex ratkaisevat eri ongelmia.

Käytä canonicalia, kun on olemassa päällekkäisiä versioita ja haluat signaalien yhdistyvän ensisijaiseen URL-osoitteeseen. Käytä noindex-merkintää, kun et halua sivua indeksoitavan lainkaan.

Molempien käyttäminen yhdessä lähettää kömpelön viestin: “Älä indeksoi tätä sivua, mutta käytä sitä myös päällekkäisyyssignaalina toiselle sivulle.” Hakukoneet osaavat usein kiertää tämän, mutta se ei ole selkeä ohje. Jos sivu on päällekkäinen, canonicalisoi se. Jos sen ei pitäisi näkyä haussa eikä sillä ole hyödyllistä päällekkäisyyssuhdetta, harkitse noindex-merkintää.

Käytännöllinen canonical-auditointi

Et tarvitse suurta SEO-alustaa löytääksesi monia canonical-ongelmia. Aloita crawlauksella, muutamalla URL-näytteellä ja taulukkolaskentaohjelmalla.

Tarkista jokaisesta tärkeästä sivupohjasta:

  1. Onko sivulla täsmälleen yksi canonical-tagi? Useat canonical-tagit luovat epäselvyyttä.
  2. Onko canonical absoluuttinen? Käytä koko URL-osoitetta, mukaan lukien protokolla ja isäntänimi.
  3. Palauttaako canonical-kohde 200 OK? Vältä uudelleenohjattuja, estettyjä tai virhettä palauttavia kohteita.
  4. Onko canonical-kohde indeksoitava? Ei noindex-merkintää, ei robots-estettä, ei kirjautumisvaatimusta.
  5. Onko sisältö aidosti vastaavaa? Samankaltainen ei aina ole vastaava.
  6. Ovatko sisäiset linkit samaa mieltä? Linkitä canonical-URL-muotoon aina kun mahdollista.
  7. Onko sivustokartta samaa mieltä? Sivustokartoissa pitäisi yleensä listata canonical- ja indeksoitavat URL-osoitteet.
  8. Ovatko hreflang-tagit samaa mieltä? Kansainväliset sivut tarvitsevat johdonmukaiset canonical- ja hreflang-suhteet.
  9. Vastaako renderöity HTML raakaa HTML:ää? JavaScript voi muuttaa tai lisätä tageja.
  10. Minkä canonicalin hakukone valitsi? Tarkastustyökalut voivat paljastaa, milloin ilmoittamasi canonical poikkeaa valitusta canonicalista.

Tässä myös Lighthouse voi olla hyödyllinen, mutta vain omissa rajoissaan. Se voi merkitä joitakin crawlattavuuteen ja dokumenttiin liittyviä ongelmia, mutta se ei ymmärrä kaupallista intentiotasi tai canonical-strategiaasi. Käsittele sitä yhtenä syötteenä, älä tuomiona. Jos tarvitset rauhallisemman tavan erottaa hyödylliset havainnot kohinasta, katso, miten Lighthouse-raporttia luetaan panikoimatta.

Itseensä viittaavat canonicalit ovat yleensä hyvä oletus

Jokaisen tärkeän indeksoitavan sivun pitäisi yleensä ilmoittaa itsensä canonicaliksi. Ei siksi, etteivät hakukoneet voisi päätellä sitä ilman tagia. Vaan siksi, että itseensä viittaavat canonicalit vähentävät epäselvyyttä, kun parametrit, seurantalingit, kopioidut URL-osoitteet ja CMS:n erikoisuudet luovat vaihtoehtoisia polkuja samaan sisältöön.

Siistille tuotesivulle tämä on yleensä oikein:

<link rel="canonical" href="https://example.com/products/linen-shirt/">

Seuranta-URL-osoitteessa canonicalin pitäisi yleensä osoittaa takaisin siistiin versioon:

<link rel="canonical" href="https://example.com/products/linen-shirt/">

Aidosti erilaisen tuotevariantin kohdalla vastaus riippuu tilanteesta. Jos punaisella paidalla, sinisellä paidalla ja mustalla paidalla on sama kuvaus ja vain väri vaihtuu, yksi canonical-tuotesivu voi riittää. Jos jokaisella variantilla on erillistä kysyntää, arvosteluja, kuvia, varastosaatavuutta ja sisäisiä linkkejä, erilliset indeksoitavat sivut voivat olla järkeviä.

Variantteihin ei ole yleispätevää canonical-sääntöä. On vain kysymys: ovatko nämä sivut hakijalle keskenään vaihdettavissa?

Canonical-tagien pitäisi vastata sivustosi todellista URL-käytäntöä

Useimmat canonical-bugit ovat oire syvemmästä URL-käytäntöjen ongelmasta. Sivusto ei ole päättänyt, onko lopun vinoviivalla merkitystä, pitäisikö isoin kirjaimin kirjoitettujen URL-osoitteiden toimia, sallitaanko parametrit, uudelleenohjataanko HTTP HTTPS:ään tai onko www canonical.

Valitse kustakin URL-osoitteesta yksi siisti versio ja saa koko järjestelmä tukemaan sitä:

  • Uudelleenohjaa ei-ensisijaiset URL-versiot ensisijaisiin versioihin.
  • Linkitä sisäisesti ensisijaisiin versioihin.
  • Laita ensisijaiset versiot XML-sivustokarttoihin.
  • Käytä ensisijaisilla sivuilla itseensä viittaavia canonicaleja.
  • Canonicalisoi vain aidot duplikaatit ensisijaiseen URL-osoitteeseen.

Kun kaikki nämä signaalit osoittavat samaan suuntaan, canonical-tageista tulee tylsiä. Se on tavoite.

Lopputulos

Canonical-tagit ovat voimakkaita, koska ne vaikuttavat indeksointiin ja signaalien yhdistämiseen. Ne ovat vaarallisia samasta syystä.

Väärä canonical ei aina poista sivua hausta. Hakukoneet voivat sivuuttaa sen. Mutta hakukoneisiin luottaminen huonojen signaalien pelastajana ei ole strategia. Turvallisempi tapa on varata canonicalisointi aidoille duplikaateille, pitää kohteet siisteinä ja indeksoitavina sekä varmistaa, että sisäiset linkit, uudelleenohjaukset, sivustokartat ja canonicalit kertovat samaa tarinaa.

Canonicalit eivät ole paikka, johon piilotetaan sotkuinen arkkitehtuuri. Ne ovat paikka, jossa vahvistetaan, että se on siivottu.

Usein kysytyt kysymykset

Voiko huono canonical-tagi poistaa sivun indeksistä?
Kyllä, epäsuorasti. Canonical ei poista sivua samalla tavalla kuin noindex voi, mutta se voi kertoa hakukoneille, että toinen URL-osoite on ensisijainen versio. Jos ne hyväksyvät vihjeen, ei-canonical-sivua ei välttämättä indeksoida erikseen.
Onko canonicalisointi ratkaisu päällekkäisen sisällön rangaistukseen?
Ei aivan. Päällekkäinen sisältö on yleensä klusterointi- ja valintaongelma, ei rangaistus. Canonical-tagit auttavat hakukoneita valitsemaan ensisijaisen URL-osoitteen ja yhdistämään signaaleja, mutta ne eivät korjaa heikkoa sisältöä tai huonoa sivustorakennetta.
Pitäisikö jokaisella sivulla olla itseensä viittaava canonical?
Useimmilla tärkeillä indeksoitavilla sivuilla pitäisi. Itseensä viittaava canonical auttaa vahvistamaan ensisijaisen URL-osoitteen, erityisesti kun olemassa on seurantaparametreja, vaihtoehtoisia polkuja tai CMS:n luomia URL-osoitteita.
Voinko canonicalisoida sivutetut sivut ensimmäiselle sivulle?
Yleensä et. Sivutetut sivut sisältävät usein eri kohteita ja auttavat löytämisessä. Useimmissa tapauksissa jokaisella sivutetulla URL-osoitteella pitäisi olla itseensä viittaava canonical, elleivät sivut ole aidosti päällekkäisiä.
Mitä eroa on canonicalilla ja noindexillä?
Canonical sanoo: “tämä sivu on duplikaatti tai vaihtoehtoinen versio; suosi tätä toista URL-osoitetta.” Noindex sanoo: “älä näytä tätä sivua hakutuloksissa.” Ne ratkaisevat eri ongelmia, eikä niitä pitäisi käyttää keskenään vaihtokelpoisesti.

Lähteet ja lisälukeminen

  1. Google Search Central: How to specify a canonical URL
  2. Google Search Central: Canonicalization and duplicate URLs
  3. RFC 6596: The Canonical Link Relation
  4. Bing Webmaster Guidelines
Tietoja kirjoittajasta
The Wux Webtools Team

Viimeksi päivitetty:

Jatka lukemista