SEO & Discoverability

Ce que font les balises canoniques quand vous vous trompez

Les balises canoniques sont utiles, mais elles ne sont pas sans risque. Une mauvaise canonique peut masquer la page que vous vouliez positionner, fusionner les signaux vers la mauvaise URL et rendre le débogage de l’indexation bien plus difficile qu’il ne

The Wux Webtools Team The Wux Webtools Team 12 min de lecture Assisté par l'IA, revu par des humains
Overlapping web pages with one preferred canonical page highlighted and warning markers on incorrect duplicates.
Table des matières
  1. La balise canonique n’efface pas le contenu dupliqué
  2. Ce qui se passe quand une canonique pointe vers la mauvaise URL
  3. 1. La mauvaise URL est indexée
  4. 2. Les signaux de classement se consolident au mauvais endroit
  5. 3. Les moteurs de recherche ignorent la balise
  6. 4. Le débogage devient inutilement difficile
  7. Les erreurs de canonique les plus coûteuses
  8. Canonicaliser tout vers la page d’accueil
  9. Canonicaliser les pages paginées vers la page un
  10. Canonicaliser des pages filtrées sans vérifier l’intention de recherche
  11. Pointer des canoniques vers des URL redirigées ou bloquées
  12. Mélanger canonique et noindex comme s’ils signifiaient la même chose
  13. Un audit canonique pratique
  14. Les canoniques autoréférentes sont généralement un bon réglage par défaut
  15. Les balises canoniques doivent correspondre à la politique d’URL réelle de votre site
  16. L’essentiel

La balise canonique n’efface pas le contenu dupliqué

Une balise canonique indique aux moteurs de recherche quelle URL vous préférez lorsque plusieurs URL contiennent le même contenu, ou un contenu très similaire. La version HTML courante ressemble à ceci :

<link rel="canonical" href="https://example.com/preferred-page/">

Il existe aussi une version sous forme d’en-tête HTTP, surtout utile pour les fichiers non HTML comme les PDF :

Link: <https://example.com/preferred-file.pdf>; rel="canonical"

Cela semble assez simple. Les problèmes commencent lorsque les équipes traitent les balises canoniques comme un moyen sûr de ranger tout ce qui est gênant : navigation à facettes, paramètres de suivi, pages imprimables, pages produit quasi dupliquées, pagination, URL de staging et anciennes pages de campagne.

Les balises canoniques ne sont pas un bouton de suppression. Elles ne sont pas une redirection. Elles ne remplacent pas une architecture de l’information. Et il n’est pas garanti qu’elles soient respectées.

Les moteurs de recherche utilisent les canoniques comme des indications fortes. Ils comparent la balise canonique avec d’autres signaux : redirections, liens internes, URL de sitemap, annotations hreflang, similarité du contenu, codes de statut HTTP, ainsi que les URL que les utilisateurs et les robots rencontrent réellement. Si ces signaux se contredisent, le moteur de recherche peut ignorer votre canonique ou choisir une URL canonique entièrement différente.

C’est pourquoi les erreurs de canonique peuvent être si déroutantes. Le balisage semble correct dans le navigateur, mais la mauvaise page apparaît dans les résultats de recherche — ou la bonne page disparaît.

Ce qui se passe quand une canonique pointe vers la mauvaise URL

Lorsqu’un moteur de recherche voit des URL dupliquées ou quasi dupliquées, il les regroupe généralement dans un cluster et sélectionne une URL comme canonique. La canonique choisie est la version la plus susceptible d’être indexée et affichée dans les résultats de recherche. Les signaux des doublons peuvent être consolidés vers cette URL choisie.

Si votre balise canonique pointe vers la mauvaise page, plusieurs choses peuvent se produire.

1. La mauvaise URL est indexée

Supposons que vous ayez deux URL :

  • /mens-running-shoes/
  • /sale/mens-running-shoes/

Si la page de soldes pointe en canonique vers la page principale de catégorie, cela peut convenir si le contenu est presque identique et si l’URL de soldes n’est qu’une version filtrée. Mais si la page de soldes contient un texte unique, des produits uniques et une demande de recherche propre, la canonique peut l’étouffer.

La page peut toujours être explorée. Elle peut toujours être accessible aux utilisateurs. Mais les moteurs de recherche peuvent décider de ne pas l’indexer séparément, parce que vous leur avez indiqué qu’une autre URL est la version préférée.

C’est l’échec canonique le plus courant : pas une panne technique spectaculaire, simplement une disparition discrète de l’index.

2. Les signaux de classement se consolident au mauvais endroit

Les canoniques sont souvent utilisées pour consolider des signaux comme les liens et les variantes de contenu dupliqué. C’est utile lorsque les doublons sont réellement équivalents. C’est risqué lorsqu’ils ne le sont pas.

Si un article de blog a des URL de suivi comme :

  • /guide-to-canonical-tags/?utm_source=newsletter
  • /guide-to-canonical-tags/?utm_source=linkedin

Alors les canonicaliser toutes deux vers /guide-to-canonical-tags/ est logique.

Mais si une version espagnole, une version imprimable avec du contenu supplémentaire ou une variante produit avec une intention différente pointe vers la même canonique, vous risquez de fusionner des signaux qui devraient rester séparés. Le résultat peut être une pertinence plus faible pour chacune d’elles.

Les balises canoniques concernent l’équivalence. Si deux pages répondent à des intentions de recherche différentes, elles ne devraient probablement pas se canonicaliser l’une vers l’autre.

3. Les moteurs de recherche ignorent la balise

Une canonique n’est pas une commande. Si la cible canonique redirige, renvoie une 404, est bloquée, contient un noindex ou présente un contenu très différent, les moteurs de recherche peuvent l’ignorer.

C’est une bonne chose dans un sens : une mauvaise canonique ne détruit pas toujours l’indexation. Mais cela signifie aussi que vous ne pouvez pas supposer que la balise fait ce que vous pensez. Une page peut déclarer une canonique pendant que Google en sélectionne une autre.

C’est particulièrement courant lorsque les liens internes, les sitemaps et les canoniques ne sont pas d’accord. Si chaque lien interne pointe vers /product, que votre sitemap liste /product/ et que votre canonique pointe vers https://www.example.com/product?ref=main, vous avez créé une petite contradiction entre vos propres signaux.

Les moteurs de recherche savent bien résoudre cette contradiction. Ils ne la résolvent pas toujours de la manière que vous aviez prévue.

4. Le débogage devient inutilement difficile

Les mauvaises canoniques échouent rarement de manière bruyante. Elles produisent des symptômes qui ressemblent à d’autres problèmes SEO :

  • « Découverte, actuellement non indexée » ou un équivalent de limbes d’indexation
  • La mauvaise URL qui se positionne sur une requête
  • Des URL avec paramètres qui apparaissent dans les rapports
  • Des pages de catégorie qui n’apparaissent pas malgré leur explorabilité
  • Des pages internationales repliées dans la mauvaise version linguistique
  • De nouveaux templates lancés avec moins de pages indexées que prévu

C’est pourquoi le débogage des canoniques doit inclure le HTML brut, le HTML rendu, les en-têtes HTTP, les redirections et les entrées de sitemap. Si vous enquêtez déjà sur des chaînes de redirection ou des en-têtes incohérents, les mêmes habitudes s’appliquent ; un flux de travail pratique d’inspection HTTP comme celui de notre guide pour déboguer les redirections et les en-têtes HTTP en production détectera généralement les contradictions de canonique plus vite que l’observation d’un champ de CMS.

Les erreurs de canonique les plus coûteuses

Canonicaliser tout vers la page d’accueil

Cela arrive encore. Un champ de template reste vide, un plugin se rabat sur la racine du site, et soudain des centaines de pages déclarent la page d’accueil comme canonique.

Les moteurs de recherche peuvent l’ignorer parce que le contenu est manifestement différent. Mais si suffisamment de signaux sont désordonnés, certaines pages peuvent être écartées ou regroupées de manière incorrecte. Au minimum, vous envoyez une indication inutile et contradictoire sur chaque page.

La page d’accueil n’est presque jamais la canonique d’une page interne.

Canonicaliser les pages paginées vers la page un

Pendant longtemps, certains sites ont canonicalisé /category/page/2/, /page/3/, et ainsi de suite vers la page un. L’intention était d’éviter les pages de catégorie dupliquées.

Le problème est que les pages paginées ne sont pas des doublons. Elles contiennent des éléments différents et aident les robots à découvrir du contenu plus profond. Les canonicaliser toutes vers la page un peut réduire les chances que les moteurs de recherche traitent pleinement les pages suivantes.

En général, les pages paginées devraient avoir des canoniques autoréférentes, sauf s’il existe une raison précise de les consolider.

Canonicaliser des pages filtrées sans vérifier l’intention de recherche

La navigation à facettes crée des choix difficiles. Certaines URL filtrées sont du bruit :

  • ?sort=price_ascending
  • ?view=grid
  • ?sessionid=123

D’autres peuvent être des pages d’atterrissage utiles :

  • /sofas/blue/
  • /laptops/16gb-ram/
  • /hotels/paris/pet-friendly/

Les règles de canonique générales effacent souvent des pages de recherche utiles en même temps que le bruit inutile des paramètres. Avant de canonicaliser des pages filtrées, demandez-vous si la page filtrée a un contenu stable, des liens internes, une demande de recherche et un besoin utilisateur distinct.

Si la réponse est oui, elle mérite peut-être d’être indexable avec une canonique autoréférente.

Pointer des canoniques vers des URL redirigées ou bloquées

Une cible canonique doit être propre, indexable et renvoyer 200 OK. Ne pointez pas de canoniques vers des URL qui redirigent, renvoient des erreurs, exigent des cookies, sont bloquées par robots.txt ou portent un noindex.

C’est l’une des vérifications les plus faciles à automatiser. Explorez votre site et signalez les cibles canoniques qui ne renvoient pas une réponse 200 propre.

Mélanger canonique et noindex comme s’ils signifiaient la même chose

rel="canonical" et noindex résolvent des problèmes différents.

Utilisez la canonique lorsqu’il existe des doublons et que vous voulez consolider les signaux vers une URL préférée. Utilisez noindex lorsque vous ne voulez pas qu’une page soit indexée du tout.

Utiliser les deux ensemble envoie un message maladroit : « N’indexez pas cette page, mais utilisez-la aussi comme signal de doublon pour une autre page. » Les moteurs de recherche peuvent souvent contourner cela, mais ce n’est pas une instruction propre. Si une page est un doublon, canonicalisez-la. Si elle ne doit pas apparaître dans la recherche et n’a pas de relation de doublon utile, envisagez noindex.

Un audit canonique pratique

Vous n’avez pas besoin d’une grande plateforme SEO pour trouver de nombreux problèmes de canonique. Commencez par une exploration, quelques échantillons d’URL et une feuille de calcul.

Pour chaque template important, vérifiez :

  1. La page a-t-elle exactement une balise canonique ? Plusieurs balises canoniques créent de l’ambiguïté.
  2. La canonique est-elle absolue ? Utilisez l’URL complète, y compris le protocole et le nom d’hôte.
  3. La cible canonique renvoie-t-elle 200 OK ? Évitez les cibles redirigées, bloquées ou en erreur.
  4. La cible canonique est-elle indexable ? Pas de noindex, pas de blocage robots, pas d’exigence d’authentification.
  5. Le contenu est-il réellement équivalent ? Similaire ne signifie pas toujours équivalent.
  6. Les liens internes sont-ils d’accord ? Créez des liens vers le format d’URL canonique chaque fois que possible.
  7. Le sitemap est-il d’accord ? Les sitemaps devraient généralement lister des URL canoniques et indexables.
  8. Les balises hreflang sont-elles d’accord ? Les pages internationales ont besoin de relations canonique et hreflang cohérentes.
  9. Le HTML rendu correspond-il au HTML brut ? JavaScript peut modifier ou injecter des balises.
  10. Quelle canonique le moteur de recherche a-t-il choisie ? Les outils d’inspection peuvent révéler quand votre canonique déclarée diffère de la canonique sélectionnée.

C’est aussi là que Lighthouse peut être utile, mais seulement dans ses limites. Il peut signaler certains problèmes d’explorabilité et de document, mais il ne comprend pas votre intention commerciale ni votre stratégie canonique. Traitez-le comme une source parmi d’autres, pas comme un verdict. Si vous avez besoin d’une manière plus calme de séparer les constats utiles du bruit, voyez comment lire un rapport Lighthouse sans paniquer.

Les canoniques autoréférentes sont généralement un bon réglage par défaut

Chaque page importante et indexable devrait généralement se déclarer elle-même comme canonique. Ce n’est pas parce que les moteurs de recherche ne peuvent pas le comprendre sans la balise. C’est parce que les canoniques autoréférentes réduisent l’ambiguïté lorsque des paramètres, des liens de suivi, des URL copiées et des particularités de CMS créent des chemins alternatifs vers le même contenu.

Pour une page produit propre, ceci est généralement correct :

<link rel="canonical" href="https://example.com/products/linen-shirt/">

Pour une URL de suivi, la canonique devrait généralement pointer vers la version propre :

<link rel="canonical" href="https://example.com/products/linen-shirt/">

Pour une variante produit réellement différente, la réponse dépend. Si la chemise rouge, la chemise bleue et la chemise noire ont la même description et que seule la couleur change, une seule page produit canonique peut suffire. Si chaque variante a sa propre demande, ses avis, ses images, son stock et ses liens internes, des pages indexables séparées peuvent avoir du sens.

Il n’existe pas de règle canonique universelle pour les variantes. Il n’y a qu’une question : ces pages sont-elles interchangeables pour une personne qui cherche ?

Les balises canoniques doivent correspondre à la politique d’URL réelle de votre site

La plupart des bugs de canonique sont les symptômes d’un problème plus profond de politique d’URL. Le site n’a pas décidé si les barres obliques finales comptent, si les URL en majuscules doivent se résoudre, si les paramètres sont autorisés, si HTTP redirige vers HTTPS, ou si www est canonique.

Choisissez une version propre de chaque URL et faites en sorte que tout le système soit d’accord :

  • Redirigez les versions d’URL non préférées vers les versions préférées.
  • Créez des liens internes vers les versions préférées.
  • Placez les versions préférées dans les sitemaps XML.
  • Utilisez des canoniques autoréférentes sur les pages préférées.
  • Canonicalisez uniquement les vrais doublons vers l’URL préférée.

Quand tous ces signaux pointent dans la même direction, les balises canoniques deviennent ennuyeuses. C’est l’objectif.

L’essentiel

Les balises canoniques sont puissantes parce qu’elles influencent l’indexation et la consolidation des signaux. Elles sont dangereuses pour la même raison.

Une mauvaise canonique ne retirera pas toujours une page de la recherche. Les moteurs de recherche peuvent l’ignorer. Mais compter sur les moteurs de recherche pour sauver de mauvais signaux n’est pas une stratégie. L’approche la plus sûre consiste à réserver la canonicalisation aux vrais doublons, à garder des cibles propres et indexables, et à faire en sorte que vos liens internes, redirections, sitemaps et canoniques racontent la même histoire.

Les canoniques ne sont pas l’endroit où cacher une architecture désordonnée. Elles sont l’endroit où vous confirmez qu’elle a été nettoyée.

Questions fréquemment posées

Une mauvaise balise canonique peut-elle désindexer une page ?
Oui, indirectement. Une canonique ne supprime pas une page comme peut le faire noindex, mais elle peut indiquer aux moteurs de recherche qu’une autre URL est la version préférée. S’ils acceptent cette indication, la page non canonique peut ne pas être indexée séparément.
La canonicalisation corrige-t-elle une pénalité de contenu dupliqué ?
Pas exactement. Le contenu dupliqué est généralement un problème de regroupement et de sélection, pas une pénalité. Les balises canoniques aident les moteurs de recherche à choisir l’URL préférée et à consolider les signaux, mais elles ne réparent pas un contenu faible ni une mauvaise structure de site.
Chaque page devrait-elle avoir une canonique autoréférente ?
La plupart des pages importantes et indexables devraient en avoir une. Une canonique autoréférente aide à confirmer l’URL préférée, surtout lorsqu’il existe des paramètres de suivi, des chemins alternatifs ou des URL générées par le CMS.
Puis-je canonicaliser des pages paginées vers la page un ?
Généralement non. Les pages paginées contiennent souvent des éléments différents et aident à la découverte. Dans la plupart des cas, chaque URL paginée devrait avoir une canonique autoréférente, sauf si les pages sont vraiment dupliquées.
Quelle est la différence entre canonical et noindex ?
Canonical signifie : « cette page est un doublon ou une version alternative ; préférez cette autre URL. » Noindex signifie : « n’affichez pas cette page dans les résultats de recherche. » Ils résolvent des problèmes différents et ne devraient pas être utilisés de manière interchangeable.

Sources et lectures complémentaires

  1. Google Search Central: How to specify a canonical URL
  2. Google Search Central: Canonicalization and duplicate URLs
  3. RFC 6596: The Canonical Link Relation
  4. Bing Webmaster Guidelines
À propos de l'auteur
The Wux Webtools Team

Dernière mise à jour:

Continuez à lire