SEO & Discoverability

O que as tags canónicas fazem quando são usadas incorretamente

As tags canónicas são úteis, mas não são inofensivas. Uma canonical mal definida pode esconder a página que queria posicionar, fundir sinais no URL errado e tornar a depuração da indexação muito mais difícil do que deveria ser.

The Wux Webtools Team The Wux Webtools Team 11 min de leitura Assistido por IA, revisado por humanos
Overlapping web pages with one preferred canonical page highlighted and warning markers on incorrect duplicates.
Tabela de conteúdos
  1. A tag canónica não é uma borracha para conteúdo duplicado
  2. O que acontece quando uma canonical aponta para o URL errado
  3. 1. O URL errado é indexado
  4. 2. Os sinais de ranking consolidam-se no sítio errado
  5. 3. Os motores de busca ignoram a tag
  6. 4. A depuração torna-se desnecessariamente difícil
  7. Os erros canónicos mais caros
  8. Canonicalizar tudo para a homepage
  9. Canonicalizar páginas paginadas para a página um
  10. Canonicalizar páginas filtradas sem verificar a intenção de pesquisa
  11. Apontar canonicals para URLs redirecionados ou bloqueados
  12. Misturar canonical com noindex como se significassem a mesma coisa
  13. Uma auditoria canónica prática
  14. Canonicals autorreferenciais são normalmente um bom padrão
  15. As tags canónicas devem corresponder à política real de URLs do seu site
  16. Conclusão

A tag canónica não é uma borracha para conteúdo duplicado

Uma tag canónica diz aos motores de busca qual URL prefere quando vários URLs contêm o mesmo conteúdo, ou conteúdo substancialmente semelhante. A versão HTML comum é assim:

<link rel="canonical" href="https://example.com/preferred-page/">

Existe também uma versão em cabeçalho HTTP, sobretudo útil para ficheiros não HTML, como PDFs:

Link: <https://example.com/preferred-file.pdf>; rel="canonical"

Parece suficientemente simples. O problema começa quando as equipas tratam as tags canónicas como uma forma segura de arrumar tudo o que é incómodo: navegação facetada, parâmetros de tracking, páginas de impressão, páginas de produto quase duplicadas, paginação, URLs de staging e páginas antigas de campanhas.

As tags canónicas não são um botão de eliminação. Não são um redirect. Não são um substituto para a arquitetura de informação. E não há garantia de que sejam obedecidas.

Os motores de busca usam canonicals como indícios fortes. Comparam a tag canónica com outros sinais: redirects, links internos, URLs no sitemap, anotações hreflang, semelhança de conteúdo, códigos de estado HTTP e os URLs que utilizadores e crawlers encontram de facto. Se esses sinais entrarem em conflito, o motor de busca pode ignorar a sua canonical ou escolher um URL canónico completamente diferente.

É por isso que errar nas canonicals pode ser tão confuso. A marcação parece correta no browser, mas a página errada aparece nos resultados de pesquisa — ou a página certa desaparece.

O que acontece quando uma canonical aponta para o URL errado

Quando um motor de busca vê URLs duplicados ou quase duplicados, normalmente agrupa-os num cluster e seleciona um URL como canónico. A canonical escolhida é a versão com maior probabilidade de ser indexada e apresentada nos resultados de pesquisa. Os sinais dos duplicados podem ser consolidados nesse URL escolhido.

Se a sua tag canónica apontar para a página errada, podem acontecer várias coisas.

1. O URL errado é indexado

Suponha que tem dois URLs:

  • /mens-running-shoes/
  • /sale/mens-running-shoes/

Se a página de promoções fizer canonical para a página principal da categoria, isso pode estar bem se o conteúdo for quase idêntico e o URL de promoção for apenas uma versão filtrada. Mas se a página de promoção tiver texto único, produtos únicos e procura de pesquisa própria, a canonical pode suprimi-la.

A página pode continuar a ser rastreada. Pode continuar acessível aos utilizadores. Mas os motores de busca podem decidir não a indexar separadamente porque lhes disse que outro URL é a versão preferida.

Esta é a falha canónica mais comum: não uma interrupção técnica dramática, apenas um desaparecimento silencioso do índice.

2. Os sinais de ranking consolidam-se no sítio errado

As canonicals são frequentemente usadas para consolidar sinais como links e variantes de conteúdo duplicado. Isso é útil quando os duplicados são realmente equivalentes. É arriscado quando não são.

Se um artigo de blog tiver URLs de tracking como:

  • /guide-to-canonical-tags/?utm_source=newsletter
  • /guide-to-canonical-tags/?utm_source=linkedin

Então faz sentido canonicalizar ambos para /guide-to-canonical-tags/.

Mas se uma versão em espanhol, uma versão imprimível com conteúdo extra ou uma variante de produto com intenção diferente apontar para a mesma canonical, pode estar a fundir sinais que deveriam permanecer separados. O resultado pode ser uma relevância mais fraca para todos.

As tags canónicas têm a ver com equivalência. Se duas páginas satisfazem intenções de pesquisa diferentes, provavelmente não devem canonicalizar uma para a outra.

3. Os motores de busca ignoram a tag

Uma canonical não é um comando. Se o destino canónico redirecionar, devolver um 404, estiver bloqueado, tiver um noindex ou contiver conteúdo muito diferente, os motores de busca podem ignorá-lo.

Isso é bom num sentido: uma má canonical nem sempre destrói a indexação. Mas também significa que não pode assumir que a tag está a fazer aquilo que pensa. Uma página pode declarar uma canonical enquanto o Google seleciona outra.

Isto é especialmente comum quando links internos, sitemaps e canonicals discordam. Se todos os links internos apontam para /product, o seu sitemap lista /product/ e a sua canonical aponta para https://www.example.com/product?ref=main, criou uma pequena discussão entre os seus próprios sinais.

Os motores de busca são bons a resolver essa discussão. Nem sempre são bons a resolvê-la da forma que pretendia.

4. A depuração torna-se desnecessariamente difícil

Más canonicals raramente falham de forma ruidosa. Produzem sintomas que se parecem com outros problemas de SEO:

  • “Descoberta, atualmente não indexada” ou um limbo de indexação equivalente
  • O URL errado a posicionar para uma consulta
  • URLs com parâmetros a aparecer em relatórios
  • Páginas de categoria que não aparecem apesar de serem rastreáveis
  • Páginas internacionais a serem incorporadas na versão linguística errada
  • Novos templates lançados com menos páginas indexadas do que o esperado

É por isso que a depuração de canonicals deve incluir o HTML bruto, o HTML renderizado, cabeçalhos HTTP, redirects e entradas do sitemap. Se já está a investigar cadeias de redirects ou cabeçalhos incompatíveis, aplicam-se os mesmos hábitos; um fluxo prático de inspeção HTTP como o de o nosso guia para depurar redirects e cabeçalhos HTTP em produção costuma detetar contradições canónicas mais depressa do que ficar a olhar para um campo do CMS.

Os erros canónicos mais caros

Canonicalizar tudo para a homepage

Isto ainda acontece. Um campo de template fica em branco, um plugin usa a raiz do site como fallback e, de repente, centenas de páginas declaram a homepage como canonical.

Os motores de busca podem ignorar isto porque o conteúdo é obviamente diferente. Mas, se houver sinais suficientemente desorganizados, algumas páginas podem ser removidas ou agrupadas incorretamente. No mínimo, está a enviar um indício inútil e contraditório em todas as páginas.

A homepage quase nunca é a canonical de uma página interna.

Canonicalizar páginas paginadas para a página um

Durante muito tempo, alguns sites canonicalizaram /category/page/2/, /page/3/ e assim por diante de volta para a página um. A intenção era evitar páginas de categoria duplicadas.

O problema é que páginas paginadas não são duplicados. Contêm itens diferentes e ajudam os crawlers a descobrir conteúdo mais profundo. Canonicalizá-las todas para a página um pode reduzir a probabilidade de os motores de busca processarem totalmente as páginas seguintes.

Normalmente, páginas paginadas devem ter canonicals autorreferenciais, a menos que exista uma razão específica para consolidar.

Canonicalizar páginas filtradas sem verificar a intenção de pesquisa

A navegação facetada cria escolhas difíceis. Alguns URLs filtrados são lixo:

  • ?sort=price_ascending
  • ?view=grid
  • ?sessionid=123

Outros podem ser landing pages valiosas:

  • /sofas/blue/
  • /laptops/16gb-ram/
  • /hotels/paris/pet-friendly/

Regras de canonical genéricas muitas vezes apagam páginas de pesquisa úteis juntamente com ruído inútil de parâmetros. Antes de canonicalizar páginas filtradas, pergunte se a página filtrada tem conteúdo estável, links internos, procura de pesquisa e uma necessidade de utilizador distinta.

Se a resposta for sim, pode merecer ser indexável com uma canonical autorreferencial.

Apontar canonicals para URLs redirecionados ou bloqueados

Um destino canónico deve ser limpo, indexável e devolver 200 OK. Não aponte canonicals para URLs que redirecionam, devolvem erros, exigem cookies, estão bloqueados por robots.txt ou carregam noindex.

Esta é uma das verificações mais fáceis de automatizar. Faça um crawl ao seu site e sinalize destinos canónicos que não devolvam uma resposta 200 limpa.

Misturar canonical com noindex como se significassem a mesma coisa

rel="canonical" e noindex resolvem problemas diferentes.

Use canonical quando existem duplicados e quer consolidar sinais num URL preferido. Use noindex quando não quer que uma página seja indexada de todo.

Usar ambos em conjunto envia uma mensagem estranha: “Não indexes esta página, mas usa-a também como sinal de duplicado para outra página.” Os motores de busca muitas vezes conseguem contornar isto, mas não é uma instrução limpa. Se uma página é duplicada, canonicalize-a. Se não deve aparecer na pesquisa e não tem uma relação útil de duplicação, considere noindex.

Uma auditoria canónica prática

Não precisa de uma grande plataforma de SEO para encontrar muitos problemas de canonical. Comece com um crawl, algumas amostras de URLs e uma folha de cálculo.

Para cada template importante, verifique:

  1. A página tem exatamente uma tag canónica? Várias tags canónicas criam ambiguidade.
  2. A canonical é absoluta? Use o URL completo, incluindo protocolo e hostname.
  3. O destino canónico devolve 200 OK? Evite destinos redirecionados, bloqueados ou com erro.
  4. O destino canónico é indexável? Sem noindex, sem bloqueio por robots, sem requisito de autenticação.
  5. O conteúdo é genuinamente equivalente? Semelhante nem sempre é equivalente.
  6. Os links internos concordam? Sempre que possível, ligue para o formato de URL canónico.
  7. O sitemap concorda? Os sitemaps devem geralmente listar URLs canónicos e indexáveis.
  8. As tags hreflang concordam? Páginas internacionais precisam de relações canonical e hreflang consistentes.
  9. O HTML renderizado corresponde ao HTML bruto? JavaScript pode alterar ou injetar tags.
  10. Que canonical escolheu o motor de busca? Ferramentas de inspeção podem revelar quando a canonical declarada difere da canonical selecionada.

É também aqui que o Lighthouse pode ser útil, mas apenas dentro dos seus limites. Pode sinalizar alguns problemas de rastreabilidade e de documento, mas não compreende a sua intenção comercial nem a sua estratégia canónica. Trate-o como um contributo, não como uma sentença. Se precisa de uma forma mais calma de separar conclusões úteis de ruído, veja como ler um relatório Lighthouse sem entrar em pânico.

Canonicals autorreferenciais são normalmente um bom padrão

Todas as páginas indexáveis importantes devem normalmente declarar-se a si próprias como canonical. Não porque os motores de busca não consigam perceber isso sem a tag. É porque canonicals autorreferenciais reduzem a ambiguidade quando parâmetros, links de tracking, URLs copiados e peculiaridades do CMS criam caminhos alternativos para o mesmo conteúdo.

Para uma página de produto limpa, isto costuma estar certo:

<link rel="canonical" href="https://example.com/products/linen-shirt/">

Para um URL de tracking, a canonical deve normalmente apontar de volta para a versão limpa:

<link rel="canonical" href="https://example.com/products/linen-shirt/">

Para uma variante de produto genuinamente diferente, a resposta depende. Se a camisa vermelha, a camisa azul e a camisa preta tiverem a mesma descrição e apenas a cor mudar, uma página de produto canónica pode ser suficiente. Se cada variante tiver procura, avaliações, imagens, stock e links internos próprios, páginas indexáveis separadas podem fazer sentido.

Não existe uma regra canónica universal para variantes. Existe apenas a pergunta: estas páginas são intercambiáveis para quem pesquisa?

As tags canónicas devem corresponder à política real de URLs do seu site

A maioria dos bugs de canonical são sintomas de um problema mais profundo de política de URLs. O site não decidiu se as barras finais importam, se URLs em maiúsculas devem resolver, se parâmetros são permitidos, se HTTP redireciona para HTTPS ou se www é canónico.

Escolha uma versão limpa de cada URL e faça com que todo o sistema concorde:

  • Redirecione versões de URL não preferidas para versões preferidas.
  • Faça links internos para as versões preferidas.
  • Coloque as versões preferidas em sitemaps XML.
  • Use canonicals autorreferenciais nas páginas preferidas.
  • Canonicalize apenas duplicados reais para o URL preferido.

Quando todos estes sinais apontam na mesma direção, as tags canónicas tornam-se aborrecidas. Esse é o objetivo.

Conclusão

As tags canónicas são poderosas porque influenciam a indexação e a consolidação de sinais. São perigosas pela mesma razão.

Uma canonical errada nem sempre remove uma página da pesquisa. Os motores de busca podem ignorá-la. Mas confiar que os motores de busca vão resgatar maus sinais não é uma estratégia. A abordagem mais segura é reservar a canonicalização para duplicados genuínos, manter os destinos limpos e indexáveis, e fazer com que os seus links internos, redirects, sitemaps e canonicals contem a mesma história.

Canonicals não são o sítio onde se esconde uma arquitetura desorganizada. São o sítio onde se confirma que ela foi limpa.

Perguntas frequentes

Uma má tag canónica pode desindexar uma página?
Sim, indiretamente. Uma canonical não remove uma página da mesma forma que noindex pode remover, mas pode dizer aos motores de busca que outro URL é a versão preferida. Se aceitarem esse indício, a página não canónica pode não ser indexada separadamente.
A canonicalização é uma correção para penalizações por conteúdo duplicado?
Não exatamente. Conteúdo duplicado é normalmente um problema de agrupamento e seleção, não uma penalização. As tags canónicas ajudam os motores de busca a escolher o URL preferido e a consolidar sinais, mas não reparam conteúdo fraco nem uma estrutura de site deficiente.
Todas as páginas devem ter uma canonical autorreferencial?
A maioria das páginas indexáveis importantes deve ter. Uma canonical autorreferencial ajuda a confirmar o URL preferido, especialmente quando existem parâmetros de tracking, caminhos alternativos ou URLs gerados pelo CMS.
Posso canonicalizar páginas paginadas para a página um?
Normalmente, não. Páginas paginadas muitas vezes contêm itens diferentes e ajudam à descoberta. Na maioria dos casos, cada URL paginado deve ter uma canonical autorreferencial, a menos que as páginas sejam realmente duplicadas.
Qual é a diferença entre canonical e noindex?
Canonical diz: “esta página é um duplicado ou uma versão alternativa; prefira este outro URL.” Noindex diz: “não mostre esta página nos resultados de pesquisa.” Resolvem problemas diferentes e não devem ser usados de forma intercambiável.

Fontes e leituras adicionais

  1. Google Search Central: How to specify a canonical URL
  2. Google Search Central: Canonicalization and duplicate URLs
  3. RFC 6596: The Canonical Link Relation
  4. Bing Webmaster Guidelines
Sobre o autor
The Wux Webtools Team

Última atualização:

Continue lendo