Qué hacen las etiquetas canonical cuando las configuras mal
Las etiquetas canonical son útiles, pero no son inocuas. Una canonical incorrecta puede ocultar la página que querías posicionar, fusionar señales en la URL equivocada y hacer que depurar la indexación sea mucho más difícil de lo que debería.
Tabla de contenido
- La etiqueta canonical no es un borrador de contenido duplicado
- Qué ocurre cuando una canonical apunta a la URL equivocada
- 1. Se indexa la URL equivocada
- 2. Las señales de posicionamiento se consolidan en el lugar equivocado
- 3. Los motores de búsqueda ignoran la etiqueta
- 4. La depuración se vuelve innecesariamente difícil
- Los errores de canonical más costosos
- Canonicalizar todo hacia la página de inicio
- Canonicalizar páginas paginadas hacia la página uno
- Canonicalizar páginas filtradas sin comprobar la intención de búsqueda
- Apuntar canonical a URL redirigidas o bloqueadas
- Mezclar canonical con noindex como si significaran lo mismo
- Una auditoría práctica de canonical
- Las canonical autorreferenciales suelen ser una buena opción por defecto
- Las etiquetas canonical deben coincidir con la política real de URL de tu sitio
- La conclusión
La etiqueta canonical no es un borrador de contenido duplicado
Una etiqueta canonical indica a los motores de búsqueda qué URL prefieres cuando varias URL contienen el mismo contenido, o contenido sustancialmente similar. La versión HTML habitual tiene este aspecto:
<link rel="canonical" href="https://example.com/preferred-page/">
También existe una versión en encabezado HTTP, útil sobre todo para archivos que no son HTML, como los PDF:
Link: <https://example.com/preferred-file.pdf>; rel="canonical"
Suena bastante simple. El problema empieza cuando los equipos tratan las etiquetas canonical como una forma segura de ordenar cualquier cosa incómoda: navegación facetada, parámetros de seguimiento, páginas de impresión, páginas de producto casi duplicadas, paginación, URL de staging y antiguas páginas de campaña.
Las etiquetas canonical no son un botón de borrar. No son una redirección. No sustituyen a la arquitectura de la información. Y no hay garantía de que se obedezcan.
Los motores de búsqueda usan las canonical como indicaciones fuertes. Comparan la etiqueta canonical con otras señales: redirecciones, enlaces internos, URL del sitemap, anotaciones hreflang, similitud del contenido, códigos de estado HTTP y las URL que usuarios y rastreadores encuentran realmente. Si esas señales entran en conflicto, el motor de búsqueda puede ignorar tu canonical o elegir una URL canonical completamente distinta.
Por eso equivocarse con las canonical puede ser tan confuso. El marcado parece correcto en el navegador, pero la página equivocada aparece en los resultados de búsqueda — o la página correcta desaparece.
Qué ocurre cuando una canonical apunta a la URL equivocada
Cuando un motor de búsqueda ve URL duplicadas o casi duplicadas, normalmente las agrupa en un clúster y selecciona una URL como canonical. La canonical elegida es la versión con más probabilidades de ser indexada y mostrada en los resultados de búsqueda. Las señales de los duplicados pueden consolidarse en esa URL elegida.
Si tu etiqueta canonical apunta a la página equivocada, pueden ocurrir varias cosas.
1. Se indexa la URL equivocada
Supongamos que tienes dos URL:
/mens-running-shoes//sale/mens-running-shoes/
Si la página de ofertas canonicaliza hacia la página principal de la categoría, puede estar bien si el contenido es casi idéntico y la URL de ofertas es solo una versión filtrada. Pero si la página de ofertas tiene texto único, productos únicos y demanda de búsqueda propia, la canonical puede suprimirla.
La página puede seguir rastreándose. Puede seguir siendo accesible para los usuarios. Pero los motores de búsqueda pueden decidir no indexarla por separado porque les dijiste que otra URL es la versión preferida.
Este es el fallo de canonical más común: no una caída técnica dramática, sino una desaparición silenciosa del índice.
2. Las señales de posicionamiento se consolidan en el lugar equivocado
Las canonical se usan a menudo para consolidar señales como enlaces y variantes de contenido duplicado. Eso es útil cuando los duplicados son realmente equivalentes. Es arriesgado cuando no lo son.
Si un artículo de blog tiene URL de seguimiento como:
/guide-to-canonical-tags/?utm_source=newsletter/guide-to-canonical-tags/?utm_source=linkedin
Entonces canonicalizar ambas a /guide-to-canonical-tags/ es sensato.
Pero si una versión en español, una versión imprimible con contenido adicional o una variante de producto con una intención distinta apunta a la misma canonical, puedes estar fusionando señales que deberían permanecer separadas. El resultado puede ser una relevancia más débil para todas ellas.
Las etiquetas canonical tratan de equivalencia. Si dos páginas satisfacen intenciones de búsqueda distintas, probablemente no deberían canonicalizarse entre sí.
3. Los motores de búsqueda ignoran la etiqueta
Una canonical no es una orden. Si el destino canonical redirige, devuelve un 404, está bloqueado, tiene un noindex o contiene contenido muy diferente, los motores de búsqueda pueden ignorarlo.
Eso es bueno en cierto sentido: una canonical incorrecta no siempre destruye la indexación. Pero también significa que no puedes asumir que la etiqueta hace lo que crees. Una página puede declarar una canonical mientras Google selecciona otra.
Esto es especialmente común cuando los enlaces internos, los sitemaps y las canonical no coinciden. Si todos los enlaces internos apuntan a /product, tu sitemap lista /product/ y tu canonical apunta a https://www.example.com/product?ref=main, has creado una pequeña discusión entre tus propias señales.
Los motores de búsqueda son buenos resolviendo esa discusión. No siempre son buenos resolviéndola de la forma que pretendías.
4. La depuración se vuelve innecesariamente difícil
Las canonical incorrectas rara vez fallan de forma ruidosa. Producen síntomas que parecen otros problemas de SEO:
- “Discovered, currently not indexed” o un limbo de indexación equivalente
- La URL equivocada posicionando para una consulta
- URL con parámetros apareciendo en informes
- Páginas de categoría que no aparecen pese a ser rastreables
- Páginas internacionales plegadas en la versión de idioma equivocada
- Nuevas plantillas lanzadas con menos páginas indexadas de lo esperado
Por eso la depuración de canonical debería incluir el HTML sin procesar, el HTML renderizado, los encabezados HTTP, las redirecciones y las entradas del sitemap. Si ya estás investigando cadenas de redirección o encabezados no coincidentes, se aplican los mismos hábitos; un flujo de inspección HTTP práctico como el de nuestra guía para depurar redirecciones y encabezados HTTP en producción normalmente detectará contradicciones de canonical más rápido que mirar fijamente un campo del CMS.
Los errores de canonical más costosos
Canonicalizar todo hacia la página de inicio
Esto todavía ocurre. Un campo de plantilla queda vacío, un plugin recurre a la raíz del sitio y, de repente, cientos de páginas declaran la página de inicio como canonical.
Los motores de búsqueda pueden ignorarlo porque el contenido es obviamente distinto. Pero si hay suficientes señales desordenadas, algunas páginas pueden descartarse o agruparse incorrectamente. Como mínimo, estás enviando una indicación inútil y contradictoria en cada página.
La página de inicio casi nunca es la canonical de una página interna.
Canonicalizar páginas paginadas hacia la página uno
Durante mucho tiempo, algunos sitios canonicalizaban /category/page/2/, /page/3/ y así sucesivamente hacia la página uno. La intención era evitar páginas de categoría duplicadas.
El problema es que las páginas paginadas no son duplicados. Contienen elementos distintos y ayudan a los rastreadores a descubrir contenido más profundo. Canonicalizarlas todas hacia la página uno puede reducir la probabilidad de que los motores de búsqueda procesen por completo las páginas posteriores.
Por lo general, las páginas paginadas deberían tener canonical autorreferenciales salvo que exista una razón específica para consolidarlas.
Canonicalizar páginas filtradas sin comprobar la intención de búsqueda
La navegación facetada crea decisiones difíciles. Algunas URL filtradas son basura:
?sort=price_ascending?view=grid?sessionid=123
Otras pueden ser páginas de destino valiosas:
/sofas/blue//laptops/16gb-ram//hotels/paris/pet-friendly/
Las reglas de canonical generales suelen borrar páginas de búsqueda útiles junto con ruido inútil de parámetros. Antes de canonicalizar páginas filtradas, pregúntate si la página filtrada tiene contenido estable, enlaces internos, demanda de búsqueda y una necesidad de usuario diferenciada.
Si la respuesta es sí, puede merecer ser indexable con una canonical autorreferencial.
Apuntar canonical a URL redirigidas o bloqueadas
Un destino canonical debe ser limpio, indexable y devolver 200 OK. No apuntes canonical a URL que redirigen, devuelven errores, requieren cookies, están bloqueadas por robots.txt o llevan noindex.
Esta es una de las comprobaciones más fáciles de automatizar. Rastrea tu sitio y marca los destinos canonical que no devuelvan una respuesta 200 limpia.
Mezclar canonical con noindex como si significaran lo mismo
rel="canonical" y noindex resuelven problemas distintos.
Usa canonical cuando existan duplicados y quieras consolidar señales en una URL preferida. Usa noindex cuando no quieras que una página se indexe en absoluto.
Usar ambas juntas envía un mensaje incómodo: “No indexes esta página, pero úsala también como señal de duplicado para otra página.” Los motores de búsqueda a menudo pueden sortearlo, pero no es una instrucción limpia. Si una página es un duplicado, canonicalízala. Si no debería aparecer en búsqueda y no tiene una relación de duplicado útil, considera noindex.
Una auditoría práctica de canonical
No necesitas una gran plataforma de SEO para encontrar muchos problemas de canonical. Empieza con un rastreo, algunas muestras de URL y una hoja de cálculo.
Para cada plantilla importante, comprueba:
- ¿La página tiene exactamente una etiqueta canonical? Varias etiquetas canonical crean ambigüedad.
- ¿La canonical es absoluta? Usa la URL completa, incluido el protocolo y el nombre de host.
- ¿El destino canonical devuelve
200 OK? Evita destinos redirigidos, bloqueados o con errores. - ¿El destino canonical es indexable? Sin
noindex, sin bloqueo de robots, sin requisito de autenticación. - ¿El contenido es realmente equivalente? Similar no siempre es equivalente.
- ¿Los enlaces internos coinciden? Enlaza al formato de URL canonical siempre que sea posible.
- ¿El sitemap coincide? Los sitemaps deberían listar generalmente URL canonical e indexables.
- ¿Las etiquetas hreflang coinciden? Las páginas internacionales necesitan relaciones canonical y hreflang coherentes.
- ¿El HTML renderizado coincide con el HTML sin procesar? JavaScript puede cambiar o inyectar etiquetas.
- ¿Qué canonical eligió el motor de búsqueda? Las herramientas de inspección pueden revelar cuándo tu canonical declarada difiere de la canonical seleccionada.
Aquí es también donde Lighthouse puede ser útil, pero solo dentro de sus límites. Puede señalar algunos problemas de rastreabilidad y de documento, pero no entiende tu intención comercial ni tu estrategia de canonical. Trátalo como una entrada, no como un veredicto. Si necesitas una forma más tranquila de separar hallazgos útiles del ruido, consulta cómo leer un informe de Lighthouse sin entrar en pánico.
Las canonical autorreferenciales suelen ser una buena opción por defecto
Cada página indexable importante debería normalmente declararse a sí misma como canonical. No porque los motores de búsqueda no puedan resolverlo sin la etiqueta. Sino porque las canonical autorreferenciales reducen la ambigüedad cuando parámetros, enlaces de seguimiento, URL copiadas y peculiaridades del CMS crean rutas alternativas hacia el mismo contenido.
Para una página de producto limpia, esto suele ser correcto:
<link rel="canonical" href="https://example.com/products/linen-shirt/">
Para una URL de seguimiento, la canonical normalmente debería apuntar de vuelta a la versión limpia:
<link rel="canonical" href="https://example.com/products/linen-shirt/">
Para una variante de producto realmente diferente, la respuesta depende. Si la camisa roja, la camisa azul y la camisa negra tienen la misma descripción y solo cambia el color, una sola página de producto canonical puede ser suficiente. Si cada variante tiene demanda, reseñas, imágenes, stock y enlaces internos propios, puede tener sentido usar páginas indexables separadas.
No existe una regla universal de canonical para variantes. Solo existe la pregunta: ¿son estas páginas intercambiables para quien busca?
Las etiquetas canonical deben coincidir con la política real de URL de tu sitio
La mayoría de los errores de canonical son síntomas de un problema más profundo de política de URL. El sitio no ha decidido si las barras finales importan, si las URL en mayúsculas deben resolverse, si se permiten parámetros, si HTTP redirige a HTTPS o si www es canonical.
Elige una versión limpia de cada URL y haz que todo el sistema coincida:
- Redirige las versiones de URL no preferidas a las versiones preferidas.
- Enlaza internamente a las versiones preferidas.
- Coloca las versiones preferidas en los sitemaps XML.
- Usa canonical autorreferenciales en las páginas preferidas.
- Canonicaliza solo duplicados reales hacia la URL preferida.
Cuando todas estas señales apuntan en la misma dirección, las etiquetas canonical se vuelven aburridas. Ese es el objetivo.
La conclusión
Las etiquetas canonical son poderosas porque influyen en la indexación y en la consolidación de señales. Son peligrosas por la misma razón.
Una canonical equivocada no siempre eliminará una página de la búsqueda. Los motores de búsqueda pueden ignorarla. Pero depender de que los motores de búsqueda rescaten señales malas no es una estrategia. El enfoque más seguro es reservar la canonicalización para duplicados reales, mantener los destinos limpios e indexables, y hacer que tus enlaces internos, redirecciones, sitemaps y canonical cuenten la misma historia.
Las canonical no son el lugar donde ocultas una arquitectura desordenada. Son el lugar donde confirmas que se ha limpiado.