Contenido Duplicado y Etiquetas Canónicas: Cómo Afectan la Indexación
Por qué las páginas casi idénticas compiten entre sí por la indexación, y cómo una etiqueta canónica le dice a los motores de búsqueda qué versión debe indexarse y posicionarse realmente.
El contenido duplicado rara vez es una copia completa
La mayoría del contenido duplicado no son dos artículos idénticos: es la misma página accesible mediante múltiples URL: con y sin www, con y sin barra diagonal final, sobre http y https, con parámetros de seguimiento u ordenamiento añadidos, o una versión apta para imprimir en su propia URL. Para un rastreador, cada una de esas es una URL distinta que resulta mostrar el mismo contenido.
Por qué afecta la indexación, no solo el posicionamiento
La suposición común es que el contenido duplicado simplemente divide las señales de posicionamiento entre las versiones. En la práctica, los motores de búsqueda a menudo van un paso más allá y simplemente eligen una versión para indexar e ignoran en gran medida el resto, y esa elección no está garantizada que sea la versión que realmente querías. Esta es una de las causas más comunes y menos obvias detrás de que una página permanezca en "Rastreada - actualmente no indexada": fue rastreada, reconocida como equivalente a otra URL y simplemente descartada en favor de esa.
Qué hace realmente una etiqueta canónica
Una etiqueta <link rel="canonical" href="..."> le dice a un rastreador: varias URL pueden llevar aquí, pero esta específica es la versión que debería indexarse y recibir el crédito. Toda página indexable debería llevar una etiqueta canónica, incluida una autorreferencial que apunte hacia sí misma, para que nunca haya ambigüedad sobre qué URL considera autoritativa el propio contenido de una página.
Es una sugerencia, no una directiva
Los motores de búsqueda tratan las etiquetas canónicas como una señal fuerte, no como una regla absoluta, de forma muy similar a un sitemap. Si otras señales fuertes no coinciden (por ejemplo, la mayoría de los enlaces externos apuntan a la versión no canónica), un motor de búsqueda puede optar por indexar una URL diferente a la que especificaste. Las etiquetas canónicas funcionan mejor cuando son consistentes con todas las demás señales de la página: los enlaces internos, la entrada del sitemap y las redirecciones deberían coincidir todos en la misma URL.
Errores comunes de canonicalización
- Apuntar una etiqueta canónica a una URL que redirige a otro lugar: el rastreador tiene que seguir la cadena, agregando fricción a una señal que se supone debe eliminar la ambigüedad.
- Apuntar una etiqueta canónica a una página que a su vez tiene una etiqueta noindex: un par contradictorio de señales que puede dejar ambas versiones sin indexar.
- Canónicas inconsistentes en una serie paginada (cada página apuntando de vuelta a la página 1) cuando cada página en realidad tiene contenido único e indexable que vale la pena mantener por separado.
- Un error de plantilla a nivel de todo el sitio que canonicaliza cada página hacia la página de inicio: poco común, pero catastrófico, y vale la pena revisar tras cualquier cambio de plantilla.
Corregirlo de cara al futuro
Elige una forma canónica única para tu dominio (con www o sin, con barra diagonal final o sin) y redirige cualquier otra variante hacia ella a nivel de servidor: una etiqueta canónica es una señal secundaria, no un sustituto de realmente no servir URL duplicadas como respuestas 200 en primer lugar. Una vez que eso sea consistente, asegúrate de que tu sitemap solo enumere la versión canónica de cada página: enumerar una URL no canónica envía una señal que contradice directamente la propia etiqueta canónica de la página.
¿Quieres que tu próxima página se encuentre más rápido que con el rastreo orgánico por sí solo?
IndexLaunch envía cada URL que envías directamente a Bing, Yandex, Seznam y Naver mediante IndexNow en el momento en que la pones en cola.
Ver Precios