Aprender
Canonicalización de contenido duplicado: canonical, parámetros y variantes de URL
Una guía práctica de contenido duplicado y canonicalización: de dónde salen las variantes de URL, cómo elegir entre canonical, redirección y noindex, y cómo consolidar sin riesgo.
Ejecuta una auditoría nueva en DomainLens y usa el informe como lista de prioridades.
Qué te cuesta de verdad el contenido duplicado
No existe una «penalización por contenido duplicado» como se teme. Lo que ocurre es dilución e imprevisibilidad: cuando el mismo contenido vive en varias URLs, Google debe elegir una para indexar y posicionar, y puede no elegir la que quieres. Enlaces, atención de rastreo y señales se reparten entre las variantes en vez de concentrarse en una URL fuerte.
También desperdicia crawl budget. En un sitio grande, miles de URLs de parámetros y filtros casi idénticas hacen que Google recrastree copias en vez de descubrir tus páginas realmente nuevas — un problema que crece con el sitio.
De dónde salen las URLs duplicadas
La duplicación casi nunca es alguien copiando un artículo. Casi siempre es la misma página accesible por muchas URLs:
- Variantes de protocolo y host: http vs https, www vs sin www, con barra final o sin ella.
- Parámetros de tracking y sesión: ?utm_source=…, ?sessionid=…, que cambian la URL pero no el contenido.
- Navegación por facetas y órdenes de clasificación: ?color=red&sort=price generando combinaciones infinitas.
- Paginación y versiones «ver todo» de la misma lista.
- Mayúsculas/minúsculas en la ruta, index.html vs /, y variantes de impresión o AMP.
Canonical, redirección o noindex: elegir la herramienta
No son intercambiables — elige según qué quieres que le pase a la URL duplicada.
- Redirección 301: cuando el duplicado no debería existir como URL propia (http→https, consolidación www, antigua→nueva). Consolida señales y elimina la variante.
- rel="canonical": cuando ambas URLs deben seguir accesibles pero solo una debe posicionar (variantes de parámetros, un producto en dos categorías). Es una pista, no una directiva — mantén las páginas casi idénticas.
- noindex: cuando la página debe seguir accesible para usuarios pero nunca posicionar (búsqueda interna, combinaciones de filtros delgadas). No combines noindex con canonical a otra URL.
- robots.txt: no es herramienta de deduplicación — bloquea el rastreo, impidiendo que Google vea tu canonical.
Cómo consolidar duplicados sin riesgo
- Decide la única URL canónica de cada contenido y haz que enlaces internos, sitemaps y canonicals apunten a ella.
- Impón un solo host y protocolo con un 301 global, y normaliza la barra final y las mayúsculas.
- Para parámetros que no cambian el contenido, canonicalízalos a la URL limpia; para facetas con valor, decide caso por caso si indexar.
- Haz la canónica autorreferencial en la URL que quieres posicionar, para que no apunte a otro sitio por accidente.
- Despliega por plantilla y vuelve a rastrear antes de aplicar el patrón a todo el sitio.
Errores que empeoran la duplicación
- Bloquear las URLs duplicadas en robots.txt, lo que impide a Google leer la canónica que las habría consolidado.
- Canonicalizar a una página que a su vez redirige o tiene noindex, lo que invalida la pista.
- Apuntar la canónica de cada página paginada a la página 1, lo que oculta los elementos más profundos.
- Mezclar señales: canónica a A mientras enlaces internos, sitemap y hreflang apuntan a B.
Cómo validar la consolidación
Usa la Inspección de URLs en un duplicado y confirma que Google reporta tu URL elegida como «canónica seleccionada por Google», y luego observa cómo los grupos «Duplicada» y «Página alternativa» del informe de indexación se reducen las semanas siguientes.
En DomainLens, el destino canónico y el código de estado se muestran juntos, así que una página cuya canónica apunta a un lugar inesperado — o una variante que devuelve 200 cuando debería redirigir — aparece como un conflicto que puedes corregir antes de que divida tus señales.