DomainLens

Aprender

Debug de indexabilidad: por qué Google no indexa tu página

Un flujo práctico para páginas rastreadas pero no indexadas: qué significan los estados de Search Console, las señales que deciden la indexación y cómo corregir cada causa.

Revisa tu sitio antes de corregir

Ejecuta una auditoría nueva en DomainLens y usa el informe como lista de prioridades.

Ejecutar auditoría SEO gratis

Rastreada pero no indexada: qué significan los estados

Rastreo e indexación son dos pasos distintos. Google puede obtener una URL (rastrearla) y aun así decidir no almacenarla en el índice — por eso una página puede devolver 200, verse bien en el navegador y nunca aparecer en búsqueda. El informe Indexación de páginas de Search Console nombra el estado exacto, y la corrección depende por completo de cuál veas.

Cada estado común significa algo concreto: «Rastreada: actualmente sin indexar» suele indicar un juicio de calidad o duplicación; «Detectada: actualmente sin indexar» apunta a crawl budget o carga del servidor; «Excluida por etiqueta noindex» es una directiva que pusiste; «Página alternativa con etiqueta canónica adecuada» significa que Google eligió otra URL como canónica; y «Duplicada, Google eligió una canónica distinta» significa que se anuló tu pista canónica.

Las señales que controlan la indexación

Una página solo es indexable cuando cada una de estas señales confirma que debe estarlo. Una sola señal contradictoria basta para dejarla fuera.

  • Estado HTTP: la URL debe devolver 200. Un 3xx, 4xx o soft 404 la descarta.
  • robots.txt: no debe bloquear la ruta — una página bloqueada puede indexarse solo como URL, pero su noindex no se leerá.
  • Meta robots / X-Robots-Tag: ni la meta HTML ni la cabecera HTTP pueden decir noindex.
  • Canonical: la canónica de la página debe apuntar a sí misma, no a otra URL que luego la absorbe.
  • Calidad y unicidad del contenido: páginas delgadas, boilerplate o casi duplicadas se rastrean y se descartan.

Cómo depurar una URL, paso a paso

  • Pasa la URL por la Inspección de URLs de Search Console y lee el estado exacto y el motivo de cobertura.
  • Usa «Probar URL en directo» y mira el HTML renderizado — confirma que el contenido y la meta robots que se presentan a Googlebot coinciden, no solo los de tu navegador.
  • Obtén las cabeceras (curl -I) y comprueba un X-Robots-Tag: noindex que ninguna vista HTML revelaría.
  • Confirma que robots.txt permite la ruta, y luego que la canónica del HTML renderizado apunta a esta URL.
  • Si todo pasa y sigue «Rastreada: sin indexar», juzga el contenido frente a la intención: ¿merece de verdad un puesto o es un casi duplicado de plantilla?

Cómo corregir cada causa

  • noindex no intencionado: quita la meta o la cabecera X-Robots-Tag, y luego solicita indexación.
  • Canónica incorrecta: apunta la canónica a la propia página y haz que los enlaces internos usen esa misma URL canónica.
  • Bloqueada en robots.txt pero la quieres indexar: desbloquea la ruta — no uses robots.txt para desindexar, usa noindex.
  • Duplicada / casi duplicada: consolida con una canónica a la versión principal, o haz el contenido realmente distinto.
  • Detectada, sin indexar: reduce el desperdicio de rastreo (menos URLs de bajo valor, servidor más rápido) y refuerza los enlaces internos hacia ella.

Errores que dejan páginas fuera del índice

  • Usar robots.txt para quitar una página — una página bloqueada mantiene su entrada de índice porque Google ya no puede leer el noindex.
  • Auditar solo el HTML fuente cuando el noindex o la canónica los inyecta JavaScript tras el render.
  • Solicitar indexación una y otra vez en lugar de corregir la señal que la bloquea.
  • Suponer que un estado 200 significa indexable, ignorando un soft 404 donde el cuerpo dice «no encontrado».

Cómo confirmar que la página es indexable

Tras la corrección, usa de nuevo «Probar URL en directo» y confirma que el HTML renderizado, las cabeceras y la canónica coinciden en que la página debe indexarse, luego solicita indexación y observa el cambio de estado en el informe durante los días siguientes.

DomainLens muestra estas señales en un solo lugar — código de estado, directivas robots, destino canónico y si se contradicen — para que detectes la contradicción antes de esperar días a que Search Console confirme qué falla.

Recursos relacionados