DomainLens

Aprender

Guía de navegación por facetas SEO: URLs filtradas, parámetros e indexación

Una guía de navegación por facetas SEO: cómo los filtros explotan en URLs, qué combinaciones merecen indexación y cómo controlar el rastreo y el index bloat.

Revisa tu sitio antes de corregir

Ejecuta una auditoría nueva en DomainLens y usa el informe como lista de prioridades.

Ejecutar auditoría SEO gratis

Por qué la navegación por facetas es un campo de minas SEO

La navegación por facetas — los filtros de una página de categoría por talla, color, marca, precio, orden — es genial para los usuarios y peligrosa para los crawlers. Cada combinación de filtros puede generar una URL única, y esas combinaciones se multiplican: cinco filtros con unas pocas opciones cada uno producen miles o millones de URLs, la mayoría casi duplicadas o vacías.

El problema SEO es doble. El crawl budget se agota mientras Google recorre permutaciones infinitas en vez de tus productos reales. Y el index bloat aparece cuando páginas de filtros delgadas y duplicadas se indexan, diluyendo las páginas de categoría que quieres posicionar. El objetivo no es bloquear todo — algunas páginas de filtros responden a demanda real — sino abrir las combinaciones valiosas y cerrar el resto.

Cómo los filtros explotan en URLs rastreables

  • Cada filtro seleccionado añade un parámetro (?color=red&size=m&sort=price), y cada orden y combinación es una URL distinta para un crawler.
  • Los parámetros de orden y vista (sort=price, view=grid) crean duplicados del mismo conjunto de productos.
  • Los filtros de selección múltiple se multiplican de forma combinatoria — el número crece más rápido de lo esperado.
  • La paginación sobre los filtros multiplica el total otra vez (?color=red&page=2…).
  • Si esas URLs están enlazadas y son rastreables, Google intentará rastrearlas todas.

Qué páginas de filtros merecen indexarse

Decide por demanda: una página de filtro solo debe ser indexable si la gente busca esa combinación y ofrece un conjunto de resultados realmente útil y distinto.

  • Indexar: páginas de un solo atributo con alta demanda que coinciden con consultas reales — «zapatillas rojas», «chaquetas impermeables».
  • No indexar: combinaciones multifiltro, órdenes y conmutadores de vista que nadie busca y que duplican una página más amplia.
  • Nunca indexar: conjuntos vacíos y combinaciones que devuelven los mismos productos que su padre.
  • Haz que la página de categoría limpia sea la canónica de sus variantes filtradas de bajo valor.

Cómo controlar rastreo e indexación

  • Para filtros valiosos e indexables: dales URLs limpias, canónica autorreferencial, títulos/H1 únicos y enlaces internos.
  • Para variantes de bajo valor que deben seguir usables: pon una canónica a la página de categoría limpia, o noindex,follow.
  • Para parámetros sin valor (orden, vista, sesión): mantenlos fuera de los enlaces internos y considera bloquearlos en robots.txt cuando no hagan falta para renderizar.
  • Mejor no enlazar en absoluto las combinaciones inútiles — la corrección de crawl budget más barata es no exponer la URL.
  • No confíes en robots.txt para desindexar páginas de filtros ya indexadas; primero noindex, y bloquea después.

Errores que desperdician crawl budget o entierran valor

  • Bloquear URLs de filtros en robots.txt mientras están indexadas, así Google no puede leer el noindex y permanecen en el índice.
  • Canonicalizar hacia la categoría una página de filtro realmente útil y demandada, ocultando una página que podría posicionar.
  • Dejar rastrear e indexar cada parámetro de orden y vista, inundando el índice de duplicados.
  • Dejar URLs de facetas en el sitemap XML, invitando activamente a Google a rastrearlas.

Cómo validar la configuración

Rastrea las plantillas de categoría y confirma que solo tus páginas de filtros previstas son indexables y están enlazadas, mientras el resto lleva una canónica a la categoría o un noindex. Luego observa las stats de rastreo y el número indexado: las peticiones a URLs con parámetros deben bajar y el index bloat reducirse.

DomainLens comprueba la canónica y las directivas robots de una URL filtrada como las ve un crawler, así que una página de facetas indexable por accidente — o una valiosa canonicalizada por error — aparece como conflicto antes de desperdiciar crawl budget o costarte una página que posiciona.

Recursos relacionados