Apprendre
Guide navigation à facettes SEO : crawl des URLs filtrées, paramètres et indexation
Un guide de navigation à facettes SEO : comment les filtres explosent en URLs, quelles combinaisons méritent l’indexation et comment contrôler le crawl et l’index bloat.
Lancez un audit DomainLens frais et utilisez le rapport comme liste de priorités.
Pourquoi la navigation à facettes est un champ de mines SEO
La navigation à facettes — les filtres d’une page catégorie par taille, couleur, marque, prix, tri — est excellente pour les utilisateurs et dangereuse pour les crawlers. Chaque combinaison de filtres peut générer une URL unique, et ces combinaisons se multiplient : cinq filtres avec quelques options chacun produisent des milliers ou millions d’URLs, la plupart quasi dupliquées ou vides.
Le problème SEO est double. Le crawl budget s’épuise pendant que Google parcourt d’infinies permutations au lieu de vos vrais produits. Et l’index bloat s’installe quand des pages de filtres minces et dupliquées sont indexées, diluant les pages catégories à classer. Le but n’est pas de tout bloquer — certaines pages de filtres répondent à une vraie demande — mais d’ouvrir les combinaisons utiles et de fermer le reste.
Comment les filtres explosent en URLs crawlables
- Chaque filtre ajoute un paramètre (?color=red&size=m&sort=price), et chaque ordre et combinaison est une URL distincte pour un crawler.
- Les paramètres de tri et d’affichage (sort=price, view=grid) créent des doublons du même ensemble de produits.
- Les filtres multi-sélection se multiplient de façon combinatoire — le nombre croît plus vite qu’attendu.
- La pagination sur les filtres multiplie encore le total (?color=red&page=2…).
- Si ces URLs sont liées et crawlables, Google tentera de toutes les crawler.
Quelles pages de filtres méritent l’indexation
Décidez par la demande : une page de filtre ne doit être indexable que si les gens recherchent cette combinaison et qu’elle offre un ensemble de résultats vraiment utile et distinct.
- Indexer : pages mono-attribut à forte demande correspondant à de vraies requêtes — « chaussures rouges », « vestes imperméables ».
- Ne pas indexer : combinaisons multi-filtres, ordres de tri et affichages que personne ne recherche et qui dupliquent une page plus large.
- Ne jamais indexer : ensembles vides et combinaisons renvoyant les mêmes produits que leur parent.
- Faites de la page catégorie propre la canonique de ses variantes filtrées à faible valeur.
Comment contrôler crawl et indexation
- Pour les filtres utiles et indexables : donnez-leur des URLs propres, une canonique auto-référentielle, des titres/H1 uniques et des liens internes.
- Pour les variantes à faible valeur devant rester utilisables : posez une canonique vers la page catégorie propre, ou noindex,follow.
- Pour les paramètres sans valeur (tri, affichage, session) : gardez-les hors des liens internes et envisagez de les bloquer dans robots.txt une fois inutiles au rendu.
- Préférez ne pas lier du tout les combinaisons inutiles — le correctif crawl le moins cher est de ne jamais exposer l’URL.
- Ne comptez pas sur robots.txt pour désindexer des pages déjà indexées ; noindex d’abord, blocage ensuite.
Les erreurs qui gaspillent le crawl ou enterrent la valeur
- Bloquer les URLs de filtres dans robots.txt alors qu’elles sont indexées, empêchant Google de lire le noindex.
- Canonicaliser vers la catégorie une page de filtre vraiment utile et demandée, masquant une page qui pourrait classer.
- Laisser crawler et indexer chaque paramètre de tri et d’affichage, inondant l’index de doublons.
- Laisser les URLs à facettes dans le sitemap XML, invitant activement Google à les crawler.
Comment valider la configuration
Crawlez les templates catégorie et confirmez que seules vos pages de filtres voulues sont indexables et liées, le reste portant une canonique vers la catégorie ou un noindex. Puis suivez les stats de crawl et le nombre indexé : les requêtes vers les URLs à paramètres doivent baisser et l’index bloat se réduire.
DomainLens vérifie la canonique et les directives robots d’une URL filtrée comme les voit un crawler, si bien qu’une page à facettes indexable par accident — ou une page utile canonicalisée à tort — apparaît comme un conflit avant de gaspiller du crawl ou de vous coûter une page qui classe.