DomainLens

Навчання

Фасетна навігація SEO: індексація сторінок фільтрів і URL з параметрами

Гайд про фасетну навігацію SEO: як фільтри розростаються в URL, які комбінації варті індексації і як керувати crawling та index bloat.

Перевір сайт перед виправленнями

Запусти свіжий аудит DomainLens і використовуй звіт як список пріоритетів.

Запустити безкоштовний SEO-аудит

Чому фасетна навігація — це SEO-мінне поле

Фасетна навігація — фільтри на сторінці категорії за розміром, кольором, брендом, ціною, сортуванням — чудова для користувачів і небезпечна для краулерів. Кожна комбінація фільтрів може створити унікальний URL, і ці комбінації множаться: пʼять фільтрів із кількома опціями кожен дають тисячі чи мільйони URL, більшість з яких майже-дублікати або порожні.

SEO-проблема подвійна. Crawl budget виснажується, бо Google обробляє безкінечні перестановки фільтрів замість твоїх реальних товарів і контенту. А index bloat настає, коли тонкі, дублікатні сторінки фільтрів індексуються, розмиваючи сторінки категорій, які ти хочеш ранжувати. Мета не заблокувати все — деякі сторінки фільтрів відповідають реальному попиту — а відкрити цінні комбінації і закрити решту.

Як фільтри розростаються в crawlable URL

  • Кожен вибраний фільтр додає параметр (?color=red&size=m&sort=price), і кожен порядок та комбінація — окремий URL для краулера.
  • Параметри сортування й вигляду (sort=price, view=grid) створюють дублікати того самого набору товарів.
  • Мультивибіркові фільтри множаться комбінаторно — кількість росте швидше, ніж будь-хто очікує.
  • Пагінація поверх фільтрів множить загал ще раз (?color=red&page=2…).
  • Якщо ці URL злінковані й crawlable, Google намагатиметься просканувати їх усі.

Які сторінки фільтрів варті індексації

Вирішуй за попитом: сторінка фільтра має бути indexable лише якщо люди шукають цю комбінацію і вона дає справді корисний, унікальний набір результатів.

  • Індексувати: сторінки з високим попитом і одним атрибутом, що відповідають реальним запитам — напр. «червоні кросівки», «водонепроникні куртки».
  • Не індексувати: мультифільтрові комбінації, сортування й перемикачі вигляду, яких ніхто не шукає і які дублюють ширшу сторінку.
  • Ніколи не індексувати: порожні набори результатів і комбінації, що повертають ті самі товари, що й батьківська.
  • Роби чисту сторінку категорії canonical для її малоцінних фільтрованих варіантів.

Як керувати crawling та індексацією

  • Для цінних, indexable фільтрів: дай їм чисті URL, самопосилальний canonical, унікальні title/H1 і внутрішні посилання.
  • Для малоцінних фільтрових варіантів, які мають лишатися доступними: став canonical на чисту сторінку категорії або noindex,follow.
  • Для параметрів, що ніколи не додають цінності (sort, view, session): тримай їх поза внутрішніми посиланнями і розглянь disallow у robots.txt, коли вони більше не потрібні для рендера.
  • Краще взагалі не лінкувати марні комбінації — найдешевше виправлення crawl budget це не показувати URL.
  • Не покладайся на robots.txt, щоб деіндексувати вже проіндексовані сторінки фільтрів; спершу noindex, а блокуй лише коли вони випали.

Помилки, що марнують crawl budget або ховають цінність

  • Блокувати URL фільтрів у robots.txt, поки вони ще в індексі, тож Google не може прочитати noindex і вони лишаються в індексі.
  • Canonical-ити справді корисну сторінку фільтра з високим попитом на категорію, ховаючи сторінку, що могла б ранжуватись.
  • Дозволяти сканувати й індексувати кожен параметр сортування й вигляду, заливаючи індекс дублікатами.
  • Лишати фасетні URL у XML sitemap, активно запрошуючи Google їх сканувати.

Як перевірити налаштування

Проскануй шаблони категорій і підтверди, що лише задумані сторінки фільтрів indexable і внутрішньо злінковані, а решта несе canonical на категорію або noindex. Потім стеж за crawl stats у Search Console і кількістю в індексі: запити на параметричні URL мають падати, а index bloat зменшуватись наступні тижні.

DomainLens перевіряє canonical і robots-директиви на фільтрованому URL так, як їх бачить краулер, тож фасетна сторінка, що випадково indexable — або цінна, яку canonical-нули геть — спливає як конфлікт, перш ніж змарнувати crawl budget чи коштувати тобі сторінки, що ранжується.

Схожі ресурси