SEO-інструменти
Перевірка canonical: що саме оголошує сторінка
Читає канонічний URL, який оголошує сторінка, а потім завантажує цю адресу, щоб переконатися, що вона доступна, не редиректить і не має noindex — три способи, якими canonical тихо перестає працювати.
Що перевіряє цей інструмент
Якщо треба перевірити конкретну сторінку, вставляйте повний URL, а не лише домен. Помилки canonical майже завжди належать шаблону, тож перевірка однієї товарної чи статейної сторінки зазвичай розповідає про всі сторінки з того самого шаблону.
- Чи оголошує сторінка canonical узагалі й чи є значення абсолютним URL.
- Чи віддає канонічна адреса 200, а не редирект і не 404.
- Чи немає на цільовій сторінці директиви noindex, яка скасувала б обʼєднання сигналів.
- Чи canonical вказує сам на себе, чи на іншу адресу.
Як читати результат
| Знахідка | Що це означає |
|---|---|
| Вказує сам на себе | Здоровий стандарт для індексованої сторінки |
| Вказує на іншу адресу | Правильно для дубля; помилка, якщо сторінка унікальна |
| Відсутній | Бажану адресу не оголошено; варіанти з параметрами конкурують |
| Відносне значення | Дозволено, але ризиковано — легко помилитися з розвʼязанням адреси |
| Ціль редиректить | Google відкидає canonical, що вказує на редирект |
| Ціль має noindex | Обʼєднання сигналів на сторінку, яка просить її не індексувати |
Canonical — це підказка, а не інструкція
Google зважує ваше оголошення проти внутрішніх посилань, вмісту карти сайту, редиректів і того, наскільки сторінки насправді схожі. Коли інші свідчення вказують деінде, він обирає інший URL і повідомляє його як обраний Google канонічний. Повторне оголошення того самого тега цього не змінить — про роботу з самими свідченнями читайте в матеріалі проблеми з тегом canonical.
- Чому інструмент бачить інший canonical, ніж у моєму шаблоні?
- Клієнтські скрипти можуть перезаписати або продублювати тег після завантаження. Цей інструмент читає віддану сервером HTML — саме те, що отримує робот до рендерингу.
- Чи має кожна сторінка бути канонічною сама на себе?
- Кожна індексована — так. Це нічого не коштує й фіксує бажану форму адреси ще до появи варіантів із параметрами.
Інші інструменти
Завантажує robots.txt для вказаного хоста, повідомляє, чи існує файл і чи не блокує він усіх роботів, і паралельно читає директиви робота на рівні сторінки.
Шукає карту сайту так само, як це робить пошуковий робот — спершу оголошення в robots.txt, потім стандартні розташування — після чого перевіряє, що документ парситься як XML, і рахує URL усередині.
Розбирає структуровані дані вказаної сторінки, перелічує знайдені типи schema.org і позначає блоки, які не парсяться або яким бракує обовʼязкових для їхнього типу властивостей.
Проходить за вказаним URL через кожен крок, показуючи статус-код на кожному з них і кінцеву адресу — деталі, які браузер ховає, щойно адресний рядок заспокоївся.
Перевіряє кожен сигнал, який вирішує, чи дозволено сторінці потрапити в індекс: статус-код, доступ у robots.txt, meta robots, заголовок X-Robots-Tag і canonical.