Outils SEO
Testeur d’indexabilité : Google peut-il indexer cette page ?
Contrôle tous les signaux qui décident si une page a le droit d’entrer dans l’index : le code de statut, l’accès dans robots.txt, la meta robots, l’en-tête X-Robots-Tag et la balise canonique.
Ce que « indexable » veut dire ici
Cet outil répond à la question de savoir si une page autorise l’indexation, pas si Google l’a indexée. Ce sont deux questions différentes, et seule la première se répond de l’extérieur : savoir si Google a réellement indexé une URL n’est visible que dans Search Console, pour une propriété que vous possédez.
La distinction compte parce que, vues depuis les résultats de recherche, les deux situations sont identiques. Une page peut être parfaitement indexable et absente de la recherche parce que Google a jugé qu’elle n’en valait pas la peine — aucun outil externe ne peut distinguer cela d’un blocage technique.
Les signaux, dans l’ordre où Google les évalue
Lisez-les dans cet ordre. Un échec précoce rend tout le reste sans objet, et c’est la raison pour laquelle une URL interdite dans robots.txt ne peut pas être désindexée par une balise noindex : le robot n’arrive jamais assez loin pour la lire.
- Code de statut — une réponse autre que 200 clôt immédiatement la question.
- robots.txt — si le chemin est interdit, la page n’est jamais récupérée et ses directives jamais lues.
- meta robots — un noindex dans le head, qui suppose une exploration réussie pour être lu.
- X-Robots-Tag — la même directive au niveau des en-têtes, facile à manquer car invisible dans le HTML.
- Balise canonique — une canonique pointant ailleurs demande à Google d’indexer l’autre URL.
Quand tout passe mais que la page reste absente
Cette combinaison est fréquente et éloigne complètement du terrain technique. « Détectée, actuellement non indexée » signifie que Google a fixé ses priorités ailleurs, en général parce que la page est mince, quasi dupliquée ou faiblement maillée. Poursuivez avec le diagnostic d’indexabilité.
- Cet outil me dit-il si ma page est dans Google ?
- Non, et aucun outil externe ne le dit de façon fiable. Il indique si la page autorise l’indexation. Pour savoir si Google l’a indexée, utilisez Search Console sur une propriété que vous possédez.
- La page est indexable mais absente des résultats. Pourquoi ?
- L’indexabilité est une permission, pas un mérite. Google décide toujours si une page vaut l’index, et les pages minces ou quasi dupliquées sont régulièrement explorées puis écartées.
Autres outils
Récupère le fichier robots.txt de l’hôte saisi, indique s’il existe et s’il bloque tous les robots, et lit au passage les directives robots au niveau de la page.
Cherche le sitemap comme le ferait un robot — d’abord la déclaration dans robots.txt, puis les emplacements conventionnels — puis vérifie que le document se parse en XML et compte les URL qu’il contient.
Lit l’URL canonique déclarée par la page, puis récupère cette adresse pour confirmer qu’elle répond, qu’elle ne redirige pas et qu’elle n’est pas en noindex — les trois façons dont une balise canonique devient silencieusement inopérante.
Analyse les données structurées de la page saisie, liste les types schema.org trouvés et signale les blocs qui ne se parsent pas ou auxquels manquent les propriétés requises par leur type.
Suit l’URL saisie à travers chaque saut, en indiquant le code de statut à chaque étape et la destination finale — le détail que le navigateur masque dès que la barre d’adresse se stabilise.