Diagnostic d' Indexabilité
Saisissez une adresse ; nous vous disons si Google peut l'indexer et, si ce n'est pas le cas, ce qui l'en empêche exactement, preuve à l'appui.
La page est récupérée en tant que Googlebot (Smartphone), sans envoyer de préférence de langue. Quelques requêtes atteignent le site cible : robots.txt, la page elle-même et, sur les sites multilingues, un test de langue.
Saisissez une adresse ; nous vous montrons si Google peut indexer cette page et, sinon, ce qui la bloque exactement.
Qu'est-ce que le Diagnostic d'Indexabilité ?
Cet outil répond à une seule question : Google peut-il indexer cette adresse ? Il récupère la page en tant que Googlebot et déroule les contrôles dans l'ordre appliqué par Google, s'arrête au premier blocage réel et nomme le motif avec sa preuve exacte. L'ordre compte : si robots.txt bloque l'exploration, Google ne lit jamais la balise noindex présente dans la page, et le bon conseil change donc du tout au tout. Ce qui ne bloque pas l'indexation mais réduit vos chances (titre manquant, contenu maigre, sitemap non déclaré) reste dans une classe d'avertissements distincte.

Comment l'utiliser
- 1Saisissez l'adresse complète de la page que vous attendez dans l'index.
- 2Lisez la carte de verdict en haut : une phrase dit s'il y a blocage.
- 3S'il y en a un, copiez la preuve et corrigez précisément cette ligne ou cette balise.
- 4Laissez les lignes ambrées de la liste pour plus tard ; ce ne sont pas des blocages.
Comment lire les résultats
Quand l'utiliser
Juste Après La Publication
Vérifiez dès la mise en ligne. Un noindex hérité du gabarit ou une canonique erronée se voient ici, pas des semaines plus tard.
Quand Une Page Disparaît
Si la Search Console dit "non indexée", vous voyez ici le motif avec sa preuve et corrigez cette ligne précise au lieu de deviner.
Après Une Migration
Un noindex resté de la préproduction et des canoniques pointant vers d'anciennes adresses sont des fautes classiques. Diagnostiquez vos pages les plus visitées une à une.
Erreurs fréquentes
Utiliser robots.txt Pour Désindexer
robots.txt bloque l'exploration, pas l'indexation. Une page déjà dans l'index peut y rester derrière le blocage. Le bon outil est noindex, et il n'agit que si la page est explorable.
Figer La Canonique Dans Le Gabarit
Un gabarit qui fixe la canonique sur une seule valeur fait pointer toutes les sous-pages vers l'accueil. Les pages marchent sans erreur, mais aucune n'est indexée.
Le noindex De Préproduction
Un noindex appliqué à tout le site en environnement de test est le réglage le plus souvent oublié au lancement. Diagnostiquez toujours l'accueil et quelques pages internes après la mise en ligne.
Questions fréquentes
Il dit indexable, mais ma page n'est pas dans Google. Pourquoi ?
Cet outil mesure les blocages techniques, pas le jugement de Google. Une page techniquement ouverte peut rester dehors parce qu'elle a peu de valeur, qu'elle est dupliquée ou simplement nouvelle. Utilisez le Vérificateur d'Index Google pour savoir si elle y est, et la Search Console pour savoir si elle a été explorée.
Que faire si la page a un blocage robots.txt ET un noindex ?
Choisissez. Pour l'indexer, retirez les deux. Pour la garder hors de l'index, RETIREZ le blocage robots et gardez le noindex. Cela paraît inversé, mais Google doit récupérer la page pour voir le noindex ; tant que le blocage tient, il ne lit jamais la balise et l'adresse peut entrer dans l'index via des liens.
La canonique pointe vers une autre page. Est-ce une erreur ?
Pas si c'est volontaire. Faire pointer les doublons et les variantes à paramètres vers une adresse principale est exactement le rôle de la canonique. Mais quand un contenu original en désigne un autre comme canonique, cette page ne sera jamais indexée, et c'est l'une des erreurs de configuration les plus courantes.
Voit-il les balises générées en JavaScript ?
Non. Il lit le HTML envoyé par le serveur et n'exécute pas JavaScript comme un navigateur. Google l'exécute, mais avec du retard. Si vous écrivez la canonique ou les balises robots en JavaScript, les mettre aussi dans le HTML serveur est toujours plus sûr.
Pourquoi récupérer en tant que Googlebot ?
Parce que certains sites répondent différemment aux robots : autre en-tête X-Robots-Tag, autre canonique, parfois autre code de statut. Un résultat mesuré avec une identité de navigateur normale peut ne pas refléter ce que voit Google. Pour comparer les deux identités, utilisez le Simulateur Googlebot.