La Search Console distingue « Détectée, actuellement non indexée » et « Explorée, actuellement non indexée » comme deux statuts parmi d’autres dans un même tableau. En pratique, ce sont deux problèmes opposés qui appellent des corrections opposées, et confondre les deux fait perdre des semaines sur la mauvaise action.
Sommaire
Diagnostiquer avant de corriger
Avant toute correction, confirmez le problème par deux vérifications rapides. D’abord une recherche site:votredomaine.fr/url-concernee dans Google : si rien ne remonte, la page n’est effectivement pas indexée. Ensuite, l’outil Inspection d’URL de Search Console, qui donne le statut exact, la dernière date d’exploration et, le cas échéant, la raison précise de l’exclusion. C’est ce second outil qui doit guider la correction, pas une supposition.
Le piège des deux statuts qu’on confond
Deux diagnostics opposés, une seule ligne dans le tableau
« Détectée, actuellement non indexée » signifie que Google connaît l’URL mais ne l’a pas encore explorée : un problème de PRIORITÉ de crawl. « Explorée, actuellement non indexée » signifie que Google a visité la page et a choisi de ne pas l’indexer : un problème de QUALITÉ perçue. Les deux apparaissent côte à côte dans le même rapport, avec des libellés proches, et beaucoup d’audits leur appliquent la même correction.
Face à une page « Détectée non indexée », ajouter du contenu ou réécrire le texte ne sert à rien : Google n’a même pas encore lu la page, le problème est qu’elle n’a pas été jugée assez prioritaire pour être crawlée. La correction porte sur le signal d’importance : maillage interne renforcé depuis des pages à forte autorité, présence dans le sitemap, réduction du nombre de pages à faible valeur qui concurrencent le budget de crawl.
Face à une page « Explorée non indexée », Google a fait son travail et a tranché : le contenu ne mérite pas sa place dans l’index tel quel, souvent parce qu’il est trop proche d’une autre page du site ou insuffisamment développé. Ici, renforcer le maillage ne change rien tant que le contenu lui-même n’est pas retravaillé. Traiter ce second cas comme le premier (en ajoutant des liens sans toucher au texte) explique une bonne partie des pages qui restent bloquées des mois dans ce statut.
Les blocages techniques directs
| Blocage | Signal dans Search Console | Correction |
|---|---|---|
| Robots.txt | « Bloquée par robots.txt » | Retirer la directive Disallow concernée, pas la balise noindex (Google recommande noindex plutôt que robots.txt pour désindexer sans bloquer le crawl) |
| Balise noindex | « Exclue par la balise noindex » | Retirer la balise si la page doit être indexée ; vérifier qu’elle n’a pas été activée par erreur lors d’une refonte ou d’un changement de thème |
| Erreur 404 ou 410 | « Page introuvable (404) » | Restaurer la page ou rediriger en 301 vers l’équivalent le plus proche |
| Erreur serveur 5xx | « Erreur de serveur » | Diagnostiquer côté hébergement : plugin en conflit, ressources serveur insuffisantes |
| Canonical vers une autre page | « Autre page avec balise canonique correcte » | Normal si intentionnel ; anomalie si la canonical pointe par erreur vers une page non pertinente |
Quand le problème n’est pas la page, mais le budget
Sur un site de quelques dizaines de pages, chaque page individuelle reçoit largement assez de passages de Googlebot pour être explorée rapidement. Sur un site de plusieurs centaines ou milliers d’URLs, une page peut rester en « Détectée non indexée » non pas à cause d’un défaut qui lui est propre, mais parce que d’autres pages à faible valeur du même site (résultats de recherche interne indexables, combinaisons de filtres, archives fines) consomment une part disproportionnée du budget de crawl que Google alloue au domaine.
Dans ce cas, corriger la page elle-même ne résout rien : c’est le site dans son ensemble qui doit libérer du budget en excluant du crawl les URLs à faible valeur (robots.txt ou paramètres d’exploration dans Search Console), pour que Googlebot concentre ses passages sur les pages qui comptent. C’est un diagnostic à l’échelle du site, pas de la page, souvent manqué parce qu’on audite la page isolément sans regarder ce qui se passe autour d’elle dans les logs de crawl.
Quand le problème est la qualité perçue
Trois signaux amènent Google à explorer une page puis à choisir de ne pas l’indexer. Le contenu est trop proche d’une autre page du site, sans différenciation suffisante pour justifier une entrée séparée dans l’index. Le contenu est jugé trop mince : peu de texte, peu de valeur ajoutée par rapport à ce que l’internaute trouverait ailleurs. Ou le site dans son ensemble est perçu comme globalement pauvre, ce qui peut faire exclure une page individuellement correcte si elle appartient à un domaine où la proportion de contenu faible est trop élevée.
Dans quel ordre corriger
- D’abord les blocages techniques directsRobots.txt, noindex involontaire, erreurs 404/5xx : ce sont les corrections les plus rapides et au résultat le plus certain.
- Puis distinguez Détectée vs ExploréeAppliquez la bonne famille de correction (priorité de crawl vs qualité de contenu) selon le statut réel, pas une correction générique.
- Vérifiez le budget de crawl si le site dépasse quelques centaines de pagesUn audit de logs ou du rapport « Statistiques sur l’exploration » de Search Console révèle si des URLs à faible valeur cannibalisent les passages de Googlebot.
- Demandez une nouvelle indexation en dernierL’outil d’inspection d’URL accélère la prise en compte d’une correction déjà faite ; il ne remplace jamais la correction elle-même.
Questions fréquentes
Quelle est la différence entre « Détectée non indexée » et « Explorée non indexée » ?
« Détectée » signifie que Google connaît l’URL mais ne l’a pas encore explorée : un problème de priorité de crawl. « Explorée » signifie que Google a visité la page et a choisi de ne pas l’indexer : un problème de qualité perçue. Les corrections sont différentes.
Faut-il bloquer une page via robots.txt ou noindex pour la désindexer ?
Noindex est recommandé par Google : la page reste explorable, ce qui permet à Google de constater la consigne. Le robots.txt empêche l’exploration, donc Google ne peut jamais lire une éventuelle balise noindex placée dessus.
Pourquoi une page correcte reste-t-elle non indexée sur un gros site ?
Souvent parce que d’autres pages à faible valeur du même site consomment l’essentiel du budget de crawl. La correction porte alors sur le site entier, pas sur la page en question.
Combien de temps après correction avant réindexation ?
Quelques jours à quelques semaines selon l’autorité du site. La demande d’indexation manuelle via l’outil d’inspection d’URL accélère la prise en compte, sans garantir un délai fixe.
À propos de l’auteur
Aymeric Maingé
Consultant SEO senior avec plus de 10 ans d’expérience, côté agence et annonceur. J’interviens en freelance sur des audits techniques, des problématiques d’indexation, de crawl budget et de structure de site, tous CMS confondus. Mon approche croise audit terrain, priorisation métier et recommandations actionnables. Faites appel à un consultant SEO freelance pour distinguer les deux causes avant de corriger.
À lire aussi
Les autres articles sur le sujet
Fichier robots.txt : syntaxe exacte, ce qui se passe vraiment en cas d’erreur 404 ou panne serveur, robots IA, et les erreurs qui…
Lire l’article
Erreurs canonical les plus fréquentes et, surtout, l’ordre pour les corriger sur un audit à temps limité. Grille de triage par…
Lire l’article
Search Console ne montre pas tout. Les logs serveur révèlent le vrai gaspillage de crawl et les pages orphelines qu’un crawl…
Lire l’article
Capacité vs demande de crawl, erreurs qui gaspillent du budget, et la formule pour chiffrer ce gaspillage, que la plupart des…
Lire l’article
Cinq rapports concentrent l’essentiel d’un audit Screaming Frog. La vraie économie de temps vient d’une configuration…
Lire l’article
Un audit SEO technique complet suit 4 piliers, mais un freelance qui audite seul doit les traiter dans un ordre précis pour rester…
Lire l’article

