Pourquoi Google n'indexe pas une page, et comment le savoir

Une page non indexée par Google n'apparaît dans aucun résultat, quelle que soit la requête. La cause se lit presque toujours dans la Search Console : un motif précis du rapport « Indexation des pages », confirmé par l'inspection d'URL, qui distingue un blocage technique d'une page que Google a vue mais choisi de ne pas garder.
Google explore beaucoup plus d'adresses qu'il n'en indexe. Une page absente de l'index n'est donc pas forcément une anomalie : une page de résultats de recherche interne, une variante triée d'une catégorie ou une page de connexion n'ont rien à y faire. Le travail consiste à vérifier que les pages utiles y sont, et à comprendre pourquoi celles qui manquent sont écartées.
Lire le motif dans le rapport Indexation des pages
Le rapport de la Search Console classe chaque adresse connue en « Dans l'index » ou « Non indexée », avec un motif. L'aide officielle de la Search Console détaille chacun d'eux ; les plus fréquents se lisent ainsi :
| Motif affiché | Ce qu'il signifie | Que faire |
|---|---|---|
| Explorée, actuellement non indexée | Google a lu la page sans la retenir pour l'instant | Améliorer la page et ses liens internes ; inutile de la renvoyer à l'exploration en boucle |
| Détectée, actuellement non indexée | L'adresse est connue mais pas encore explorée, souvent pour ne pas surcharger le serveur | Vérifier la vitesse du serveur et l'importance donnée à la page dans le maillage |
| URL marquée « noindex » | Une directive interdit l'indexation | Retirer la directive si la page doit être indexée |
| Page en double sans URL canonique sélectionnée par l'utilisateur | Google a choisi une autre page comme version principale | Déclarer une canonique, ou fusionner les contenus proches |
| Page en double : Google a choisi une autre URL canonique que l'utilisateur | La canonique déclarée n'a pas été suivie | Comparer les deux pages avec l'inspection d'URL |
| Bloquée par le fichier robots.txt | Le robot n'a pas le droit d'explorer | Corriger la règle Disallow si la page doit être visible |
| Erreur « soft 404 » | La page répond 200 mais ressemble à une page vide ou d'erreur | Renvoyer un vrai code 404, ou enrichir la page |
Les blocages techniques : noindex, robots.txt et canonique
Trois réglages expliquent la plupart des pages écartées par erreur, souvent après une mise en ligne où les protections de la préproduction sont restées en place.
La balise meta robots noindex, ou son équivalent dans l'en-tête HTTP X-Robots-Tag, retire la page des résultats. Piège classique : si le robots.txt bloque aussi la page, Google ne peut pas lire cette directive. Sa documentation sur la balise meta robots le rappelle : pour qu'un noindex soit appliqué, l'adresse ne doit pas être exclue de l'exploration. À l'inverse, un blocage par robots.txt seul n'empêche pas toujours l'indexation d'une adresse citée ailleurs.
La canonique pose un autre problème. Une balise rel="canonical" qui pointe par erreur vers l'accueil ou vers une page voisine demande au moteur de ne garder que cette autre page. Le rapport affiche alors l'adresse comme doublon. Une série de catégories paginées où chaque page désigne la première comme canonique tombe dans ce cas, comme l'explique le guide sur la pagination SEO des listes.
Quand la page est explorée mais pas retenue
Le motif « Explorée, actuellement non indexée » ne signale aucun réglage fautif. Google a lu la page et ne l'a pas jugée assez utile, ou assez distincte des autres, pour l'ajouter. Les causes habituelles sont un contenu très court, une page presque identique à une autre du site, une page orpheline qu'aucun lien interne ne cite, ou un site jeune encore peu exploré. La réponse passe par le contenu et le maillage : une page qui répond complètement à une question, citée depuis sa rubrique et depuis des articles proches, a plus de chances d'entrer dans l'index.
Diagnostiquer une adresse en cinq vérifications
- Inspection d'URL dans la Search Console : état d'indexation, canonique déclarée et canonique retenue par Google, date de la dernière exploration.
- Test en direct depuis le même outil : il montre le code HTTP reçu et le HTML rendu par Google.
- Code de réponse : une page utile doit répondre 200 ; une redirection ou une erreur 404 côté référencement explique son absence.
- Directives : balise meta robots, en-tête X-Robots-Tag, règle du robots.txt, canonique.
- Découverte : présence dans le sitemap et liens internes depuis des pages déjà indexées.
Une fois le défaut corrigé, la demande d'indexation de l'inspection d'URL accélère la prise en compte d'une page importante, et le bouton « Valider la correction » relance le contrôle d'un motif entier ; Google indique qu'une validation dure en général environ deux semaines. Les étapes de déclaration d'un site neuf sont décrites dans le guide du référencement gratuit avec les outils officiels, et le suivi des clics une fois la page indexée passe par le rapport de performances de la Search Console. Le sujet fait partie du SEO technique.
Sources : aide Search Console, « Rapport sur l'indexation des pages » ; Google Search Central, « Spécifications concernant la balise meta robots et l'en-tête X-Robots-Tag », « Pagination, défilement incrémentiel et impact sur la recherche Google » ; pages consultées le 10 octobre 2026.